人工智能
已收录文章:73篇
-
MCP 工具返回长列表时,分页协议会直接影响 Agent 是否拿到完整且不重复的结果。本文从游标失效、排序稳定性和增量验收三个问题出发,给出可落地的返回字段与测试方法。269 收藏
-
AI Agent 一轮工具调用可能已经改写库存、发送通知,却在最后一步返回超时。本文用订单履约场景拆开部分成功的状态记录、补偿动作和安全重试边界,给出可落地的验收清单。460 收藏
-
科技周边 · 人工智能 | 1个月前 | 人工智能 · gemini · 结构化输出 · 接口测试 · 结构化输出 JSON Schema Gemini 3 Function Calling 工具调用验收Gemini 3 的工具调用和结构化输出解决的是两个不同阶段的问题:前者负责取得外部结果,后者约束最终回答。本文用订单查询场景拆开两段协议,给出 schema、工具结果、拒答和失败分支的验收方法。346 收藏
-
超长视频不能只靠一次请求和一段摘要解决。本文以长视频检索为例,拆解分段抽帧、时间轴索引、候选片段复核和证据回溯的工程流程,并给出可验收的结果格式。229 收藏
-
RAG 知识库更新后仍返回旧答案,通常不是模型突然失忆,而是旧分片仍能被召回。本文用文档版本、元数据过滤和固定问题集建立一条可验收的更新流程,覆盖发布、回滚和灰度边界。104 收藏
-
多模态知识库接入图片后,成本和延迟往往不是由文件大小单独决定。本文从图片任务、detail 级别、裁剪策略和上下文预算四个维度,给出可执行的输入分层与验收方法。394 收藏
-
AI 图片里出现多余文字,通常不是把否定词堆得更多就能解决。本文从画面目的、文字约束、分步修改和交付验收四个环节,给出一套可复用的排查方法。113 收藏
-
把 AI 接口从普通聊天模型切到推理模型时,max_tokens 不是简单改个字段名。本文从请求兼容、推理 token 预算、截断判断和回滚核对四个方面,给出一套可复用的迁移检查方法。464 收藏
-
RAG 应用里,回答看似有引用却指错段落,往往不是模型单独出错,而是切块编号、索引元数据和原文版本没有保持同一条链路。本文用文档快照、chunk_id 和回答后验校验,搭一套可定位、可回归的引用验收方法。148 收藏
-
Google 安全团队近期讨论了智能体让攻击自动化后,红队工作如何变化。本文按攻击路径、验证阶段和治理边界拆开这条新闻,给开发与安全团队一份可落地的观察清单。144 收藏
-
RAG 问答里反复出现相同段落,通常不是模型突然变笨,而是切块重叠、相邻片段、候选数量和证据合并共同造成的。本文用一组可复现的检索样例分层排查重复来源,再说明 MMR、多样性阈值和最终去重应该放在哪一层。259 收藏
-
Gemini 3.7 Flash 发布后,团队不该只看榜单分数。本文把代码调试、Agent 工具调用和输入输出成本拆成可复现的检查项,帮助开发团队判断它适合试验、灰度还是继续使用现有模型。471 收藏