人工智能技术文章
-
科技周边 · 人工智能 | 1天前 | API · 人工智能 · agent · gemini · 工程实践 · agent 工具调用 Interactions API Gemini 3.7 Flash 任务验收
围绕 Gemini 3.7 Flash 的托管 Agent 任务,拆解多步执行、工具结果、sandbox 边界与最终状态验收,并给出 Go 侧可复用的状态检查代码。176 收藏 -
Responses API 的图片输入不是把图片路径直接塞进字符串,而是把 input_text 与 input_image 放进同一条 user content;本文用 Go 代码拆开请求结构、图片 URL 与 output_text 的读取边界。444 收藏 -
RAG 系统如果只保存一段孤立文本,回答命中后很难解释它来自文档哪里。本文用 Go 设计带标题路径、页码和片段编号的 Chunk,演示切片、检索上下文和引用回链如何连成一条可复查的数据路径。163 收藏 -
RAG 系统不要只把文本片段交给模型。本文用 Go 设计带 source_id、标题和定位信息的检索结果接口,让生成答案可以回溯来源、处理空召回,并在调用失败时保留可验证的错误边界。178 收藏 -
RAG 应用回答看似流畅却总带错文档,通常不是模型突然失常,而是切分、召回和证据核对没有连成一条可追踪链路。本文用一个知识库排障场景,拆解如何定位错召回并验证修复效果。141 收藏 -
多模态接口处理图片时,分辨率越高不一定越划算。本文用图片尺寸、切片数量和 media_resolution 拆开 token 与延迟的关系,并给出调用前估算、缩放和结果复核方法。161 收藏 -
一个 AI 应用把危险请求挡住是安全表现,把正常请求误判为风险则是业务失败。本文用一组可回放的测试样本拆分安全拒答、过度拒答、正常通过和非安全业务错误,说明如何设计标签、计算指标并在上线前复核。377 收藏 -
多模态模型识别扫描表格时,漏列通常不是模型单点失误,而是图像缩放、表格线、列坐标和结构化输出共同造成的。本文给出一套从输入预处理到坐标复核、局部纠错和结果验收的实用流程。461 收藏 -
MCP 工具调用遇到超时,不能简单地把所有失败都重试。本文从资产保护、调用路径和错误分级入手,设计一套包含超时、重试、幂等、审计与人工接管的收口方案。111 收藏 -
大模型接口返回 JSON 时,偶尔会带上 Markdown 代码围栏、解释文字或截断内容。本文从真实响应现场出发,给出 Go 解析、边界判断、重试与结构化响应约束的组合方案。213 收藏 -
多轮对话越聊越长时,直接截掉旧消息会丢失用户约束,完全保留又会推高延迟和成本。本文给出摘要触发点、最近消息窗口和关键事实保留的组合方案,并用可回放的检查方式判断压缩后对话是否仍然可靠。328 收藏 -
同一批文档、相近的问题,向量检索却可能召回不同结果。本文从查询向量归一化、元数据过滤和评测样本三个边界入手,给出一个能复现波动、定位原因并验证修复的最小流程。311 收藏 -
多轮对话一旦超过模型上下文窗口,常见表现不是单纯报错,还包括旧约束丢失、工具参数变长和响应质量波动。本文用一个可复现的 token 预算实验,拆解消息裁剪、摘要保留与最近轮次保护的组合策略。361 收藏 -
Agents SDK 把文件、命令和工具放进受控沙箱后,真正的工程难点变成状态如何跨容器恢复、凭据如何不进入模型生成代码。本文从一次沙箱失效场景出发,拆解 Manifest、外置状态、快照恢复和凭据隔离的落地边界。439 收藏 -
AI 应用调用搜索、数据库或业务接口时,超时不等于任务失败,更不能无条件重跑。本文用一个可验证的小实验拆开幂等键、部分结果、重试边界和人工接管,给出能落地的调用状态设计。195 收藏