人工智能技术文章
-
向量库里明明有数据,检索却返回空结果,常见根因不是数据库坏了,而是 embedding 维度、归一化方式和查询链路没有对齐。本文用一个最小 Go 实验把排查顺序固定下来。410 收藏 -
AI 流式回答中途断线时,真正要保留的不是一段模糊的重试状态,而是已确认的增量令牌、可续接的游标和明确的连接状态。本文用一个可落地的 StreamSession 设计,拆解重连、去重与失败归档的边界。184 收藏 -
科技周边 · 人工智能 | 1星期前 | API · 人工智能 · agent · gemini · 工程实践 · agent 工具调用 Interactions API Gemini 3.7 Flash 任务验收
围绕 Gemini 3.7 Flash 的托管 Agent 任务,拆解多步执行、工具结果、sandbox 边界与最终状态验收,并给出 Go 侧可复用的状态检查代码。176 收藏 -
Responses API 的图片输入不是把图片路径直接塞进字符串,而是把 input_text 与 input_image 放进同一条 user content;本文用 Go 代码拆开请求结构、图片 URL 与 output_text 的读取边界。444 收藏 -
RAG 系统如果只保存一段孤立文本,回答命中后很难解释它来自文档哪里。本文用 Go 设计带标题路径、页码和片段编号的 Chunk,演示切片、检索上下文和引用回链如何连成一条可复查的数据路径。163 收藏 -
RAG 系统不要只把文本片段交给模型。本文用 Go 设计带 source_id、标题和定位信息的检索结果接口,让生成答案可以回溯来源、处理空召回,并在调用失败时保留可验证的错误边界。178 收藏 -
RAG 应用回答看似流畅却总带错文档,通常不是模型突然失常,而是切分、召回和证据核对没有连成一条可追踪链路。本文用一个知识库排障场景,拆解如何定位错召回并验证修复效果。141 收藏 -
多模态接口处理图片时,分辨率越高不一定越划算。本文用图片尺寸、切片数量和 media_resolution 拆开 token 与延迟的关系,并给出调用前估算、缩放和结果复核方法。161 收藏 -
一个 AI 应用把危险请求挡住是安全表现,把正常请求误判为风险则是业务失败。本文用一组可回放的测试样本拆分安全拒答、过度拒答、正常通过和非安全业务错误,说明如何设计标签、计算指标并在上线前复核。377 收藏 -
多模态模型识别扫描表格时,漏列通常不是模型单点失误,而是图像缩放、表格线、列坐标和结构化输出共同造成的。本文给出一套从输入预处理到坐标复核、局部纠错和结果验收的实用流程。461 收藏 -
MCP 工具调用遇到超时,不能简单地把所有失败都重试。本文从资产保护、调用路径和错误分级入手,设计一套包含超时、重试、幂等、审计与人工接管的收口方案。111 收藏 -
大模型接口返回 JSON 时,偶尔会带上 Markdown 代码围栏、解释文字或截断内容。本文从真实响应现场出发,给出 Go 解析、边界判断、重试与结构化响应约束的组合方案。213 收藏 -
多轮对话越聊越长时,直接截掉旧消息会丢失用户约束,完全保留又会推高延迟和成本。本文给出摘要触发点、最近消息窗口和关键事实保留的组合方案,并用可回放的检查方式判断压缩后对话是否仍然可靠。328 收藏 -
同一批文档、相近的问题,向量检索却可能召回不同结果。本文从查询向量归一化、元数据过滤和评测样本三个边界入手,给出一个能复现波动、定位原因并验证修复的最小流程。311 收藏 -
多轮对话一旦超过模型上下文窗口,常见表现不是单纯报错,还包括旧约束丢失、工具参数变长和响应质量波动。本文用一个可复现的 token 预算实验,拆解消息裁剪、摘要保留与最近轮次保护的组合策略。361 收藏