人工智能技术文章
-
排查大模型多轮工具调用中的上下文丢失,梳理 tool_call_id、并行结果配对和消息回放验收。252 收藏 -
从一个知识库问答召回率下降的现场出发,拆解查询与文档向量任务类型、topK基线和Recall@K验证方法,帮助定位RAG检索问题到底在编码、切块还是排序。251 收藏 -
同一个模型换了提示词却突然复读、接不上回答,问题常常不在采样参数,而在 Transformers 的 chat template。本文用 apply_chat_template 对比 add_generation_prompt、重复 special tokens 和 continue_final_message 的边界,再用 token 数量与首个生成片段完成验收。243 收藏 -
RAG 知识库答非所问,通常不是模型单独失灵,而是切分、召回过滤和重排之间没有形成可验证的证据链。本文用一组可复现的检查方法定位问题,并给出适合上线前评测的调整顺序。243 收藏 -
MCP 长任务如果只有最终结果,客户端很难判断服务是否卡住。本文用一个批量索引工具拆解 progressToken 的关联规则、notifications/progress 的递增约束、未知 total 的处理,以及完成、超时、取消时如何收口。241 收藏 -
AI 流式接口不能只靠某个文本片段判断结束。本文用事件序列拆解增量内容、完成事件、失败状态与断线续接,给出客户端状态机、重复片段处理和验收清单。239 收藏 -
Gemini 3 的 function calling 在手动维护多轮历史时,不能丢掉 thought_signature。本文用一个最小工具调用链说明官方 SDK、REST 手写历史和错误降级的处理边界。238 收藏 -
科技周边 · 人工智能 | 2星期前 | go · Context · 流式处理 · 人工智能 · openai api · sse · 重试 · OpenAI Go context 流式输出 SSE Responses API 断线重试
Go 服务接入 OpenAI Responses API 的流式输出时,真正难的是事件边界、重复片段、断线重试和请求取消。本文用官方 openai-go SDK 拆解 SSE 事件,给出增量文本拼接、单次重试边界和 context 超时处理的最小流程。236 收藏 -
接入远程工具时,真正需要验收的是工具白名单、调用暂停、审批结果与工具输出的关联链路。本文用只读查询场景拆开发现、确认、拒绝和故障恢复的边界。232 收藏 -
AI 流式回答在移动网络或代理切换时可能中途断开。本文用 SSE 的事件 ID、重连窗口和客户端游标,拆解如何续接未完成内容、避免重复片段,并给出可验收的状态与日志设计。231 收藏 -
AI 接口遇到 504 不能简单重复提交。本文用 OpenAI 的 X-Client-Request-Id 和 Gemini API 的指数退避建议,拆解请求标识、可重试错误、结果去重与人工复核的完整工作流。229 收藏 -
超长视频不能只靠一次请求和一段摘要解决。本文以长视频检索为例,拆解分段抽帧、时间轴索引、候选片段复核和证据回溯的工程流程,并给出可验收的结果格式。229 收藏 -
更换 Embedding 模型后,旧向量与新向量的维度可能不一致,直接覆盖索引会让写入、查询和回滚同时失控。本文以双索引迁移为主线,拆解维度核对、查询路由、后台回填和回滚验收。229 收藏 -
中文输入法候选词还没确认时,AI 聊天框把回车当成发送,会截断用户正在输入的句子。本文用 compositionstart、compositionend 和 InputEvent.isComposing 组合出稳定的回车发送规则,并补上移动端、粘贴和可访问性检查。217 收藏 -
用 Go 封装 Ollama 本地 API 健康检查:先确认服务版本,再核对模型清单,最后用短请求验证生成能力,并处理连接超时、模型未安装和常驻内存边界。216 收藏