人工智能技术文章
-
工具调用参数校验失败时,不要直接重放可能产生副作用的工具。本文拆解 strict Schema、应用侧业务校验、tool_call_id 错误反馈、幂等键和有限重试的分工。215 收藏 -
科技周边 · 人工智能 | 3星期前 | 人工智能 · mcp · sampling · 协议迁移 · MRTR · 模型 API · MCP Sampling sampling/createMessage MCP 2026-07-28 MRTR SEP-2577 大模型 API
MCP 2026-07-28 规范把 Roots、Sampling、Logging 标记为弃用,但旧接口至少保留过渡期。本文用 sampling/createMessage 的调用链说明变更原因,区分仍可运行与不宜新建的代码,并给出直连模型 API、工具参数和回归验收的迁移清单。213 收藏 -
大模型流式接口出现重复片段,通常不是模型把同一句话生成了两次,而是客户端把重试、重放或累计快照重复拼接。本文用可观测指标拆开增量事件、断线续传和去重边界。213 收藏 -
大模型接口返回 JSON 时,偶尔会带上 Markdown 代码围栏、解释文字或截断内容。本文从真实响应现场出发,给出 Go 解析、边界判断、重试与结构化响应约束的组合方案。213 收藏 -
重复把长文档或系统提示词发送给 Gemini API 时,可以用显式 Context Caching 保存公共上下文,再通过 cachedContents、TTL 和 usage.total_cached_tokens 验证缓存是否真的生效。209 收藏 -
关键词检索和向量检索各自找到了内容,合并后却出现重复段落、来源顺序混乱或引用丢失,问题往往出在结果融合阶段。本文用可运行的 Python 示例拆开去重、分组、来源优先级与引用回填,让多路 RAG 的合并结果可解释、可回归。208 收藏 -
RAG 检索结果过多时,不要只调小 top_k。本文拆分候选去重、重排、上下文压缩与预算装箱,给出可落地的选择规则、Python 示例和四项排查指标。207 收藏 -
AI Agent 调用外部工具超时后,不要把异常当空结果或无条件重试。通过 schema、参数校验、幂等键、未知状态和恢复队列,设计可判断、可追踪、可继续处理的结果。203 收藏 -
本文给出一套 AI 批量调用成本控制工作流:记录请求日志、估算 token、设置预算阈值、区分实时和离线任务,并用账单复查闭环防止成本失控。202 收藏 -
Go 服务接入多模态接口时,图片预检应放在上传入口:先检查 MIME、文件头和字节上限,再决定是否送给模型;遇到格式不支持或服务超时则返回可解释的降级结果。202 收藏 -
科技周边 · 人工智能 | 4星期前 | go · 人工智能 · Gemini API · 函数调用 · 多轮对话 · Go 函数调用 工具链 Gemini 3 thoughtSignature Interactions API
Gemini 3 的函数调用不是拿到 functionCall 就结束:多轮请求必须保留模型返回的 thoughtSignature,并按原顺序回传模型步骤与工具结果。本文用 Go 拆解一次天气工具调用的状态流、签名保存和失败核对。202 收藏 -
Embedding 模型一换,向量维度可能跟着变化,批量写入时轻则报错,重则让新旧数据混在同一索引里。本文用维度契约、批量预检、双索引切换和回滚清单,把模型升级变成可验收的入库流程。202 收藏 -
接入远程 MCP 服务器时,不要把工具发现当成授权。本文从工具 allowlist、来源校验、OAuth 受众绑定和审计记录四个边界,整理一套可复核的权限收口方法。202 收藏 -
RAG 应用最难排查的错误之一,是模型把相似检索片段直接改写成确定答案。本文从引用绑定、证据片段和拒答边界入手,给出一套可落地的输出验收方法。201 收藏 -
多模态 RAG 能检索到图片,却在回答里漏掉关键上下文,通常不是模型单点失效,而是 OCR、图文切片、向量检索和引用回链之间有一段断了。本文按证据顺序定位并修复这类问题。197 收藏