人工智能技术文章
-
Gemini Interactions API 的 2026 schema 迁移不只是把 outputs 改成 steps,还涉及 response_format、函数调用、工具事件、无状态历史和 SSE 监听。本文按 REST 与 SDK 两条路径给出兼容改法和验收清单。367 收藏 -
用 Claude Prompt Caching 降低长上下文请求的延迟和成本时,要把静态前缀、动态尾部、TTL 与 usage 里的 cache read/write 分开验收。363 收藏 -
多轮对话一旦超过模型上下文窗口,常见表现不是单纯报错,还包括旧约束丢失、工具参数变长和响应质量波动。本文用一个可复现的 token 预算实验,拆解消息裁剪、摘要保留与最近轮次保护的组合策略。361 收藏 -
OpenAI Responses API 的推理项不是普通文本,手动管理多轮上下文时要保留完整 reasoning item。本文拆解 reasoning.encrypted_content、include 参数和函数调用续接的验收边界,避免第二轮请求丢上下文。357 收藏 -
AI Agent 的超时不能只设一个总秒数。把模型等待、工具调用和整条任务预算分开,才能区分慢在哪里、及时停止无效工作,并在重试与回退时保留可核对的状态。357 收藏 -
RAG 明明已经写入知识库,回答却像没有检索到内容?从查询改写、文本分块、相似度阈值和召回日志四个位置建立一条可验证的排查路径。350 收藏 -
模型服务出现限流、超时或参数错误时,AI 网关不能把所有失败都交给重试。本文从统一请求契约出发,拆分可降级、可重试和必须直返的错误,并用幂等键保护跨模型切换后的结果一致性。347 收藏 -
科技周边 · 人工智能 | 3天前 | 人工智能 · gemini · function calling · 结构化输出 · 接口测试 · 结构化输出 JSON Schema Gemini 3 Function Calling 工具调用验收
Gemini 3 的工具调用和结构化输出解决的是两个不同阶段的问题:前者负责取得外部结果,后者约束最终回答。本文用订单查询场景拆开两段协议,给出 schema、工具结果、拒答和失败分支的验收方法。346 收藏 -
MCP elicitation/create 允许服务器在工具调用过程中向用户请求结构化补充信息。本文用一个配置向导场景拆解能力声明、JSON Schema、accept/decline/cancel 响应,以及为什么 API 密钥和支付信息不能放进表单模式。340 收藏 -
AI 流式输出最难防的不是一句脏话,而是外部内容诱导模型越权调用工具。本文用一个可落地的请求链说明权限隔离、增量输出过滤、审计字段和失败回收如何配合。338 收藏 -
多轮对话越聊越长时,直接截掉旧消息会丢失用户约束,完全保留又会推高延迟和成本。本文给出摘要触发点、最近消息窗口和关键事实保留的组合方案,并用可回放的检查方式判断压缩后对话是否仍然可靠。328 收藏 -
Gemini API 的 URL Context 能读取公开网页,但应用不能只看模型有没有输出。本文用 Go 检查 url_context_result、引用标注、输入 token 与失败回退,建立一条可验收的网页上下文链路。320 收藏 -
Embedding 模型升级或调整 dimensions 后,旧向量、查询向量和数据库索引可能不再兼容。本文用维度契约、双写灰度和检索验收三步,说明如何安全迁移并避免静默召回下降。313 收藏 -
OpenAI Responses API 进入后台模式后,response.completed 会通过 Webhook 通知服务端。本文用 Python 说明如何保留原始请求体、调用官方 SDK 验证签名、处理时间窗口与重复事件,避免把未验证的回调直接当成任务完成信号。312 收藏 -
同一批文档、相近的问题,向量检索却可能召回不同结果。本文从查询向量归一化、元数据过滤和评测样本三个边界入手,给出一个能复现波动、定位原因并验证修复的最小流程。311 收藏