人工智能技术文章
-
AI 网关同时承载多路流式回答时,连接复用、异步回调和日志采集很容易把不同请求的片段混到一起。本文用 request_id 贯穿入口、上游连接、事件转发和落盘日志,再配合状态机与断言,把串线问题变成可以复现、定位和验收的工程流程。407 收藏 -
同一个模型请求失败,并不代表应该立刻换到下一个模型。本文按超时、限流、服务异常和内容拒答拆开处理,给出路由状态、重试边界、降级策略与可验收的实现路径。398 收藏 -
多模态知识库接入图片后,成本和延迟往往不是由文件大小单独决定。本文从图片任务、detail 级别、裁剪策略和上下文预算四个维度,给出可执行的输入分层与验收方法。394 收藏 -
RAG 检索命中并不等于答案可靠。本文从文档切块边界、条件与例外的证据链、引用片段校验三个角度,说明如何定位答案被带偏的原因并建立可复查的回归检查。385 收藏 -
科技周边 · 人工智能 | 2天前 | 人工智能 · openai · 工程实践 · 流式输出 · Responses API · SSE 断线重连 Responses API AI流式输出 事件游标
AI 流式输出断线后不要直接重发请求。本文以 OpenAI Responses API 的 SSE 事件为例,说明如何保存 response_id、sequence_number 和已展示片段,重连后消除重复内容,并用最终状态完成一次可审计的收尾。377 收藏 -
一个 AI 应用把危险请求挡住是安全表现,把正常请求误判为风险则是业务失败。本文用一组可回放的测试样本拆分安全拒答、过度拒答、正常通过和非安全业务错误,说明如何设计标签、计算指标并在上线前复核。377 收藏 -
多租户 AI 知识库最危险的故障不是检索变慢,而是把 A 租户的片段、缓存或引用带给 B 租户。本文从检索权限、缓存键、引用回显和审计证据四条线,拆解一套可验证的隔离方案。369 收藏 -
多轮对话一旦超过模型上下文窗口,常见表现不是单纯报错,还包括旧约束丢失、工具参数变长和响应质量波动。本文用一个可复现的 token 预算实验,拆解消息裁剪、摘要保留与最近轮次保护的组合策略。361 收藏 -
AI Agent 的超时不能只设一个总秒数。把模型等待、工具调用和整条任务预算分开,才能区分慢在哪里、及时停止无效工作,并在重试与回退时保留可核对的状态。357 收藏 -
RAG 明明已经写入知识库,回答却像没有检索到内容?从查询改写、文本分块、相似度阈值和召回日志四个位置建立一条可验证的排查路径。350 收藏 -
模型服务出现限流、超时或参数错误时,AI 网关不能把所有失败都交给重试。本文从统一请求契约出发,拆分可降级、可重试和必须直返的错误,并用幂等键保护跨模型切换后的结果一致性。347 收藏 -
科技周边 · 人工智能 | 3天前 | 人工智能 · gemini · function calling · 结构化输出 · 接口测试 · 结构化输出 JSON Schema Gemini 3 Function Calling 工具调用验收
Gemini 3 的工具调用和结构化输出解决的是两个不同阶段的问题:前者负责取得外部结果,后者约束最终回答。本文用订单查询场景拆开两段协议,给出 schema、工具结果、拒答和失败分支的验收方法。346 收藏 -
AI 流式输出最难防的不是一句脏话,而是外部内容诱导模型越权调用工具。本文用一个可落地的请求链说明权限隔离、增量输出过滤、审计字段和失败回收如何配合。338 收藏 -
多轮对话越聊越长时,直接截掉旧消息会丢失用户约束,完全保留又会推高延迟和成本。本文给出摘要触发点、最近消息窗口和关键事实保留的组合方案,并用可回放的检查方式判断压缩后对话是否仍然可靠。328 收藏 -
Embedding 模型升级或调整 dimensions 后,旧向量、查询向量和数据库索引可能不再兼容。本文用维度契约、双写灰度和检索验收三步,说明如何安全迁移并避免静默召回下降。313 收藏