人工智能技术文章
-
从评测样本、提示词模板和模型输出三层排查评测集污染,给出变量隔离、快照留存与回归验收方法。496 收藏 -
Responses API 的 tool_choice 不只是 auto 和 required 两个开关。本文用一个订单查询工具说明如何强制调用、指定具体工具,并用响应项和业务回退做可复查验收。484 收藏 -
AI 接口遇到超时不能简单重复提交。本文用 OpenAI 的 X-Client-Request-Id 和 Gemini API 的指数退避建议,拆解请求标识、可重试错误、结果去重与人工复核的完整工作流。482 收藏 -
从首字延迟 TTFT、分段间隔和客户端断线三个信号入手,搭建大模型流式输出的观测口径,并给出 Go 服务端记录与回放验收方法。466 收藏 -
科技周边 · 人工智能 | 3天前 | 人工智能 · openai · 兼容性 · Chat Completions · 推理模型 · token预算 AI推理模型 max_tokens max_completion_tokens 参数迁移
把 AI 接口从普通聊天模型切到推理模型时,max_tokens 不是简单改个字段名。本文从请求兼容、推理 token 预算、截断判断和回滚核对四个方面,给出一套可复用的迁移检查方法。464 收藏 -
多模态模型识别扫描表格时,漏列通常不是模型单点失误,而是图像缩放、表格线、列坐标和结构化输出共同造成的。本文给出一套从输入预处理到坐标复核、局部纠错和结果验收的实用流程。461 收藏 -
AI Agent 一轮工具调用可能已经改写库存、发送通知,却在最后一步返回超时。本文用订单履约场景拆开部分成功的状态记录、补偿动作和安全重试边界,给出可落地的验收清单。460 收藏 -
Gemini 3.5 Flash 已建议用 thinking_level 替代 thinking_budget。本文用同一组请求对比 minimal、low、medium、high,说明迁移写法、选档边界与回归检查。457 收藏 -
MCP 工具注解能帮助客户端理解工具是否只读、是否可能破坏环境、重复调用是否幂等以及是否访问开放世界,但它们只是提示而非权限系统。本文给出从服务端声明到客户端审批的安全验收清单。452 收藏 -
面向需要稳定输出的 AI 应用,梳理 JSON Schema 版本兼容中的新增字段、枚举收缩、校验失败与回滚策略。449 收藏 -
Responses API 的图片输入不是把图片路径直接塞进字符串,而是把 input_text 与 input_image 放进同一条 user content;本文用 Go 代码拆开请求结构、图片 URL 与 output_text 的读取边界。444 收藏 -
Agents SDK 把文件、命令和工具放进受控沙箱后,真正的工程难点变成状态如何跨容器恢复、凭据如何不进入模型生成代码。本文从一次沙箱失效场景出发,拆解 Manifest、外置状态、快照恢复和凭据隔离的落地边界。439 收藏 -
科技周边 · 人工智能 | 5小时前 | websocket · 人工智能 · gemini · 实时语音 · Gemini Live API session resumption SessionResumptionUpdate GoAway
Gemini Live API 的 WebSocket 连接会周期性结束,单纯重连会丢掉上下文。本文用 session resumption 保存最新恢复句柄,再结合 GoAway.timeLeft、generationComplete 和上下文压缩处理重连时机与数据边界。436 收藏 -
Gemini Files API 适合复用 PDF、图片、音视频等媒体,但上传成功不等于可以立刻调用。本文用 Go 拆开 ACTIVE 状态、48 小时保存、项目与单文件上限、主动删除和调用前复查,给出一条可回收、可重试的文件生命周期方案。433 收藏 -
大模型返回的 JSON 偶尔缺字段、枚举值漂移或混入解释文字时,不能只继续堆提示词。本文按输出稳定性、供应商能力和业务风险比较提示词约束、结构化输出与服务端校验,给出可落地的组合选择和验收门槛。431 收藏