人工智能技术文章
-
流式调用工具时,参数 JSON 会被拆成多个增量事件,不能把每个片段直接解析。本文用 buffer、JSON.parse 和状态恢复拆开半包边界,给出失败重试与重复调用的防线。197 收藏 -
Gradio 长任务不要只等函数返回:用生成器 yield 阶段状态,用 gr.Progress 显示进度,再用 cancels 连接停止按钮,同时明确 UI 取消与外部作业停止的边界。197 收藏 -
本文整理一套 AI Agent 工具调用失败排查流程:先定义工具边界,再校验 Schema、参数和权限,最后处理超时、空结果、重试和兜底回答,帮助把不稳定的工具调用变成可验证的工程链路。195 收藏 -
即使接口启用了严格 JSON Schema,Go 服务仍要检查拒答、截断和字段值语义。本文用一个可运行的校验边界示例,拆开模型响应、json.Unmarshal 和业务校验各自该负责什么。195 收藏 -
科技周边 · 人工智能 | 3星期前 | 安全 · mcp · ai agent · MCP ToolAnnotations readOnlyHint destructiveHint idempotentHint
MCP ToolAnnotations 能帮助客户端理解工具是否只读、是否可能破坏环境、重复调用是否幂等以及是否访问开放世界,但四个 Hint 只是行为提示而非权限系统。本文给出从服务端声明、状态实测到客户端拦截的上线核对清单。195 收藏 -
AI 应用不应把模型内部推理链直接展示给用户,但可以通过 Responses API 的 reasoning summary 提供简洁的过程摘要。本文用 Python 示例说明配置方式、摘要与最终答案的区别、展示边界和上线核对项。195 收藏 -
AI 应用调用搜索、数据库或业务接口时,超时不等于任务失败,更不能无条件重跑。本文用一个可验证的小实验拆开幂等键、部分结果、重试边界和人工接管,给出能落地的调用状态设计。195 收藏 -
科技周边 · 人工智能 | 1星期前 | 人工智能 · LangChain · rag · RAG 文档分块 RecursiveCharacterTextSplitter chunk_size chunk_overlap
RAG 文档分块没有一组对所有知识库都适用的固定参数。本文以 RecursiveCharacterTextSplitter 为例,说明 chunk_size、chunk_overlap 和中文分隔符的职责,并给出从检索效果反推参数的调整方法。192 收藏 -
GPT-6 Astra API 限量开放期间,应用应区分访问资格、参数错误与 429/5xx 临时故障,再按能力档案选择备用模型,并记录实际模型与降级原因。192 收藏 -
本文整理一套 AI 知识库检索召回工作流,从文档清洗、切分、向量入库、查询改写、过滤重排到证据引用和复查指标,帮助知识库回答从能用走向可控。191 收藏 -
Gemini API 的 Google Search Grounding 会自动决定是否检索,并在响应中返回搜索步骤与 URL 引用。本文用一个实时事实问答链路拆解工具启用、引用提取、结果验收和失败边界。191 收藏 -
RAG 系统最危险的不是检索慢,而是证据为空时模型仍然给出肯定答案。本文用相似度门槛、引用绑定和拒答回退,把无证据回答挡在业务接口之外。188 收藏 -
科技周边 · 人工智能 | 3星期前 | 异步任务 · openai · AI API · 接口状态 · 轮询 background OpenAI Responses API queued completed
Responses API 的 background 模式适合把较长任务交给后台处理。本文用状态机说明创建、轮询、超时、取消和结果保存,避免把 queued 误判成失败。188 收藏 -
提示词注入不是简单的敏感词过滤问题。本文从应用要保护的系统提示词、用户数据和外部工具权限出发,给出输入隔离、最小权限、结构化参数、审计日志和回归验证的一套落地做法。187 收藏 -
大模型流式输出不能把每个分片当成完整 JSON。用缓冲区、完成事件、事务与请求幂等键,把半截内容和重试写入挡在数据库之外。186 收藏