人工智能技术文章
-
从一个知识库问答召回率下降的现场出发,拆解查询与文档向量任务类型、topK基线和Recall@K验证方法,帮助定位RAG检索问题到底在编码、切块还是排序。251 收藏 -
面向需要稳定输出的 AI 应用,梳理 JSON Schema 版本兼容中的新增字段、枚举收缩、校验失败与回滚策略。449 收藏 -
在一次请求的流式窗口发生中断时,重发与否是关键风险点。本文给出以请求 ID、幂等键、状态回放与回退策略构成的恢复闭环。145 收藏 -
AI 接口遇到 504 不能简单重复提交。本文用 OpenAI 的 X-Client-Request-Id 和 Gemini API 的指数退避建议,拆解请求标识、可重试错误、结果去重与人工复核的完整工作流。171 收藏 -
AI 接口遇到 504 不能简单重复提交。本文用 OpenAI 的 X-Client-Request-Id 和 Gemini API 的指数退避建议,拆解请求标识、可重试错误、结果去重与人工复核的完整工作流。229 收藏 -
AI 接口遇到超时不能简单重复提交。本文用 OpenAI 的 X-Client-Request-Id 和 Gemini API 的指数退避建议,拆解请求标识、可重试错误、结果去重与人工复核的完整工作流。482 收藏 -
AI 应用不应把模型内部推理链直接展示给用户,但可以通过 Responses API 的 reasoning summary 提供简洁的过程摘要。本文用 Python 示例说明配置方式、摘要与最终答案的区别、展示边界和上线核对项。195 收藏 -
Gemini API 的 Google Search Grounding 会自动决定是否检索,并在响应中返回搜索步骤与 URL 引用。本文用一个实时事实问答链路拆解工具启用、引用提取、结果验收和失败边界。191 收藏 -
科技周边 · 人工智能 | 6天前 | 异步任务 · openai · AI API · 接口状态 · 轮询 background OpenAI Responses API queued completed
Responses API 的 background 模式适合把较长任务交给后台处理。本文用状态机说明创建、轮询、超时、取消和结果保存,避免把 queued 误判成失败。188 收藏 -
Gemini 3.5 Flash 已建议用 thinking_level 替代 thinking_budget。本文用同一组请求对比 minimal、low、medium、high,说明迁移写法、选档边界与回归检查。457 收藏 -
重复把长文档或系统提示词发送给 Gemini API 时,可以用显式 Context Caching 保存公共上下文,再通过 cachedContents、TTL 和 usage.total_cached_tokens 验证缓存是否真的生效。209 收藏 -
科技周边 · 人工智能 | 1星期前 | ai · claude · Anthropic API · 文档问答 · 可追溯回答 · Claude 引用 Anthropic Messages API citations document block
Anthropic Claude Messages API 的 citations 能把回答片段关联回 PDF、纯文本或自定义文档块。本文从 document block、citations.enabled、引用位置和 streaming 的 citations_delta 四个层面核对返回结果,避免只让模型口头声称有来源。295 收藏 -
Gemini Developer API 的零数据留存不是只设置一个 store=false:Interactions、File API、显式缓存、隐式缓存和 Live API 的保留边界不同。本文用一张核对表和最小请求示例说明如何逐项关闭或清理状态。374 收藏 -
Hugging Face Inference Providers 可以让同一套客户端接入多个推理服务。本文从 provider=auto 的默认路由开始,说明何时固定具体 provider、如何设计 fallback、如何记录实际路由和响应字段,避免模型可用但结果格式悄悄变化。309 收藏 -
Gemini 3 的 function calling 在手动维护多轮历史时,不能丢掉 thought_signature。本文用一个最小工具调用链说明官方 SDK、REST 手写历史和错误降级的处理边界。238 收藏