人工智能技术文章
-
流式 AI 输出不应在最后一段文字到达时直接入库。本文用 finish_reason、状态机和幂等键说明何时保存正式结果,何时保留 partial 草稿或等待工具调用。195 收藏 -
PyTorch 当前 ONNX 导出器应优先用 dynamic_shapes 声明动态输入轴,旧导出路径才使用 dynamic_axes。本文给出 batch、高宽动态的最小写法、元数据检查与常见误区。194 收藏 -
RAG 文档分块没有一组对所有知识库都适用的固定参数。本文以 RecursiveCharacterTextSplitter 为例,说明 chunk_size、chunk_overlap 和中文分隔符的职责,并给出从检索效果反推参数的调整方法。192 收藏 -
GPT-6 Astra API 限量开放期间,应用应区分访问资格、参数错误与 429/5xx 临时故障,再按能力档案选择备用模型,并记录实际模型与降级原因。192 收藏 -
Gemini API 的 Google Search Grounding 会自动决定是否检索,并在响应中返回搜索步骤与 URL 引用。本文用一个实时事实问答链路拆解工具启用、引用提取、结果验收和失败边界。191 收藏 -
用 Structured Outputs 和 Pydantic 固定模型字段、类型与枚举,并区分正常解析、明确拒答、截断响应和业务校验失败,建立可落地的 JSON Schema 结果兜底方案。191 收藏 -
RAG 系统最危险的不是检索慢,而是证据为空时模型仍然给出肯定答案。本文用相似度门槛、引用绑定和拒答回退,把无证据回答挡在业务接口之外。188 收藏 -
Responses API 的 background 模式适合把较长任务交给后台处理。本文用状态机说明创建、轮询、超时、取消和结果保存,避免把 queued 误判成失败。188 收藏 -
提示词注入不是简单的敏感词过滤问题。本文从应用要保护的系统提示词、用户数据和外部工具权限出发,给出输入隔离、最小权限、结构化参数、审计日志和回归验证的一套落地做法。187 收藏 -
大模型流式输出不能把每个分片当成完整 JSON。用缓冲区、完成事件、事务与请求幂等键,把半截内容和重试写入挡在数据库之外。186 收藏 -
AI 流式回答中途断线时,真正要保留的不是一段模糊的重试状态,而是已确认的增量令牌、可续接的游标和明确的连接状态。本文用一个可落地的 StreamSession 设计,拆解重连、去重与失败归档的边界。184 收藏 -
科技周边 · 人工智能 | 2个月前 | go语言 · 异步任务 · 人工智能 · openai · Go 异步任务 轮询 数据保留 OpenAI Responses API background mode
长时间 AI 请求不适合一直占着 Go HTTP 连接。本文用一个报告生成场景拆开 Responses API background mode 的提交、轮询、完成判断和错误处理,并提醒后台模式与数据保留、Zero Data Retention 的边界。183 收藏 -
向量检索不要等拿到 top-k 后才做租户和权限判断。本文用 Qdrant payload filter 说明如何把元数据过滤放进召回边界,并处理索引、相似度阈值、空结果和隔离验收。183 收藏 -
RAG 知识库把长文档切成片段后,最容易丢掉的是标题层级。本文用一个产品手册场景说明如何把章节路径随片段保存,让检索结果保留上下文,减少同名字段和跨章节误答。182 收藏 -
AI 能调用工具不等于可以直接相信工具参数。本文用服务端重算权限、字段白名单、资源归属校验和拒绝用例,搭一套可验收的参数越权防线。178 收藏