人工智能技术文章
-
OpenAI Responses API 使用 background=true 后,先保存 response.id,再通过 Responses 取回接口轮询 queued 或 in_progress 状态;本文说明如何读取 output_text,并处理 failed、cancelled、incomplete 等终态。314 收藏 -
讲清 Diffusers ControlNet 条件图与生成画布的尺寸匹配方法,覆盖等比补边、居中裁切、多 ControlNet 和批量输入检查。314 收藏 -
减少大模型裁判的位置偏差,不能只在提示词里要求公平,而应对同一回答对同时运行 A-B 与 B-A 两种顺序,统一还原答案身份,只合并一致判定,并把翻转样本升级为不确定或人工复核。314 收藏 -
介绍视觉模型读取表格图片时的区域化证据链:用稳定 region_id 组织裁剪图和字段范围,结合多图输入与 JSON Schema 保存可回溯的字段证据,并处理成本、空值和跨页边界。312 收藏 -
RAG 处理 PDF、Excel 或 Markdown 表格时,固定长度切片容易丢失表头和来源。本文用行级知识块、metadata 和检索组合保留表格关系。311 收藏 -
从应用层响应分支出发,把安全拒答、业务失败和上游错误拆开记录,建立稳定错误码、重试边界与日志字段。310 收藏 -
Diffusers 临时禁用 LoRA 不需要卸载权重,调用 disable_lora() 可回到基础模型推理,随后用 enable_lora() 恢复;本文同时区分卸载、删除和多适配器场景。309 收藏 -
Diffusers 单文件模型不能靠改后缀变成组件目录。正确做法是用匹配的 Pipeline.from_single_file() 读取权重,再用 save_pretrained() 保存配置、组件子目录和权重文件;配置推断失败时显式提供 config。308 收藏 -
AI Agent 工具调用失败时,不要无条件重放模型请求。本文用统一错误信封、错误码分层、原始 call_id 回传和有限重试预算,让模型只重试可修复问题,并避免副作用重复执行。307 收藏 -
AI Agent 调用外部工具时,超时只解决等待上限,幂等键才解决重复副作用。本文用统一 deadline、幂等账本和结果分类,给出可落地的调用边界与排查清单。305 收藏 -
面向离线推理任务,介绍如何用 Transformers pipeline 接入流式数据、按样本长度和显存选择 batch_size,并为显存不足与失败批次保留可恢复的降级路径。301 收藏 -
长上下文应用不应把全部聊天记录直接拼进请求。本文用近期消息、滚动摘要和按需检索三层结构,配合 token 预算、去重与计数,减少无关历史进入模型上下文。296 收藏 -
OpenAI 提示词模板的变量主要负责替换输入,默认值、类型和必填校验应放在应用侧包装函数中。本文用 TypeScript 建立一层可复用契约。296 收藏 -
RAG 评测不要只看一个总分。本文用固定 JSONL 样本,把检索上下文覆盖率与最终答案正确率拆开统计,并用指标组合定位检索、生成和数据集问题。293 收藏 -
OpenAI Realtime API 可通过 session.audio.input.turn_detection 配置 server_vad、semantic_vad 或关闭 VAD。本文讲清阈值、静音时长、eagerness、自动响应与手动提交的取舍。293 收藏