人工智能技术文章
-
科技周边 · 人工智能 | 2星期前 | 人工智能 · api设计 · gemini · AI Agent Gemini Interactions API previous_interaction_id store=false 多轮状态
梳理 Gemini Interactions API 多轮状态的真实继承范围,说明 previous_interaction_id、交互级配置与 store=false 的取舍边界。432 收藏 -
大模型返回的 JSON 偶尔缺字段、枚举值漂移或混入解释文字时,不能只继续堆提示词。本文按输出稳定性、供应商能力和业务风险比较提示词约束、结构化输出与服务端校验,给出可落地的组合选择和验收门槛。431 收藏 -
多模态模型处理跨页 PDF 表格时,字段错位往往来自分页、表头和行号没有对齐。本文把 PDF 页面切片、表头继承、行号复核和低置信度回收串成一条可操作的排查链,给出结构化结果验收方法。430 收藏 -
Hugging Face 的 hf_fs MCP 把仓库、存储、文档和论文入口收进一个接口。本文解释它解决的上下文问题、如何划定权限边界,以及接入前应该核对哪些事实和回退路径。427 收藏 -
MCP Tasks 把耗时工具调用变成可查询的任务,但取消不是简单发一个通知。本文按能力协商、任务状态、tasks/cancel 请求和客户端收口拆开可取消流程,说明如何处理竞态与终态边界。426 收藏 -
用 FAISS 做向量检索时,不要把返回位置当成文档主键。本文用 IndexIDMap 绑定 int64 业务 ID,演示 search 结果如何安全回表,并说明 IndexIVF 的选型边界。426 收藏 -
LoRA 微调效果不只取决于 rank 和学习率,训练样本的角色、模板、结束标记与推理入口也必须保持一致。本文用 messages 示例说明如何固定这份格式契约。426 收藏 -
科技周边 · 人工智能 | 2天前 | 人工智能 · openai api · 检索增强生成 · 文件搜索 · OpenAI Attributes 元数据过滤 Responses API File Search vector store
OpenAI File Search 可以在 vector store file 上写入 attributes,再用 file_search.filters 通过 eq、and、or、in 和数值范围条件缩小检索范围。本文用租户、语言和年份示例说明字段设计、复合过滤以及空结果排查。426 收藏 -
把整张长图直接交给视觉模型,常见结果是文字区域太小、成本偏高且难以复核。本文用 OCR 返回的 boundingPoly 先定位目标区域,再把归一化坐标映射为像素矩形,最后用二次识别确认裁剪没有偏移。425 收藏 -
多轮对话变长后,简单截掉旧消息很容易让模型丢失用户约束。本文从上下文压缩的边界出发,拆解摘要漂移、关键事实遗漏和回放验收,用可重复的测试样例判断压缩是否真的可用。418 收藏 -
向量库里明明有数据,检索却返回空结果,常见根因不是数据库坏了,而是 embedding 维度、归一化方式和查询链路没有对齐。本文用一个最小 Go 实验把排查顺序固定下来。410 收藏 -
科技周边 · 人工智能 | 2天前 | 人工智能 · rag · 向量检索 · 检索增强生成 · rerank · 向量数据库 metadata filter 向量检索过滤条件 rerank顺序 RAG检索
向量检索通常应先执行租户、权限、状态和时间等硬过滤,再做向量或混合召回与 rerank,最后应用阈值、去重和多样性检查,本文给出可落地的判断顺序。409 收藏 -
AI 网关同时承载多路流式回答时,连接复用、异步回调和日志采集很容易把不同请求的片段混到一起。本文用 request_id 贯穿入口、上游连接、事件转发和落盘日志,再配合状态机与断言,把串线问题变成可以复现、定位和验收的工程流程。407 收藏 -
视觉语言模型接入 OCR 时,结果漂移往往不是模型突然失忆,而是裁切坐标、原图尺寸和结构化字段没有对齐。本文用一条可复核的数据路径拆开问题,并给出校验与回退做法。406 收藏 -
图像问答不稳定,常常不是模型不会看,而是说明文字和视觉证据没有分层。本文给出冲突分类、证据优先级、结构化输入和人工复核的实用提示设计。404 收藏