人工智能技术文章
-
OCR 通常先返回文本、坐标和置信度,不会直接给出可用的二维表。通过统一坐标、按垂直重叠聚类行、按横坐标排序并推断列锚点,可以重建表格关系,同时保留低置信度单元格供复核。385 收藏 -
AI Agent 调用外部工具时,超时只解决等待上限,幂等键才解决重复副作用。本文用统一 deadline、幂等账本和结果分类,给出可落地的调用边界与排查清单。305 收藏 -
多轮对话压缩不能只追求文本变短。本文用任务目标、已确认决策、硬约束、未完成动作、待确认问题和证据引用六类字段设计提示模板,并说明如何组合状态摘要与最近原文,减少上下文丢失和任务返工。278 收藏 -
LLM输出能解析不代表字段完整。本文从JSON Schema最小契约、响应状态归一化、字段缺失有限重试和上线观测四个方面,给出结构化输出的处理方案。364 收藏 -
从批次边界、吞吐控制、错误分流和幂等写入四个层面,说明 Embedding 批量生成如何稳定处理长文本、429、超时和进程重启。387 收藏 -
长文档做RAG时,先解析标题树并把标题路径、来源位置和版本写入chunk metadata,再按语义边界切分和重建上下文,减少检索片段丢失章节语境的问题。170 收藏 -
向量检索不要等拿到 top-k 后才做租户和权限判断。本文用 Qdrant payload filter 说明如何把元数据过滤放进召回边界,并处理索引、相似度阈值、空结果和隔离验收。183 收藏 -
向量检索不应把租户、文档类型等硬约束交给 embedding 猜测。本文以 Qdrant 为例,把过滤字段写入 payload、提前建立 payload index,再用 Filter 绑定向量召回,并说明应用层后置筛选、字段选择性和索引成本的边界。467 收藏 -
围绕视觉模型图像输入,讲清任务分档、等比缩放、detail 选择、patch/token 成本估算和发送前边界检查。487 收藏 -
从应用层响应分支出发,把安全拒答、业务失败和上游错误拆开记录,建立稳定错误码、重试边界与日志字段。310 收藏 -
通过稳定前缀、动态变量和缓存观测三层拆分,整理 Prompt cache 的命中条件、请求排列方式与 cached_tokens 排查清单。199 收藏 -
把模型评测样本按拒答、事实错误、格式错误和工具调用失败等类型切桶,分别计算指标,再用固定分桶对比模型版本,避免总分掩盖局部回归。173 收藏 -
面向离线推理任务,介绍如何用 Transformers pipeline 接入流式数据、按样本长度和显存选择 batch_size,并为显存不足与失败批次保留可恢复的降级路径。301 收藏 -
量化推理选精度不能只看模型参数量,还要扣除 KV cache、激活、运行时余量和量化元数据。本文用显存预算、位宽估算和 Transformers BitsAndBytesConfig,说明何时选择 FP16/BF16、INT8 或 INT4,并给出吞吐与质量的验证边界。398 收藏 -
科技周边 · 人工智能 | 2天前 | 错误处理 · mcp · 工具调用 · AI工程 · MCP工具错误 isError structuredContent CallToolResult JSON-RPC错误
MCP 工具遇到业务失败时,应在正常工具结果中设置 isError,并把可行动信息放进 content;只有协议层故障才返回 JSON-RPC error。本文用 TypeScript 示例说明结构化错误的设计边界。208 收藏