人工智能技术文章
-
在一次请求的流式窗口发生中断时,重发与否是关键风险点。本文给出以请求 ID、幂等键、状态回放与回退策略构成的恢复闭环。145 收藏 -
向量检索召回很多无关片段,通常不是单一模型失效,而是候选范围、相似度阈值和最终排序没有分层。本文用一个文档问答场景拆开召回噪声的定位路径,说明元数据过滤、score_threshold、候选集放大和重排的使用边界。141 收藏 -
RAG 应用回答看似流畅却总带错文档,通常不是模型突然失常,而是切分、召回和证据核对没有连成一条可追踪链路。本文用一个知识库排障场景,拆解如何定位错召回并验证修复效果。141 收藏 -
模型没有返回答案时,不能只看空字符串或 HTTP 状态码。本文把提示被拦截、候选被安全过滤、正常截断和服务异常分开,给出统一状态判断、用户提示与回归验收的方法。140 收藏 -
围绕 GLM-5.3-Flash 的图文输入场景,拆开消息、抽取字段与校验层,给出一套不把模型输出直接当事实的结构化抽取边界。140 收藏 -
AI Agent 执行长任务时,真正难的是中途失败后从哪里继续。本文围绕 checkpoint、恢复点和幂等回放,拆解状态保存、重启恢复、重复执行与回归验收的工程边界。132 收藏 -
PDF 图表检索失败时,先区分抽取、模态 embedding、向量集合和视觉重排四层。本文用固定回归样本和配置检查,定位图表到底在哪一层丢失。132 收藏 -
视觉模型遇到 20MB 以上图片时,真正棘手的是尺寸预算、上传方式和重试边界同时变化。本文从请求前预缩放、分块上传到失败回收,拆解一条可验证的图片输入链路,并说明什么时候应该拒绝重试。124 收藏 -
量化模型精度下降时,不要只看一个总分。本文用固定输入、配对预测和分桶误差,区分评测条件不一致、长输入敏感与校准集覆盖不足,并给出可复用的对照脚本。124 收藏 -
科技周边 · 人工智能 | 1星期前 | oauth · 人工智能 · mcp · Agent 工程 · resource MCP OAuth 2.1 RFC 8707 token audience 远程 MCP
远程 HTTP MCP 的 OAuth 授权不能只把 Bearer token 透传过去。客户端要以 MCP 服务器的 canonical URI 作为 resource,同时放入授权请求和令牌请求;服务端还要校验 token 是否确实签发给自己。本文用一个最小实现拆开这条受众绑定链路,并说明 401、403 与跨服务器误用的边界。123 收藏 -
RAG 系统把 Markdown 表格按换行或固定字符数切开后,检索结果常常只剩半行字段,模型看似答对却无法说明数据关系。本文用 Markdown AST 识别表格边界、保留表头与行上下文,再用可验收的切片结果接入向量索引。121 收藏 -
MCP 2026-07-28 将协议层改为无状态,但业务仍可能有状态。本文用显式句柄、请求级路由、缓存范围和 Trace Context 拆解迁移边界。119 收藏 -
长文切片容易在 RAG 召回中占满候选集。本文用 Go 演示按来源分桶、限制每桶配额,再把候选交给 rerank,最后按 token 预算组装上下文,并给出可复查的召回指标。118 收藏 -
AI API 上线评审不能只看请求是否成功,还要画清输入、平台短期状态、回调结果和删除动作。本文用一个后台响应场景拆解客户数据与短期保留的边界,给出可落地的合规核对清单。115 收藏 -
评测分数异常好,未必代表模型真的可靠。训练集、验证集和测试集之间的重复样本、未来字段和错误的预处理顺序,都会造成数据泄漏。本文以带时间的客服工单分类为例,给出切分、去重、特征时间点和最终验收的检查方法。115 收藏