人工智能技术文章
-
Hugging Face 的 hf_fs MCP 把仓库、存储、文档和论文入口收进一个接口。本文解释它解决的上下文问题、如何划定权限边界,以及接入前应该核对哪些事实和回退路径。427 收藏 -
围绕 GLM-5.3-Flash 的图文输入场景,拆开消息、抽取字段与校验层,给出一套不把模型输出直接当事实的结构化抽取边界。140 收藏 -
科技周边 · 人工智能 | 22小时前 | 人工智能 · ai agent · 安全边界 · 智能硬件 · 硬件安全 AI Agent Model Hardware Standard MHS 物理AI
Model Hardware Standard 把可编程设备的状态、操作和安全限制整理为代理可理解的驱动层。本文从 MHS 研究预览与官方站点出发,拆解接入前应保留的权限、确认和人工复核边界。216 收藏 -
Responses API 接入远程 MCP 服务器时,关键不是把工具接通,而是把工具声明、审批边界、拒绝分支和错误恢复放在同一套调用约束里。本文用两个静态结构图和 Go 示例拆开这条边界。484 收藏 -
用 Moderations API 的 flagged、categories 和 category_scores 区分规则命中与业务误报,再把审核结果分成放行、人工复核和拒绝三条路径。218 收藏 -
用 Go 实现一个请求级 AI 模型路由器,在选择上游前同时检查 token 预算、请求超时和上游降级状态,避免备用模型被误用或无限重试。481 收藏 -
流式 AI 接口返回的是连续事件而不是一段完整文本。本文用浏览器 ReadableStream 拆解 delta、done、缓冲区与断线续传的边界,给出可落地的拼接方案。323 收藏 -
Gemini Interactions API 将输出格式统一到 response_format,本文结合 Google 官方文档拆解 text、audio、image 配置迁移,以及 JSON Schema 格式正确但业务值仍需校验的边界。147 收藏 -
Gemini Flex inference 用标准价格的一半换取可让渡容量,适合不赶实时结果的评测、数据丰富和后台链路。本文用 service_tier=flex 的请求示例拆开 429、503、超时、重试和 Batch 的边界,避免把低价请求误接到用户关键路径。394 收藏 -
大模型流式响应偶尔重复半句,通常不是模型把同一句生成了两遍,而是客户端重复消费增量块、混淆事件边界或把结束事件再次当成正文。本文从流式传输、UTF-8 解码和结束标记三个边界拆开排查方法。222 收藏 -
MCP Tasks 把耗时工具调用变成可查询的任务,但取消不是简单发一个通知。本文按能力协商、任务状态、tasks/cancel 请求和客户端收口拆开可取消流程,说明如何处理竞态与终态边界。426 收藏 -
AI 接口返回结构化结果时,空对象不一定代表没有数据。本文用 finish_reason、拒答字段和 JSON Schema 校验拆开拒答、截断、合法空结果三种状态,并给出可落地的用户提示策略。363 收藏 -
RAG 不是把检索结果越多越好。长文档切块过粗、候选混杂或没有在重排后裁剪上下文,模型就会被无关段落淹没。本文用 Go 拆开分块元数据、dense 与 sparse 候选、重排 top 10 和上下文预算,给出可回放的验收路径。312 收藏 -
Qdrant 中删除文档后仍被检索到,通常不是删除接口失效,而是写入确认、索引可见性、分布式顺序或应用缓存处在不同阶段。本文用一条可复查的排查链定位并修复这个问题。482 收藏 -
多模态模型返回的 JSON 即使能解析,也可能缺字段、类型漂移或混入不该出现的值。本文用一条可复现的处理链说明如何先解析、再校验、按错误类型决定修复或重试,并划清模型约束与业务校验的边界。102 收藏