人工智能
已收录文章:73篇
-
AI 应用接收流式工具参数时,JSON 往往被拆在多个数据块里,直接逐块解析会遇到意外 EOF、转义字符断开和重复提交。本文用 Go 写一个小型增量缓冲器,展示如何拼接、解析、去重并验证完整参数。497 收藏
-
模型换版本后,先别只看几条手工对话。本文用 Go 从零做一个轻量 AI 评测样本 CLI,校验 JSONL 字段、按固定种子抽样,并把命中规则与通过率写成可复查的报告。472 收藏
-
Gemini 3.7 Flash 发布后,团队不该只看榜单分数。本文把代码调试、Agent 工具调用和输入输出成本拆成可复现的检查项,帮助开发团队判断它适合试验、灰度还是继续使用现有模型。471 收藏
-
RAG 应用答错时,不要只怪模型。更常见的根因在检索层:切片不合适、召回证据偏题、排序没过滤、回答没有引用约束。复盘时要把用户问题、检索结果、证据片段、模型回答和评测样本串起来,才能真正防复发。468 收藏
-
把 AI 接口从普通聊天模型切到推理模型时,max_tokens 不是简单改个字段名。本文从请求兼容、推理 token 预算、截断判断和回滚核对四个方面,给出一套可复用的迁移检查方法。464 收藏
-
AI Agent 一轮工具调用可能已经改写库存、发送通知,却在最后一步返回超时。本文用订单履约场景拆开部分成功的状态记录、补偿动作和安全重试边界,给出可落地的验收清单。460 收藏
-
GPT-5.6 Sol、Terra、Luna 面向不同任务能力层级。本文用任务分桶、格式命中率、尾延迟和回退日志搭建一套可复查的 A/B 验收方法,帮助团队判断模型差异是否值得进入生产路由。458 收藏
-
用一个最小前端配方实现 AI 聊天流式输出,覆盖 Fetch Stream 读取、TextDecoder 解码、逐段渲染、AbortController 中断和 SSE 变体选择。448 收藏
-
科技周边 · 人工智能 | 2个月前 | 安全 · oauth · 人工智能 · mcp · 工具调用 · MCP 401 MCP 403 MCP OAuth mcp resource_metadata MCP scope MCP token audience远程 MCP 服务的工具调用返回 401 或 403,通常不是模型没有找到工具,而是授权发现、scope 或 token audience 没有和目标 MCP 资源对齐。本文按响应状态、WWW-Authenticate、Protected Resource Metadata 和 resource 参数逐步定位,并给出最小核对清单。443 收藏
-
大模型接口出现 429 时,连续立刻再发往往只会让队列更长。本文按运行手册的节奏说明如何保留响应线索,区分请求数量、令牌总量与并发积压三类原因,再用限并发、缩短上下文和带抖动的退避把线上对话从拥塞中拉回来。432 收藏
-
从 RAG 应用答非所问的现场出发,逐步检查文档切块、Embedding、向量召回、混合检索和上下文拼接,给出一套可复查的排查路径。427 收藏
-
围绕 AI 调用规模化后的日志散乱、模型字段不统一、token 成本不可见和隐私采集风险,讲解如何用 OpenTelemetry GenAI 字段建设统一观测架构。427 收藏