人工智能
已收录文章:107篇
-
AI 应用接收流式工具参数时,JSON 往往被拆在多个数据块里,直接逐块解析会遇到意外 EOF、转义字符断开和重复提交。本文用 Go 写一个小型增量缓冲器,展示如何拼接、解析、去重并验证完整参数。497 收藏
-
提示词一改,AI 回答可能变好,也可能让旧场景退化。本文从一次改提示词后回答跑偏的现场开始,带你搭建小样本集、评分规则、前后对比和人工复核流程,让提示词上线前有据可查。475 收藏
-
模型换版本后,先别只看几条手工对话。本文用 Go 从零做一个轻量 AI 评测样本 CLI,校验 JSONL 字段、按固定种子抽样,并把命中规则与通过率写成可复查的报告。472 收藏
-
Gemini 3.7 Flash 发布后,团队不该只看榜单分数。本文把代码调试、Agent 工具调用和输入输出成本拆成可复现的检查项,帮助开发团队判断它适合试验、灰度还是继续使用现有模型。471 收藏
-
RAG 应用答错时,不要只怪模型。更常见的根因在检索层:切片不合适、召回证据偏题、排序没过滤、回答没有引用约束。复盘时要把用户问题、检索结果、证据片段、模型回答和评测样本串起来,才能真正防复发。468 收藏
-
把 AI 接口从普通聊天模型切到推理模型时,max_tokens 不是简单改个字段名。本文从请求兼容、推理 token 预算、截断判断和回滚核对四个方面,给出一套可复用的迁移检查方法。464 收藏
-
AI Agent 一轮工具调用可能已经改写库存、发送通知,却在最后一步返回超时。本文用订单履约场景拆开部分成功的状态记录、补偿动作和安全重试边界,给出可落地的验收清单。460 收藏
-
GPT-5.6 Sol、Terra、Luna 面向不同任务能力层级。本文用任务分桶、格式命中率、尾延迟和回退日志搭建一套可复查的 A/B 验收方法,帮助团队判断模型差异是否值得进入生产路由。458 收藏
-
本文用代入式排查方式讲解 RAG 知识库明明有资料却答不上来的常见原因:分块过大、元数据缺失、召回偏离和排序不准,并给出重切分、混合召回、结果重排和引用验证流程。453 收藏
-
用一个最小前端配方实现 AI 聊天流式输出,覆盖 Fetch Stream 读取、TextDecoder 解码、逐段渲染、AbortController 中断和 SSE 变体选择。448 收藏
-
科技周边 · 人工智能 | 2个月前 | 安全 · oauth · 人工智能 · mcp · 工具调用 · MCP 401 MCP 403 MCP OAuth mcp resource_metadata MCP scope MCP token audience远程 MCP 服务的工具调用返回 401 或 403,通常不是模型没有找到工具,而是授权发现、scope 或 token audience 没有和目标 MCP 资源对齐。本文按响应状态、WWW-Authenticate、Protected Resource Metadata 和 resource 参数逐步定位,并给出最小核对清单。443 收藏
-
引言:随着业务的发展,模型应用场景的增加,AI 工程化落地成为了不少企业面对的切实挑战。近几年,应对这个痛点的新概念——MLOps 逐渐成为了机器学习领域的热门话题。OpenMLDB 提供FeatureOp442 收藏