人工智能技术文章
-
多轮对话变长后,简单截掉旧消息很容易让模型丢失用户约束。本文从上下文压缩的边界出发,拆解摘要漂移、关键事实遗漏和回放验收,用可重复的测试样例判断压缩是否真的可用。418 收藏 -
AI 流式回答在移动网络或代理切换时可能中途断开。本文用 SSE 的事件 ID、重连窗口和客户端游标,拆解如何续接未完成内容、避免重复片段,并给出可验收的状态与日志设计。231 收藏 -
Embedding 模型升级或调整 dimensions 后,旧向量、查询向量和数据库索引可能不再兼容。本文用维度契约、双写灰度和检索验收三步,说明如何安全迁移并避免静默召回下降。313 收藏 -
从首字延迟 TTFT、分段间隔和客户端断线三个信号入手,搭建大模型流式输出的观测口径,并给出 Go 服务端记录与回放验收方法。466 收藏 -
同一个模型请求失败,并不代表应该立刻换到下一个模型。本文按超时、限流、服务异常和内容拒答拆开处理,给出路由状态、重试边界、降级策略与可验收的实现路径。398 收藏 -
MCP 工具返回长列表时,分页协议会直接影响 Agent 是否拿到完整且不重复的结果。本文从游标失效、排序稳定性和增量验收三个问题出发,给出可落地的返回字段与测试方法。269 收藏 -
AI Agent 一轮工具调用可能已经改写库存、发送通知,却在最后一步返回超时。本文用订单履约场景拆开部分成功的状态记录、补偿动作和安全重试边界,给出可落地的验收清单。460 收藏 -
科技周边 · 人工智能 | 1星期前 | 人工智能 · gemini · function calling · 结构化输出 · 接口测试 · 结构化输出 JSON Schema Gemini 3 Function Calling 工具调用验收
Gemini 3 的工具调用和结构化输出解决的是两个不同阶段的问题:前者负责取得外部结果,后者约束最终回答。本文用订单查询场景拆开两段协议,给出 schema、工具结果、拒答和失败分支的验收方法。346 收藏 -
合同中的金额、日期和付款条件经常藏在跨页表格里。本文以多模态模型抽取合同表格为例,拆解版面切片、字段约束、来源定位和人工复核,给出一套可回放的验收流程。289 收藏 -
超长视频不能只靠一次请求和一段摘要解决。本文以长视频检索为例,拆解分段抽帧、时间轴索引、候选片段复核和证据回溯的工程流程,并给出可验收的结果格式。229 收藏 -
RAG 知识库更新后仍返回旧答案,通常不是模型突然失忆,而是旧分片仍能被召回。本文用文档版本、元数据过滤和固定问题集建立一条可验收的更新流程,覆盖发布、回滚和灰度边界。104 收藏 -
多模态知识库接入图片后,成本和延迟往往不是由文件大小单独决定。本文从图片任务、detail 级别、裁剪策略和上下文预算四个维度,给出可执行的输入分层与验收方法。394 收藏 -
AI 图片里出现多余文字,通常不是把否定词堆得更多就能解决。本文从画面目的、文字约束、分步修改和交付验收四个环节,给出一套可复用的排查方法。113 收藏 -
科技周边 · 人工智能 | 1星期前 | 人工智能 · openai · 兼容性 · Chat Completions · 推理模型 · token预算 AI推理模型 max_tokens max_completion_tokens 参数迁移
把 AI 接口从普通聊天模型切到推理模型时,max_tokens 不是简单改个字段名。本文从请求兼容、推理 token 预算、截断判断和回滚核对四个方面,给出一套可复用的迁移检查方法。464 收藏 -
RAG 应用里,回答看似有引用却指错段落,往往不是模型单独出错,而是切块编号、索引元数据和原文版本没有保持同一条链路。本文用文档快照、chunk_id 和回答后验校验,搭一套可定位、可回归的引用验收方法。148 收藏