人工智能技术文章
-
AI 流式回答在移动网络或代理切换时可能中途断开。本文用 SSE 的事件 ID、重连窗口和客户端游标,拆解如何续接未完成内容、避免重复片段,并给出可验收的状态与日志设计。231 收藏 -
AI 接口遇到 504 不能简单重复提交。本文用 OpenAI 的 X-Client-Request-Id 和 Gemini API 的指数退避建议,拆解请求标识、可重试错误、结果去重与人工复核的完整工作流。229 收藏 -
超长视频不能只靠一次请求和一段摘要解决。本文以长视频检索为例,拆解分段抽帧、时间轴索引、候选片段复核和证据回溯的工程流程,并给出可验收的结果格式。229 收藏 -
更换 Embedding 模型后,旧向量与新向量的维度可能不一致,直接覆盖索引会让写入、查询和回滚同时失控。本文以双索引迁移为主线,拆解维度核对、查询路由、后台回填和回滚验收。229 收藏 -
Embedding 模型切换后,向量维度、距离度量和索引构建参数可能同时变化,旧索引不能靠改字段继续复用。本文用 pgvector 的 vector(1536)、vector(3072) 与 HNSW 示例,给出双写迁移、验收和可回滚方案。222 收藏 -
大模型流式响应偶尔重复半句,通常不是模型把同一句生成了两遍,而是客户端重复消费增量块、混淆事件边界或把结束事件再次当成正文。本文从流式传输、UTF-8 解码和结束标记三个边界拆开排查方法。222 收藏 -
MCP 服务端不能看到客户端声明了 elicitation 就直接发送任意模式。本文按初始化能力、form 与 url 分支、请求结果和失败回退,说明如何核对客户端支持范围并守住敏感信息边界。221 收藏 -
多模态模型处理长截图或复杂表格时,整图输入常把小字号和列关系一起压缩掉。本文用区域裁剪、坐标记录和字段映射三步,搭建一套可复核的表格识别流程,避免只看最终文本猜错位置。221 收藏 -
批量推理输入长度差异大时,固定 batch 会产生大量 padding。本文用 Hugging Face Transformers、PyTorch DataLoader 和 token 长度分桶说明配置方式,并给出显存、吞吐和结果顺序的排查清单。221 收藏 -
用 Moderations API 的 flagged、categories 和 category_scores 区分规则命中与业务误报,再把审核结果分成放行、人工复核和拒绝三条路径。218 收藏 -
科技周边 · 人工智能 | 1个月前 | 人工智能 · sse · 流式输出 · 接口稳定性 · 重试 · SSE 断线重连 Responses API AI流式输出 sequence_number 重复片段
AI 流式输出遇到网络断开时,不能简单重试并把新片段直接拼到旧文本后面。本文从 SSE 事件序号入手,给出事件落盘、断点重放、重复片段去重和最终状态核对的最小实现。217 收藏 -
中文输入法候选词还没确认时,AI 聊天框把回车当成发送,会截断用户正在输入的句子。本文用 compositionstart、compositionend 和 InputEvent.isComposing 组合出稳定的回车发送规则,并补上移动端、粘贴和可访问性检查。217 收藏 -
用 Go 封装 Ollama 本地 API 健康检查:先确认服务版本,再核对模型清单,最后用短请求验证生成能力,并处理连接超时、模型未安装和常驻内存边界。216 收藏 -
Model Hardware Standard 把可编程设备的状态、操作和安全限制整理为代理可理解的驱动层。本文从 MHS 研究预览与官方站点出发,拆解接入前应保留的权限、确认和人工复核边界。216 收藏 -
AI 问答评测不稳定,通常不是模型分数本身的问题,而是提示、检索配置和数据集同时在变化。本文给出一套可重复的 RAG 评测拆分、数据字段和回归清单。215 收藏