Go语言技术文章
-
RAG 不是把检索结果越多越好。长文档切块过粗、候选混杂或没有在重排后裁剪上下文,模型就会被无关段落淹没。本文用 Go 拆开分块元数据、dense 与 sparse 候选、重排 top 10 和上下文预算,给出可回放的验收路径。312 收藏 -
同一批文档、相近的问题,向量检索却可能召回不同结果。本文从查询向量归一化、元数据过滤和评测样本三个边界入手,给出一个能复现波动、定位原因并验证修复的最小流程。311 收藏 -
RAG 处理 PDF、Excel 或 Markdown 表格时,固定长度切片容易丢失表头和来源。本文用行级知识块、metadata 和检索组合保留表格关系。311 收藏 -
Go 官方在 2026 年 5 月发布 pkg.go.dev API,提供查询模块、包、版本、符号和漏洞元数据的 GET 接口。本文用 v1beta 做一个小型依赖索引实验,处理路径编码、版本参数、歧义模块和失败重试边界。310 收藏 -
AI 应用调用搜索、数据库或业务接口时,超时不只是返回一条错误消息。本文用 Go context 把截止时间、取消信号、工具结果和用户状态串成一条可验收的链路,说明何时停止、如何记录以及怎样避免重复执行。310 收藏 -
AI 接口要求返回 JSON,却偶发多字、缺字段或类型不一致。本文从问题现场出发,按提示词、Schema、模型返回、解析层和兜底策略逐步定位,给出更稳的结构化输出落地流程。309 收藏 -
Hugging Face Inference Providers 可以让同一套客户端接入多个推理服务。本文从 provider=auto 的默认路由开始,说明何时固定具体 provider、如何设计 fallback、如何记录实际路由和响应字段,避免模型可用但结果格式悄悄变化。309 收藏 -
RAG 系统检索到了相关资料却仍然答非所问,通常不是模型单点失误。本文用一个可复现的小实验,依次检查召回内容、切片边界、排序分数和上下文拼接,最后给出可回归的验证方法。309 收藏 -
RAG 的 chunk overlap 不是越大越好。本文从标题层级切片、token 上限和检索命中三个可测边界出发,给出一套可复现的初始参数、验证方法和调整顺序。309 收藏 -
GitHub Copilot coding agent 能完成编码、运行测试并创建拉取请求,但绿色 CI 不等于需求、安全和架构都正确。本文用一个可执行的 draft PR 审查闭环说明为什么人工复核仍是合并前的必需环节。309 收藏 -
本地视觉模型服务最容易被忽略的问题,不是单次推理慢,而是上传任务无限排队。本文用 Python asyncio.Queue(maxsize=2) 建立背压,让生产者在队列满时等待,并用 inference_mode、task_done 和显存检查验证流水线是否真的稳定。308 收藏 -
AI Agent 工具调用失败时,不要无条件重放模型请求。本文用统一错误信封、错误码分层、原始 call_id 回传和有限重试预算,让模型只重试可修复问题,并避免副作用重复执行。307 收藏 -
MCP 2026-07-28 无状态改造移除了协议层会话,但业务状态仍需显式保存。文章用 basket_id、Mcp-Method、ttlMs、cacheScope 与 Trace Context 梳理迁移边界。305 收藏 -
Go 接入 Responses API 图片理解时,最容易踩到的不是模型参数,而是 MIME 类型、Base64 体积和失败回退没有在客户端先处理。本文用一个图片质检接口说明如何预检文件、估算请求大小、设置超时,并把失败结果安全地送入人工队列。303 收藏 -
GitHub Actions 新增 cache-mode 后,可用 read、write、write-only、none 四种模式细化缓存权限。本文说明低信任触发器、job 覆盖和 reusable workflow 的配置边界。301 收藏