Go语言技术文章
-
AI 能调用工具不等于可以直接相信工具参数。本文用服务端重算权限、字段白名单、资源归属校验和拒绝用例,搭一套可验收的参数越权防线。178 收藏 -
RAG 系统不要只把文本片段交给模型。本文用 Go 设计带 source_id、标题和定位信息的检索结果接口,让生成答案可以回溯来源、处理空召回,并在调用失败时保留可验证的错误边界。178 收藏 -
LLM 流式输出不能只把增量文本放在浏览器内存里。本文用 generation_id、递增序号和持久化事件日志保存检查点,说明断线后如何回放缺失事件、避免重复写入,并区分传输恢复与模型重新生成。177 收藏 -
LLM评测集不要只放正常问答。更稳妥的做法是把样本分成正常任务、明确拒答和可澄清的边界请求,为每条记录期望行为、原因标签和替代方向,再按分片统计完成率、拒答准确率、澄清率与不必要拒答率。177 收藏 -
科技周边 · 人工智能 | 2星期前 | API · 人工智能 · agent · gemini · 工程实践 · agent 工具调用 Interactions API Gemini 3.7 Flash 任务验收
围绕 Gemini 3.7 Flash 的托管 Agent 任务,拆解多步执行、工具结果、sandbox 边界与最终状态验收,并给出 Go 侧可复用的状态检查代码。176 收藏 -
Anthropic Prompt Caching 的关键不在于盲目加 cache_control,而在于把断点放在稳定前缀末尾,再从 cache_creation_input_tokens 和 cache_read_input_tokens 核对是否真正命中。本文用 Python Messages API 示例说明断点、20 个区块回看窗口、TTL 与成本判断。176 收藏 -
Embedding 模型、维度或距离度量升级后,旧向量通常不能直接混用。本文说明如何判断空间兼容性,并用双写、后台回填、灰度评测和可回滚切换完成生产迁移。173 收藏 -
向量检索的分数阈值不能照抄一个固定数字。本文以 Go 的候选分层流程为例,说明如何先理解距离方向,再用 score_threshold、候选数量和低相关兜底共同控制 RAG 答案质量。172 收藏 -
AI 接口遇到 504 不能简单重复提交。本文用 OpenAI 的 X-Client-Request-Id 和 Gemini API 的指数退避建议,拆解请求标识、可重试错误、结果去重与人工复核的完整工作流。171 收藏 -
使用 Hugging Face TRL 做 LoRA 微调时,先把 instruction、input、output 等业务字段统一为 text、messages 或 prompt/completion,再分别排查聊天模板、损失目标和 target_modules 配置。171 收藏 -
从一个 AI Agent 把任务交给错误方向的案例出发,排查意图识别、边界规则、上下文摘要和结果复查四个环节,给出可落地的交接治理流程。170 收藏 -
RAG 知识库的切片不是越短越好。本文用一份带标题和代码块的技术文档说明切片长度、重叠窗口与语义边界如何共同影响召回证据,并给出可复现的调参流程、检查指标和常见误区。170 收藏 -
RAG 流程里,检索命中不等于可以直接交给模型。本文用来源分层、上下文拼接、引用保留和空结果分支,搭出一条可核对、可回退的回答链路。170 收藏 -
OpenAI Agents SDK 引入沙箱工作区、权限和快照后,开发者应把执行身份、文件权限、主机路径授权与外层审批拆开设计。本文给出一套可落地的权限分层与发布前检查清单。169 收藏 -
科技周边 · 业界新闻 | 2星期前 | 网络安全 · mcp · 开发者工具 · Cloudflare · AI 工程 · Cloudflare Gateway MCP 流量 experimental.is_mcp AI Security HTTP 策略
Cloudflare Gateway 新增 MCP 协议识别、experimental.is_mcp 策略选择器和 AI Security 报表。本文用一条最小验证路径拆开识别条件、阻断策略、报表核对与回滚边界。168 收藏