Go语言技术文章
-
分布式 AI 训练把云原生平台的设计单元从单个 Pod 推向完整工作负载:GPU 调度、网络拓扑、共享存储、性能就绪和多租户治理必须协同。本文解释变化原因与演进路径。200 收藏 -
把开源项目安全响应拆成修复交付、公开披露和下游通知三个节点,结合协调披露、分阶段披露与紧急带外响应,说明每个节点的产物、完成条件和常见误区。199 收藏 -
通过稳定前缀、动态变量和缓存观测三层拆分,整理 Prompt cache 的命中条件、请求排列方式与 cached_tokens 排查清单。199 收藏 -
Kubernetes v1.37 将 WatchCache 初始化与恢复时的请求洪峰处理得更稳:理解 API Server 如何限制回源、客户端为何必须处理 HTTP 429,以及升级后怎样验证控制面恢复。198 收藏 -
多模态 RAG 能检索到图片,却在回答里漏掉关键上下文,通常不是模型单点失效,而是 OCR、图文切片、向量检索和引用回链之间有一段断了。本文按证据顺序定位并修复这类问题。197 收藏 -
流式调用工具时,参数 JSON 会被拆成多个增量事件,不能把每个片段直接解析。本文用 buffer、JSON.parse 和状态恢复拆开半包边界,给出失败重试与重复调用的防线。197 收藏 -
Gradio 长任务不要只等函数返回:用生成器 yield 阶段状态,用 gr.Progress 显示进度,再用 cancels 连接停止按钮,同时明确 UI 取消与外部作业停止的边界。197 收藏 -
即使接口启用了严格 JSON Schema,Go 服务仍要检查拒答、截断和字段值语义。本文用一个可运行的校验边界示例,拆开模型响应、json.Unmarshal 和业务校验各自该负责什么。195 收藏 -
科技周边 · 人工智能 | 1个月前 | 安全 · mcp · ai agent · MCP ToolAnnotations readOnlyHint destructiveHint idempotentHint
MCP ToolAnnotations 能帮助客户端理解工具是否只读、是否可能破坏环境、重复调用是否幂等以及是否访问开放世界,但四个 Hint 只是行为提示而非权限系统。本文给出从服务端声明、状态实测到客户端拦截的上线核对清单。195 收藏 -
AI 应用不应把模型内部推理链直接展示给用户,但可以通过 Responses API 的 reasoning summary 提供简洁的过程摘要。本文用 Python 示例说明配置方式、摘要与最终答案的区别、展示边界和上线核对项。195 收藏 -
AI 应用调用搜索、数据库或业务接口时,超时不等于任务失败,更不能无条件重跑。本文用一个可验证的小实验拆开幂等键、部分结果、重试边界和人工接管,给出能落地的调用状态设计。195 收藏 -
etcd v3.7 引入 RangeStream 后,List 请求应按结果规模、排序与 revision 过滤、gRPC proxy 依赖和灰度指标评估,避免盲目替换普通 Range。195 收藏 -
流式 AI 输出不应在最后一段文字到达时直接入库。本文用 finish_reason、状态机和幂等键说明何时保存正式结果,何时保留 partial 草稿或等待工具调用。195 收藏 -
科技周边 · 业界新闻 | 2天前 | 云原生 · kubernetes · 业界新闻 · Kubernetes 1.35 Pod重启 restartPolicy restartPolicyRules RestartAllContainers
Kubernetes 1.35 把容器级重启规则推进到 Beta,并提供 Alpha 的原地全容器重启能力。本文用 Pod UID、IP 与 restartCount 区分容器重启、Pod 重建、滚动更新和原地重启,整理常见误解与核对方法。195 收藏 -
面对 GitHub Changelog,不要只看标题判断风险。本文用触发器、权限、运行器三层筛选法,结合 Actions 的近期变更说明如何定位真正会影响生产流水线的公告。194 收藏