Go语言技术文章
-
CNCF 2026 年云原生研究显示,开发团队关注点正从单纯使用 Kubernetes 转向平台标准化、应用交付、安全策略和可观测性。本文把报告信号整理成可落地的交付检查清单,帮助团队判断下一步先补哪一层能力。423 收藏 -
Prompt 缓存命中率下降时,先比较最终渲染前缀而不是源模板。本文用 cached_tokens、prefix hash、模型设置和动态字段边界给出一套可复查的排查方法。487 收藏 -
Python 3.15 candidate 2 的正式版本名是 3.15.0rc2。本文按构建、ABI、运行回归和 wheel 发布四层,说明 C 扩展作者现在应先测什么,以及 abi3、abi3t 和版本专用包如何取舍。479 收藏 -
模型输出 JSON 偶尔带有 Markdown 围栏时,先判断拒答和截断状态,再只清理首尾围栏,最后用 encoding/json 解码并执行字段级业务校验。398 收藏 -
Redis 8.8 的 XNACK 让 Streams 消费者可以显式释放待处理消息。本文结合 SILENT、FAIL、FATAL 三种语义,说明它对事件驱动应用恢复、重试计数和死信路由的影响。348 收藏 -
多模态模型的图片成本不只取决于文件大小,还取决于处理器如何把像素切成视觉 token。本文以 Hugging Face Transformers 的 processor 为参照,说明服务端怎样读取 min_pixels、max_pixels,按像素预算等比例缩放,再决定压缩、裁剪和监控字段。259 收藏 -
Redis Iris 将 Agent 记忆放在模型之外的上下文层,用于统一承载短期对话、长期偏好、实时业务状态和权限治理。本文拆解模型层与上下文层的边界,并给出企业上线前的检查清单。147 收藏 -
Embedding 模型更换后,旧文档向量与新查询向量可能不在同一个向量空间;即使维度相同,语义方向、归一化和提示词约定也可能不同。本文给出双写、全量回填、离线验收、别名切换和回滚方案。259 收藏 -
GPT-6 Astra 的重点不只是模型更强,而是把长任务控制带进 Responses API:异步工具调用、中途引导和会话中调整推理强度,让开发者能把等待、变更和任务难度纳入同一条工作流。319 收藏 -
本地大模型量化后变慢,不一定是量化本身造成的。本文用显存峰值、首 token 延迟、生成 token/s 和上下文长度的对照实验,区分权重显存压力与 KV Cache 上下文瓶颈,并比较 4/8 bit、缓存卸载和量化缓存的选择。433 收藏 -
Go 1.27 将 goroutineleak profile 正式带入 runtime/pprof,并提供 HTTP 端点。本文解释它能识别哪些无法唤醒的阻塞协程、适合哪些服务排查,以及为什么结果仍需回到所有权和取消路径确认。105 收藏 -
AI Agent 工具调用失败时,不要无条件重放模型请求。本文用统一错误信封、错误码分层、原始 call_id 回传和有限重试预算,让模型只重试可修复问题,并避免副作用重复执行。307 收藏 -
Go 1.27 支持具体类型的方法声明自己的类型参数,但接口方法仍不能声明泛型参数。本文用 List 的转换 API 拆解哪些旧函数值得改成 generic method,以及接口、反射和升级检查的边界。237 收藏 -
RAG 不应该把向量召回的所有片段直接塞进上下文。本文用 reranker 重排候选片段,再用 token 预算、单片段上限和来源去重装配最终上下文,给出可观测的参数与 Python 示例。281 收藏 -
Google 新加坡 2026 公告宣布向 AI Singapore 的 Project Aquarium 追加 100 万美元,改善东南亚数据集质量并推动开放源代码。本文区分公告事实与开发推断,说明模型、应用和企业数据团队如何核对语言覆盖、许可证、质量与评测条件。257 收藏