Go语言技术文章
-
用 Qdrant payload 保存 tenant_id 和 doc_type,通过 must 组合租户与文档类型过滤条件,并为高频字段建立 payload index,让向量检索先守住知识库权限边界。473 收藏 -
Embedding 模型切换时,旧向量不能只看维度是否相同。本文从维度、语义空间和索引元数据三个层面说明混用风险,并给出重嵌入、建新索引和灰度切换的迁移做法。473 收藏 -
分类评测集不均衡时,macro 与 micro 不是谁更高级的问题,而是按类别平均还是按样本汇总。本文用统一口径、混淆矩阵和复核清单解释两者差异。473 收藏 -
模型换版本后,先别只看几条手工对话。本文用 Go 从零做一个轻量 AI 评测样本 CLI,校验 JSONL 字段、按固定种子抽样,并把命中规则与通过率写成可复查的报告。472 收藏 -
用 TextIteratorStreamer 接收 Transformers 的增量文本,再通过 FastAPI SSE 传给浏览器,完成一个可处理异常和断开的流式生成接口。472 收藏 -
科技周边 · 业界新闻 | 1个月前 | pprof · 性能排查 · 业界新闻 · Go 1.26 · goroutine泄漏 Go 1.26 goroutineleak runtime/pprof 生产诊断
Go 1.26 把实验性的 goroutineleak 画像放进 runtime/pprof,用来发现长期存活的 goroutine。本文结合官方发布信息和最小服务实验,说明它能解决什么问题、如何验证结果,以及为什么不应把实验性画像直接当成生产告警。471 收藏 -
Gemini 3.7 Flash 发布后,团队不该只看榜单分数。本文把代码调试、Agent 工具调用和输入输出成本拆成可复现的检查项,帮助开发团队判断它适合试验、灰度还是继续使用现有模型。471 收藏 -
Python 3.15 的免费线程构建适合进入隔离环境做生产评估,但不能只看多线程吞吐。团队还要核对 C 扩展是否重新启用 GIL、单线程回退、内存开销、数据竞争和明确的退出条件。471 收藏 -
Atlassian Forge Container Services 新增 Web Trigger 生命周期 REST API。本文按创建、查询、删除和鉴权边界拆开这次变化,说明容器化应用接入时应先改哪里、怎样验证回收是否生效。470 收藏 -
大模型回答出现整段重复时,不要只把 temperature 调高。本文按请求参数、采样范围和停止条件拆开排查,给出一个可复现的参数核对流程,并说明哪些现象属于模型能力边界,哪些是客户端拼接造成的。470 收藏 -
Google 发布 Gemma 4 QAT 检查点后,模型选择不只是看参数量。本文从 Q4_0 权重格式、内存预算、LiteRT-LM 与 Transformers.js 部署路径拆解适用场景,并给出上线前的验收清单。469 收藏 -
Chrome 152 引入 Connection Allowlists,用 Connection-Allowlist 响应头把网页和 Web Worker 的外连目标收紧到明确的 URL 模式。本文从一个第三方脚本可能外发数据的场景切入,拆解最小配置、DevTools 验证、与 CSP 的边界以及上线前的回退检查。469 收藏 -
复盘 Google Cloud 6 月印度网络延迟事件,梳理官方时间线、影响范围、证据判断、业务侧应急动作和恢复后的反向验证清单。468 收藏 -
RAG 应用答错时,不要只怪模型。更常见的根因在检索层:切片不合适、召回证据偏题、排序没过滤、回答没有引用约束。复盘时要把用户问题、检索结果、证据片段、模型回答和评测样本串起来,才能真正防复发。468 收藏 -
Node.js 26.5.0 新增 Blob.textStream(),返回可读流。本文从 Blob 文本读取场景出发,对比 text()、stream() 和 textStream(),给出逐块处理、编码边界与版本核对方法。468 收藏