Go语言技术文章
-
科技周边 · 业界新闻 | 1天前 | vs code · AI编程 · 业界新闻 · 开发者工具 · Copilot Codex Claude 开发流程 VS Code AI代理 Agent Host 代理会话
VS Code 正把代理会话、执行框架、工具调用和变更审查放进统一编辑体验。本文依据官方资料解读 Chat view、Agents window 与 Agent Host 的关系,以及团队试用时的流程和安全边界。478 收藏 -
科技周边 · 人工智能 | 18小时前 | 缓存 · 人工智能 · 提示词工程 · 提示词缓存 cache_control Prompt Caching 静态前缀 cache_read_input_tokens
提示词缓存命中率低时,先把工具定义、系统规则和稳定上下文划为前缀,把时间戳、用户问题和检索结果留在后缀,再用 usage 字段判断断点、TTL、长度门槛和并发时序问题。453 收藏 -
语义检索是否需要第二阶段重排,关键不在模型更强,而在第一阶段已能召回正确文档、前排仍错序且业务能承担额外时延。本文用 Recall@K、NDCG/MRR、P95 和单次成本给出决策与实现方法。449 收藏 -
RAG 的 chunk_overlap 过大,会让相邻分块产生高度相似的向量,top-k 被同一来源的重复内容占满。本文从切分边界、候选池、去重和 MMR 重排四个方面给出可回归的调整方法。409 收藏 -
LoRA 合并后输出变化很大,先不要盲目重训。本文从基础模型、适配器缩放、量化与 dtype、推理随机性和 tokenizer 五层排查,并给出确定性对照代码与回归清单。404 收藏 -
连续批处理会在每轮推理后移出已完成请求并补入新请求,减少批次槽位浪费;调优还需同时约束 Token 预算、KV Cache 与延迟。404 收藏 -
科技周边 · 业界新闻 | 2天前 | 开发工具 · google · ai agent · 智能体 WebMCP Google I/O 2026 Antigravity Managed Agents
Google I/O 2026 的重点不只是新模型,而是把模型、Agent Harness、工具接口、隔离执行和生成式界面连成可落地的开发链路。本文区分官方事实与趋势推断,给出团队试点时的边界。385 收藏 -
Redis 发布官方 FastAPI 集成 SDK 后,Python 项目可以用应用生命周期与依赖注入统一管理连接、HTTP 缓存和分布式限流。本文给出版本边界、最小接入、缓存失效与排查路径。385 收藏 -
静态量化的校准集不能只随机抽训练样本。本文从线上预处理、来源领域、长度形状、常见分布和关键长尾建立覆盖矩阵,并说明如何用独立评估与漂移监控判断校准是否可靠。372 收藏 -
时间切分不能证明评测集绝对无污染,但能用训练截止时间、样本最早来源时间、冻结时间和评测时间建立可审计边界。本文给出三桶切分、重复检测、检索隔离、分窗报告与滚动换题方案。356 收藏 -
Claude Opus 5.5 的价值不只在基准分数,而在复杂编码、长链路 Agent 和知识工作中的效率。本文结合 Anthropic 对 Opus、Sonnet、Haiku 三档模型的定位,给出按任务边界、调用频率和成本做选择的实用判断。321 收藏 -
pkg.go.dev 开放官方 API 后,Go 包、模块、版本和符号信息可以通过 JSON 直接查询。本文用实际 curl 示例说明目录、搜索和升级辅助的接入方式,并梳理路径歧义、分页、限流与 beta 版本边界。319 收藏 -
从标题路径、递归切分、token 上限和召回聚合四个环节,说明 RAG 如何减少断章与误召回。300 收藏 -
混合召回应让关键词与向量检索并行产生候选,再用 RRF 等可解释方法合并名次,而不是直接相加不同量纲的原始分数。本文给出实现骨架、参数选择、过滤边界与评估方法。293 收藏 -
智能体一次任务答对,不代表执行过程可靠。本文用一个可落地的评测表,把最终结果、工具轨迹、成本、延迟和失败恢复拆开衡量,并给出规则评分与版本对比方法。290 收藏