Go语言技术文章
-
RAG 不应该把向量召回的所有片段直接塞进上下文。本文用 reranker 重排候选片段,再用 token 预算、单片段上限和来源去重装配最终上下文,给出可观测的参数与 Python 示例。281 收藏 -
Google 新加坡 2026 公告宣布向 AI Singapore 的 Project Aquarium 追加 100 万美元,改善东南亚数据集质量并推动开放源代码。本文区分公告事实与开发推断,说明模型、应用和企业数据团队如何核对语言覆盖、许可证、质量与评测条件。257 收藏 -
AI 推理服务的 p95、p99 延迟突然抖动时,不要只看 GPU 利用率。本文用请求、排队、输入处理、模型计算和输出处理的分段指标,结合并发与吞吐变化,判断瓶颈究竟在调度排队还是模型计算。462 收藏 -
IBM 与 Google Cloud 2026 年 6 月宣布新的 Google Cloud Practice。合作重点不在发布新基础模型,而在把行业经验、AI 交付资产、数据连接、Agent Runtime、治理与观测能力串成企业 AI 的生产化流程。289 收藏 -
PDF 图表检索失败时,先区分抽取、模态 embedding、向量集合和视觉重排四层。本文用固定回归样本和配置检查,定位图表到底在哪一层丢失。132 收藏 -
IBM 在 Think 2026 公布的 Concert 平台,重点不是替换现有监控工具,而是把应用、基础设施、网络和安全信号放到共享运维层中,辅助团队从发现问题走到审批后的行动。本文拆解其模块、AI 工作流和渐进式试点边界。486 收藏 -
PDF 表格在 RAG 中不能只靠正文抽取。本文用摄取、元素表示和检索核对三层方法,说明如何保留表格结构、图片与页码元数据。244 收藏 -
Google 与 Apple 的合作首先改变的是 Apple Foundation Models 的模型底座和云端承载方式,并不等于现有开发者 API 已经改名。本文按接口层、运行边界和 Siri 集成面梳理当前影响。408 收藏 -
AI 问答评测不稳定,通常不是模型分数本身的问题,而是提示、检索配置和数据集同时在变化。本文给出一套可重复的 RAG 评测拆分、数据字段和回归清单。215 收藏 -
GitHub Copilot Business 和 Enterprise 的 GA 模型默认启用策略已经生效。本文拆解未配置模型、显式设置、企业与组织继承关系,以及管理员在开发效率和治理要求之间如何做一张可复查的模型准入清单。277 收藏 -
RAG 评测不要只看一个总分。本文用固定 JSONL 样本,把检索上下文覆盖率与最终答案正确率拆开统计,并用指标组合定位检索、生成和数据集问题。293 收藏 -
GitHub Copilot 将 app 与云端 Agent 纳入企业托管设置支持范围,本文拆解插件、市场、模型默认值与审批绕过控制的边界,并给出低风险验证方式。106 收藏 -
AI Agent 调用外部工具超时后,不要把异常当空结果或无条件重试。通过 schema、参数校验、幂等键、未知状态和恢复队列,设计可判断、可追踪、可继续处理的结果。203 收藏 -
GitHub Copilot App 现在拥有独立客户端策略,企业和组织管理员可在 AI Controls 的 Copilot Clients 中单独控制访问,并按治理范围选择三种策略状态。246 收藏 -
AI Agent 调用工具时经常漏传必填字段,问题通常不在提示词,而在工具契约没有收紧。本文用 JSON Schema 拆分必填、类型、额外字段和失败回传,给出可落地的校验与重试边界。316 收藏