Go语言技术文章
-
看云原生调查报告时,比例数字必须连同样本、筛选条件和问题分母一起读。以 CNCF 2025 年度调查为例,拆解调查比例、条件比例与全行业采用率的区别。484 收藏 -
RAG 检索结果重复时,先按 source_id 做同来源去重,再保留 chunk_id、最高分和冲突标记形成证据组,避免重复上下文和来源误合并。484 收藏 -
本地模型选 4-bit 还是 8-bit,不能只看显存节省。本文用统一基线、固定输入和实际测量比较显存、吞吐、延迟与精度风险,并给出 Transformers 加载示例和部署决策表。481 收藏 -
LLM 输出 JSON 不稳定时,不能只靠提示词要求“返回 JSON”。本文用一个工单分类小项目拆解解析、JSON Schema 校验、错误分类和有限重试,并说明为什么业务失败不该混入格式重试。480 收藏 -
Python 3.15 candidate 2 的正式版本名是 3.15.0rc2。本文按构建、ABI、运行回归和 wheel 发布四层,说明 C 扩展作者现在应先测什么,以及 abi3、abi3t 和版本专用包如何取舍。479 收藏 -
模型服务的批处理不是把 batch size 调大就结束。本文用 Triton 动态批处理和 TGI 连续批处理说明如何设置排队等待上限、批量或令牌预算,并用队列长度、prefill/decode 时长与端到端 p95 验证吞吐收益。479 收藏 -
torch.compile 出现 graph break 时,先用 fullgraph=True 暴露首个断点,再用 torch._dynamo.explain 和 TORCH_LOGS 分析原因,最后决定重写、隔离还是保留。478 收藏 -
Reranker 分数不是通用的相关性刻度。本文从分数归一化、候选集标注、分层阈值和 top-k 兜底四个方面,说明如何减少相关答案被过滤的问题。477 收藏 -
避免 Chat Template 角色格式不一致的关键,是让训练、评测和推理共享同一份 role/content 消息契约,并统一交给 tokenizer.apply_chat_template 序列化。本文给出参数区别、重复特殊 token 的规避方法和集中封装示例。477 收藏 -
Redis 8.8 的 array 适合按数字索引访问、稀疏位置写入、滑动窗口和范围聚合。本文用 ARSET、ARGET、ARRING 等命令说明它与 List、Hash、Stream 的选择边界。475 收藏 -
多智能体系统出错时,单看模型调用或 HTTP 状态往往找不到根因。本文从一次用户任务出发,拆解 agent 委派、交接、工具调用和记忆读写的追踪边界,给出可回放的链路设计与检查清单。474 收藏 -
分类评测集不均衡时,macro 与 micro 不是谁更高级的问题,而是按类别平均还是按样本汇总。本文用统一口径、混淆矩阵和复核清单解释两者差异。473 收藏 -
开源项目毕业是重要的外部成熟度信号,但不是企业上线批准。本文给出双重证据门模式和六维清单,帮助团队评估业务适配、运行可靠性、安全供应链、升级退出与风险归属。471 收藏 -
科技周边 · 人工智能 | 1天前 | python · 人工智能 · shuffle Hugging Face Datasets streaming IterableDataset buffer_size
Hugging Face Datasets 的 streaming 模式可用 IterableDataset.shuffle 在有限缓冲区内随机采样,无需下载完整数据集。本文说明 buffer_size、seed、set_epoch、分片顺序以及 take/skip 的调用边界。470 收藏 -
RAG 重排不要用同一个 TopK 同时控制召回和上下文。本文给出 candidate_k 与 final_top_k 的起始范围、三组评估指标、调参顺序和可直接落地的 Python 示例。468 收藏