人工智能技术文章
-
AI 评测集不要只放标准答案。把应答、应拒答和边界样本分开,记录 expected_action、拒答理由、人工标注和安全替代建议,再分别计算准确率、漏拒答率与拒答帮助度。385 收藏 -
用 HF_HUB_CACHE 或 HF_HOME 把 Hugging Face 模型缓存放到指定磁盘,再用 snapshot_download 提前准备文件,结合 HF_HUB_OFFLINE=1 与 local_files_only=True 完成无网加载。384 收藏 -
科技周边 · 人工智能 | 2个月前 | 人工智能 · mcp · ai agent · 工具接入 · 安全审计 · AI Agent MCP Model Context Protocol 工具清单 资源上下文 权限审计
本文从工程落地角度讲解 MCP 服务接入流程:先定义工具清单和资源上下文,再把输入校验、权限边界、限流保护、人工确认和审计日志前置,帮助 AI Agent 更稳地连接业务系统。378 收藏 -
科技周边 · 人工智能 | 2星期前 | 人工智能 · openai · 工程实践 · 流式输出 · Responses API · SSE 断线重连 Responses API AI流式输出 事件游标
AI 流式输出断线后不要直接重发请求。本文以 OpenAI Responses API 的 SSE 事件为例,说明如何保存 response_id、sequence_number 和已展示片段,重连后消除重复内容,并用最终状态完成一次可审计的收尾。377 收藏 -
一个 AI 应用把危险请求挡住是安全表现,把正常请求误判为风险则是业务失败。本文用一组可回放的测试样本拆分安全拒答、过度拒答、正常通过和非安全业务错误,说明如何设计标签、计算指标并在上线前复核。377 收藏 -
科技周边 · 人工智能 | 1星期前 | Gemini API · AI检索 · File Search · 多模态检索 Gemini File Search media_id page_number
Gemini File Search 支持图片检索后,引用记录不能只保存回答文本。本文拆开 media_id、page_number 与 file_citation 的职责,给出一套可复查的多模态引用记录方法。377 收藏 -
Gemini Interactions API 迁移真正容易漏的是验收:steps 顺序、函数调用、服务端工具、无状态历史、response_format 和 SSE 事件都要分别断言。本文给出 REST 与 SDK 迁移后的 6 类检查。376 收藏 -
科技周边 · 人工智能 | 3星期前 | 人工智能 · transformers · Hugging Face · 文本生成 · 模型评估 · Hugging Face Transformers generate output_scores compute_transition_scores 长度惩罚 生成概率
Transformers 的 generate 默认只返回生成序列,不会直接给出每个 token 的分数。本文用 return_dict_in_generate、output_scores 和 compute_transition_scores 还原逐 token 对数概率,并说明 decoder-only 输入长度、beam search 和 length_penalty 的验收边界。374 收藏 -
Gemini Developer API 的零数据留存不是只设置一个 store=false:Interactions、File API、显式缓存、隐式缓存和 Live API 的保留边界不同。本文用一张核对表和最小请求示例说明如何逐项关闭或清理状态。374 收藏 -
多租户 AI 知识库最危险的故障不是检索变慢,而是把 A 租户的片段、缓存或引用带给 B 租户。本文从检索权限、缓存键、引用回显和审计证据四条线,拆解一套可验证的隔离方案。369 收藏 -
科技周边 · 人工智能 | 1个月前 | API · go · 人工智能 · 工程实践 · 工具调用 · Go Anthropic Messages API tool_use tool_result Claude工具调用
Go 服务接入 Anthropic Messages API 的工具调用时,模型返回 tool_use 只是请求执行工具,不是最终答案。本文用天气查询工具拆解 stop_reason、tool_use_id、tool_result 的往返消息格式,并给出防止无限循环和错误回传的实现边界。368 收藏 -
Gemini Interactions API 的 2026 schema 迁移不只是把 outputs 改成 steps,还涉及 response_format、函数调用、工具事件、无状态历史和 SSE 监听。本文按 REST 与 SDK 两条路径给出兼容改法和验收清单。367 收藏 -
AI 生成代码最容易失控的地方不是语法,而是修改范围。本文用单元测试、修改预算和 git diff 双重门禁,拆解如何让一次生成式改动保持可验收、可回退。366 收藏 -
用 Claude Prompt Caching 降低长上下文请求的延迟和成本时,要把静态前缀、动态尾部、TTL 与 usage 里的 cache read/write 分开验收。363 收藏 -
AI 接口返回结构化结果时,空对象不一定代表没有数据。本文用 finish_reason、拒答字段和 JSON Schema 校验拆开拒答、截断、合法空结果三种状态,并给出可落地的用户提示策略。363 收藏