人工智能
已收录文章:73篇
-
AI 对话的停止按钮不只是调用 abort()。要让用户、键盘操作和辅助技术都获得一致反馈,需要为每次请求新建 AbortController,正确收尾读取循环,并把生成、停止、失败状态放进合适的实时状态区域。425 收藏
-
客服回复提示词改了两句话,结果结构化字段合格率下降,才发现线上没有记录每条回答来自哪个版本。本文用样本对照、灰度比例、输出门禁和请求标识建立可回退的提示词发布流程。419 收藏
-
多轮对话变长后,简单截掉旧消息很容易让模型丢失用户约束。本文从上下文压缩的边界出发,拆解摘要漂移、关键事实遗漏和回放验收,用可重复的测试样例判断压缩是否真的可用。418 收藏
-
AI 网关同时承载多路流式回答时,连接复用、异步回调和日志采集很容易把不同请求的片段混到一起。本文用 request_id 贯穿入口、上游连接、事件转发和落盘日志,再配合状态机与断言,把串线问题变成可以复现、定位和验收的工程流程。407 收藏
-
同一个模型请求失败,并不代表应该立刻换到下一个模型。本文按超时、限流、服务异常和内容拒答拆开处理,给出路由状态、重试边界、降级策略与可验收的实现路径。398 收藏
-
多模态知识库接入图片后,成本和延迟往往不是由文件大小单独决定。本文从图片任务、detail 级别、裁剪策略和上下文预算四个维度,给出可执行的输入分层与验收方法。394 收藏
-
Cloudflare 在 2026 年 8 月发布 WebMCP 开发者预览后,网站可以把可操作能力交给浏览器代理。本文拆解工具暴露、页面上下文和人工控制边界,并给出评估预览能力时应检查的权限、确认和回退点。383 收藏
-
OpenAI 已将 GPT-5.6 分为 Sol、Terra、Luna 三档,并在 2026 年 7 月 30 日更新了部分价格。本文按代码代理、知识工作和高频批处理三类任务拆解选择边界,给出成本、延迟、可靠性与灰度上线的检查方法。374 收藏
-
科技周边 · 人工智能 | 1个月前 | 人工智能 · Hugging Face Transformers generate output_scores compute_transition_scores 长度惩罚 生成概率Transformers 的 generate 默认只返回生成序列,不会直接给出每个 token 的分数。本文用 return_dict_in_generate、output_scores 和 compute_transition_scores 还原逐 token 对数概率,并说明 decoder-only 输入长度、beam search 和 length_penalty 的验收边界。374 收藏
-
多租户 AI 知识库最危险的故障不是检索变慢,而是把 A 租户的片段、缓存或引用带给 B 租户。本文从检索权限、缓存键、引用回显和审计证据四条线,拆解一套可验证的隔离方案。369 收藏
-
科技周边 · 人工智能 | 2个月前 | API · go · 人工智能 · 工程实践 · 工具调用 · Go Anthropic Messages API tool_use tool_result Claude工具调用Go 服务接入 Anthropic Messages API 的工具调用时,模型返回 tool_use 只是请求执行工具,不是最终答案。本文用天气查询工具拆解 stop_reason、tool_use_id、tool_result 的往返消息格式,并给出防止无限循环和错误回传的实现边界。368 收藏
-
AI Agent 的超时不能只设一个总秒数。把模型等待、工具调用和整条任务预算分开,才能区分慢在哪里、及时停止无效工作,并在重试与回退时保留可核对的状态。357 收藏