人工智能技术文章
-
知识库切片重叠率会同时影响边界语义、重复召回、索引成本和上下文长度。本文用 LangChain 与 Hugging Face 的切分思路说明参数起点、评测方法和不同语料的边界处理。268 收藏 -
在同一个基础模型上预加载多个 PEFT LoRA 适配器,使用唯一名称和 set_adapter 按任务切换,并说明 delete_adapter、unload 与 hotswap 的生命周期边界。268 收藏 -
GradScaler 会在反缩放后的梯度含 inf 或 NaN 时跳过对应优化器的 step。本文说明单优化器、多优化器、scale 回退与学习率调度器的判断边界。268 收藏 -
科技周边 · 人工智能 | 1个月前 | oauth · 人工智能 · mcp · ai agent · OAuth MCP redirect_uri iss CIMD Client ID Metadata Documents
MCP 2026-07-28 强化了 OAuth 授权边界,登录失败时不能只盯着 redirect_uri。本文从授权响应中的 iss、Client ID Metadata Document(CIMD)和授权服务器绑定关系入手,给出一套可复现的排查与迁移清单。267 收藏 -
多模态模型接收图片时,文件大小并不是唯一门槛。先检查格式、宽高、总像素和编码后的体积,再按剩余预算决定压缩、拒绝或重试,才能减少请求失败和重复上传。267 收藏 -
AI Embedding 批量请求变慢时,先把客户端准备、网络往返、服务端排队和模型计算拆开记录,再用固定文本与批次对照区分瓶颈;同时核对输出维度和向量库 schema,避免把维度不一致误判成网络问题。264 收藏 -
以 Hugging Face 风格工具调用为例,说明 JSON Schema、tool_calls 参数形状与 Pydantic/业务规则校验的排查方法。264 收藏 -
工具调用型智能体会因超时、重试、工作流回放和多副本竞争重复触发有副作用的动作。本文给出稳定动作键、参数指纹、动作账本、租约、结果复用与外部幂等键的完整设计,并说明未知结果、补偿和监控边界。262 收藏 -
向量检索的 top_k 越大不一定让 RAG 答案更好。本文用一个可运行的 Python 小实验说明如何按 source_id 分组、保留上下文多样性,再把有限的候选片段交给生成模型。261 收藏 -
通过最小化工具参数、固定工作区根目录、规范化路径和区分读写审批,限制 AI Agent 越权访问文件,并用结构化拒绝结果和日志保留可追踪性。261 收藏 -
多模型推理服务常见的问题不是请求发不出去,而是任务一拥而上把显存和上游连接同时压满。本文用 Python asyncio.Semaphore 限制并发入口,配合 TaskGroup、超时和结果核对,给出一套可验证的推理任务调度写法。260 收藏 -
围绕 MCP Tasks 的任务句柄、状态轮询、输入等待、终态取数和断线恢复,整理一套不依赖具体厂商编排的客户端处理边界。260 收藏 -
向量搜索选余弦距离还是内积,取决于 embedding 模型是否归一化,以及向量长度是否承载业务信息。本文用公式、Python 示例和选择表说明两者边界,并提醒区分相似度与数据库距离。260 收藏 -
RAG 问答里反复出现相同段落,通常不是模型突然变笨,而是切块重叠、相邻片段、候选数量和证据合并共同造成的。本文用一组可复现的检索样例分层排查重复来源,再说明 MMR、多样性阈值和最终去重应该放在哪一层。259 收藏 -
Embedding 模型更换后,旧文档向量与新查询向量可能不在同一个向量空间;即使维度相同,语义方向、归一化和提示词约定也可能不同。本文给出双写、全量回填、离线验收、别名切换和回滚方案。259 收藏