登录
首页 >  科技周边 >  业界新闻

ZLab开源DFlash,破解推理新框架

时间:2026-02-04 18:09:38 182浏览 收藏

golang学习网今天将给大家带来《Z Lab开源DFlash,破解推理新框架》,感兴趣的朋友请继续看下去吧!以下内容将会涉及到等等知识点,如果你是正在学习科技周边或者已经是大佬级别了,都非常欢迎也希望大家都能给我建议评论哈~希望能帮助到大家!

Z Lab 推出了开源推测解码框架 DFlash,该框架采用轻量级 Block Diffusion 模型来生成草稿序列,旨在突破自回归大语言模型在推测解码过程中因草稿生成串行化所引发的性能瓶颈。

DFlash 创新性地将目标模型的隐层特征融入草稿生成过程,作为上下文条件进行建模,从而实现高质量、高效率的并行草稿预测。

Z Lab 发布开源推测解码框架 DFlash

https://github.com/z-lab/dflash

据官方测试结果,DFlash 在 Qwen3-8B 模型上达成高达 6.17 倍的无损推理加速,解码吞吐量相较当前最优的推测解码方案 EAGLE-3 提升近 2.5 倍。项目现已开源,并同步发布适配 Qwen3-4B 与 Qwen3-8B 的预训练草稿模型,相关技术论文正在整理中,即将正式公开。

Z Lab 发布开源推测解码框架 DFlash

研发团队透露,DFlash 正在紧锣密鼓地接入 vLLM 推理引擎,并已规划对大规模 MoE 架构模型的支持路线图。

源码地址:点击下载

文中关于的知识介绍,希望对你的学习有所帮助!若是受益匪浅,那就动动鼠标收藏这篇《ZLab开源DFlash,破解推理新框架》文章吧,也可关注golang学习网公众号了解相关技术文章。

前往漫画官网入口并下载 ➜
相关阅读
更多>
最新阅读
更多>
课程推荐
更多>