AI情报2026年8月19日AI情报
文章
CORA-Diff:用于高效扩散语言模型推理的置信导向残差接受方法
公告类型:新摘要:扩散语言模型(DLMs)并行更新许多令牌,但实际解码器通常使用固定的去噪步长。许多预测会提前稳定,但分块解码会持续到所有位置都被解析,导致重复的密集前向传递。现有的加速器通常依赖于学习到的过滤器、修改后的分数、依赖模型或特定缓存
Frontier 编辑部来源: arXiv
公告类型:新摘要:扩散语言模型(DLMs)并行更新许多令牌,但实际解码器通常使用固定的去噪步长。许多预测会提前稳定,但分块解码会持续到所有位置都被解析,导致重复的密集前向传递。现有的加速器通常依赖于学习到的过滤器、修改后的分数、依赖模型或特定缓存