原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://arxiv.org/abs/2610.04198
立即前往原文

ALoDLM:采用自适应循环计算的扩散语言模型

扩散语言模型能够并行生成多个词元,但其质量往往落后于规模相近的自回归模型。ALoDLM通过按词元调整的潜在状态循环计算来缩小差距:为更难预测的词元分配更多计算,并将已确定的词元作为上下文反馈。该模型在17亿和80亿参数规模下训练,在11项基准测试的平均得分上超过了受测扩散模型及相应的自回归基线,同时保留并行解码能力。在评估的模型中,它展现出较好的质量与效率平衡。
行业资讯 AI模型 研究 2026-10-06 12:02:10 542 阅读 阅读约 1 分钟 来源:Hugging Face
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。