inclusionAI开源LLaDA2.2-flash:让扩散语言模型能边写边改
自回归模型生成token只能从左到右加下去,写错一步没法回头改,长上下文Agent任务里工具出错常要推倒重来。扩散语言模型(diffusion model)能并行生成,但过去序列是“写死”的,改不了长度、删不掉冗余。
LLaDA2.2-flash首次给扩散解码加入编辑机制,新增DELETE和INSERT两个控制token,让模型生成时能主动删内容、插内容,动态调整序列结构,具备自我纠错能力,对多轮工具调用和长程Agent交互尤其关键。
不过一顿操作猛如虎,一看评分0-5。对比参数类似的其他模型,扩散模型得分显著偏低。
模型:
显示更多