港大团队扎根深圳!补齐大湾区基础语言模型短板

羊城派
2026-09-17 15:12

来源:羊城派

近期,记者获悉,扩散语言模型团队DiffuSpace(扩散智能)正在训练一款参数规模更大的扩散语言模型(dLLM),或将于今年10月正式发布并开源。此前,DiffuSpace核心团队成员推出的Dream 7B曾登顶全球开源扩散语言模型,发布时其规划能力即与671B参数的DeepSeek V3持平,目前在Hugging Face上的累计下载量已超250万次。

与自回归模型“从左至右逐个生成”不同,dLLM借鉴扩散机制实现“全局生成”,可结合上下文持续优化,推理速度在部分场景可达自回归模型的10倍。今年以来,Google、Inception、蚂蚁集团等企业均在dLLM领域加速布局。

据公开资料,DiffuSpace由香港大学孔令鹏教授及博士生龚珊三、叶佳成联合创立。核心团队成员自2022年起持续投入扩散语言模型研究,是全球最早探索该技术路线的团队之一。2022年,团队推出DiffuSeq,率先将扩散模型系统引入序列到序列文本生成,使其能够完成对话、改写等真实任务;此后又推出RDM,进一步探索离散文本的扩散建模问题,并通过DiffuLLaMA探索降低训练成本、向更大模型规模扩展的技术路径。

DiffuSpace也在推进dLLM的产业落地。近期,DiffuSpace与亚洲智能体计算平台公司Acrab达成合作,并在双方测试中通过dLLM实现Agent运行速度最高5倍提升。双方将继续推进扩散语言模型在AI PC、智能汽车、机器人及智能家居等端侧场景的落地。

业内相关人士认为,随着扩散语言模型与端侧计算平台的深度协同,dLLM有望在实时性要求高、多任务并行的端侧智能体场景中率先规模化落地,为大模型从云端走向设备端提供新的技术路径。

值得注意的是,DiffuSpace选择将公司落在深圳。深圳及大湾区聚集了AI芯片、智能汽车、机器人、智能终端等产业链资源,为基础模型与硬件、终端企业的协同提供了集中的应用环境。

文、图|记者 潘亮

(来源:羊城派 编辑:麦见柔)