LG发布750B参数K-EXAONE 2.0开源模型
「LG AI研究院发布K-EXAONE 2.0,采用混合注意力MoE架构,总参数750B,激活参数37B,规模是初代的三倍以上,成为韩国最大AI基础模型。新模型以Apache 2.0许可证开源,在24项基准测试中平均得分70.1,较初代提升10%,编码与智能体基准测试提升约30%,长上下文和工具使用能力表现优异。」
LG AI研究院近日在Hugging Face上正式发布了K-EXAONE 2.0模型,这是继初代K-EXAONE之后,该研究院在韩国科技信息通信部主权人工智能基金会模型项目下开发的第二个大型语言模型。新模型不仅在参数规模上实现了显著跃升,更在多项基准测试中展现出强劲性能,标志着韩国在人工智能基础模型领域迈出了重要一步。
K-EXAONE 2.0采用了混合注意力MoE架构,拥有750B总参数和37B激活参数,规模是初代K-EXAONE(236B总参数,23B激活参数)的三倍以上,成为韩国迄今为止开发的最大人工智能基础模型。值得注意的是,该模型以Apache 2.0许可证开源,这意味着全球开发者可以自由使用、修改和分发该模型,这对于推动AI技术的民主化和社区协作具有重要意义。
在性能表现上,K-EXAONE 2.0在24项基准测试中平均得分达到70.1分,相比初代K-EXAONE的63.3分提升了超过10%。尤其在三大主要编码和智能体编码基准测试中,性能改进幅度约为30%,显示出该模型在代码生成和智能体任务处理方面的显著进步。这一提升不仅反映了模型架构优化的成效,也体现了LG AI研究院在训练数据和算法调优上的深厚积累。
横向对比来看,K-EXAONE 2.0在长上下文理解方面优于GLM-5.1,在智能体工具使用能力方面优于智谱GLM-5.1和Qwen3.5,在指令执行评估中则表现出与GLM-5.1、DeepSeek V4 Pro Max、Qwen3.5等主流模型相当的性能。这些结果说明,K-EXAONE 2.0在特定任务上已经具备与国际领先模型竞争的实力,尤其是在处理复杂指令和工具调用场景中表现出色。
K-EXAONE 2.0的开源发布,不仅为AI研究社区提供了一个高性能的基础模型,也为韩国在全球AI竞赛中赢得了更多话语权。随着模型参数的扩大和架构的创新,未来该模型有望在更多实际应用场景中发挥价值,推动人工智能技术的进一步发展。
来源:Heooo AI工具导航