每天早上一封邮件,把昨天的 AI 梳理好订阅邮件

METAL LAB

LG AI研究院发布7500亿规模K-EXAONE 2.0 FP8模型

MoE架构激活参数370亿,FP8量化版本上传至Hugging Face

이미지: METAL LAB 생성

摘要

  • LG AI研究院在Hugging Face上公开了K-EXAONE-2.0-750B-A37B-FP8模型
  • 该模型总参数7500亿、激活参数370亿,采用MoE(混合专家)架构
  • 支持10种语言,并以apache-2.0许可证发布
모델명
K-EXAONE-2.0-750B-A37B-FP8
개발사
LG AI연구원(LGAI-EXAONE)
구조
Mixture of Experts(exaone_moe)
지원 언어
10개 언어
라이선스
apache-2.0
관련 논문
arXiv:2608.04505

LG AI研究院在Hugging Face上公开了大规模语言模型K-EXAONE系列的新版本"K-EXAONE-2.0-750B-A37B-FP8"。据悉,正如模型名称中所示,该模型总参数规模为7500亿,而实际推理时激活的参数约为370亿,属于MoE(混合专家)架构。

此次模型以FP8量化版本发布,支持transformers、safetensors格式,并确认与vLLM、SGLang等主要推理框架兼容。标签中包含exaone_moe、lg-ai、exaone、k-exaone、moe等,并被介绍为支持10种语言的对话型(conversational)模型。

该模型以apache-2.0许可证公开,看起来可实现包括商业用途的广泛使用。据悉,与该模型相关的技术内容可在arXiv上登记的论文(2608.04505)中查阅。

此前,LG AI研究院曾公开过2360亿规模的K-EXAONE模型,因此这次的750B级模型被解读为在参数规模上大幅扩展了现有产品线的后续作品。