Meta 开源 30B 模型 Muse Glimmer,4bit 量化可在单卡 24GB 显存 GPU 本地运行

Meta 开源 30B 模型 Muse Glimmer,4bit 量化可在单卡 24GB 显存 GPU 本地运行

近日,Meta 正式开源 30B 参数大模型 Muse Glimmer,基于 Apache 2.0 宽松协议开放权重,主打本地智能体场景,依靠高效量化方案,能够在单张 24GB 显存消费级 GPU 完成本地推理。

800_auto

Muse Glimmer 由 Muse Spark 蒸馏而来...

点击查看剩余70%

{{collectdata}}

网友评论