蚂蚁百灵发布 Ling-3.1-flash 模型:约 560B MoE 架构,最高支持 1M 上下文

蚂蚁百灵发布 Ling-3.1-flash 模型:约 560B MoE 架构,最高支持 1M 上下文

800_auto

近日,蚂蚁集团百灵团队正式发布 Ling-3.1-flash 大语言模型。该模型采用 MoE 混合专家架构,总参数量约 5600 亿(560B),单 Token 推理仅激活约 250 亿参数,兼顾超大模型容量与推理效率,最高可支持 100 万 Token ...

点击查看剩余70%

{{collectdata}}

网友评论