简介:

Moonlight是一个16B参数的混合专家模型,使用Muon优化器训练,性能优异。

功能:

使用Muon优化器实现高效的模型训练

支持大规模分布式训练,优化内存和通信效率

在多项基准测试中表现优异,如MMLU、BBH等

提供预训练模型和指令调优版本,方便直接使用

兼容Hugging Face平台,易于部署和推理

支持多种自然语言处理任务,包括文本生成和代码生成

开源实现,便于研究和二次开发

提供中间检查点,支持持续研究和模型改进

需求人群:

"Moonlight适合需要高效训练和高性能模型的自然语言处理研究人员和开发者,尤其是那些关注计算效率和模型规模的团队。它也适用于需要快速部署和推理的企业应用,以及对混合专家模型感兴趣的学术研究。"

浏览量:15

s1785318098921236

打开站点

构建AI去赚钱
s1785341518918206
类似产品

© 2025     AIbase    备案号:闽ICP备08105208号-14

隐私政策

用户协议

意见反馈 网站地图