AI在线 AI在线

摩尔线程开源音频理解大模型 MooER:基于国产全功能 GPU 训练和推理

摩尔线程开源了音频理解大模型 —MooER(摩耳),是业界首个基于国产全功能 GPU 进行训练和推理的大型开源语音模型。基于摩尔线程夸娥(KUAE)智算平台,MooER 大模型用 38 小时完成了 5000 小时音频数据和伪标签的训练。MooER 不仅支持中文和英文的语音识别,还具备中译英的语音翻译能力。在 Covost2 中译英测试集中,MooER-5K 取得了 25.2 的 BLEU 分数,接近工业级效果。摩尔线程 AI 团队在该工作中开源了推理代码和 5000 小时数据训练的模型,并计划进一步开源训练代码和基

摩尔线程开源了音频理解大模型 —MooER(摩耳),是业界首个基于国产全功能 GPU 进行训练和推理的大型开源语音模型。

基于摩尔线程夸娥(KUAE)智算平台,MooER 大模型用 38 小时完成了 5000 小时音频数据和伪标签的训练。

MooER 不仅支持中文和英文的语音识别,还具备中译英的语音翻译能力。在 Covost2 中译英测试集中,MooER-5K 取得了 25.2 的 BLEU 分数,接近工业级效果。

摩尔线程 AI 团队在该工作中开源了推理代码和 5000 小时数据训练的模型,并计划进一步开源训练代码和基于 8 万小时数据训练的模型。

摩尔线程开源音频理解大模型 MooER:基于国产全功能 GPU 训练和推理

MooER 的模型结构包括 Encoder、Adapter 和 Decoder(Large Language Model,LLM)三个部分,具体的模型参数规模如下:

摩尔线程开源音频理解大模型 MooER:基于国产全功能 GPU 训练和推理

AI在线附相关链接:

Github 地址:https://github.com/MooreThreads/MooER

技术文档:https://arxiv.org/pdf/2408.05101

技术演示:https://mooer-speech.mthreads.com:10077/

相关资讯

摩尔线程:与师者 AI 完成 70 亿参数教育大模型训练测试

IT之家从摩尔线程官方公众号获悉,摩尔线程与全学科教育 AI 大模型“师者 AI”联合宣布,双方已完成大模型训练测试。师者 AI 成⽴于 2020 年,核心模型团队来自清华大学,总部位于北京海淀区。师者 AI 全学科教育大模型自开放内测以来,拥有超过 2.5 万用户,支持 30 个以上学科知识,2000 本以上教材。摩尔线程表示,依托摩尔线程夸娥(KUAE)千卡智算集群,师者 AI 完成了其 70 亿参数大模型的高强度训练测试。整个训练过程用时一周,训练效率达到预期。双方还将在大模型推理上开展适配工作,以更好应对教
6/14/2024 1:39:43 PM
沛霖(实习)

摩尔线程 MUSA 架构强势适配 llama.cpp,助力 AI 推理新纪元!

在全球人工智能技术飞速发展的今天,摩尔线程(Moore Threads)又有了新的突破! 其自主研发的通用并行计算架构 MUSA(Meta-computing Unified System Architecture)日前宣布,成功适配了开源推理框架 llama.cpp。 这一成就不仅展示了摩尔线程在 AI 生态系统中的进一步布局,也为广大开发者提供了更为高效的推理工具。
8/8/2025 7:39:51 AM
AI在线

大模型迎来「开源季」,盘点过去一个月那些开源的LLM和数据集

前段时间,谷歌泄露的内部文件表达了这样一个观点,虽然表面看起来 OpenAI 和谷歌在 AI 大模型上你追我赶,但真正的赢家未必会从这两家中产生,因为有一个第三方力量正在悄然崛起。这个力量就是「开源」。
5/16/2023 2:53:00 PM
机器之心
  • 1