AI在线 AI在线

LLaSO

逻辑智能发布全球首个开源语音大模型框架 LLaSO

在人工智能的快速发展浪潮中,北京深度逻辑智能科技有限公司于近日推出了一项令人瞩目的创新 ——LLaSO。 这一开创性的研究框架被称为全球首个完全开放、端到端的语音语言模型,标志着语音识别和处理技术的新高度。 LLaSO 框架的最大亮点在于它的开放性。
9/16/2025 4:21:30 PM
AI在线

LLaSO 横空出世:逻辑智能推出全球首个完全开源语音大模型框架,定义 LSLM 研究新基准

在大型语言模型(LLM)的浪潮下,多模态 AI 取得了飞速发展,尤其是在视觉语言(LVLM)领域,已经形成了成熟的研究范式。 然而,与之形成鲜明对比的是,大型语音语言模型(LSLM)的发展却显得零散且步调缓慢。 该领域长期被碎片化的架构、不透明的训练数据和缺失的评估标准所困扰,导致研究之间难以进行公平比较,严重阻碍了技术的可复现性和社区的系统性进步。
9/14/2025 1:42:00 PM
机器之心
  • 1