混合架构

长视频理解新突破！Mamba混合架构让显存消耗腰斩，处理10万视频token不费力

Mamba混合架构视频模型来了，不再对视频token进行压缩——而是通过改进模型架构设计的方式提升模型在训练及推理预填充阶段处理视频token的效率。图片滑铁卢大学陈文虎团队与多伦多大学、零一万物、向量学院以及M-A-P的研究人员提出了一种新的Mamba-Transformer混合模型Vamba。图片通过大量实验验证，研究团队发现Vamba在同等硬件条件下可处理的视频帧数较传统Transformer架构提升4倍，训练内存消耗降低50%以上，并且可实现单步训练速度的翻倍。

3/27/2025 12:20:25 PM

资讯热榜

阿里推出 AI 医学助手 App“氢离子”：收录千万级核心期刊文献，还可查疾病、找药品 OpenAI 董事会主席：如果你想快速烧掉百万美元，就开发自己的 AI 模型吧刷新无监督异常检测上限！首提「匹配代价滤波for异常检测」范式 | ICML'25 AI和云基础设施初创企业E2B如何成为88%的财富100强企业的必备选择腾讯Robotics X具身智能开放平台Tairos发布，融合左脑、右脑、小脑业界首个，腾讯混元 3D 世界模型正式发布并开源中国移动“九天”通用基础大模型 3.0 发布，核心技术开源阿里宋刚：突破用户体验瓶颈，将AI眼镜真正带入大众消费市场

标签云

人工智能 AI OpenAI AIGC 模型 ChatGPT DeepSeek AI绘画谷歌机器人数据大模型 Midjourney 开源智能用户 Meta 微软 GPT 学习技术图像 Gemini AI创作马斯克论文智能体 Anthropic 英伟达代码算法训练 Stable Diffusion 芯片蛋白质开发者腾讯生成式 LLM 苹果 Claude 神经网络 AI新词 3D 研究机器学习生成 AI for Science Agent xAI 计算人形机器人 Sora AI视频 GPU AI设计百度华为搜索大语言模型工具场景字节跳动具身智能 RAG 大型语言模型预测深度学习伟达视觉 Transformer AGI 视频生成神器推荐亚马逊 Copilot DeepMind 架构模态应用