sft 大模型
纯蒸馏模型 SOTA 出现!直接 SFT 成本直降 50 倍,数据已全部开源
a-m-team 又发新论文了。 这个团队上周刚刚在 Hugging Face 低调开源了32B稠密模型,但在多项关键推理评测中击败了 DeepSeek-R1,并与超大规模的 MoE 模型Qwen3-235B-A22B、Seed1.5-Thinking 不相上下,因此赢得了海内外的不少关注。 今天,a-m-team 发布了一篇名为“Not All Correct Answers Are Equal: Why Your Distillation Source Matters”的论文,介绍了 R1 之后下一代推理模型的小进展。
5/22/2025 10:21:00 AM
郭海惟
- 1
资讯热榜
实测 Google Veo 3:AI 视频终于能开口“说话”了 (附白嫖攻略+提示词技巧)
DeepSeek R1-0528震撼发布:免费128K上下文,性能直逼OpenAI o3!
小米多模态大模型Xiaomi MiMo-VL开源
字节发布图像Agent“小云雀AI” 打造一键爆款创作神器
Manus Slides重磅发布:一键生成专业幻灯片
正式开源!DeepSeek-R1-0528震撼发布,性能直逼OpenAI o3,免费API已上线
Resemble AI开源TTS Chatterbox ,性能直逼超越ElevenLabs
“一天内完成更新”:腾讯多款产品接入 DeepSeek R1-0528 最新版
标签云
人工智能
AI
OpenAI
AIGC
模型
ChatGPT
DeepSeek
AI绘画
数据
机器人
谷歌
大模型
Midjourney
用户
智能
开源
微软
GPT
学习
Meta
图像
技术
AI创作
Gemini
论文
马斯克
Stable Diffusion
算法
代码
芯片
英伟达
Anthropic
生成式
蛋白质
开发者
腾讯
神经网络
研究
3D
生成
计算
Sora
机器学习
苹果
训练
AI设计
AI for Science
智能体
GPU
Claude
AI视频
华为
搜索
人形机器人
场景
百度
xAI
预测
大语言模型
伟达
深度学习
Transformer
字节跳动
模态
Agent
具身智能
LLaMA
文本
视觉
神器推荐
Copilot
驾驶
工具
算力
API
应用
大型语言模型
安全
架构
RAG