音视频创作模型
豆包上线 Seedance 1.5 Pro,可直接生成有声视频
字节跳动新一代音视频创作模型 “Seedance1.5Pro” 正式登陆豆包,为普通用户打开了 “零门槛做有声视频” 的新体验。 这次上线的 Seedance1.5Pro,核心是把 “文字 - 画面 - 声音” 的创作链路做了一体化升级:语义 音画同步:不再是先出画面再配声音,模型能深度理解文本意图,同步生成匹配内容的画面与音效、台词,避免 “音画脱节”;更自然的 “开口说话”:生成的人物台词不再是机械合成音,语气、节奏更贴近真人表达;电影感叙事 动态镜头:画面会自带景别切换、运镜效果,复杂动作(比如人物的肢体互动)也能被精准捕捉,不用再手动调特效。 普通用户的操作也很简单:打开豆包 App 对话框,点击 “照片动起来” 功能,选择 “1.5Pro” 模型,上传一张参考图(比如自己的生活照、手绘草稿),再输入提示词(比如 “让这只猫用温柔的语气讲睡前故事,背景是星空卧室”),就能直接生成一条完整的有声视频。
字节跳动发布 Seedance 1.5 Pro:AI 音视频创作进入 100% 视听同步时代!
12月16日,字节跳动在北京正式发布了其新一代音视频创作模型 ——Seedance1.5pro。 这一全新的创作工具不仅在音视频生成领域实现了重大突破,还为用户带来了更为丰富的视听体验。 Seedance1.5pro 支持音视频的联合生成,用户可以通过文本输入生成音视频内容,或者利用图像引导生成音视频。
资讯热榜
标签云
AI
人工智能
OpenAI
AIGC
模型
ChatGPT
谷歌
DeepSeek
AI新词
AI绘画
大模型
机器人
数据
Midjourney
开源
Meta
微软
智能
用户
GPT
学习
英伟达
Gemini
智能体
技术
马斯克
Anthropic
图像
AI创作
训练
LLM
论文
AI for Science
代码
腾讯
苹果
算法
Agent
Claude
芯片
具身智能
Stable Diffusion
xAI
蛋白质
人形机器人
开发者
生成式
神经网络
机器学习
AI视频
3D
字节跳动
大语言模型
RAG
Sora
百度
研究
GPU
生成
华为
工具
AGI
计算
生成式AI
AI设计
大型语言模型
搜索
亚马逊
AI模型
视频生成
特斯拉
DeepMind
场景
Copilot
深度学习
Transformer
架构
MCP
编程
视觉