谷歌计划融合 Gemini 与 Veo 模型，打造全能 AI 助手

作者：远洋 2025-04-13 08:53

谷歌DeepMind CEO透露，计划将Gemini AI与Veo视频生成模型融合，提升AI对物理世界的理解能力。Gemini已支持多模态，可生成图像、文本和音频，行业正朝“全能”模型发展。#AI技术##谷歌Gemini#

感谢谷歌 DeepMind 首席执行官 Demis Hassabis 在由领英联合创始人 Reid Hoffman 共同主持的播客节目 Possible 中透露，谷歌计划将旗下的 Gemini AI 模型与 Veo 视频生成模型进行融合，以此提升 Gemini 对物理世界的理解能力。

Hassabis 表示：“我们从一开始就将 Gemini 这一基础模型打造为多模态模型，因为我们有着构建一个通用数字助手的愿景，这个助手能够在现实世界中真正为你提供帮助。”

目前，整个 AI 行业正逐渐朝着“全能”模型的方向发展，这些模型能够理解和整合多种媒体形式。谷歌最新的 Gemini 模型不仅可以生成图像和文本，还能生成音频；而 OpenAI 在 ChatGPT 中的默认模型如今也能创建图像，包括宫崎骏风格的艺术作品。亚马逊也宣布计划在今年晚些时候推出一款“任意到任意”的模型。

据AI在线了解，这些“全能”模型需要大量的训练数据，包括图像、视频、音频、文本等。Hassabis 暗示，Veo 的视频数据主要来源于谷歌旗下的 YouTube 平台。他说道：“通过观看大量的 YouTube 视频，Veo 2 能够了解世界的物理规律。”此前，谷歌曾向 TechCrunch 表示，其模型可能会根据与 YouTube 创作者达成的协议，使用“部分”YouTube 内容进行训练。据报道，该公司去年扩大了服务条款的部分内容，以便获取更多数据来训练其 AI 模型。

谷歌 Veo 2 视频生成模型入驻 Gemini，用户可创建 8 秒 720p 视频

谷歌宣布将Veo 2视频生成AI模型引入Gemini Advanced订阅服务，用户可创作8秒720p视频并分享至社交平台。同时，Google Labs整合Veo 2推出Whisk Animate功能，静态图秒变动画。AI视频工具崛起也引发创意行业担忧。#谷歌AI##视频生成#

4/16/2025 7:31:28 AM 远洋

谁还敢说谷歌掉队？2025年，它打了一场漂亮的翻身仗

在即将过去的 2025 年，谷歌在人工智能领域交出了一份颇具分量的成绩单。曾因「发表了 Transformer 却痛失先机」而备受外界质疑，谷歌一度深陷「大模型掉队」的舆论漩涡。但这一年，谷歌用一系列里程碑式的发布打了一场漂亮的翻身仗。

12/24/2025 6:03:00 PM 机器之心

8秒出大片！10个案例实测谷歌Veo 3视频生成功能

前几天的 2025 年 Google I/O 开发者大会上，谷歌发布了一系列先进的图像和视频生成工具，好玩的太多了，我还没来得及一一体验，今天先尝试一下最近超级火的 Veo 3 视频生成。后续再尝试下 Imagen 4 和 Flow 平台和大家分享。先简单介绍一下。

5/27/2025 7:31:45 AM 阿真Irene

谷歌计划融合 Gemini 与 Veo 模型，打造全能 AI 助手

相关资讯

谷歌 Veo 2 视频生成模型入驻 Gemini，用户可创建 8 秒 720p 视频

谁还敢说谷歌掉队？2025年，它打了一场漂亮的翻身仗

8秒出大片！10个案例实测谷歌Veo 3视频生成功能