全模态实时交互
青岛发布国内首个全模态实时交互大模型 VisualGPT,打造“所见即所得”AI体验
青岛虚拟智能体产业大会正式推出国内首个支持全模态实时交互的视觉语言大模型 VisualGPT,并同步上线智能体训练平台,面向全国开发者开放多模态数据与算力资源,标志着AI交互从“文字对话”迈入“视觉界面即时互动”新阶段。 模型亮点 - 全模态实时交互:用户上传图片/视频后可直接在画面上圈选、标注或语音提问,模型秒级返回结构化答案、可执行代码或3D场景,无需切换文字输入。 - 所见即所得:VisualGPT将视觉编码器与流式解码器耦合,实现300ms端到端延迟,支持1080p60fps实时画面分析与多轮对话。
11/24/2025 11:06:15 AM
AI在线
资讯热榜
标签云
AI
人工智能
OpenAI
AIGC
模型
ChatGPT
谷歌
DeepSeek
AI绘画
大模型
机器人
数据
AI新词
Midjourney
开源
Meta
微软
智能
用户
GPT
学习
技术
智能体
Gemini
马斯克
Anthropic
英伟达
图像
AI创作
训练
LLM
论文
代码
算法
苹果
AI for Science
Agent
Claude
腾讯
芯片
Stable Diffusion
蛋白质
开发者
具身智能
xAI
生成式
神经网络
机器学习
3D
人形机器人
AI视频
RAG
大语言模型
研究
百度
Sora
生成
GPU
工具
华为
字节跳动
计算
AGI
大型语言模型
AI设计
搜索
生成式AI
视频生成
DeepMind
特斯拉
场景
AI模型
深度学习
亚马逊
架构
Transformer
MCP
编程
视觉
预测