1024
2024 科大讯飞全球 1024 开发者节官宣:首发多模态视觉交互、超拟人虚拟人交互能力
感谢AI在线从科大讯飞获悉,第七届世界声博会暨 2024 科大讯飞全球 1024 开发者节将于今年 10 月 24 日在合肥奥体中心正式开启。官方表示,届时将发布讯飞星火大模型升级版,其底座能力将再次升级,包含数学、代码和长文本能力显著提升、中英文综合能力持续领先,训练推理效率大幅提升等特性。在今年的 1024 开发者节活动中,科大讯飞还将首次发布多模态视觉交互及超拟人虚拟人交互能力,官方称将面向万物智联“打造极致人机交互体验”。此外,还将在教育、医疗、科研、司法、政务等领域升级行业大模型及更多应用产品。在去年的
10/10/2024 10:33:38 AM
清源
Adobe 演示 VideoGigaGAN:视频分辨率从 128×128 提升到 1024*1024
Adobe 公司近日展示了名为 VideoGigaGAN 的全新 AI 工具,通过上采样技术可以将视频分辨率从 128×128 提升到 1024*1024。VideoGigaGAN 是基于 GigaGAN 的生成视频超分辨率(VSR)模型,可以生成具有高频细节和时间一致性的视频。 研究人员为了确保时间一致性,首先需要在解码器块(decoder blocks)中添加时间注意力层(temporal attention layers),将图像上采样器扩展为视频上采样器(video upsampler)。IT之家附上参考地
4/25/2024 2:55:10 PM
故渊
- 1
资讯热榜
标签云
AI
人工智能
OpenAI
AIGC
模型
ChatGPT
DeepSeek
AI绘画
谷歌
机器人
数据
大模型
Midjourney
开源
智能
Meta
用户
微软
GPT
学习
技术
图像
Gemini
马斯克
AI创作
智能体
英伟达
Anthropic
论文
代码
AI新词
训练
算法
Stable Diffusion
LLM
芯片
蛋白质
开发者
腾讯
Claude
苹果
生成式
AI for Science
Agent
神经网络
3D
机器学习
研究
xAI
生成
人形机器人
AI视频
计算
百度
Sora
GPU
华为
AI设计
工具
大语言模型
RAG
搜索
具身智能
字节跳动
大型语言模型
场景
深度学习
预测
视频生成
伟达
视觉
Transformer
AGI
架构
亚马逊
神器推荐
Copilot
应用
DeepMind
特斯拉