1024
2024 科大讯飞全球 1024 开发者节官宣:首发多模态视觉交互、超拟人虚拟人交互能力
感谢AI在线从科大讯飞获悉,第七届世界声博会暨 2024 科大讯飞全球 1024 开发者节将于今年 10 月 24 日在合肥奥体中心正式开启。官方表示,届时将发布讯飞星火大模型升级版,其底座能力将再次升级,包含数学、代码和长文本能力显著提升、中英文综合能力持续领先,训练推理效率大幅提升等特性。在今年的 1024 开发者节活动中,科大讯飞还将首次发布多模态视觉交互及超拟人虚拟人交互能力,官方称将面向万物智联“打造极致人机交互体验”。此外,还将在教育、医疗、科研、司法、政务等领域升级行业大模型及更多应用产品。在去年的
10/10/2024 10:33:38 AM
清源
Adobe 演示 VideoGigaGAN:视频分辨率从 128×128 提升到 1024*1024
Adobe 公司近日展示了名为 VideoGigaGAN 的全新 AI 工具,通过上采样技术可以将视频分辨率从 128×128 提升到 1024*1024。VideoGigaGAN 是基于 GigaGAN 的生成视频超分辨率(VSR)模型,可以生成具有高频细节和时间一致性的视频。 研究人员为了确保时间一致性,首先需要在解码器块(decoder blocks)中添加时间注意力层(temporal attention layers),将图像上采样器扩展为视频上采样器(video upsampler)。IT之家附上参考地
4/25/2024 2:55:10 PM
故渊
- 1
资讯热榜
标签云
人工智能
OpenAI
AIGC
AI
ChatGPT
AI绘画
DeepSeek
模型
数据
机器人
谷歌
大模型
Midjourney
智能
用户
开源
学习
GPT
微软
Meta
图像
AI创作
技术
论文
Gemini
Stable Diffusion
马斯克
算法
蛋白质
芯片
代码
生成式
英伟达
腾讯
神经网络
研究
计算
Anthropic
3D
Sora
AI for Science
AI设计
机器学习
开发者
GPU
AI视频
华为
场景
人形机器人
预测
百度
苹果
伟达
Transformer
深度学习
xAI
Claude
模态
字节跳动
大语言模型
搜索
驾驶
具身智能
神器推荐
文本
Copilot
LLaMA
算力
安全
视觉
视频生成
训练
干货合集
应用
大型语言模型
亚马逊
科技
智能体
AGI
DeepMind