应用
谷歌 Veo 视频生成模型走红后,国外网友开始上传“人扮 AI”内容博取关注
TikTok 等社交平台迅速被大量 AI 视频充斥。这款模型可在短短几秒内生成高度真实的八秒钟短片,配备音效与对口对白,内容涵盖挑战视频、虚构新闻,甚至是超现实短剧,引发用户广泛尝试与转发。
5/31/2025 7:57:19 PM
清源
百度 AI 搜索宣布全面接入 DeepSeek R1 最新版,推理能力更强
今日,百度AI搜索宣布全面接入深度思考模型DeepSeek R1-0528 ,用户可通过PC端、APP端免费使用。
5/31/2025 3:08:07 PM
问舟
谷歌 DeepMind 最强 AI 手语翻译模型:SignGemma 登场,打破手语沟通壁垒
谷歌 DeepMind 团队于 5 月 27 日宣布推出 SignGemma,是其迄今为止最强大的手语翻译模型,可将手语转化为口语文本,该开源模型将于今年晚些时候加入 Gemma 模型家族。
5/31/2025 11:24:22 AM
故渊
谷歌联合创始人 Sergey Brin 揭秘:AI 爱吃“罚酒”,受威胁后反而提升性能
在出席迈阿密举办的 All-In-Live 活动中,谷歌联合创始人谢尔盖・布林(Sergey Brin)抛出新观点,有时候恐吓人工智能(AI)模型,反而能刺激提升其表现。
5/31/2025 10:43:01 AM
故渊
美国白宫委员会编制儿童健康报告被指 AI 造假:引用“幽灵论文”,结论遭质疑
纽约时报于 5 月 29 日发布博文,报道称由美国白宫 Make America Healthy Again Commission 委员会编写的儿童健康报告,大量引用了不存在的科学研究,因此报告给出的数据和结论遭到质疑。
5/31/2025 10:27:05 AM
故渊
通义开源视觉感知多模态RAG推理框架VRAG-RL
近日,通义实验室自然语言智能团队正式发布并开源了VRAG-RL——一款视觉感知驱动的多模态RAG推理框架,旨在解决在真实业务场景中,AI如何从图像、表格、设计稿等视觉语言中检索关键信息并进行精细化推理的难题。 在复杂视觉文档知识库中检索并推理关键信息,一直是AI领域的一大挑战。 传统的检索增强型生成(RAG)方法在处理视觉丰富信息时显得力不从心,主要因为它们难以应对图像、图表等视觉内容,且现有视觉RAG方法受限于固定的检索-生成流程,难以充分挖掘视觉信息中的关键知识。
5/31/2025 10:00:54 AM
AI在线
BFL 推出 FLUX.1 Kontex 模型套件,AI 生图速度比主流竞争对手快一个数量级
科技媒体 WinBuzzer 昨日(5 月 30 日)发布博文,报道称 Black Forest Labs(BFL)推出全新 AI 模型套件 FLUX.1 Kontext,专注于生成与编辑上下文图像,号称速度比主流竞争对手快一个数量级。
5/31/2025 9:55:51 AM
故渊
英伟达 CEO 黄仁勋:中国的 Deepseek 和阿里通义千问是当前最佳开源模型
他表示,DeepSeek 和阿里巴巴的通义千问(Qwen)是“当前表现最优的开源 AI 模型之一”,已在美国、欧洲等多个市场获得广泛应用。
5/30/2025 9:07:30 PM
清源
谷歌 AI 概览被指无法正确回答“今年是哪一年”,官方紧急修复
谷歌发言人表示:“和所有搜索功能一样,我们会持续改进,并通过这类案例更新系统。绝大多数 AI 概览都能提供有用且准确的信息,我们正着手修复这一类问题。”
5/30/2025 7:54:20 PM
清源
研究人员揭示大模型并非真正推理,只是在 “找关系”
随着人工智能(AI)技术的飞速发展,越来越多的研究人员开始对大型语言模型(如 ChatGPT)进行深入探讨。 近日,亚利桑那州立大学的研究小组在预印本平台 arXiv 上发表了一项引人关注的论文,指出我们对这些 AI 模型的理解可能存在误区。 他们认为,这些模型实际上并不会进行真正的思考或推理,而仅仅是在寻找相关性。
5/30/2025 6:00:54 PM
AI在线
夸克上线“深度研究”:AI写报告不是梦,每天限量开放体验
5月,夸克正式上线全新“深度研究”功能,并面向用户限量邀请体验。 该功能依托通义千问大模型,支持围绕学术课题、行业分析等复杂议题,完成从资料搜集、数据分析、观点提炼到报告生成的全流程研究,实现“输入主题,输出成品”。 用户现可通过夸克 App 或 PC 端申请邀请码,激活资格后点击首页“深度研究”图标即可提交需求。
5/30/2025 6:00:54 PM
AI在线
Perplexity Labs上线,多工具协同、化繁为简
作为AI技术的前沿探索者,Perplexity AI近期推出了备受瞩目的Perplexity Labs,为Pro订阅用户带来了全新的AI生产力工具。 这一功能不仅扩展了Perplexity的搜索与研究能力,还通过深度整合多种工具,将复杂的项目开发流程简化至数分钟。 AIbase基于最新信息整理,为您全面解析Perplexity Labs的核心功能及其潜在影响。
5/30/2025 6:00:54 PM
AI在线
国家邮政局:加快邮政业科技发展,打造人工智能 + 邮政业标杆产品
国家邮政局今日下午举行新闻发布会,相关负责人介绍了《国家邮政局关于加快邮政业科技发展的意见》相关内容。
5/30/2025 5:28:58 PM
汪淼
全流程昇腾平台训练,华为推出准万亿参数盘古 Ultra MoE 模型
华为今日宣布推出参数规模高达7180亿的全新模型盘古Ultra MoE,这是一个全流程在昇腾AI计算平台上训练的准万亿MoE模型。
5/30/2025 5:19:55 PM
清源
机器狗能打羽毛球:仅靠强化学习从 0 自学,还会自己移步
该研究在各种环境中进行了大量实验,验证了四足机器人预测羽毛球轨迹、有效导航服务区域,以及对人类球员进行最精准打击的能力。证明了足式移动机器人在复杂和动态的体育场景中应用的可行性。
5/30/2025 5:19:00 PM
汪淼
人工智能能耗有望在2025年底超越比特币挖矿
根据一项新的分析,人工智能的电力消耗预计将在2025年底前接近全球数据中心总电力消耗的一半,这意味着人工智能的能耗将很快超越比特币挖矿。 该分析由阿姆斯特丹自由大学环境研究所的博士生 Alex de Vries-Gao 进行,他曾跟踪研究过加密货币的电力消耗及其环境影响,并在他的网站 Digiconomist 上发布了相关数据。 目前,人工智能已经占据了数据中心电力消耗的高达五分之一。
5/30/2025 5:00:54 PM
AI在线
小米多模态大模型 MiMo-VL 开源,官方称多方面领先 Qwen2.5-VL-7B
官方表示,其在图片、视频、语言的通用问答和理解推理等多个任务上,大幅领先同尺寸标杆多模态模型 Qwen2.5-VL-7B,并且在 GUI Grounding 任务上比肩专用模型,为 Agent 时代而来。
5/30/2025 4:06:03 PM
清源
华为发布昇腾大模型:无GPU训练高数大题仅需2秒!
最近,华为通过其新推出的 “昇腾 Pangu Ultra MoE” 系统展示了一个令人惊叹的突破:一个近万亿参数的 MoE 大模型在短短2秒内就能理解并解答一道高等数学题。 而这一切都在没有使用 GPU 的情况下实现,显示出华为在自主可控的国产算力和模型训练方面的强大能力。 在技术层面,华为的团队成功提升了训练系统的整体性能,通过智能选择并行策略和优化计算通信,大幅提高了集群的训练效率。
5/30/2025 4:00:54 PM
AI在线
资讯热榜
Meta视觉基座DINOv3王者归来:自监督首次全面超越弱监督,商用开源
Meta刚刚开源DINOv3,横扫60+任务,无标注封神!
扎克伯格看OpenAI直播挖人,北大校友孙之清加入Meta
ChatGPT或将引入广告!OpenAI高管首度松口,用户破7亿仍难盈利
Nvidia 投资 5 亿美元,Cohere 公司估值达 68 亿美元
OpenAI华人露头就被小扎挖!95后北大校友1个月前上直播,今天已是Meta人
破天荒!OpenAI、Cursor多位开发大牛联手曝出GPT5提示词指南!晒官方系统提示词优化秘籍,最大化编程性能,工作流更可控
被曝蒸馏DeepSeek还造假!欧版OpenAI塌房了
标签云
AI
人工智能
OpenAI
AIGC
模型
ChatGPT
DeepSeek
AI绘画
谷歌
机器人
数据
大模型
Midjourney
开源
智能
用户
Meta
微软
GPT
学习
技术
图像
Gemini
马斯克
AI创作
智能体
论文
英伟达
Anthropic
代码
训练
算法
Stable Diffusion
芯片
蛋白质
LLM
开发者
腾讯
AI新词
生成式
Claude
苹果
Agent
神经网络
AI for Science
3D
机器学习
研究
生成
xAI
人形机器人
AI视频
计算
Sora
GPU
AI设计
百度
华为
工具
大语言模型
搜索
具身智能
RAG
场景
字节跳动
大型语言模型
深度学习
预测
伟达
视觉
Transformer
视频生成
AGI
架构
神器推荐
亚马逊
Copilot
DeepMind
应用
安全