应用
谷歌 DeepMind 最强 AI 手语翻译模型:SignGemma 登场,打破手语沟通壁垒
谷歌 DeepMind 团队于 5 月 27 日宣布推出 SignGemma,是其迄今为止最强大的手语翻译模型,可将手语转化为口语文本,该开源模型将于今年晚些时候加入 Gemma 模型家族。
谷歌联合创始人 Sergey Brin 揭秘:AI 爱吃“罚酒”,受威胁后反而提升性能
在出席迈阿密举办的 All-In-Live 活动中,谷歌联合创始人谢尔盖・布林(Sergey Brin)抛出新观点,有时候恐吓人工智能(AI)模型,反而能刺激提升其表现。
美国白宫委员会编制儿童健康报告被指 AI 造假:引用“幽灵论文”,结论遭质疑
纽约时报于 5 月 29 日发布博文,报道称由美国白宫 Make America Healthy Again Commission 委员会编写的儿童健康报告,大量引用了不存在的科学研究,因此报告给出的数据和结论遭到质疑。
通义开源视觉感知多模态RAG推理框架VRAG-RL
近日,通义实验室自然语言智能团队正式发布并开源了VRAG-RL——一款视觉感知驱动的多模态RAG推理框架,旨在解决在真实业务场景中,AI如何从图像、表格、设计稿等视觉语言中检索关键信息并进行精细化推理的难题。 在复杂视觉文档知识库中检索并推理关键信息,一直是AI领域的一大挑战。 传统的检索增强型生成(RAG)方法在处理视觉丰富信息时显得力不从心,主要因为它们难以应对图像、图表等视觉内容,且现有视觉RAG方法受限于固定的检索-生成流程,难以充分挖掘视觉信息中的关键知识。
BFL 推出 FLUX.1 Kontex 模型套件,AI 生图速度比主流竞争对手快一个数量级
科技媒体 WinBuzzer 昨日(5 月 30 日)发布博文,报道称 Black Forest Labs(BFL)推出全新 AI 模型套件 FLUX.1 Kontext,专注于生成与编辑上下文图像,号称速度比主流竞争对手快一个数量级。
英伟达 CEO 黄仁勋:中国的 Deepseek 和阿里通义千问是当前最佳开源模型
他表示,DeepSeek 和阿里巴巴的通义千问(Qwen)是“当前表现最优的开源 AI 模型之一”,已在美国、欧洲等多个市场获得广泛应用。
谷歌 AI 概览被指无法正确回答“今年是哪一年”,官方紧急修复
谷歌发言人表示:“和所有搜索功能一样,我们会持续改进,并通过这类案例更新系统。绝大多数 AI 概览都能提供有用且准确的信息,我们正着手修复这一类问题。”
研究人员揭示大模型并非真正推理,只是在 “找关系”
随着人工智能(AI)技术的飞速发展,越来越多的研究人员开始对大型语言模型(如 ChatGPT)进行深入探讨。 近日,亚利桑那州立大学的研究小组在预印本平台 arXiv 上发表了一项引人关注的论文,指出我们对这些 AI 模型的理解可能存在误区。 他们认为,这些模型实际上并不会进行真正的思考或推理,而仅仅是在寻找相关性。
Perplexity Labs上线,多工具协同、化繁为简
作为AI技术的前沿探索者,Perplexity AI近期推出了备受瞩目的Perplexity Labs,为Pro订阅用户带来了全新的AI生产力工具。 这一功能不仅扩展了Perplexity的搜索与研究能力,还通过深度整合多种工具,将复杂的项目开发流程简化至数分钟。 AIbase基于最新信息整理,为您全面解析Perplexity Labs的核心功能及其潜在影响。
夸克上线“深度研究”:AI写报告不是梦,每天限量开放体验
5月,夸克正式上线全新“深度研究”功能,并面向用户限量邀请体验。 该功能依托通义千问大模型,支持围绕学术课题、行业分析等复杂议题,完成从资料搜集、数据分析、观点提炼到报告生成的全流程研究,实现“输入主题,输出成品”。 用户现可通过夸克 App 或 PC 端申请邀请码,激活资格后点击首页“深度研究”图标即可提交需求。
国家邮政局:加快邮政业科技发展,打造人工智能 + 邮政业标杆产品
国家邮政局今日下午举行新闻发布会,相关负责人介绍了《国家邮政局关于加快邮政业科技发展的意见》相关内容。
全流程昇腾平台训练,华为推出准万亿参数盘古 Ultra MoE 模型
华为今日宣布推出参数规模高达7180亿的全新模型盘古Ultra MoE,这是一个全流程在昇腾AI计算平台上训练的准万亿MoE模型。
机器狗能打羽毛球:仅靠强化学习从 0 自学,还会自己移步
该研究在各种环境中进行了大量实验,验证了四足机器人预测羽毛球轨迹、有效导航服务区域,以及对人类球员进行最精准打击的能力。证明了足式移动机器人在复杂和动态的体育场景中应用的可行性。
人工智能能耗有望在2025年底超越比特币挖矿
根据一项新的分析,人工智能的电力消耗预计将在2025年底前接近全球数据中心总电力消耗的一半,这意味着人工智能的能耗将很快超越比特币挖矿。 该分析由阿姆斯特丹自由大学环境研究所的博士生 Alex de Vries-Gao 进行,他曾跟踪研究过加密货币的电力消耗及其环境影响,并在他的网站 Digiconomist 上发布了相关数据。 目前,人工智能已经占据了数据中心电力消耗的高达五分之一。
小米多模态大模型 MiMo-VL 开源,官方称多方面领先 Qwen2.5-VL-7B
官方表示,其在图片、视频、语言的通用问答和理解推理等多个任务上,大幅领先同尺寸标杆多模态模型 Qwen2.5-VL-7B,并且在 GUI Grounding 任务上比肩专用模型,为 Agent 时代而来。
华为发布昇腾大模型:无GPU训练高数大题仅需2秒!
最近,华为通过其新推出的 “昇腾 Pangu Ultra MoE” 系统展示了一个令人惊叹的突破:一个近万亿参数的 MoE 大模型在短短2秒内就能理解并解答一道高等数学题。 而这一切都在没有使用 GPU 的情况下实现,显示出华为在自主可控的国产算力和模型训练方面的强大能力。 在技术层面,华为的团队成功提升了训练系统的整体性能,通过智能选择并行策略和优化计算通信,大幅提高了集群的训练效率。
元宝打通腾讯地图 移动版、网页版已正式上线
近日,元宝与腾讯地图正式实现打通,为用户带来更为精准和便捷的地点搜索及导航服务。 依托腾讯地图的强大功能,元宝在地点搜索方面的表现更加出色,能够满足用户多样化的需求。 现在,当用户询问“附近有修鞋的吗”或是“附近人均百元的粤菜馆有哪些”时,元宝能够结合地图信息,迅速给出准确的推荐。
新型人工智能检测可预测前列腺癌患者是否能从药物中获益
近日,国际医学界传来令人振奋的消息,一种新开发的人工智能(AI)工具可以预测哪些前列腺癌患者能够从一种能够将死亡风险降低一半的药物 —— 阿比特龙(abiraterone)中获益。 这种药物被称为前列腺癌治疗的 “游戏规则改变者”,在100多个国家中成为男性最常见的癌症治疗选择,已帮助数十万名晚期前列腺癌患者延长了生命。 然而,一些国家,尤其是英国,对于尚未扩散的前列腺癌患者并未广泛提供这款 “惊人的” 药物。
资讯热榜
标签云
AI
人工智能
OpenAI
AIGC
模型
ChatGPT
谷歌
DeepSeek
AI新词
AI绘画
大模型
机器人
数据
Midjourney
开源
Meta
微软
智能
用户
GPT
学习
英伟达
Gemini
智能体
技术
马斯克
Anthropic
图像
AI创作
训练
LLM
论文
AI for Science
代码
腾讯
苹果
算法
Agent
Claude
芯片
具身智能
Stable Diffusion
xAI
蛋白质
人形机器人
开发者
生成式
神经网络
机器学习
AI视频
3D
字节跳动
大语言模型
RAG
Sora
百度
研究
GPU
生成
华为
工具
AGI
计算
生成式AI
AI设计
大型语言模型
搜索
亚马逊
AI模型
视频生成
特斯拉
DeepMind
场景
Copilot
深度学习
Transformer
架构
MCP
编程
视觉