AI在线 AI在线

Meta

Meta 构建分布式 RoCEv2 网络:探索串联数万片 GPU,训练千亿参数级 AI 模型

Meta 公司于 8 月 5 日发布博文,表示为了满足大规模分布式 AI 训练对网络的需求,构建了基于 RoCEv2 协议的大规模 AI 网络。RoCEv2 的全称是 RDMA Over Converged Ethernet version 2,是一种节点间通信传输方式,用于大部分人工智能容量。Meta 公司已成功扩展了 RoCE 网络,从原型发展到部署了众多集群,每个集群可容纳数千个 GPU。这些 RoCE 集群支持广泛的生产型分布式 GPU 训练工作,包括排名、内容推荐、内容理解、自然语言处理和 GenAI 模
8/7/2024 7:35:32 AM
故渊

小扎自曝砸重金训 Meta Llama 4 模型:24 万块 GPU 齐发力,预计 2025 年发布

Llama 3.1 刚发布不久,Llama 4 已完全投入训练中。这几天,小扎在二季度财报会上称,Meta 将用 Llama 3 的十倍计算量,训练下一代多模态 Llama 4,预计在 2025 年发布。这笔账单,老黄又成为最大赢家十倍计算量,是什么概念?要知道,Llama 3 是在两个拥有 24,000 块 GPU 集群完成训练。也就是说,Llama 4 训练要用 24 万块 GPU。那么,Meta 存货还够不够?还记得小扎曾在年初宣布,计划到年底要部署 35 万块英伟达 H100。他还透露了更多的细节,Meta
8/5/2024 1:30:22 PM
汪淼

Meta 被曝向好莱坞明星“发钱”:以数百万美元“买下”声音授权用于 AI 项目

根据彭博社今天清晨的报道,几名熟悉谈判情况的消息人士称,Meta 公司正在向好莱坞明星们提供数百万美元,以获得他们的录音和在 AI 项目中使用他们的声音的权利。这些人士表示,该公司正在与朱迪・丹奇(Judi Dench)、奥卡菲娜(Awkwafina)和凯根・迈克尔・基(Keegan-Michael Key)进行谈判。由于项目保密,这些消息人士不愿透露姓名,Meta 公司的代表拒绝发表评论。图源 PexelsMeta 正在抓紧时间完成交易,从而为 AI 工具的开发争取时间 —— 该工具计划在 9 月的 Connec
8/3/2024 7:12:58 AM
清源

苹果 AI 版 iOS 登场,模型使用谷歌芯片;Meta 推新模型,与黄仁勋探讨 AI 与开源生态的未来丨AI情报局

今日融资快报基于 AI 的云平台 osapiens 获得 1.2 亿美元 B 轮融资osapiens是一家ESG软件解决方案提供商,开发软件即服务解决方案,帮助各行各业的公司快速、自动、安全地实施ESG要求。 公司核心是osapiens HUB,一个基于人工智能的云平台,在价值链上创造合规性和透明度。 它允许公司应对所有ESG挑战,以识别风险,实施CSRD、EUDR和CSDDD等报告要求,并使其运营流程在长期内更具可持续性。
7/31/2024 11:12:00 AM
我在思考中

攻击成功率从 3% 到接近 100%,利用空格键可绕过 Meta AI 模型安全系统

Meta 公司上周在发布 Llama 3.1 AI 模型的同时,还发布了 Prompt-Guard-86M 模型,主要帮助开发人员检测并响应提示词注入和越狱输入。AI在线在这里简要补充下背景知识:提示词注入(prompt injection):将恶意或非预期内容添加到提示中,以劫持语言模型的输出。提示泄露和越狱实际上是这种攻击的子集;提示词越狱(prompt jailbreaks):绕过安全和审查功能。不过根据科技媒体 theregister 报道,这个防止 AI 提示词注入和越狱的模型,本身也存在漏洞,用户只需要
7/31/2024 10:28:07 AM
故渊

Meta 叫停明星 AI 聊天机器人,转向用户自制 AI

据 The Information 报道,Meta 已经关闭了此前备受瞩目的明星 AI 聊天机器人功能。这些聊天机器人允许用户与模仿明星性格的 AI 进行对话,是去年九月 Meta Connect 大会上的重要亮点之一。AI在线注意到,Meta 周一推出了 AI Studio,该工具允许美国创作者打造自己的 AI 聊天机器人。从 Meta 官方声明来看,公司似乎更倾向于这种用户自主创作的方式,而非之前精心打造的明星机器人。Meta 发言人 Liz Sweeney 表示,用户将无法再与以明星为原型的 AI 角色互动。
7/31/2024 6:58:10 AM
远洋

Meta 发布 AI Studio:让用户零编程创建、分享和定制 AI 角色

Meta 公司昨日(7 月 29 日)发布 AI Studio,目标让用户创建、分享和定制 AI 角色。Meta AI Studio 基于 Llama 3.1 模型,在不需要任何技术或者技能情况下,可以让任何人都来创建定制 AI 角色。创建者可以将所创建的 AI 角色作为其延伸,回答私信或者回复网友,从而接触到更多受众。Meta 公司在新闻稿中写到:“我们的目标是构建所有人都能利用 AI 创意能力的世界,而 AI Studio 让我们迈出了第一步,这仅仅是开始”。AI在线注:Meta AI Studio 目前提供了
7/30/2024 2:40:07 PM
故渊

刚刚,Meta开源「分割一切」2.0模型,视频也能分割了

还记得 Meta 的「分割一切模型」吗?这个模型在去年 4 月发布,被很多人认为是颠覆传统 CV 任务的研究。时隔一年多,刚刚,Meta 在 SIGGRAPH 上重磅宣布 Segment Anything Model 2 (SAM 2) 来了。在其前身的基础上,SAM 2 的诞生代表了领域内的一次重大进步 —— 为静态图像和动态视频内容提供实时、可提示的对象分割,将图像和视频分割功能统一到一个强大的系统中。SAM 2 可以分割任何视频或图像中的任何对象 —— 甚至是它以前没有见过的对象和视觉域,从而支持各种不同的用
7/30/2024 11:38:00 AM
机器之心

Meta SAM 2 登场:首个能在图片和视频中实时分割对象的统一开源 AI 模型

感谢Meta 公司发布 Meta Segment Anything Model 2(SAM2),SAM 2 能分割任何目标,能在一个视频中实时追踪所有镜头 —— 解锁新的视频编辑能力并在混合现实中提供新的体验。Meta 公司今天发布新闻稿,介绍了全新的 Meta Segment Anything Model 2(SAM 2)模型,先支持分割视频和图像中的对象。开源Meta 公司宣布将以 Apache 2.0 许可发布 SAM 2,因此任何人都可以使用它来构建自己的体验。Meta 还将以 CC BY 4.0 许可共享
7/30/2024 9:58:28 AM
故渊

Meta 训练 Llama 3 遭遇频繁故障:16384 块 H100 GPU 训练集群每 3 小时“罢工”一次

Meta 发布的一份研究报告显示,其用于训练 4050 亿参数模型 Llama 3 的 16384 个英伟达 H100 显卡集群在 54 天内出现了 419 次意外故障,平均每三小时就有一次。其中,一半以上的故障是由显卡或其搭载的高带宽内存(HBM3)引起的。由于系统规模巨大且任务高度同步,单个显卡故障可能导致整个训练任务中断,需要重新开始。尽管如此,Meta 团队还是保持了 90% 以上的有效训练时间。AI在线注意到,在为期 54 天的预预训练中,共出现了 466 次工作中断,其中 47 次是计划中断,419 次
7/28/2024 7:20:54 PM
远洋

AI 法律公司 Clio 获 9 亿美元融资;阿里云、腾讯云推出 Llama3.1 训练推理服务;可灵国际版上线丨AI科技评论

今日融资快报AI 法律公司 Clio 完成 F 轮 9 亿美元融资AI 法律科技公司 Clio 宣布完成 F 轮 9 亿美元融资,估值达到 30 亿美元。 Clio 的正式名称为 Themis Solutions Inc.,销售律师事务所用来管理其业务运营的一套云应用程序。 旗下产品 Clio Accounting 是一款应用程序,可帮助律师事务所的财务团队更高效地开展日常工作。
7/25/2024 9:46:00 AM
我在思考中

击败GPT-4o的开源模型如何炼成?关于Llama 3.1 405B,Meta都写在这篇论文里了

经历了提前两天的「意外泄露」之后,Llama 3.1 终于在昨夜由官方正式发布了。Llama 3.1 将上下文长度扩展到了 128K,拥有 8B、70B 和 405B 三个版本,再次以一已之力抬高了大模型赛道的竞争标准。对 AI 社区来说,Llama 3.1 405B 最重要的意义是刷新了开源基础模型的能力上限,Meta 官方称,在一系列任务中,其性能可与最好的闭源模型相媲美。下表展示了当前 Llama 3 系列模型在关键基准测试上的性能。可以看出,405B 模型的性能与 GPT-4o 十分接近。与此同时,Meta
7/24/2024 2:35:00 PM
机器之心

最强模型Llama 3.1 405B正式发布,扎克伯格:开源引领新时代

刚刚,大家期待已久的 Llama 3.1 官方正式发布了!Meta 官方发出了「开源引领新时代」的声音。在官方博客中,Meta 表示:「直到今天,开源大语言模型在功能和性能方面大多落后于封闭模型。现在,我们正在迎来一个开源引领的新时代。我们公开发布 Meta Llama 3.1 405B,我们认为这是世界上最大、功能最强大的开源基础模型。迄今为止,所有 Llama 版本的总下载量已超过 3 亿次,我们才刚刚开始。」Meta 创始人、CEO 扎克伯格也亲自写了篇长文《Open Source AI Is the Pat
7/24/2024 2:16:00 PM
机器之心

你想成为什么模样?Meta AI 测试 Imagine Me 功能:一图一句话帮你“实现”

Meta 公司昨日发布 Llama 3.1 开源 AI 模型之外,还更新扩充了 Meta AI 功能,其中最值得关注的是引入了“Imagine Me”新功能。Meta 公司目前正在美国地区邀请用户测试,用户上传自拍照,然后使用“Imagine me as xxx”(假设我是 xxx)文字提示词(例如宇航员、医生等等),可以生成各种个性化照片。AI在线注:Meta AI 是其个人数字助理,可用于 WhatsApp、Instagram、Facebook 和 Messenger 等 Meta 服务,现在美国用户可以在 M
7/24/2024 2:12:41 PM
故渊

边缘人工智能提供商 Gcore 获 6000 万美元融资;马斯克开训最大 AI 集群,目标年底开发全球最强 AI丨AI情报局

今日融资快报边缘人工智能、云、网络和安全解决方案提供商Gcore获6000万美元A轮融资Gcore 的云基础设施专为边缘而构建,为边缘的 LLM 训练和人工智能应用程序的推理提供支持。 融资由Wargaming 领投,Constructor Capital 和 Han River Partners 跟投。 这些资金将战略性投资于 Gcore 的技术和平台,包括由 NVIDIA GPU 驱动的 AI 服务器,以推动 AI 主导的创新。
7/24/2024 9:58:00 AM
我在思考中

Meta 发布 Llama 3.1 开源大语言模型:128K 上下文长度,405B 版可与 GPT-4o 和 Claude 3.5 Sonnet 媲美

感谢Meta 今晚正式发布 Llama 3.1 开源大语言模型,提供 8B、70B 及 405B 参数版本。据介绍,Llama 3.1 系列改进了推理能力及多语言支持,上下文长度提升至 128K,首次推出 405B 参数的旗舰模型。Meta 称 4050 亿参数的 Llama 3.1-405B 在常识、可引导性、数学、工具使用和多语言翻译等一系列任务中,可与 GPT-4、GPT-4o、Claude 3.5 Sonnet 等领先的闭源模型相媲美。此外,8B 与 70B 参数的 Llama 3.1 模型与其他参数量相似
7/23/2024 11:38:18 PM
泓澄(实习)

首个超越GPT4o级开源模型!Llama 3.1泄密:4050亿参数,下载链接、模型卡都有了

快准备好你的 GPU!Llama 3.1 终于现身了,不过出处却不是 Meta 官方。今日,Reddit 上新版 Llama 大模型泄露的消息遭到了疯传,除了基础模型,还包括 8B、70B 和最大参数的 405B 的基准测试结果。下图为 Llama 3.1 各版本与 OpenAI GPT-4o、Llama 3 8B/70B 的比较结果。可以看到,即使是 70B 的版本,也在多项基准上超过了 GPT-4o。                           图源:,3.1 版本的 8B 和 70B 模型是由 405
7/23/2024 11:17:00 AM
机器之心

开源 AI 模型挑战闭源里程碑?Meta Llama 3.1-405B 多项跑分超越 OpenAI GPT-4o

网友在 LocalLLaMA 子 Reddit 板块中发帖,分享了 4050 亿参数的 Meta Llama 3.1 信息,从该 AI 模型在几个关键 AI 基准测试的结果来看,其性能超越目前的领先者(OpenAI 的 GPT-4o)。这是开源人工智能社区的一个重要里程碑,标志着开源模型可能首次击败目前最先进的闭源 LLM 模型。如基准测试所示,Meta Llama 3.1 在 GSM8K、Hellaswag、boolq、MMLU-humanities、MMLU-other、MMLU-stem 和 winograd
7/23/2024 7:26:36 AM
故渊