Meta
开源启动!18个月Llama系列下载量近3.5亿,黄仁勋:快到难以置信
今天一大早,Meta 便秀了一把「Llama 系列模型在开源领域取得的成绩」,包括如下:HuggingFace 下载量接近 3.5 亿次,较 2023 年同期增长了 10 倍;过去一个月下载量达到了 2000 万次,使得 Llama 成为领先的开源模型系列;云服务供应商对 Llama 需求巨大,自 5 月以来,Meta 最大云供应商的 token 使用量增加了一倍多;Llama 模型正被整个行业采用,包括 Accenture、ATT、DoorDash、GoldmanSachs 等。距离 Llama 3.1 的发布(
8/30/2024 5:30:00 PM
机器之心
一年翻番,OpenAI 称 ChatGPT AI 聊天机器人全球周活跃用户数量破 2 亿
科技媒体 Axios 今天(8 月 30 日)发布博文,报道称 OpenAI 的 AI 聊天机器人目前周活跃用户数量已经超过 2 亿,短短 1 年时间实现翻倍。OpenAI 还表示在全球财富 500 强企业中,92% 正在使用其产品;自 7 月份发布 GPT-4o mini 以来,其自动 API 的使用量已翻了一番。首席执行官山姆・阿尔特曼(Sam Altman)在给该媒体的一份声明中表示:人们正在使用我们的工具,将其融入到日常生活中,在医疗保健和教育等领域发挥着真正的作用,可以帮助完成日常任务、解决棘手问题,还是
8/30/2024 6:22:49 AM
故渊
Meta 研发新方法:整合语言和扩散 AI 模型,降低计算量、提高运算效率、优化生成图像
Meta AI 公司最新推出了 Transfusion 新方法,可以结合语言模型和图像生成模型,将其整合到统一的 AI 系统中。AI在线援引团队介绍,Transfusion 结合了语言模型在处理文本等离散数据方面的优势,以及扩散模型在生成图像等连续数据方面的能力。Meta 解释说,目前的图像生成系统通常使用预先训练好的文本编码器来处理输入的提示词,然后将其与单独的扩散模型结合起来生成图像。许多多模态语言模型的工作原理与此类似,它们将预先训练好的文本模型与用于其他模态的专用编码器连接起来。不过 Transfusion
8/24/2024 6:57:06 AM
故渊
Meta 部署新网络爬虫机器人,为其 AI 模型收集大量数据
北京时间 8 月 21 日,近日,Meta 悄悄地发布了一款新的网络爬虫,用于搜索互联网并收集大量数据,为其人工智能模型提供支持。据三家追踪网络抓取器的公司称,Meta 新网络爬虫机器人 Meta External Agent 于上月推出,类似于 OpenAI 的 GPTBot,可以抓取网络上的人工智能训练数据,例如新闻文章中的文本或在线讨论组中的对话。根据使用档案历史记录显示,Meta 确实在 7 月底更新了一个面向开发者的公司网站,其中一个标签显示了新爬虫的存在,但 Meta 至今还没有公开宣布其新爬虫机器人。
8/21/2024 1:10:05 PM
余青
Meta 深化与环球音乐合作:遏制 AI 音乐影响,提高艺术家报酬
Meta 公司昨日发布公告,宣布和环球音乐集团(Universal Music Group)深化合作,达成了新的多年合作协议。Meta 公司在公告中表示,新协议反映了双方共同致力于保护人类创作者和艺术,包括确保艺术家和词曲作者得到公平报酬,帮助艺术家和词曲作者在 Meta 平台上提供更广阔的发展空间和商业机遇。两家公司并未披露协议细节,不过双方表示会进一步推动 UMG 艺术家和环球音乐出版集团歌曲作者在 Facebook、Instagram、Messenger、Horizon、Threads 以及 WhatsApp
8/13/2024 7:41:51 AM
故渊
Meta 构建分布式 RoCEv2 网络:探索串联数万片 GPU,训练千亿参数级 AI 模型
Meta 公司于 8 月 5 日发布博文,表示为了满足大规模分布式 AI 训练对网络的需求,构建了基于 RoCEv2 协议的大规模 AI 网络。RoCEv2 的全称是 RDMA Over Converged Ethernet version 2,是一种节点间通信传输方式,用于大部分人工智能容量。Meta 公司已成功扩展了 RoCE 网络,从原型发展到部署了众多集群,每个集群可容纳数千个 GPU。这些 RoCE 集群支持广泛的生产型分布式 GPU 训练工作,包括排名、内容推荐、内容理解、自然语言处理和 GenAI 模
8/7/2024 7:35:32 AM
故渊
小扎自曝砸重金训 Meta Llama 4 模型:24 万块 GPU 齐发力,预计 2025 年发布
Llama 3.1 刚发布不久,Llama 4 已完全投入训练中。这几天,小扎在二季度财报会上称,Meta 将用 Llama 3 的十倍计算量,训练下一代多模态 Llama 4,预计在 2025 年发布。这笔账单,老黄又成为最大赢家十倍计算量,是什么概念?要知道,Llama 3 是在两个拥有 24,000 块 GPU 集群完成训练。也就是说,Llama 4 训练要用 24 万块 GPU。那么,Meta 存货还够不够?还记得小扎曾在年初宣布,计划到年底要部署 35 万块英伟达 H100。他还透露了更多的细节,Meta
8/5/2024 1:30:22 PM
汪淼
Meta 被曝向好莱坞明星“发钱”:以数百万美元“买下”声音授权用于 AI 项目
根据彭博社今天清晨的报道,几名熟悉谈判情况的消息人士称,Meta 公司正在向好莱坞明星们提供数百万美元,以获得他们的录音和在 AI 项目中使用他们的声音的权利。这些人士表示,该公司正在与朱迪・丹奇(Judi Dench)、奥卡菲娜(Awkwafina)和凯根・迈克尔・基(Keegan-Michael Key)进行谈判。由于项目保密,这些消息人士不愿透露姓名,Meta 公司的代表拒绝发表评论。图源 PexelsMeta 正在抓紧时间完成交易,从而为 AI 工具的开发争取时间 —— 该工具计划在 9 月的 Connec
8/3/2024 7:12:58 AM
清源
苹果 AI 版 iOS 登场,模型使用谷歌芯片;Meta 推新模型,与黄仁勋探讨 AI 与开源生态的未来丨AI情报局
今日融资快报基于 AI 的云平台 osapiens 获得 1.2 亿美元 B 轮融资osapiens是一家ESG软件解决方案提供商,开发软件即服务解决方案,帮助各行各业的公司快速、自动、安全地实施ESG要求。 公司核心是osapiens HUB,一个基于人工智能的云平台,在价值链上创造合规性和透明度。 它允许公司应对所有ESG挑战,以识别风险,实施CSRD、EUDR和CSDDD等报告要求,并使其运营流程在长期内更具可持续性。
7/31/2024 11:12:00 AM
我在思考中
攻击成功率从 3% 到接近 100%,利用空格键可绕过 Meta AI 模型安全系统
Meta 公司上周在发布 Llama 3.1 AI 模型的同时,还发布了 Prompt-Guard-86M 模型,主要帮助开发人员检测并响应提示词注入和越狱输入。AI在线在这里简要补充下背景知识:提示词注入(prompt injection):将恶意或非预期内容添加到提示中,以劫持语言模型的输出。提示泄露和越狱实际上是这种攻击的子集;提示词越狱(prompt jailbreaks):绕过安全和审查功能。不过根据科技媒体 theregister 报道,这个防止 AI 提示词注入和越狱的模型,本身也存在漏洞,用户只需要
7/31/2024 10:28:07 AM
故渊
Meta 叫停明星 AI 聊天机器人,转向用户自制 AI
据 The Information 报道,Meta 已经关闭了此前备受瞩目的明星 AI 聊天机器人功能。这些聊天机器人允许用户与模仿明星性格的 AI 进行对话,是去年九月 Meta Connect 大会上的重要亮点之一。AI在线注意到,Meta 周一推出了 AI Studio,该工具允许美国创作者打造自己的 AI 聊天机器人。从 Meta 官方声明来看,公司似乎更倾向于这种用户自主创作的方式,而非之前精心打造的明星机器人。Meta 发言人 Liz Sweeney 表示,用户将无法再与以明星为原型的 AI 角色互动。
7/31/2024 6:58:10 AM
远洋
Meta 发布 AI Studio:让用户零编程创建、分享和定制 AI 角色
Meta 公司昨日(7 月 29 日)发布 AI Studio,目标让用户创建、分享和定制 AI 角色。Meta AI Studio 基于 Llama 3.1 模型,在不需要任何技术或者技能情况下,可以让任何人都来创建定制 AI 角色。创建者可以将所创建的 AI 角色作为其延伸,回答私信或者回复网友,从而接触到更多受众。Meta 公司在新闻稿中写到:“我们的目标是构建所有人都能利用 AI 创意能力的世界,而 AI Studio 让我们迈出了第一步,这仅仅是开始”。AI在线注:Meta AI Studio 目前提供了
7/30/2024 2:40:07 PM
故渊
刚刚,Meta开源「分割一切」2.0模型,视频也能分割了
还记得 Meta 的「分割一切模型」吗?这个模型在去年 4 月发布,被很多人认为是颠覆传统 CV 任务的研究。时隔一年多,刚刚,Meta 在 SIGGRAPH 上重磅宣布 Segment Anything Model 2 (SAM 2) 来了。在其前身的基础上,SAM 2 的诞生代表了领域内的一次重大进步 —— 为静态图像和动态视频内容提供实时、可提示的对象分割,将图像和视频分割功能统一到一个强大的系统中。SAM 2 可以分割任何视频或图像中的任何对象 —— 甚至是它以前没有见过的对象和视觉域,从而支持各种不同的用
7/30/2024 11:38:00 AM
机器之心
Meta SAM 2 登场:首个能在图片和视频中实时分割对象的统一开源 AI 模型
感谢Meta 公司发布 Meta Segment Anything Model 2(SAM2),SAM 2 能分割任何目标,能在一个视频中实时追踪所有镜头 —— 解锁新的视频编辑能力并在混合现实中提供新的体验。Meta 公司今天发布新闻稿,介绍了全新的 Meta Segment Anything Model 2(SAM 2)模型,先支持分割视频和图像中的对象。开源Meta 公司宣布将以 Apache 2.0 许可发布 SAM 2,因此任何人都可以使用它来构建自己的体验。Meta 还将以 CC BY 4.0 许可共享
7/30/2024 9:58:28 AM
故渊
Meta 训练 Llama 3 遭遇频繁故障:16384 块 H100 GPU 训练集群每 3 小时“罢工”一次
Meta 发布的一份研究报告显示,其用于训练 4050 亿参数模型 Llama 3 的 16384 个英伟达 H100 显卡集群在 54 天内出现了 419 次意外故障,平均每三小时就有一次。其中,一半以上的故障是由显卡或其搭载的高带宽内存(HBM3)引起的。由于系统规模巨大且任务高度同步,单个显卡故障可能导致整个训练任务中断,需要重新开始。尽管如此,Meta 团队还是保持了 90% 以上的有效训练时间。AI在线注意到,在为期 54 天的预预训练中,共出现了 466 次工作中断,其中 47 次是计划中断,419 次
7/28/2024 7:20:54 PM
远洋
AI 法律公司 Clio 获 9 亿美元融资;阿里云、腾讯云推出 Llama3.1 训练推理服务;可灵国际版上线丨AI科技评论
今日融资快报AI 法律公司 Clio 完成 F 轮 9 亿美元融资AI 法律科技公司 Clio 宣布完成 F 轮 9 亿美元融资,估值达到 30 亿美元。 Clio 的正式名称为 Themis Solutions Inc.,销售律师事务所用来管理其业务运营的一套云应用程序。 旗下产品 Clio Accounting 是一款应用程序,可帮助律师事务所的财务团队更高效地开展日常工作。
7/25/2024 9:46:00 AM
我在思考中
击败GPT-4o的开源模型如何炼成?关于Llama 3.1 405B,Meta都写在这篇论文里了
经历了提前两天的「意外泄露」之后,Llama 3.1 终于在昨夜由官方正式发布了。Llama 3.1 将上下文长度扩展到了 128K,拥有 8B、70B 和 405B 三个版本,再次以一已之力抬高了大模型赛道的竞争标准。对 AI 社区来说,Llama 3.1 405B 最重要的意义是刷新了开源基础模型的能力上限,Meta 官方称,在一系列任务中,其性能可与最好的闭源模型相媲美。下表展示了当前 Llama 3 系列模型在关键基准测试上的性能。可以看出,405B 模型的性能与 GPT-4o 十分接近。与此同时,Meta
7/24/2024 2:35:00 PM
机器之心
最强模型Llama 3.1 405B正式发布,扎克伯格:开源引领新时代
刚刚,大家期待已久的 Llama 3.1 官方正式发布了!Meta 官方发出了「开源引领新时代」的声音。在官方博客中,Meta 表示:「直到今天,开源大语言模型在功能和性能方面大多落后于封闭模型。现在,我们正在迎来一个开源引领的新时代。我们公开发布 Meta Llama 3.1 405B,我们认为这是世界上最大、功能最强大的开源基础模型。迄今为止,所有 Llama 版本的总下载量已超过 3 亿次,我们才刚刚开始。」Meta 创始人、CEO 扎克伯格也亲自写了篇长文《Open Source AI Is the Pat
7/24/2024 2:16:00 PM
机器之心
资讯热榜
标签云
AI
人工智能
OpenAI
AIGC
模型
ChatGPT
DeepSeek
谷歌
AI绘画
大模型
机器人
数据
Midjourney
AI新词
开源
Meta
微软
智能
用户
GPT
学习
技术
智能体
马斯克
Gemini
Anthropic
英伟达
图像
AI创作
训练
LLM
论文
代码
算法
AI for Science
Agent
苹果
Claude
芯片
腾讯
Stable Diffusion
蛋白质
开发者
xAI
具身智能
生成式
神经网络
机器学习
3D
RAG
AI视频
人形机器人
研究
大语言模型
百度
生成
Sora
GPU
工具
华为
计算
字节跳动
AI设计
AGI
大型语言模型
搜索
视频生成
生成式AI
场景
DeepMind
深度学习
AI模型
特斯拉
架构
MCP
亚马逊
Transformer
编程
视觉
预测