大语言模型(LLM)

字节跳动发布高效预训练长度缩放技术，突破长序列训练瓶颈

字节跳动发布高效预训练长度缩放技术，突破长序列训练瓶颈

字节跳动宣布推出高效预训练长度缩放技术（Efficient Pretraining Length Scaling），通过创新的Parallel Hidden Decoding Transformer(PHD-Transformer)框架，显著提升大语言模型(LLM)在长序列预训练中的效率与性能。据AIbase了解，该技术在保持推理效率的同时，支持高达2048K(2M)的上下文长度训练，解决了传统框架在数据异构性与计算平衡上的瓶颈。相关研究已在arXiv公开，引发了AI研究社区的广泛关注。

4/23/2025 3:00:42 PM AI在线

GLM-4-32B 与 GLM-Z1-32B 在 OpenRouter 上线，免费开放

GLM-4-32B 与 GLM-Z1-32B 在 OpenRouter 上线，免费开放

清华大学 KEG 实验室（THUDM）研发的 GLM-4-32B 及 GLM-Z1-32B 两款前沿大语言模型(LLM)正式在 OpenRouter 平台上线，且完全免费向全球用户开放。这一里程碑式的事件标志着高性能 AI 模型的普及迈出了重要一步，为开发者、研究人员及 AI 爱好者提供了强大的工具，以推动人工智能应用的进一步创新。模型上线:性能强劲，免费开放GLM-4-32B 作为一款拥有320亿参数的通用大语言模型，以其在复杂推理、数学能力及多语言处理方面的卓越表现，成为当前开源 LLM 领域的佼佼者。

4/22/2025 9:00:40 AM AI在线

Persona Engine开源发布，AI虚拟助手与Live2D融合打造交互新体验

Persona Engine开源发布，AI虚拟助手与Live2D融合打造交互新体验

近日，Persona Engine（人格引擎）项目正式开源，凭借其融合大语言模型(LLM)、Live2D、自动语音识别(ASR)、文本转语音(TTS)以及实时语音克隆(RVC)等前沿技术的强大功能，引发了AI与虚拟内容创作领域的广泛关注。据AIbase了解，该项目通过赋予虚拟角色自然对话与动态表情能力，实现了与虚拟人物的实时交互，特别适用于VTubing、直播和虚拟助手场景。项目已在GitHub上线，标志着AI驱动虚拟交互技术的又一里程碑。

4/21/2025 11:00:47 AM AI在线

Intel 开源 AI Playground，可用intel Arc 显卡使用各种AI模型

Intel 开源 AI Playground，可用intel Arc 显卡使用各种AI模型

Intel 宣布将其生成式 AI 软件 AI Playground 正式开源，这一举措引发了 AI 社区的广泛关注。作为一款专为 Intel Arc GPU 和集成显卡优化的 AI 工具，AI Playground 被描述为一个“AI 中心”，支持本地运行聊天式大语言模型（LLM）以及图像和视频生成功能。此次开源标志着 Intel 在推动生成式 AI 技术普及和社区协作方面迈出了重要一步。

4/21/2025 9:00:47 AM AI在线

清华与上海 AI Lab 联合打造新型过程奖励模型GenPRM，让小模型超越 GPT-4o

清华与上海 AI Lab 联合打造新型过程奖励模型GenPRM，让小模型超越 GPT-4o

在人工智能领域，随着 OpenAI 的 o1和 DeepSeek 的 R1模型受到广泛关注，大语言模型（LLM）的推理能力和测试时扩展(TTS)技术引发了众多研究者的兴趣。然而，在处理复杂推理问题时，如何准确评估模型每一步的回答质量，依然是一个亟待解决的难题。为此，清华大学与上海 AI Lab 共同提出了生成式过程奖励模型(GenPRM)，为过程监督推理提供了创新解决方案。

4/14/2025 3:01:07 PM AI在线

MCP生态崛起，六行代码打造智能AI代理

MCP生态崛起，六行代码打造智能AI代理

随着人工智能技术的飞速发展，模型上下文协议（Model Context Protocol，MCP）生态正在成为连接大语言模型(LLM)与外部工具的桥梁，赋予AI前所未有的操作能力。 MCP作为由Anthropic于2024年11月推出的开源协议，旨在标准化LLM与外部数据源和工具的交互方式。开发者们称其为“AI的USB-C接口”。

4/14/2025 10:01:22 AM AI在线

王兴：美团已开发内部大模型LongCat 投资数十亿元GPU资源

王兴：美团已开发内部大模型LongCat 投资数十亿元GPU资源

近日，美团正式公布了其2024年第四季度及全年财务报告。据财报显示，美团在2024年全年实现了3376亿元人民币的营收，与去年同期相比增长了22%，彰显了公司稳健且持续的增长动力。在随后的业绩发布会上，美团首席执行官王兴详细阐述了公司对于人工智能（AI）领域的战略规划。

3/24/2025 4:00:41 PM AI在线

AMD发布GAIA开源项目助力本地大语言模型高效运行

AMD发布GAIA开源项目助力本地大语言模型高效运行

近日，AMD 宣布推出一款名为 GAIA 的开源应用，旨在为用户提供一种高效、本地化的方式来运行大语言模型（LLM）。目前，该应用已支持 Windows 平台，特别为锐龙 AI300系列处理器进行了优化，充分发挥了这些处理器在 AI 任务中的优势。 GAIA 是一个生成式 AI 应用，用户可以在个人电脑上私密地运行 LLM，确保数据隐私。

3/24/2025 9:40:00 AM AI在线

CMU 团队推出元强化微调：提升大语言模型推理能力的新范式

CMU 团队推出元强化微调：提升大语言模型推理能力的新范式

在人工智能领域，大语言模型（LLM）正在不断进化，最近，卡内基梅隆大学(CMU)与 HuggingFace 的研究者们共同提出了一种名为 “元强化微调”(Meta Reinforcement Fine-Tuning，简称 MRT)的新方法。这一方法旨在优化大语言模型在测试时的计算效率，尤其是在解决复杂推理问题时，表现尤为突出。研究表明，现有的大语言模型在推理过程中常常消耗过多的计算资源，而 MRT 的目标是让模型在给定的计算预算内，实现更高效的答案发现。

3/13/2025 11:37:00 AM AI在线

Firecrawl推出LLM.txt API：提供网址即可生成任意网站的LLM.txt

Firecrawl推出LLM.txt API：提供网址即可生成任意网站的LLM.txt

近日，Firecrawl 推出了一项全新的功能 ——LLMs.txt 生成器接口（Alpha 版），旨在帮助用户将任何网站的内容转化为清晰、适用于大语言模型(LLM)训练的文本文件。用户只需提供一个网站的 URL，Firecrawl 便会对该网站及其链接页面进行抓取，生成两种格式的文本文件:llms.txt 和 llms-full.txt，便于后续的分析和训练。该生成器的工作流程相对简单。

3/10/2025 9:48:00 AM AI在线

资讯热榜

免费！让图片放大不失真的位图转矢量图神器 Tmttool AI应用新纪元：2025中国AI应用排行榜榜单揭晓丨2025年1月 6秒视频10秒生成！全新AI视频神器 Grok Imagine 深度体验+元提示词分享最火、最全的Agent记忆综述，NUS、人大、复旦、北大等联合出品后悔没早发现！教你用谷歌Gemini生成精美PPT（附提示词） GGUF 是什么？一文看懂大模型里最火的模型格式 Sora、可灵、即梦哪家强？AI视频软件深度测评！ Mac也能跑Qwen3，一文看懂本地部署qwen 3配置要求

标签云

AI 人工智能 OpenAI AIGC 模型 ChatGPT 谷歌 DeepSeek AI新词 AI绘画大模型机器人数据 Midjourney 开源 Meta 微软智能用户 GPT 学习英伟达 Gemini 智能体技术马斯克 Anthropic 图像 AI创作训练 LLM 论文 AI for Science 代码腾讯苹果算法 Agent Claude 芯片具身智能 Stable Diffusion xAI 蛋白质人形机器人开发者生成式神经网络机器学习 AI视频 3D 字节跳动大语言模型 RAG Sora 百度研究 GPU 生成华为工具 AGI 计算生成式AI AI设计大型语言模型搜索亚马逊 AI模型视频生成特斯拉 DeepMind 场景 Copilot 深度学习 Transformer 架构 MCP 编程视觉