理论
大模型结构化推理优势难复制到垂直领域!最新法律AI评估标准来了,抱抱脸评测集趋势第一
大模型推理,无疑是当下最受热议的科技话题之一。 但在数学和物理等STEM之外,当LLM落到更多实际应用领域之中,大模型的推理能力又有多大的潜能和局限? 比如,如何评估大模型的推理能力在法律领域的应用,就在当前备受关注。
6/6/2025 9:00:00 AM
LLM 协作革命:Group Think 如何重塑推理边界
大家好,我是肆〇柒。 今天和大家聊聊 Group Think。 顾名思义,它通过让单个 LLM 模拟多个并行推理智能体,并以 token 级别的细粒度协作,提出了推理协作的新范式。
6/6/2025 8:57:42 AM
肆零柒
RL后训练步入超节点时代!华为黑科技榨干算力,一张卡干俩活
在大模型竞赛白热化的当下,「强化学习后训练」已成为突破LLM性能天花板的核心路径。 爆火出圈的OpenAI o1、DeepSeek-R1等模型,背后都是依靠RL后训练点石成金。 相较于预训练阶段的「广撒网」式知识获取,RL 后训练通过驱动模型与外部环境进行动态交互,直接塑造了LLM在复杂任务中的推理效能。
6/6/2025 8:55:00 AM
上海AI实验室造出首个「通才」机器人大脑:看懂世界+空间推理+精准操控全拿下
机器人的新大脑框架来了! 上海人工智能实验室联合多家单位提出了一种全新的通用具身智能大脑框架:Visual Embodied Brain,简称VeBrain。 该模型通过同时集成视觉感知、空间推理和机器人控制能力,可实现多模态大模型(MLLM)对物理实体的直接操控,使机器人能像人类一样“看到-思考-行动”。
6/6/2025 8:52:00 AM
RAG、向量数据库和LLM搜索:人工智能驱动商业智能的未来
译者 | 李睿审校 | 重楼本文对RAG、向量数据库和LLM搜索如何塑造人工智能驱动的商业智能未来进行探讨。 RAG通过集成知识检索提升LLM性能,解决其无法及时纳入最新或专有信息的问题,尤其在客户服务领域影响显著。 向量数据库则支持快速相似性搜索,理解查询语义。
6/6/2025 8:39:15 AM
李睿
如何重构复杂的代码库 – 面向开发人员的实用指南
译者 | 刘涛审校 | 重楼目录重构概述重构前期准备争取管理层支持通过自动化测试确保安全保障识别高风险区域设定明确的重构目标复杂代码库的重构技巧识别并隔离问题区域渐进式重构与大爆炸式重构拆分单体代码确保向后兼容性处理依赖关系与紧密耦合测试策略(自信地安全重构)在不降低性能的前提下进行重构使用人工智能工具自动化代码审查总结一、重构概述重构是一种对代码开展持续优化的重要手段,其核心目标在于降低代码的复杂程度,削减技术债务。 通过不断完善代码库来解决项目推进过程中出现的代码结构恶化问题,它能将杂乱无章或低效的代码转变为结构良好、便于维护的解决方案。 二、重构前期准备在着手进行代码重构之前,搭建一个坚实稳固的基础有着举足轻重的意义。
6/6/2025 8:36:21 AM
刘涛
Cursor 1.0 终于来了
自2023年首次发布以来,Cursor终于迎来了它的第一个重大版本更新——Cursor 1.0正式发布了! 这次更新令人非常兴奋,因为Cursor已经成为我一年多来最常用的AI编程工具。 OpenAI曾多次尝试收购这款应用,但交易最终未能达成。
6/6/2025 8:13:47 AM
前端小智
如何利用AI改造智能电网
2023年,能源和公用事业领域的AI全球市场规模达到了105.6亿美元,预计到2030年将激增至457.8亿美元,这标志着AI将在重塑未来电力系统方面发挥关键作用。 与此同时,非洲城市正处于能源转型的关键节点,整个非洲大陆仍有近6亿人无法用电,若不首先对基础电网设施进行现代化改造,建设包容性且可持续的智慧城市的目标将难以实现。 随着对老旧资产的升级改造以及对服务不足社区的电力接入扩展工作的加强,AI正迅速成为这一转型的催化剂。
6/6/2025 7:02:00 AM
Satyajit
OpenAI付费企业用户猛增至300万 直击微软谷歌AI腹地
OpenAI周三宣布,自2月份以来,其企业用户群激增了50%,付费企业客户已达300万,与此同时,这家AI公司推出了一系列全新的工作场所工具,旨在与微软的企业级AI产品展开直接竞争。 这一里程碑是在推出几项新的面向企业的功能时公布的,凸显了OpenAI在可靠、安全的AI工具能够收取高价的企业市场中的积极扩张,该公司推出了新的“连接器”,这些连接器将ChatGPT与流行的商业应用程序集成在一起,还推出了一项名为“记录模式”(Record Mode)的会议转录功能,并对其深度研究(Deep Research)和Codex编码工具进行了增强。 “ChatGPT正在帮助企业转型,帮助员工更高效、更战略性地工作,”OpenAI的一位发言人告诉记者,“在过去的几个月里,我们一直在不断将ChatGPT发展成为一个对工作越来越有影响力的平台,提供了连接器、与ChatGPT集成的记录模式、Codex、图像生成、深度研究等商业产品。
6/6/2025 7:00:00 AM
Michael
LLM 的 SFT 与 RL:差异几何?
在大型语言模型(LLM)的训练领域,监督微调(SFT)和强化学习(RL)是两种备受瞩目的训练策略。 尽管它们各自有着独特的机制和侧重点,但笔者经过深入研究和实践观察发现,二者之间的差别并非如表面上那般显著,以下是具体的分析与对比。 一、核心原理的相近性SFT 的本质 :SFT 主要是利用标注好的数据集对预训练的 LLM 进行进一步训练,通过最小化模型输出与标注答案之间的差异,来调整模型的参数。
6/6/2025 4:10:00 AM
小智
结合LangGraph、DeepSeek-R1和Qdrant 的混合 RAG 技术实践
一、引言:混合RAG技术的发展与挑战在人工智能领域,检索增强生成(RAG)技术正成为构建智能问答系统的核心方案。 传统RAG通过向量数据库存储文档嵌入并检索相关内容,结合大语言模型(LLM)生成回答,有效缓解了LLM的“幻觉”问题。 然而,单一的稠密向量检索(如基于Transformer的嵌入模型)在处理关键词匹配和多义词歧义时存在局限性,而稀疏向量检索(如BM25)虽擅长精确关键词匹配,却缺乏语义理解能力。
6/6/2025 3:11:00 AM
大模型之路
三步搭建MCP服务器,让AI工具直接调用n8n工作流
今天我们将视角转向服务端实现。 n8n 自 1.88.0 版本起,引入了一个革命性特性——MCP Server Trigger 节点。 这一创新让开发者能够将复杂的工作流包装成标准化的 MCP 服务,通过 SSE(Server-Sent Events)协议对外发布。
6/6/2025 2:11:00 AM
林月半子聊AI
Qwen和DeepSeek为何都选YaRN?
这篇文章,我们还是从面试官的视角出发,一起来分析一下,如果你在面试现场被问到这个题目,应该如何回答? 1.面试官心理分析首先还是分析一下面试官的心理,面试官问这个问题,主要是想考察三点:第一,你知不知道长度外推这个概念? 很多同学可能听都没听过这个概念,那这个问题当然也就无从答起了。
6/6/2025 1:26:00 AM
丁师兄
《圣经》成书时间或被改写!AI竟发现《死海古卷》早于所罗门时代
就在刚刚,科学家用AI重新定义了《死海古卷》历史时间线! 许多卷轴其实比原先认为年代还要早很多,两卷《死海古卷》竟是《但以理书》的最早片段! 研究还显示,《传道书》很可能由无名作者在公元前三世纪完成,而非传统所称的所罗门王!
6/6/2025 1:25:00 AM
新智元
“一代更比一代强”:现代 RAG 架构的演进之路
基于 RAG(检索增强生成)的 AI 系统,过去是,现在仍然是企业利用大语言模型(LLM)的最有价值的应用之一。 我记得差不多两年前我写了第一篇关于 RAG 的文章,那时候这个术语还未被广泛采用。 我当时描述的是一个以最基础方式实现的 RAG 系统。
6/6/2025 1:15:00 AM
Baihai IDP
人工智能和知识图谱六:知识图谱的行业用例
一、医疗保健与生命科学在制药和生物技术领域,知识图谱正在加速药物发现和再利用。 这些知识图谱将异构生物医学数据整合到单一知识网络中,比如基因、蛋白质、疾病、药物、临床试验、文献等。 研究人员可以查询或分析该图谱,以发现不明显的联系,例如,与两种看似不相关的疾病有关的基因可能暗示着共同的靶向途径。
6/6/2025 1:00:00 AM
晓晓
大模型公司挖墙脚哪家强?报告:Anthropic人才吸引力是OpenAI的8倍,留存率达80%
大模型公司挖墙脚哪家强,Anthropic才是最大赢家? 不仅顶尖AI人才的留存率达到80%,而且工程师从OpenAI跳槽到Anthropic的可能性是从Anthropic转投OpenAI的8倍。 不止OpenAI,大型科技公司也是Anthropic主要的人才猎场。
6/6/2025 12:33:00 AM
超实用!Dify调用Java的三种实现方式!
在一些复杂的业务中,我们可能需要使用 Dify 调用外部程序(如 Java 程序),因为这样才能满足业务的特殊需求。 例如,当我们使用 Dify 实现“AI 简历自动筛选器”的时候,我们首先会使用 AI 筛选出符合招聘要求的简历,然后再将简历存放到公司的“人才库”系统中,完成后续流程的招聘需要(预约面试、面试评价、发送 Offer 等操作),这个时候就需要让 Dify 调用 Java 程序了。 那么问题来了,使用 Dify 调用 Java 程序的实现方式有哪些呢?
6/6/2025 12:00:00 AM
磊哥
资讯热榜
标签云
AI
人工智能
OpenAI
AIGC
模型
ChatGPT
DeepSeek
谷歌
AI绘画
机器人
数据
大模型
Midjourney
开源
智能
Meta
用户
微软
GPT
学习
技术
AI新词
图像
Gemini
智能体
马斯克
AI创作
Anthropic
英伟达
论文
训练
代码
算法
LLM
Stable Diffusion
芯片
腾讯
苹果
蛋白质
Claude
开发者
AI for Science
Agent
生成式
神经网络
机器学习
3D
xAI
研究
人形机器人
生成
AI视频
百度
工具
计算
Sora
GPU
华为
大语言模型
RAG
具身智能
AI设计
字节跳动
搜索
大型语言模型
场景
AGI
深度学习
视频生成
预测
视觉
伟达
架构
Transformer
编程
神器推荐
DeepMind
亚马逊
特斯拉
AI模型