DeepSeek
H20芯片困局:在DeepSeek崛起下的挑战与反思
在当今全球科技竞争的宏大棋局之中,美国针对中国半导体和人工智能芯片发起的制裁行动,恰似汹涌暗潮,正以悄无声息却又极具颠覆性的方式,重塑着中国人工智能产业的发展格局。 在这一复杂局势下,H20 芯片作为特殊的存在进入中国市场,看似是为国内企业送来的“及时雨”,实则暗藏玄机,背后隐藏着诸多亟待剖析的问题。 近年来,美国对我国人工智能发展的制裁手段可谓层层加码、环环相扣。
3/12/2025 5:59:31 PM
徐勇
32B IOI奥赛击败DeepSeek-R1!Open R1开源复刻第三弹,下一步R1-Zero
Hugging Face的Open R1再度升级! Hugging Face的Open R1是一个社区驱动的项目,目标是创建一个完全开源的DeepSeek-R1版本。 目前,已有模型如OlympicCoder-32B和数据集如codeforces发布,显示了项目的进展。
3/12/2025 1:55:05 PM
新智元
使用 VLLM 部署 DeepSeek:基于 Ubuntu 22.04 + RTX 4090 + Docker 的完整指南
最近,大语言模型(LLM)的部署已经成为 AI 开发者绕不开的核心技能。 而 VLLM 作为一款高性能、低延迟的推理引擎,在大模型推理领域迅速崛起。 今天,我就带大家从零开始,在 Ubuntu 22.04 RTX 4090 Docker 环境下,部署 DeepSeek模型,并让它跑起来!
3/12/2025 12:37:50 PM
写代码的中年人
DeepSeek 开源的 DualPipe,居然是梁文峰写的,你感性?
继DeepGEMM之后,deepseek开源了第四弹DualPipe。 今天来简单聊聊DualPipe,包懂。 DualPipe是干嘛的?
3/12/2025 10:36:32 AM
架构师之路
让DeepSeek推荐客户!6个章节深度聊聊设计师如何让私单来找你
若干天之前,有位客户添加我的微信咨询包装设计,一番常规沟通之后,她竟然说是通过 DeepSeek 的推荐找到我的。 当时的我大为震惊,大家看图:与客户的沟通截图. 于是我马上通过 DeepSeek 去询问远麦刘斌的知名度如何,又获得了让我吃惊的答案,DeepSeek 接近 80%还原了我近 10 年来在互联网留下的痕迹,并给出了结论性概括。
3/12/2025 7:17:54 AM
设计史太浓
王炸组合DeepSeek+剪映!手把手教你打造小红书爆款视频!
内容视频化正在成为大势所趋,尤其在小红书平台"破圈"后。 相比图文载体,视频具备 3 倍以上的信息触达效率和优秀的用户留存率,但传统视频制作的高时间成本始终是设计师的最大创作瓶颈。 本文将带你解锁零剪辑基础也能快速产出优质视频内容的方法:AI 提效:从脚本到成片的智能创作链路.
3/12/2025 6:45:30 AM
团队58UXD
用DeepSeek辅助,让竞品分析更有效的3个方法
很多时候,我们辛苦做的竞品分析没有达到预期效果,往往是因为报告里只罗列了信息,却缺乏观点和行动建议。 又或者结论和信息不一致,难以支撑观点。 无论是产出正式的多页报告,还是简短到一页的陈述,目的都是告知竞品调研的结论,为接下来的设计能达成一致作出贡献。
3/12/2025 12:42:02 AM
林影落
欧洲银行纷纷尝试 DeepSeek
The Information 报道,据相关人士透露,自今年 1 月以来,包括汇丰银行、英国国民西敏寺银行(英国四大银行之一)以及西班牙对外银行(BBVA)在内的欧洲主要金融机构,一直在将 DeepSeek 与其他 AI 模型一起进行测试。这和美国银行拒绝使用 DeepSeek 的态度截然不同。
3/11/2025 11:11:18 PM
陈俊熹
DeepSeek 官方:“R2 将在 3 月 17 日发布”为假消息
据蓝鲸新闻报道,针对 DeepSeek 将在 3 月 17 日发布下一代 R2 模型的传闻,DeepSeek 官方企业咨询账号在用户群中回应称,“辟谣:R2 发布为假消息”。
3/11/2025 7:54:51 PM
远洋
阿里巴巴AI搜索引擎Accio用户突破百万 新增AI功能赋能全球贸易
阿里巴巴旗下AI搜索引擎Accio用户数量已于3月11日突破100万里程碑。 该搜索引擎近期推出了一系列新的人工智能功能,旨在为全球贸易中的中小企业提供支持。 根据先前报道,阿里国际于2月28日宣布其面向全球B2B买家的首个AI搜索引擎Accio已接入DeepSeek等先进推理模型,并正式上线深度研究、商业探索等功能。
3/11/2025 4:32:00 PM
AI在线
“新神登场”,消息称 DeepSeek-R2 AI 模型将于 3 月 17 日发布
媒体智通财经援引“消息人士”,称 DeepSeek 下一代 AI 模型 DeepSeek-R2 将于 3 月 17 日发布。
3/11/2025 3:01:26 PM
漾仔
基于Dify与DeepSeek:零门槛训练自己的专属AI大模型
在人工智能(AI)技术日益普及的今天,训练属于自己的AI大模型不再是遥不可及的梦想。 随着DeepSeek R1的发布,其部署成本仅为ChatGPT的十分之一,这一突破让更多企业和个人能够轻松参与AI开发。 未来,垂直领域的AI大模型和应用将如雨后春笋般涌现,这无疑是一个巨大的机遇。
3/11/2025 10:51:35 AM
冰河技术
DeepSeek级AI?训练自己的推理模型仅需七个步骤
译者 | 布加迪审校 | 重楼谁需要超级计算机? 仅用15GB VRAM就可以训练你自己的功能强大的AI推理模型! DeepSeek的R1模型在不需要人类反馈的情况下就能进行更深思熟虑的推理,已颠覆了大语言模型(LLM)领域。
3/11/2025 8:37:42 AM
布加迪
从DeepSeek MoE专家负载均衡谈起
上周中的时候, 同事给我了一份线上DeepSeek-R1推理的Expert激活的数据用来研究一些专家负载均衡的算法, 当然这些线上数据来自于公司内部的请求, 从中观测出前面10层专家基本上是相对均衡的, 而越到后面不均衡程度差异越大. 当时讨论到这个问题时, 是怀疑内部的一些请求是否专注于电商领域而带来的不平衡特性, 于是做了一些研究. 恰好搜到Intel的一篇论文《Semantic Specialization in MoE Appears with Scale: A Study of DeepSeek-R1 Expert Specialization》[1]有一些基于语义的MoE分析专家的专业性相关的问题, 再加上前几天看到某个公众号采访某院长的一个比较有趣的说法:“Dense模型适合toB业务,MoE模型适合toC业务”.
3/11/2025 12:35:00 AM
zartbot
一条神奇的指令,DeepSeek直接文生图
最近又发现一条神奇的提示词指令,借助Markdown的image标签可以直接在DeepSeek当前窗口得到我们想要的图片。 效果预览我们先看看这条指令的效果:图片这是岳哥在DeepSeek官网直接生成的一辆高铁行驶在海面上生成的图片,可以在DeepSeek上直接预览和下载图片。 提示词指令这条提示词指令具体如下:复制提示词解读这条这里分为3部分第一部分的描述性内容是告诉DeepSeek要生成AI图片,并且指出要如何生成第二部分的url则是具体的AI图片生成的指令,通过替换Prompt的内容来生成第三部分则是希望DeepSeek将AI绘画的提示词以中文的形式显示出来虽然是在DeepSeek当前窗口直接输出,但其实上这里还是借助了第三方AI绘画网站生成图片的功能。
3/11/2025 12:22:00 AM
、平凡世界
00后用DeepSeek直播1天卖出3.3亿元
近日,在浙江杭州,随着 AI 工具 DeepSeek 的走红,越来越多的创业者开始借助其强大的功能来实现盈利。 日前,关于一位00后主播在使用 DeepSeek 进行直播时,仅一天就成功销售了价值3.3亿元的商品,引起了广泛关注。 据报道,在 DeepSeek 的帮助下,许多商家和个人都尝试了新的销售方式。
3/10/2025 5:56:00 PM
AI在线
LeCun 最新访谈对 DeepSeek 一顿猛夸,还谈了 AI 发展需理解物理世界
他表示,DeepSeek 是一项很出色的成果,它的开源不只是成果创造者受益,全世界都能从中受益。
3/10/2025 5:43:30 PM
清源
报名|这可能是讨论 Deepseek 部署与实践最有深度的闭门会
DeepSeek “接入潮” 持续火热,如何安全、可靠、高效地集成 DeepSeek 等先进 AI 能力,已成为各行各业当前关注的焦点。 为系统性解决企业从技术选型到价值落地的全链路挑战,加速企业部署 DeepSeek 步伐,由张江集团、AI在线主办,模力社区协办的「DeepSeek 部署应用与技术开发」闭门研讨会,将于 3 月 13 日(周四)在上海浦东模力社区举办。 本次研讨会汇聚垂类模型企业、AI 芯片厂商、模型部署服务厂商等企业在内的多位重磅嘉宾,围绕 DeepSeek 部署策略与选择、应用落地与场景、技术实践与挑战等热门话题,将带来两场精彩的主题演讲与三场高质量圆桌对话。
3/10/2025 4:45:00 PM
机器之心
资讯热榜
标签云
AI
人工智能
OpenAI
AIGC
模型
ChatGPT
谷歌
DeepSeek
AI绘画
大模型
机器人
数据
AI新词
Midjourney
开源
Meta
微软
智能
用户
GPT
学习
技术
智能体
Gemini
马斯克
Anthropic
英伟达
图像
AI创作
训练
LLM
论文
代码
算法
苹果
AI for Science
Agent
Claude
腾讯
芯片
Stable Diffusion
蛋白质
具身智能
开发者
xAI
生成式
神经网络
机器学习
人形机器人
3D
AI视频
RAG
大语言模型
研究
百度
Sora
生成
GPU
工具
华为
字节跳动
计算
AGI
大型语言模型
AI设计
搜索
生成式AI
视频生成
DeepMind
特斯拉
场景
AI模型
深度学习
亚马逊
架构
Transformer
MCP
编程
视觉
预测