Modded-NanoGPT
神级项目训练GPT-2仅需5分钟,Andrej Karpathy都点赞
租用 H100 的钱只需 233 美元。 还记得 Andrej Karpathy 纯 C 语言复现 GPT-2 大模型的项目吗? 今年 4 月,AI 领域大牛 Karpathy 一个仅用 1000 行代码即可在 CPU/fp32 上实现 GPT-2 训练的项目「llm.c」曾经引发机器学习社区的热烈讨论。
11/21/2024 1:11:00 PM
机器之心
- 1
资讯热榜
Lovart震撼发布:全球首个设计Agent,一键从创意到成品
全球首个设计Agent Lovart席卷全球,颠覆性功能与幕后团队揭秘
全球首款设计Agent Lovart内测!一句话搞定Logo、视频、品牌全套
OpenMemory MCP发布!AI记忆本地共享,Claude、Cursor一键同步效率翻倍!
苹果发布FastVLM模型,可在iPhone上运行的极速视觉语言模型
国产大模型「五强争霸」,决战AGI!
“逆天”研究!Cursor 与 Windsurf 背后的核心算法机制曝光!网友惊呼:Cursor代码总出Bug的原因找到了
苹果放大招!FastVLM 让视觉语言模型在 iPhone 上飞速 “狂飙”
标签云
人工智能
AI
OpenAI
AIGC
ChatGPT
DeepSeek
AI绘画
模型
数据
机器人
谷歌
大模型
Midjourney
用户
智能
开源
微软
学习
GPT
Meta
图像
AI创作
技术
Gemini
论文
马斯克
Stable Diffusion
算法
芯片
代码
生成式
蛋白质
英伟达
腾讯
神经网络
开发者
研究
Anthropic
3D
计算
Sora
机器学习
AI设计
AI for Science
GPU
苹果
AI视频
场景
华为
百度
人形机器人
预测
搜索
训练
Claude
生成
伟达
深度学习
xAI
Transformer
大语言模型
字节跳动
模态
具身智能
文本
驾驶
智能体
神器推荐
Copilot
LLaMA
视觉
算力
应用
安全
视频生成
干货合集
API
大型语言模型
亚马逊
Agent