标题:大神卡帕西讲解强化学习!最新大模型内部机制视频爆火,“没有技术背景也能看懂”
正文:
大神卡帕西讲解强化学习!最新大模型内部机制视频爆火,“没有技术背景也能看懂”
西风 发自 凹非寺
量子位 | 公众号 QbitAI
AI大神Andrej Karpathy的新年第一课来了——发布三小时半视频课,解析ChatGPT等大语言模型的内部工作机制,涵盖模型训练、应用及未来趋势。
卡帕西强调,视频面向大众,即使没有技术背景也能看懂。
他在视频中用具体示例如GPT-2、Llama 3.1等,详细讲述大模型原理。DeepSeek成为一大重点。
刚发布就被网友围观,评价极高。
重点一览
卡帕西解答了关于ChatGPT等工具的疑问,详细讲解了模型构建、预训练、监督微调、强化学习等阶段。
预训练
预训练阶段涉及下载和处理互联网数据、文本提取、语言过滤、去重、tokenization等步骤。模型通过大量互联网文档数据学习生成文本的能力。
后训练
模型通过学习对话数据进行微调和强化学习,使其能生成符合人类期望的回答。卡帕西讨论了强化学习在大语言模型中的应用及其重要性,特别是DeepSeek的最新进展。
他还介绍了人类反馈的强化学习(RLHF)工作原理及其优缺点。
最后,卡帕西提到多模态模型的发展,模型能够将音频、图像和文本转化为tokens,并在同一个模型中处理。
持续专注于教育的AI大牛
卡帕西曾任特斯拉AI主管,后加入OpenAI,去年2月离职。他创办了AI原生的新型学校Eureka Labs,致力于打造“教师+人工智能的共生”。
视频链接:https://www.youtube.com/watch?v=7kVfqmGtDL8
参考链接:https://x.com/karpathy/status/1887211193099825254
Eureka Labs:
eurekalabs.ai
github.com/EurekaLabsAI
原文链接
本文链接:https://kx.umi6.com/article/12713.html
转载请注明文章出处
相关推荐
换一换
终于要变聪明了!特斯拉官宣接入豆包
2026-06-24 15:38:03
上海已发布超150款备案大模型
2026-03-28 20:16:44
建议你不要再相信AI基准测试,排行榜已经没啥公信力了
2025-12-04 12:18:33
机器人运控训练步入分钟级时代!清华AIR开源UniLab:3分钟训好人形,速度暴涨10倍,Mac上也能跑
2026-06-02 12:26:59
腾讯调整大模型组织架构:姚顺雨加盟,向总裁刘炽平汇报
2025-12-18 15:51:59
智谱AI,排名「第二」
2025-12-21 12:41:26
独家专访|苏炜杰加入OpenAI:Scaling Law撞墙后为什么需要数学家出手?
2026-06-29 15:36:01
月之暗面近20天收入超去年全年
2026-02-23 19:11:04
智谱、MiniMax争夺「大模型第一股」
2025-12-24 10:30:23
大模型的尽头 怎么是费大厨辣椒炒肉?
2026-05-24 15:42:37
舔狗AI和被预约的寿司郎
2026-06-05 00:34:31
顶尖技术+标准产品+创新模式+可靠服务,打造大模型商业落地中国范式
2025-12-16 10:32:22
上海制造,AI入魂:央国企率先“重用”大模型,自动化设备被换下
2026-07-17 18:46:05
721 文章
789672 浏览
24小时热文
更多
-
2026-07-24 00:15:46 -
2026-07-24 00:14:08 -
2026-07-24 00:12:30