标题:大神卡帕西讲解强化学习!最新大模型内部机制视频爆火,“没有技术背景也能看懂”
正文:
大神卡帕西讲解强化学习!最新大模型内部机制视频爆火,“没有技术背景也能看懂”
西风 发自 凹非寺
量子位 | 公众号 QbitAI
AI大神Andrej Karpathy的新年第一课来了——发布三小时半视频课,解析ChatGPT等大语言模型的内部工作机制,涵盖模型训练、应用及未来趋势。
卡帕西强调,视频面向大众,即使没有技术背景也能看懂。
他在视频中用具体示例如GPT-2、Llama 3.1等,详细讲述大模型原理。DeepSeek成为一大重点。
刚发布就被网友围观,评价极高。
重点一览
卡帕西解答了关于ChatGPT等工具的疑问,详细讲解了模型构建、预训练、监督微调、强化学习等阶段。
预训练
预训练阶段涉及下载和处理互联网数据、文本提取、语言过滤、去重、tokenization等步骤。模型通过大量互联网文档数据学习生成文本的能力。
后训练
模型通过学习对话数据进行微调和强化学习,使其能生成符合人类期望的回答。卡帕西讨论了强化学习在大语言模型中的应用及其重要性,特别是DeepSeek的最新进展。
他还介绍了人类反馈的强化学习(RLHF)工作原理及其优缺点。
最后,卡帕西提到多模态模型的发展,模型能够将音频、图像和文本转化为tokens,并在同一个模型中处理。
持续专注于教育的AI大牛
卡帕西曾任特斯拉AI主管,后加入OpenAI,去年2月离职。他创办了AI原生的新型学校Eureka Labs,致力于打造“教师+人工智能的共生”。
视频链接:https://www.youtube.com/watch?v=7kVfqmGtDL8
参考链接:https://x.com/karpathy/status/1887211193099825254
Eureka Labs:
eurekalabs.ai
github.com/EurekaLabsAI
原文链接
本文链接:https://kx.umi6.com/article/12713.html
转载请注明文章出处
相关推荐
换一换
大模型收入暴涨1076%,港股AGI第一股首份年报:一年狂揽12亿,属实把商业化玩明白了
2026-03-27 17:08:13
蚂蚁集团开源 Awex 框架,秒级完成 TB 级参数交换
2025-11-20 10:17:17
长三角一体化大模型发布 AI将为区域发展提供决策支撑
2026-01-12 09:40:07
腾讯混元大模型品牌 Hunyuan 更名为 HY
2025-12-10 15:53:58
马斯克发起编程人机大战!卡帕西说了不
2025-10-19 12:47:59
百度新设两个大模型研发部:直接向CEO李彦宏汇报!
2025-11-25 22:10:22
MEET2026挤爆了,AI圈今年最该听的20+场演讲&对谈都在这
2025-12-11 15:57:49
马年4大顶流模型会师阿里云Coding Plan开工!Token量大管饱,自由切换真香
2026-02-26 00:01:12
卡帕西:编程从写文件变成管龙虾!IDE不会凉但得换个用法
2026-03-12 17:54:10
张亚勤谈大模型的未来:全球不超10个 且中美将各占三四个
2026-03-18 11:06:09
杨植麟当主持人的大模型圆桌:张鹏罗福莉夏立雪都放开说了
2026-03-27 23:23:11
ToC智能体火得快,但更大的价值在企业丨中关村科金@MEET2026
2025-12-12 14:53:17
Dwarkesh最新播客:AI 进展年终总结
2025-12-25 18:54:19
682 文章
548169 浏览
24小时热文
更多
-
2026-04-24 20:31:56 -
2026-04-24 20:29:51 -
2026-04-24 19:29:38