- 课程目录
- 课程介绍
-
01|课程概览
-
02|DeepSeek R1等推理类大模型回顾
-
03|目前复现o1的常规思路
-
04|增强模型推理能力的四种范式
-
05|落地角度看推理类模型和GPT模型
-
06|如何用好推理模型?
-
07|蒸馏DeepSeek R1的微调复现思路(上)
-
08|蒸馏DeepSeek R1的微调复现思路(下)
-
09|Deepseek R1-zero核心思路
-
10|DeepSeek R1开源复现项目解读(上)
-
11|Deepseek R1开源复现项目解读(中)
-
12|Deepseek R1开源复现项目解读(下)
-
13|什么是Deep Research,如何使用?
-
14|Deep Research六大复现项目
-
15|总结
课程介绍
你将获得 增强大模型推理能力的四大范式 蒸馏 DeepSeek-R1 进行微调复现的思路 DeepSeek-R1-zero 核心原理详解 DeepSeek-R1 与 Deep Research开源复现项目解读 讲师介绍 课程介绍...你将获得
- 增强大模型推理能力的四大范式
- 蒸馏 DeepSeek-R1 进行微调复现的思路
- DeepSeek-R1-zero 核心原理详解
- DeepSeek-R1 与 Deep Research开源复现项目解读
讲师介绍
课程介绍
- 推理类模型是如何炼成的?
- DeepSeek-R1 类模型擅长做哪些事?
- 蒸馏 DeepSeek-R1 进行微调复现的思路是怎样的?
- 如何理解 DeepSeek-R1-zero中的核心技术(GRPO、奖励策略)?
- OpenAI 推出的 Deep Research 如何应用?
- DeepSeek-R1、Deep Research有哪些值得关注学习的开源项目?
PS:课程形式为视频课,不提供课件。
课程目录
