Siyu Chen
  • 首页
  • 归档
  • 分类
  • 标签
  • 关于
首页
归档
分类
标签
关于
搜索
关灯
机器学习笔记 6
机器学习笔记 06:评估、验证与模型选择 机器学习笔记 05:无监督学习与降维 机器学习笔记 04:树模型 机器学习笔记 03:有监督学习 机器学习笔记 02:损失函数、优化与正则化 机器学习笔记 01:机器学习的基本框架
深度学习笔记 5
深度学习笔记 05:注意力机制 深度学习笔记 04:CNN、RNN 与经典结构 深度学习笔记 03:深度网络训练与优化器 深度学习笔记 02:MLP、前向传播与反向传播 深度学习笔记 01:从特征工程到表示学习
后训练笔记 4
后训练笔记 04:GRPO变体与DPO变体 后训练笔记 03:PPO、DPO 与 GRPO 后训练笔记 02:SFT 与 PEFT 后训练笔记 01:强化学习基础
现代大模型与前沿论文笔记 3
现代大模型笔记 04:Reasoning Model,从 CoT 到 DeepSeek-R1 现代大模型笔记 03:LLM 推理与效率优化 现代大模型笔记 01:Transformer 架构与现代改进
Blog 1
关于这个博客
推荐系统笔记 1
推荐系统笔记 01:推荐系统概述

搜索

© Siyu Chen · Hexo · Fluid