📚 Study Notes

标签: ml-ch11

此标签下有10条笔记。

  • 2026年7月24日

    大语言模型关键技术

    • machine-learning
    • moc
    • ml-ch11
  • 2026年7月20日

    11.1 大语言模型概述

    • ml-ch11
    • machine-learning
    • LLM
    • 大语言模型
    • 规模
  • 2026年7月20日

    11.2 关键技术概览

    • ml-ch11
    • machine-learning
    • LLM
    • 架构
    • 训练
  • 2026年7月20日

    11.3 后训练范式

    • ml-ch11
    • machine-learning
    • 大语言模型
    • 后训练
    • 对齐
    • RLHF
  • 2026年7月20日

    11.4 基于人类反馈的强化学习

    • ml-ch11
    • machine-learning
    • RLHF
    • 人类反馈
    • 奖励模型
    • PPO
  • 2026年7月20日

    11.5 近端策略优化算法

    • ml-ch11
    • machine-learning
    • PPO
    • 策略优化
    • 裁剪
  • 2026年7月20日

    11.6 组相对策略优化算法

    • ml-ch11
    • machine-learning
    • GRPO
    • 组策略
    • 相对优化
  • 2026年7月20日

    11.7 大模型安全合规

    • ml-ch11
    • machine-learning
    • AI安全
    • 合规
    • 著作权
  • 2026年7月20日

    11.8 ChatGPT大模型

    • ml-ch11
    • machine-learning
    • ChatGPT
    • 大语言模型
    • GPT
    • InstructGPT
  • 2026年7月20日

    11.9 DeepSeek

    • ml-ch11
    • machine-learning
    • DeepSeek
    • MoE
    • 推理

Created with Quartz v4.5.2 © 2026

  • GitHub