Dec 10, 2025 12 分 DeNA LLMスタディPart 3: モデル学習方法論 - 事前学習からRLHF/DPOまで DeNA LLMスタディ資料Part 3をベースに、事前学習、ファインチューニング、強化学習の違いとLoRA、QLoRA、DPOなど最新の効率的学習技法を深掘り分析します。