AI 實作學院
AILAB
首頁
教程總覽
VIP 專區
訂閱方案
關於
Catalog
模型微調
LoRA、QLoRA 與偏好對齊的實作流程,含資料配比與過擬合的判讀。
全部主題
提示工程
RAG 檢索增強
Agent 開發
模型微調
部署與推理優化
資料處理與評測
多模態應用
工具與工作流
不限
免費
VIP 專屬
全難度
入門
進階
實戰
符合條件:2 篇
免費
模型微調
實戰
災難性遺忘:微調後模型變笨了怎麼辦
專項任務變好、其他能力全面退化,是微調最典型的副作用。有幾個明確的緩解手段。
2026-08-19
10 分鐘
免費
模型微調
實戰
偏好對齊入門:什麼情況下需要 DPO
監督式微調教模型「怎麼做」,偏好對齊教它「兩個都對時選哪個」。多數任務不需要。
2026-08-13
10 分鐘