跳到主要內容
AI 武林

微調

Fine-tuning ・ 14 筆內容

用自己的資料調整既有模型,包含 LoRA、QLoRA 等省資源的做法。

也叫做:微調、微调、fine-tuning、fine tuning、finetuning、finetune、fine-tune、LoRA、QLoRA、PEFT

學習路徑

由淺入深:入門 → 進階 → 高階

  1. 入門初窺門徑

  2. 進階登堂入室

  3. 高階爐火純青

排行前 6 名

依相關、人氣、新鮮度綜合排序;站長推薦的加成

  1. 4影片Hung-yi Lee高階中文

    【生成式人工智慧與機器學習導論2025】第 8 講:通用模型的終身學習 (Fine-tuning, Model Editing, Model Merging, Test-Time Training)(在新分頁開啟原站)

    本講由李一駿助教整理,聚焦於生成式 AI 與機器學習的終身學習策略。內容涵蓋使用梯度下降微調引數、模型編輯與合併等技術,並首次介紹測試時訓練(TTT)的新方法。

    ※ 摘要僅根據標題與說明

最新

依發布時間

  1. 影片Hung-yi Lee高階中文

    【生成式人工智慧與機器學習導論2025】第 8 講:通用模型的終身學習 (Fine-tuning, Model Editing, Model Merging, Test-Time Training)(在新分頁開啟原站)

    本講由李一駿助教整理,聚焦於生成式 AI 與機器學習的終身學習策略。內容涵蓋使用梯度下降微調引數、模型編輯與合併等技術,並首次介紹測試時訓練(TTT)的新方法。

    ※ 摘要僅根據標題與說明

  2. 文章Eugene Yan(部落格)入門EN

    Out-of-Domain Finetuning to Bootstrap Hallucination Detection

    探討如何利用外域資料(如維基百科摘要)進行預訓練,來提升對新聞摘要中事實不一致(即謠言)的檢測能力。作者發現,即使預訓練階段在相關領域(維基百科)上只進行了少量訓練,也能顯著改善後續在特定任務(FIB)上的表現,從而減少需要收集大量標註資…

  3. 影片Umar Jamil進階EN

    BERT explained: Training, Inference, BERT vs GPT/LLamA, Fine tuning, [CLS] token(在新分頁開啟原站)

    本影片詳細解構 BERT 模型,涵蓋訓練、推理、精調等核心概念,並深入探討其與 GPT/LLaMA 的差異。透過視覺化步驟,讓讀者掌握自注意力機制、[CLS] 標記及多工應用(如分類與問答)的實作原理。

    8.6 萬次觀看

    ※ 摘要僅根據標題與說明