跳到主要內容
AI 武林

Sebastian Raschka(部落格)

部落格 ・ 國際 ・ 英文 ・ A 級 ・ 17 筆內容 ・ 最近更新 2026/09/29

《Build a Large Language Model (From Scratch)》作者

最受歡迎

依人氣

  1. 3文章進階EN

    Using Local Coding Agents

    介紹如何透過本地推理伺服器執行開源權重大語言模型,並搭配本地編寫代理工具(如 Qwen-Code)來替代雲端服務。文章詳述了從安裝 Ollama 到配置隱私設定(禁用追蹤)的完整流程,並探討了透過 SSH 隧道將本地模型部署至遠端硬體(如…

  2. 8文章入門EN

    Controlling Reasoning Effort in LLMs

    介紹了如何控制大型語言模型(LLM)的推理努力程度,使其具備低、中、高三種模式。透過 RLVR 訓練與推理時排程,模型可根據任務需求切換推理模式。

最新內容

依發布時間

  1. 文章進階EN

    How Claude Watermarks AI-Generated Text

    本影片詳細解釋了Claude 如何在其文字生成過程中加入隱形水印,並說明如何檢測與移除這些水印。影片透過從零開始的程式碼實作,深入剖析了 LLM 的隨機樣本機制,並展示了如何透過隨機鍵將隨機數變為可重複的確定性樣本,從而實現水印功能。

  2. 文章入門EN

    Controlling Reasoning Effort in LLMs

    介紹了如何控制大型語言模型(LLM)的推理努力程度,使其具備低、中、高三種模式。透過 RLVR 訓練與推理時排程,模型可根據任務需求切換推理模式。

  3. 文章進階EN

    Using Local Coding Agents

    介紹如何透過本地推理伺服器執行開源權重大語言模型,並搭配本地編寫代理工具(如 Qwen-Code)來替代雲端服務。文章詳述了從安裝 Ollama 到配置隱私設定(禁用追蹤)的完整流程,並探討了透過 SSH 隧道將本地模型部署至遠端硬體(如…

  4. 文章進階EN

    Components of A Coding Agent

    這篇文章詳細介紹了編寫程式碼代理(Coding Agents)的六大核心元件,包括實時專案上下文、提示詞與快取最佳化、結構化工具、上下文壓縮、記憶管理以及子代理分發。