跳到主要內容
AI 武林

Donato Capitella

11 筆內容 ・ 11.2 萬 訂閱

LLM Chronicles 系列作者;做本機推論與 LLM 安全的實測

他的來源

最受歡迎

依人氣

  1. 6影片Donato Capitella進階EN

    Intel Arc Pro B70 (32GB) for Local LLMs: llama.cpp (SYCL/Vulkan), vLLM (Intel LLM Scaler) Benchmarks

    介紹 Intel Arc Pro B70 硬體在本地大型語言模型推理上的效能,涵蓋 llama.cpp 與 vLLM 的安裝與跑分。觀眾能了解該卡支援的軟體環境、量化模型限制及與 AMD 產品的效能比較。

    ※ 摘要僅根據標題與說明

  2. 7影片Donato Capitella進階EN

    DeepSeek V4 Flash Inference on Strix Halo: ds4, Quantizations, Distributed Inference and Benchmarks

    介紹如何在 AMD Strix Halo 裝置上本地執行 DeepSeek V4 Flash,涵蓋 ds4 推理引擎、量化技術與分散式推理的設定與效能測試。觀眾可學習利用 2 位元與混合 4 位元量化在有限記憶體中執行大型模型的方法。

    5 萬次觀看

    ※ 摘要僅根據標題與說明

最新內容

依發布時間

  1. 影片Donato Capitella進階EN

    DeepSeek V4 Flash Inference on Strix Halo: ds4, Quantizations, Distributed Inference and Benchmarks

    介紹如何在 AMD Strix Halo 裝置上本地執行 DeepSeek V4 Flash,涵蓋 ds4 推理引擎、量化技術與分散式推理的設定與效能測試。觀眾可學習利用 2 位元與混合 4 位元量化在有限記憶體中執行大型模型的方法。

    5 萬次觀看

    ※ 摘要僅根據標題與說明

  2. 影片Donato Capitella進階EN

    Intel Arc Pro B70 (32GB) for Local LLMs: llama.cpp (SYCL/Vulkan), vLLM (Intel LLM Scaler) Benchmarks

    介紹 Intel Arc Pro B70 硬體在本地大型語言模型推理上的效能,涵蓋 llama.cpp 與 vLLM 的安裝與跑分。觀眾能了解該卡支援的軟體環境、量化模型限制及與 AMD 產品的效能比較。

    ※ 摘要僅根據標題與說明