跳到主要內容
AI 武林

H100

29 筆內容提到

最近 7 天 2 筆↓1(比前一期少 1 筆)(再前 7 天 3 筆)

也寫作:NVIDIA H100、Nvidia H100

這一頁列的是「提到 H100」的內容(名稱由語言模型從內容裡整理),不一定整筆都在講它。只想追它的新內容:訂閱 RSS;想找標題裡就有它的:搜尋「H100」。

最新

依發布時間

  1. 影片Stanford Online高階EN

    Stanford CS336 Language Modeling from Scratch | Spring 2026 | Guest Lecture: Dan Fu

    Dan Fu 演講分享語言模型從訓練到推論的完整流程,重點在於如何將 GPU 轉化為實際的「智慧引擎」。內容涵蓋推論服務架構、最佳化 KV Cache 的策略,以及透過 Mega Kernels 技術減少 GPU 等待時間以提升效率。

  2. 影片Stanford Online高階EN

    Stanford CS25: Transformers United V6 I Serving Transformers: Lessons from the Trenches

    Charles Frye 分享在生產環境部署 Transformer 模型的實戰經驗,涵蓋從應用架構到硬體選型的完整流程。內容包含如何最佳化推理效能、選擇適合的 GPU 硬體以及使用工具進行效能分析與除錯,幫助工程師解決大規模推理挑戰。

  3. PodcastThe TWIML AI Podcast高階EN

    Scaling Agentic Inference Across Heterogeneous Compute with Zain Asgar - #757

    探討 Gimlet Labs 如何透過異質運算架構,將 AI 工作負載分散於不同硬體以提升效能與成本效益。講者介紹了將模型拆解、使用 LLM 自動最佳化運算核心等技術,並討論了從邊緣裝置到資料中心的應用挑戰。

最受歡迎

依人氣