看影片(在新分頁開啟原站)連到 科技浪
其他版本:Podcast 版(在新分頁開啟)
摘要
介紹 DeepSeek V4.1 Flash 與 Bonsai 2 兩大技術,大幅壓縮 KV Cache 與模型權重。DeepSeek V4.1 Flash 將 Token 的 KV Cache 壓縮至 1KB,DeepSeek 將 V1 的 KV Cache 壓縮達 437 倍;Bonsai 2 將 Qwen3.8 的 54GB 權重壓縮至僅 6GB,僅需 iPhone 即可執行。
This episode introduces two cutting-edge AI efficiency technologies: DeepSeek V4.1 Flash compresses KV Cache to 1KB, and Bonsai 2 quantizes a 54GB model to just 6GB, running on an iPhone.
章節
依話題轉折切分,標題由 AI 產生
適合誰看
對 AI 技術感興趣,想了解最新壓縮與量化技術的讀者。
摘要依據
- 依據
- 人工字幕
為什麼排在這裡
- 人氣
- 0.27
- 新鮮
- 0.97
在主題頁與搜尋結果裡,名次由相關、人氣、新鮮三個分數決定;這一頁沒有搜尋的關鍵字,所以沒有相關分數。排序怎麼算
相關內容
- DeepSeek’s Insane New Architecture影片 ・ Two Minute Papers ・ 5 分鐘(在新分頁開啟原站)
- not much happened today文章 ・ AINews(Latent Space/smol.ai)
- not much happened today文章 ・ AINews(Latent Space/smol.ai)
- Impressioni d'uso di DeepSeek v4.1 Flash影片 ・ Salvatore Sanfilippo ・ 13 分鐘(在新分頁開啟原站)
- DeepSeek 的 10 万亿美元大战略文章 ・ 寶玉
- Proviamo DeepSeek v4.1 Flash a 2 bit con DwarfStar (SUB ITA)影片 ・ Salvatore Sanfilippo ・ 15 分鐘(在新分頁開啟原站)
摘要由 AI 根據原文產生,可能有誤;完整內容請看原站。看影片(在新分頁開啟原站)
