The summer Math fell to the machines...
記錄近期 AI 在數學領域的突破性進展,包括推翻百年猜想與解決千年難題。觀眾可了解 AI 如何輔助甚至主導數學研究,以及對未來學術界的可能影響。
08/17–08/23 170 筆新內容
影片 104、Podcast 43、文章 23;中文 30、英文 140;82 筆的摘要有根據原文。前一期 182 筆(↓12)。
這一頁是每次更新網站時自動整理的,沒有人工挑選:依發布日期歸到這段期間,照人氣排(有原文的優先),同一個來源最多兩筆,個人部落格與大頻道各佔一半。想固定收到的話可以訂閱每週回顧的 RSS(每週一出一篇)。
這段期間的內容最常提到的工具與主題,數字是筆數,與前一期相比
這一週人氣最高的
記錄近期 AI 在數學領域的突破性進展,包括推翻百年猜想與解決千年難題。觀眾可了解 AI 如何輔助甚至主導數學研究,以及對未來學術界的可能影響。
探討在軟體工廠中,人類判斷如何從程式碼撰寫轉移至產品意圖、系統設計與品質門檻的決策。作者強調即使 AI 能寫程式,仍需人類在關鍵節點進行審查與最終決定,並透過 SonarQube 等工具建立統一的品質閘門,避免自動化背壓導致維護性問題。
訪談探討 IBM 與 OpenAI 的合夥關係、Stripe 收購 OpenRouter 的戰略意義,以及 Ramp 發布的 AI 指數。內容涵蓋企業如何透過路由與治理解決模型選擇困難,並分析 AI 成本激增與立法領域的自動化現象。
探討開放式 AI 模型與 NVIDIA 投資策略的未來,分析開源生態系如何依賴硬體供應商獲利。作者比較了開源模型與 Linux 系統的差異,並預測若訓練成本過高,開源模型可能轉向專注於效率與特定任務的長尾市場,而非與閉源模型競爭通用能力。
DHH 與 The Standup 訪談團隊深入探討 Omarchy Quattro 的更新,介紹其基於 AI 代理的自動化安裝與高度可擴展的外掛生態。
回顧軟體開發領域近十年的劇變,從 GitHub、TDD 到編輯器的興衰,並探討 AI 如何改變工作模式與思維。文章分享個人對 AI 工具、企業動態及開發哲學的觀察,引導讀者反思技術演進與人類角色的關係。
整理者針對當前主流 AI 模型進行分級評測,詳細比較了 56 Soul、Fable、Luna 等模型的效能、價格與實際應用場景,並分析各模型在程式碼撰寫與代理任務上的優劣。
探討如何從封閉權重模型中提取推理軌跡,並解釋了 GPT-OSS 的 Harmony 格式與 DwarfStar 中推理努力(reasoning effort)的機制。
展示 Grok Bot 在郵件管理、行事曆協調、網頁操作、程式開發及生活事務上的實際應用案例。觀眾可學習如何設定自動化代理來處理重複性工作,提升效率並減少手動操作。
每天挑幾筆;全部的在搜尋頁依最新排序
DHH Omarchy Quattro Announcement | TheStandup
DHH 與 The Standup 訪談團隊深入探討 Omarchy Quattro 的更新,介紹其基於 AI 代理的自動化安裝與高度可擴展的外掛生態。
The PrimeTime42 分鐘● 有原文
回顧軟體開發領域近十年的劇變,從 GitHub、TDD 到編輯器的興衰,並探討 AI 如何改變工作模式與思維。文章分享個人對 AI 工具、企業動態及開發哲學的觀察,引導讀者反思技術演進與人類角色的關係。
Thorsten Ball(部落格)● 有原文
The Only Codex Course You Need in 2026 (4.5 Hours)
Nick Saraev 分享他如何從無程式背景,透過自學 YouTube 影片建立多個成功企業,並運用新 AI 模型(如 Claude)打造自動化系統。影片涵蓋從創業歷程到利用 AI 生成客源、成交訂單的實戰方法。
Nick Saraev4 小時 37 分○ 無原文
愛好 AI Engineer 電子報 🚀 OpenAI GPT-5.6 發布 #40
介紹 OpenAI GPT-5.6 的三款型號差異、Prompt Cache 新機制與 Programmatic Tool Calling 技術,並說明 Persisted Reasoning 對多輪推理的改善。
ihower(張文鈿)● 有原文
Stealing Reasoning Traces from Proprietary LLM APIs — Ilia Shumailov & Alexander Panfilov
兩位 AI 安全研究員指出,大型語言模型返回的加密推理軌跡可被小型模型解讀並重放,導致隱私洩漏、提示注入與越獄攻擊。此漏洞影響多家供應商,顯示加密機制在 AI 系統中可能失效,需重新評估安全架構。
Machine Learning Street Talk49 分鐘● 有原文
AI 巨頭的秘密:偷買二手書,掃描完就銷毀 Why? | S2E68
揭露 AI 公司如 Anthropic 與 Amazon 秘密收購二手書掃描並銷毀,以獲取未被 AI 汙染的乾淨訓練資料。內容分析此舉的版權動機、成本考量與防止競爭對手獲利的策略,並探討資料品質對模型能力的影響及資料汙染風險。
矽谷輕鬆談 Just Kidding Tech19 分鐘● 有原文
Which AI Models Are Worth Using
整理者針對當前主流 AI 模型進行分級評測,詳細比較了 56 Soul、Fable、Luna 等模型的效能、價格與實際應用場景,並分析各模型在程式碼撰寫與代理任務上的優劣。
Theo - t3․gg37 分鐘● 有原文
探討 LLM 與程式碼代理如何改變開發者對語言與技術的選擇,指出人們更傾向採用快速且嚴格的語言。讀者可了解 AI 如何影響軟體開發趨勢,並認識相關工具與案例。
Armin Ronacher(部落格)● 有原文
Greg Isenberg 專訪 Billy Howell,分享如何利用 Grok Bot 建立自動化團隊來營運新聞信件與商店。內容涵蓋從設定首席助理機器人到執行四週計畫的具體步驟,讓讀者掌握用 AI 代理團隊創收的實戰方法。
Greg Isenberg44 分鐘○ 無原文
How Claude Watermarks AI-Generated Text
詳細拆解 Anthropic 如何透過調整取樣機制來在 Claude 文字輸出中植入隱形水印,並解釋檢測與移除的挑戰。觀眾能理解 LLM 生成原理及水印對內容品質的潛在影響。
Sebastian Raschka(部落格)● 有原文
Claude vs. ChatGPT Just Got Serious
比較 Claude 與 ChatGPT 在聯結器功能的更新與表現,幫助使用者判斷哪款 AI 更適合當前需求。透過 Igor 的實測與分析,提供選擇建議。
The AI Advantage12 分鐘○ 無原文
從模型部署到 Agent Harness:Qwen 3.8 27B 與 DGX Spark 實機示範
示範在 DGX Spark 伺服器上執行 Qwen 3.8 27B 模型,並結合 Agent Harness 與安全沙箱進行實機測試。觀眾可學習地端 AI 部署細節、模型量化方法與資安邊界設定。
Will 保哥2 小時 20 分○ 無原文
Stripe buys OpenRouter, Ramp’s AI Index & IBM’s OpenAI deal
訪談探討 IBM 與 OpenAI 的合夥關係、Stripe 收購 OpenRouter 的戰略意義,以及 Ramp 發布的 AI 指數。內容涵蓋企業如何透過路由與治理解決模型選擇困難,並分析 AI 成本激增與立法領域的自動化現象。
Mixture of Experts36 分鐘● 有原文
Human judgment doesn't leave the software factory. It relocates.
探討在軟體工廠中,人類判斷如何從程式碼撰寫轉移至產品意圖、系統設計與品質門檻的決策。作者強調即使 AI 能寫程式,仍需人類在關鍵節點進行審查與最終決定,並透過 SonarQube 等工具建立統一的品質閘門,避免自動化背壓導致維護性問題。
Addy Osmani(部落格)● 有原文
11 Grok Bot Use Cases That Feel Like Cheating
展示 Grok Bot 在郵件管理、行事曆協調、網頁操作、程式開發及生活事務上的實際應用案例。觀眾可學習如何設定自動化代理來處理重複性工作,提升效率並減少手動操作。
Matthew Berman22 分鐘● 有原文
DeepSeek is back... and Silicon Valley is terrified
OpenAI 暫停最大規模訓練後,DeepSeek 強勢回歸引發矽谷關注。影片簡述此事件背景與影響,讓讀者快速掌握 AI 領域最新動態。
Fireship6 分鐘○ 無原文
作者透過實測與 benchmarks 證明,MacOS 的 APFS 檔案系統在處理大量小檔案與 npm 安裝時極慢,遠不如 Linux 的 ext4 或搭配 LZ4 壓縮的 XFS。
Theo - t3․gg32 分鐘● 有原文
“消失”的万亿债务:深扒数据中心“影子借贷”、GPU金融化与次贷风险
揭露美國科技巨頭透過複雜金融結構隱藏高達兩千億美元的資料中心債務,並探討 GPU 資產金融化帶來的次貸風險。觀眾能了解巨頭如何操作負債表、私募資本的角色以及潛在的金融危機。
硅谷10153 分鐘○ 無原文
The summer Math fell to the machines...
記錄近期 AI 在數學領域的突破性進展,包括推翻百年猜想與解決千年難題。觀眾可了解 AI 如何輔助甚至主導數學研究,以及對未來學術界的可能影響。
Fireship6 分鐘● 有原文
LIVE: Uncle Bob on Software Fundamentals in the Age of AI
Matt Pocock 與 Uncle Bob 討論在 AI 程式設計代理時代,軟體基礎原則是否依然重要。
Matt Pocock57 分鐘○ 無原文
DeepSeek Just Made Closed AI Look Ridiculous
介紹 DeepSeek V4 Pro 如何讓傳統閉源 AI 看起來過時,並連結相關資源供讀者進一步了解。
Two Minute Papers5 分鐘○ 無原文
Going In Deep On Data | YC Paper Club
三位領域專家深入探討訓練資料、評估指標與多語言預訓練的挑戰與前沿。影片涵蓋從資料重要性、代理系統 benchmark 到擴散語言模型的實際應用與多語言模型擴展法則。
Y Combinator53 分鐘○ 無原文
How I Use Skills + AI Agents to Run My Life
訪談 Remy 探討如何將 SOP 轉化為 AI 技能,透過 GitHub 儲存庫與外掛系統讓團隊共享標準作業程式。建立單一來源真相,實現自動更新、版本控制與公司資產管理。
Greg Isenberg32 分鐘○ 無原文
八月 AI 更新總整理:Grok 又更強大了!Gemini 3.7 flash 急起直追?
整理 8 月 AI 產業重點,涵蓋 Grok 4.6、Image 2.0 及 Grok bot 等更新,並分析 Google 面臨的競爭壓力與 Gemini 3.7 Flash 的表現。
泛科學院12 分鐘○ 無原文
Code a Reinforcement Learning Library in C from Scratch (Full Course)
從零開始用 C 語言編寫完整的強化學習框架,包含自訂計算圖與自動微分引擎。學員將建立 Snake 遊戲環境並實現 REINFORCE 演算法,掌握從底層實現到訓練管道的完整流程。
freeCodeCamp.org2 小時 18 分● 有原文
探討如何從封閉權重模型中提取推理軌跡,並解釋了 GPT-OSS 的 Harmony 格式與 DwarfStar 中推理努力(reasoning effort)的機制。
Armin Ronacher(部落格)● 有原文
展示 Matt Pocock 的 AI 相關技能清單,涵蓋 GitHub 上超過 20 萬星數的專案。觀眾可了解他如何利用 AI 工具提升程式開發效率與解決實際問題的方法。
Theo - t3․gg38 分鐘○ 無原文
How Claude's Text Watermarking Works
解釋 Claude 文字水印的運作機制,涵蓋大型語言模型生成過程、取樣技術與水印檢測原理。觀眾可了解水印如何嵌入文字以及其技術限制。
Sebastian Raschka48 分鐘○ 無原文
How Much Memory Does Your Agent Actually Need?
探討 AI 代理(Agent)的記憶量如何影響效能,指出記憶並非越多越好,而需依模型能力調整劑量。透過 ALTK-Evolve 方法,將代理過去經驗轉化為指導原則,並根據模型強弱選擇全量注入或精選檢索,以平衡準確度與成本。
Hugging Face Blog● 有原文
介紹 Ornith-1.5 新模型家族、壓縮技術突破與 Agent 運算架構演進,涵蓋 Qwen3.8、DeepSeek Harness 與 TrueForge 等工具。讀者可掌握最新開源模型規格、效能比較與部署策略。
AINews(Latent Space/smol.ai)● 有原文
分享從終端機轉向使用桌面應用程式(如 T3 Code、Codeex)進行 AI 程式設計的經歷,指出終端機在處理多工、影像傳遞及穩定性上的不足。觀眾可學習如何根據工作流選擇合適的開發工具,提升與 AI 協作的效率。
Theo - t3․gg31 分鐘● 有原文
How To Turn Evals Into A Better Model
介紹如何透過檢視追蹤記錄、修正評估環境與工具來提升模型表現,而非直接微調模型。觀眾可學習具體的評估最佳化步驟與常見陷阱,掌握讓模型在測試中得分更高的實務方法。
Hamel Husain36 分鐘○ 無原文
You NEED to try these 6 Open-Source Projects NOW
介紹六個開源 AI 專案,涵蓋本地模型訓練、圖表生成、筆記本工具、通訊軟體、瀏覽器自動化與 3D 建模。看完能了解如何快速部署與使用這些工具提升 AI 工作流效率。
Matthew Berman9 分鐘● 有原文
Rich Sutton and Khurram Javed: Why AI Models Stop Learning, and How to Start It Again
Rich Sutton 與 Khurram Javed 探討 AI 模型如何停止學習,提出「大世界假說」認為世界過於複雜,模型需持續更新而非靜態部署。
Sequoia Capital54 分鐘● 有原文
Qwen3.8-27B & How to Serve it Fast
介紹 Qwen3.8-27B 模型的功能與效能,並示範如何使用 SGLang 等工具實現最高每秒 token 數的服務速度。觀眾可學習如何最佳化大型語言模型的部署與推理速度。
Sam Witteveen18 分鐘○ 無原文
Hands on with Gemini 3.7 Flash
介紹 Box、Databricks 與 Emergent 的領導者如何測試並使用 Gemini 3.7 Flash 建立高效能的多代理系統。觀眾能了解該模型在低延遲與高效能 token 使用上的實際應用與挑戰。
Google for Developers4 分鐘○ 無原文
What Computer Should You Buy for Local AI
Alex Ziskind 分享如何根據目標模型選擇適合本地執行的電腦硬體,涵蓋顯示卡、記憶體與儲存建議。看完能學會評估硬體規格與 AI 模型運算需求的關係。
Alex Ziskind11 分鐘○ 無原文
Teaching Everyone to Fish for Tokens
探討開放式 AI 模型與 NVIDIA 投資策略的未來,分析開源生態系如何依賴硬體供應商獲利。作者比較了開源模型與 Linux 系統的差異,並預測若訓練成本過高,開源模型可能轉向專注於效率與特定任務的長尾市場,而非與閉源模型競爭通用能力。
Nathan Lambert(部落格)● 有原文
史丹佛推出AI研究牲,有多強?迷幻蘑菇改寫腦神經!【泛科學NEWS EP72】
介紹史丹佛大學利用迷幻蘑菇研究腦神經與 AI 的結合,探討其對人類意識與機器學習的潛在影響。觀眾可了解該項研究的基本概念與科學背景。
PanSci19 分鐘○ 無原文
State of Agentic Coding #9 with Armin and Ben
探討自動程式碼代理的當前狀態,涵蓋模型安全、自主權限界、終端機回歸等議題。觀眾可了解 AI 開發工具的最新趨勢與潛在風險。
Armin Ronacher1 小時 25 分○ 無原文
Finally we have AI Coding for ENTERPRISE Users! (Full Tutorial with Security & Governance)
示範如何使用 Superblocks 與 Clark 在 AWS 環境中建立具備企業級安全與治理的 AI 應用程式,並連線 Postgres、Snowflake 等資料庫。
Sonny Sangha27 分鐘○ 無原文
Agent Memory EXPLAINED - Complete Architecture
深入解析 Mem0 的長期記憶架構,涵蓋資料攝取、混合檢索與本地開源模型選擇。觀眾能了解 AI 代理如何透過向量搜尋與 BM25 結合來管理持久化記憶。
Hugging Face29 分鐘○ 無原文
上面沒列到的中文影片、Podcast 與文章
“消失”的万亿债务:深扒数据中心“影子借贷”、GPU金融化与次贷风险
揭露美國科技巨頭透過複雜金融結構隱藏高達兩千億美元的資料中心債務,並探討 GPU 資產金融化帶來的次貸風險。觀眾能了解巨頭如何操作負債表、私募資本的角色以及潛在的金融危機。
硅谷10153 分鐘○ 無原文
從模型部署到 Agent Harness:Qwen 3.8 27B 與 DGX Spark 實機示範
示範在 DGX Spark 伺服器上執行 Qwen 3.8 27B 模型,並結合 Agent Harness 與安全沙箱進行實機測試。觀眾可學習地端 AI 部署細節、模型量化方法與資安邊界設定。
Will 保哥2 小時 20 分○ 無原文
還在用 PPT 製作廉價簡報動畫?Claude Design 2.0 迎來重大升級,今天就用這 6 個小技巧解鎖它的專業動畫功能!
介紹 Claude Design 2.0 的六個專業動畫技巧,包含建立設計系統、調整時間軸與排版、提供素材與範本,以及製作螢幕操作與子母視窗動畫。看完即可掌握用 AI 工具製作高品質簡報動畫的方法。
PAPAYA 電腦教室13 分鐘○ 無原文
史丹佛推出AI研究牲,有多強?迷幻蘑菇改寫腦神經!【泛科學NEWS EP72】
介紹史丹佛大學利用迷幻蘑菇研究腦神經與 AI 的結合,探討其對人類意識與機器學習的潛在影響。觀眾可了解該項研究的基本概念與科學背景。
PanSci19 分鐘○ 無原文
內容最多的幾個主題,上面列過的不重複
Greg Isenberg44 分鐘○ 無原文
🟢 Build an AI-Powered Flight Booking App! | Beginner Series Ep#18 (AI Agents, Sanity Context, MCP)
Sonny Sangha3 小時 6 分○ 無原文
$75M founder reveals his Agentic Engineering setup
David Ondrej52 分鐘○ 無原文
The Only Codex Course You Need in 2026 (4.5 Hours)
Nick Saraev4 小時 37 分○ 無原文
Codex vs Claude vs Grokbot: What's The Best Super App?
Riley Brown23 分鐘○ 無原文
DeepSeek is back... and Silicon Valley is terrified
Fireship6 分鐘○ 無原文
DeepSeek Just Made Closed AI Look Ridiculous
Two Minute Papers5 分鐘○ 無原文
You NEED to try these 6 Open-Source Projects NOW
Matthew Berman9 分鐘● 有原文
Exclusive BTS of my Automated AI System (LIVE)
Matt Wolfe3 小時 1 分○ 無原文
Agent, skill, or MCP? Which to use and when to use them | AWS’ Clare Liguori
Dev Interrupted44 分鐘● 有原文
Here's How the New MCP Spec Works
Kent C. Dodds25 分鐘○ 無原文
Stateless, Yet Durable: MCP Tasks v2
AAIF Live26 分鐘○ 無原文
八月 AI 更新總整理:Grok 又更強大了!Gemini 3.7 flash 急起直追?
泛科學院12 分鐘○ 無原文
Hands on with Gemini 3.7 Flash
Google for Developers4 分鐘○ 無原文
Amp News● 有原文