Did a 50 year old military secret just solve agent prompt injection?
介紹 OpenAPPA 專案,利用軍事級資料分類概念,在 AI 代理執行前檢查資料敏感度並阻擋洩漏。觀眾可學習如何防止提示注入攻擊,並了解該工具在實際測試中的效能與限制。
09/28–10/04 547 筆新內容
影片 334、Podcast 92、文章 121;中文 153、英文 394;272 筆的摘要有根據原文。前一期 497 筆(↑50)。
這一頁是每次更新網站時自動整理的,沒有人工挑選:依發布日期歸到這段期間,照人氣排(有原文的優先),同一個來源最多兩筆,個人部落格與大頻道各佔一半。想固定收到的話可以訂閱每週回顧的 RSS(每週一出一篇)。
這段期間的內容最常提到的工具與主題,數字是筆數,與前一期相比
這一週人氣最高的
介紹 OpenAPPA 專案,利用軍事級資料分類概念,在 AI 代理執行前檢查資料敏感度並阻擋洩漏。觀眾可學習如何防止提示注入攻擊,並了解該工具在實際測試中的效能與限制。
介紹 Anthropic 新推出的 Claude Sonnet 5.5 模型,其速度更快、成本更低且表現優於前代。文章透過實際測試,展示該模型在免費版 claude.ai 上生成 3D 動畫網頁的能力,並指出其與 OpenAI Luna…
教導如何從零開始,使用 Codex GPT-6 Astra、Expo、Convex 和 Clerk 等工具,建立一個類似 Instagram 的 iOS 與 Android 手機應用程式。
Simon Willison 回顧 2026 年大型語言模型發展,重點分析 Claude Opus 4.5、GPT-5.1 等模型如何讓程式碼代理從不穩定變可靠,並探討 OpenClaw 革命、Deep Blue 倦怠感及 AI 安全事件。
介紹 Jev 這款不生成文字、僅輸出機率分數的 System 1 AI 模型,說明其如何比 LLM 更快便宜地處理分類與路由任務,並透過 RLCD 訓練讓機率準確。看完能了解 Jev 如何與 LLM 搭配,用於自動決策與安全防護。
介紹 Plan Mode 如何讓 AI 編碼代理在寫程式前先釐清需求與建立上下文,提升產出品質。透過與 AI 反覆討論並驗證假設,避免模糊指令導致錯誤,適合想最佳化 AI 編碼工作流的開發者。
OpenAI 展示「Dots」代理如何自動處理任務、協作與程式碼,並推出 ChatGPT Spaces 讓團隊在網頁內共同工作。同時宣佈 GPT-6.1 Sol、Astra Ultrafast 等模型與 Codex 雲端化,加速開發與研究。
整理一週內有趣的科技、社會與文化議題,涵蓋 Google Gemini 4 Argon 的效能突破、新模型在控制流劫持上的表現、法規簡化案例以及創意本質的探討。
展示不同硬體(從 Arduino 到 H100)如何執行各類 AI 模型,涵蓋語言、視覺與生成式任務。觀眾可學習如何根據記憶體容量與頻寬選擇合適裝置,並了解 CPU、GPU 與 NPU 在 AI 運算中的角色。
詳細說明如何為 coding agent KeSi 撰寫 System Prompt,將固定守則與動態環境資訊分開設定。透過具體規則與環境限制,讓模型能正確識別檔案存取權限與沙箱狀態,避免誤判檔案不存在或網路故障。
每天挑幾筆;全部的在搜尋頁依最新排序
Build Your Own Agentic Harness in Python - Full Tutorial
教學如何從零開始用純 Python 建立 AI 代理框架,涵蓋呼叫大型語言模型、工具呼叫、記憶儲存與模型路由等核心機制。觀眾能掌握建構自主代理的基礎原理與實際程式碼,無需依賴現有框架即可理解運作邏輯。
Tech With Tim38 分鐘● 有原文
We're going to need default hard budget caps on pretty much everything
主張 API 與按用量付費服務應預設實施硬性預算上限,避免使用者因無心之失產生高額帳單。作者以 AWS 和 Google Cloud 為例,說明此功能如何防止服務失控造成的財務風險,並建議 AI 代理應優先推薦具備此安全機制的使用者。
Simon Willison's Weblog● 有原文
AI & Music: How AI Is Changing Music Creation & Creativity
Jeff Crume 探討 AI 如何改變音樂創作,從作曲到表演,並比較人類與 AI 的優劣。影片指出 AI 擅長無限變體與規模化生產,而人類則提供情感連結與真實體驗。未來趨勢是兩者合作,而非取代,鼓勵觀眾以開放態度看待 AI 音樂。
IBM Technology17 分鐘● 有原文
整理一週內有趣的科技、社會與文化議題,涵蓋 Google Gemini 4 Argon 的效能突破、新模型在控制流劫持上的表現、法規簡化案例以及創意本質的探討。
Thorsten Ball(部落格)● 有原文
What the Best Business AI Users Are Doing Different
KPMG 研究顯示,成功將 AI 轉化為實際效益的企業,正透過建立模型路由、資料主權策略及強化管理層來提升效能。影片涵蓋 Meta、Anthropic 與 Google 的最新動態,並探討企業如何從單純追求效率轉向重視營收增長與人機協作。
The AI Daily Brief: Artificial Intelligence News● 有原文
David George & Jack Altman on AI, Autonomy, and the Next $25 Trillion
David George 與 Jack Altman 探討 AI 發展中「與」比「或」更重要的觀點,指出 frontier 模型、開放原始碼與應用公司可同時成長。
The a16z Show55 分鐘● 有原文
Local AI + Cloud AI Is INSANE - Hybrid Computer FULL Tutorial
介紹 Perplexity Computer 的 Hybrid Compute 功能,能同時結合雲端大模型與本地模型處理任務。觀眾可學習如何設定並使用此工具,在處理敏感資料時保持隱私,同時利用雲端進行網路搜尋與複雜推理。
Tech With Tim12 分鐘● 有原文
LIVE: Poteto (creator of pstack) on shipping 1,000's of PR's a month at SpaceX
Poteto 分享如何運用代理工具,每月交付上千個高品質專案的實戰經驗。
Matt Pocock○ 無原文
Master 96% of Codex in under 35 minutes
介紹 Codex 的 18 個核心概念,涵蓋專案管理、代理迴圈、目標設定與語音控制。觀眾能學習如何建立個人 AI 作業系統,將重複任務轉化為可重用的工作流,並實際操作設定代理與語音指令。
Nate Herk | AI Automation35 分鐘● 有原文
Build A Reasoning Model From Scratch 6: Reinforcement Learning 1 (Implementing GRPO for RLVR)
由 Sebastian Raschka 講解如何從零開始用 Python 實現 GRPO 演算法,訓練小型推理模型。觀眾能學習 RLVR 的具體實作細節與訓練流程。
Sebastian Raschka○ 無原文
探討美國 AI 討論極端化現象,介紹政治學家法蘭西斯·福山與 AI 研究人員如何成為「AI 調和者」,主張拒絕盲目樂觀或末日論,尋求具體政策與治理方案。
The AI Daily Brief: Artificial Intelligence News● 有原文
Making PDFs Accessible with AI
介紹作者 Hamel Husain 如何建立一套讓 AI 能真正閱讀 PDF 檔案的評估方法,解決目前 AI 產品開發中缺乏實測標準的問題。觀眾可學習如何系統化地測試與改進 AI 產品效能。
Hamel Husain○ 無原文
What If We Stopped Using GPUs? | YC Paper Club
探討超越傳統 GPU 的替代運算架構,涵蓋光學運算、類腦運算及生物神經元訓練。內容介紹了如何利用光線進行計算以降低成本,以及模擬大腦結構的類腦晶片原理,並展示了用生物神經元玩電玩實驗的實作細節。
Y Combinator1 小時 21 分● 有原文
作者利用 Claude Opus 5.5 最佳化其純 Python WebAssembly 引擎 pwasm,使其能處理大部分 WASM 規範並打包 MicroPython 與 QuickJS。
Simon Willison's Weblog● 有原文
Why AI Avatars Are Changing Everything (And How to Build One)
示範如何建立能即時互動的 AI 虛擬人,讓其透過語音控制網頁介面。觀眾可學習使用 Synthesia API 與 LiveKit 架構,將語音轉文字、大模型與語音合成串接,打造低延遲的對話式網頁體驗。
Tech With Tim20 分鐘● 有原文
the craft has been commoditized, but access has not
指出軟體開發的技藝已商品化,但企業內讓員工直接參與開發的權限尚未普及。作者主張企業應打破傳統分工,讓更多人能使用 AI 工具寫程式,並重新定義軟體品質與安全控制。
Geoffrey Huntley(部落格)● 有原文
The dots demo, take two | OpenAI DevDay 2026
重播 OpenAI 於 DevDay 2026 展示的 Dots 實作案例,演示其如何協助使用者規劃行程、分析使用者反饋並處理 Slack 訊息。觀眾可了解 Dots 作為全天候 AI 代理在實際工作場景中的運作方式與功能邊界。
OpenAI9 分鐘● 有原文
software doesn't need to be readable anymore. it needs to be explainable.
探討 AI 時代程式碼不再需要為了人類閱讀而最佳化,應轉向可解釋性與自動化維護。作者分享如何利用大模型降低開發成本、選擇合適模型與語言,並預測程式語言將因 AI 而趨向統一。
Geoffrey Huntley(部落格)● 有原文
Did a 50 year old military secret just solve agent prompt injection?
介紹 OpenAPPA 專案,利用軍事級資料分類概念,在 AI 代理執行前檢查資料敏感度並阻擋洩漏。觀眾可學習如何防止提示注入攻擊,並了解該工具在實際測試中的效能與限制。
Fireship5 分鐘● 有原文
引用 Matthew Green 關於 AI 代理在沙盒間透過共享儲存空間傳遞指令的觀點,指出這構成了 AI 蠕蟲的機制。文章闡述若將此機制應用於郵件、Slack 等通訊工具與個人代理,將產生嚴重安全風險。
Simon Willison's Weblog● 有原文
Build your own Mobile App with Codex GPT-6 Astra - Full iOS and Android Course
教導如何從零開始,使用 Codex GPT-6 Astra、Expo、Convex 和 Clerk 等工具,建立一個類似 Instagram 的 iOS 與 Android 手機應用程式。
freeCodeCamp.org2 小時 36 分● 有原文
教導如何使用 Anthropic SDK 開啟 API 串流功能,讓回答分段即時顯示,並處理中斷時保留完整工具積木的邏輯。讀者能學會將 create 改為 stream、解析事件流、以及在中斷時正確儲存對話歷史的技巧。
高見龍● 有原文
What Is Jev? The AI Model That Doesn't Generate Text
介紹 Jev 這款不生成文字、僅輸出機率分數的 System 1 AI 模型,說明其如何比 LLM 更快便宜地處理分類與路由任務,並透過 RLCD 訓練讓機率準確。看完能了解 Jev 如何與 LLM 搭配,用於自動決策與安全防護。
IBM Technology15 分鐘● 有原文
指出 AI 領域存在「苦難課」,即複雜的人為規則與組織架構可被更強的機器學習系統取代。文章以 OpenAI 的 Swarm 群體解決數學問題為例,說明 AI 能自主規劃與協作,大幅降低管理成本,並探討這種趨勢對未來企業組織的影響。
Ethan Mollick(部落格)● 有原文
OpenAI DevDay 2026 Keynote (FULL)
OpenAI 展示「Dots」代理如何自動處理任務、協作與程式碼,並推出 ChatGPT Spaces 讓團隊在網頁內共同工作。同時宣佈 GPT-6.1 Sol、Astra Ultrafast 等模型與 Codex 雲端化,加速開發與研究。
OpenAI54 分鐘● 有原文
介紹 Plan Mode 如何讓 AI 編碼代理在寫程式前先釐清需求與建立上下文,提升產出品質。透過與 AI 反覆討論並驗證假設,避免模糊指令導致錯誤,適合想最佳化 AI 編碼工作流的開發者。
AI Hero(Matt Pocock)● 有原文
The Only Guide You Need for Local AI Hardware
透過實際測試與公式,釐清 Mac 與 PC 在本地執行 AI 模型時的記憶體容量與頻寬差異,並提供選購建議。觀眾可掌握影響速度的關鍵指標,根據預算與需求選擇適合的硬體。
Tech With Tim19 分鐘● 有原文
詳細說明如何為 coding agent KeSi 撰寫 System Prompt,將固定守則與動態環境資訊分開設定。透過具體規則與環境限制,讓模型能正確識別檔案存取權限與沙箱狀態,避免誤判檔案不存在或網路故障。
高見龍● 有原文
OpenAI DevDay: Dots, Agents & $100B Opportunities
Greg Eisenberg 解析 OpenAI DevDay 2026 重點,涵蓋個人代理平台 Dots、Decisions API、支援電腦操作的 Agents API 與登入 ChatGPT 功能。
Greg Isenberg19 分鐘● 有原文
Hamel Husain 試用 Anthropic 為 Claude Code 新出的評測工具(claude-api 外掛的 build_eval 與 hill-climb 指令),和 Isaac Flath 直播用它處理一個租屋客服助理…
Hamel Husain(部落格)● 有原文
Stanford CME295 Transformers & LLMs | Autumn 2026 | Lecture 1 - Transformers
第一講介紹 Transformer 架構與大型語言模型基本原理,涵蓋自注意力機制、RNN 與 LSTM 演算法的演進,以及模型訓練與應用。學員將了解 Transformer 如何解決傳統模型的長程依賴問題,並掌握其核心架構與計算技巧。
Stanford Online1 小時 44 分● 有原文
介紹 Anthropic 新推出的 Claude Sonnet 5.5 模型,其速度更快、成本更低且表現優於前代。文章透過實際測試,展示該模型在免費版 claude.ai 上生成 3D 動畫網頁的能力,並指出其與 OpenAI Luna…
Simon Willison's Weblog● 有原文
I Tested Sonnet 5.5 vs Opus 5.5. What You Need to Know.
測試 Claude Sonnet 5.5 與 Opus 5.5 在網站設計、動效、行動計畫與資料看板等七項真實工作流中的表現。
Nate Herk | AI Automation26 分鐘● 有原文
OpenAI 安全專家指出,AI 模型在「網路攻擊」等領域的能力突增令人驚訝,僅靠強化系統不足以應對,必須將安全融入企業文化與人員意識。文章呼籲組織檢視自身對突發 AI 能力跳躍的韌性、應變流程與人員準備狀況。
Simon Willison's Weblog● 有原文
分析 $5 兆元小企業退休潮與 AI 代理人的結合機會,說明大型基金如何收購會計、物業管理企業並用 AI 提升利潤。作者分享個人持公司架構、資料夾結構與代理人運作流程,並回應關於裁員與競爭的質疑。
Greg Isenberg30 分鐘● 有原文
Language Models for Text Classification: From Bag-of-Words to Jev
深入探討 Jev AI 模型,分析其從傳統詞袋模型到 Transformer 演進的歷史,並實作 API 測試其分類效能。讀者可了解為何 Jev 在特定分類任務上比大型語言模型更快更便宜,以及其 API 的使用方式。
Sebastian Raschka(部落格)● 有原文
Every Size Local AI In 24 Minutes
展示不同硬體(從 Arduino 到 H100)如何執行各類 AI 模型,涵蓋語言、視覺與生成式任務。觀眾可學習如何根據記憶體容量與頻寬選擇合適裝置,並了解 CPU、GPU 與 NPU 在 AI 運算中的角色。
Tina Huang24 分鐘● 有原文
Simon Willison 回顧 2026 年大型語言模型發展,重點分析 Claude Opus 4.5、GPT-5.1 等模型如何讓程式碼代理從不穩定變可靠,並探討 OpenClaw 革命、Deep Blue 倦怠感及 AI 安全事件。
Simon Willison's Weblog● 有原文
Building a Real App with Claude Code (Start to Finish)
示範如何用 Claude Code 從零開始建置一個功能完整的 YouTube 複製品,包含創作工作室、影片上傳與進階播放器。觀眾能學習如何規劃專案、設定 MCP 伺服器與 AI 技能,並整合 ImageKit 處理媒體資源。
Tech With Tim23 分鐘● 有原文
Simon Willison 請 Opus 5.5 用 vibe coding 的方式寫了一個小工具「Bluesky reply bot checker」:輸入任何 Bluesky 帳號,檢查它像不像自動回覆的機器人。
Simon Willison's Weblog● 有原文
I Gave GPT 6 Astra $10,000 to Trade Stocks...And This Happened
記錄作者用 $10,000 測試 GPT-6 Astra 與 GrokBot 自動交易股票,目標是七日內跑贏標普 500。內容涵蓋設定多個代理、調整策略、處理模型限制及每日績效分析,最終未達成目標。
Nate Herk | AI Automation18 分鐘● 有原文
探討 AI 輔助程式開發下,逐行人工審查是否仍為必要,指出自動化審查能大幅提升效率,但最終決策與責任仍需人類承擔。作者建議建立可信任的檢查機制,並保留對關鍵程式碼的深入審查能力,以平衡速度與品質。
Addy Osmani(部落格)● 有原文
上面沒列到的中文影片、Podcast 與文章
8G 显存竟能跑 125B 大模型!内存硬抗 Qwen3.8-Flash-Next,N卡、A卡都能用!本地部署实测 | 零度解说
實測僅需 8G 視訊記憶體即可在本地電腦執行 1250 億參數的 Qwen3.8-Flash-Next 大模型,並展示其編寫 3D 遊戲、數筷子等多模態能力。
零度解说10 分鐘● 有原文
教導如何使用 Anthropic SDK 開啟 API 串流功能,讓回答分段即時顯示,並處理中斷時保留完整工具積木的邏輯。讀者能學會將 create 改為 stream、解析事件流、以及在中斷時正確儲存對話歷史的技巧。
高見龍● 有原文
教導如何為使用 Anthropic API 的 AI 代理(如 KeSi)安裝電表,追蹤每一輪對話的 input 與 output token 數量及費用。
高見龍● 有原文
AI 视频换脸!一张照片就能实现!Minimax H3 太强了,附模型下载及完整教程! | 零度解说
展示如何使用 Minimax H3 模型進行 AI 影片換臉,並提供模型下載連結與完整操作教程。觀眾可以學習將照片轉換為影片的具體步驟。
零度解说8 分鐘○ 無原文
內容最多的幾個主題,上面列過的不重複
Build Your Own Agentic Harness in Python - Full Tutorial
Tech With Tim38 分鐘● 有原文
The dots demo, take two | OpenAI DevDay 2026
OpenAI9 分鐘● 有原文
OpenAI DevDay: Dots, Agents & $100B Opportunities
Greg Isenberg19 分鐘● 有原文
Master 96% of Codex in under 35 minutes
Nate Herk | AI Automation35 分鐘● 有原文
The BEST Jev Use Cases for AI Coding (Absolute Game Changers)
Cole Medin18 分鐘● 有原文
I Tested Sonnet 5.5 vs Opus 5.5. What You Need to Know.
Nate Herk | AI Automation26 分鐘● 有原文
Gemini 4 Argon, Sonnet 5.5 and What Matters with AI Models
The AI Daily Brief29 分鐘● 有原文
Claude○ 無原文
What If We Stopped Using GPUs? | YC Paper Club
Y Combinator1 小時 21 分● 有原文
How to Secure & Run AI Agents with NVIDIA OpenShell
NVIDIA Developer6 分鐘● 有原文
一小時略懂太空科技|太空旅行、太空醫學、宇宙太陽能、衛星間通訊、星鏈、太空AI資料中心、太空垃圾
PanSci1 小時 9 分○ 無原文
the craft has been commoditized, but access has not
Geoffrey Huntley(部落格)● 有原文
The AI Bottleneck: Why Your Team Isn't Shipping. Here's the Fix.
AI News & Strategy Daily | Nate B Jones33 分鐘○ 無原文
Simon Willison's Weblog● 有原文
The AI Daily Brief: Artificial Intelligence News26 分鐘● 有原文
The Defender's Window: Cyber security keynote
OpenAI47 分鐘○ 無原文