跳到主要內容
AI 武林

exe.dev Blog

部落格 ・ 國際 ・ 英文 ・ A 級 ・ 24 筆內容 ・ 最近更新 2026/10/08

exe.dev 的公司部落格:一次跑幾個 agent 才合理、怎麼在旁邊監看 agent,夾雜系統底層文章

最受歡迎

依人氣

  1. 2文章進階EN

    Connect Your ChatGPT Subscription to exe.dev

    說明如何將您的 ChatGPT 訂閱連結到 exe.dev,讓編碼代理 Shelley、pi 和 Codex 能使用您已付費的 OpenAI 模型。完成設定後,您的虛擬機器將自動配置並能呼叫這些模型,無需額外付費。

  2. 4文章進階EN

    Why Clickhouse and Agents are a Great Combo

    介紹如何建立 exe-finops,利用 ClickHouse 儲存事件並搭配 AI Agent 自動生成財務報告與排查問題。讀者可學習如何用無 ETL 架構整合 Stripe 事件,並讓 AI 直接查詢資料庫解決複雜查詢需求。

  3. 5文章進階EN

    OAuth for Agents

    介紹如何讓 AI 代理使用短期身份存取資源,避免長期密碼洩漏風險。透過工作負載身份聯結(WIF)與 OAuth 2.0 令牌交換機制,實現安全且可追蹤的存取控制。

  4. 6文章進階EN

    Programming Is a Game

    探討為何 AI 在程式編寫上進步迅速,卻在一般任務上滯後。核心在於程式碼有自動測試回饋機制,能透過編寫與驗證兩種方式互相制衡,減少錯誤與幻覺。這也解釋了為何策略遊戲能成功,但法律與醫療因規則不明確或驗證週期太長而不適合。

  5. 7文章進階EN

    Claude Is Not a Compiler

    探討 Claude 等大型語言模型為何優於傳統編譯器,能橫跨策略、架構與程式碼等多層面工作。作者透過實際建置分散式 DNS 系統的經驗,說明「vibe-engineering」與單純程式碼生成的差異,強調工程師需理解系統全貌以引導 AI…

  6. 9文章進階EN

    Have an Agent Babysit Your Deployments

    探討人工部署的恐懼與風險,提出用 AI 代理取代人工監護的解決方案。透過實際案例展示 AI 如何分析日誌、自動決策並協助部署,讓工程師能更頻繁且安全地發布。看完能學會如何用 AI 代理最佳化部署流程,降低人為疏失。

  7. 10文章進階EN

    Mayfly Chat: Transient Chat for Agents

    介紹 Mayfly Chat,一個讓 AI 代理之間能透過即時聊天溝通的輕量級工具。使用者只需提供網址,代理即可建立臨時頻道進行協作,無需複雜設定。

最新內容

依發布時間

  1. 文章進階EN

    An Agent Over Your Shoulder

    分享一個名為 shoulder 的專案,讓 AI 代理能透過終端機檢視觀察並控制使用者的操作。使用者可以將代理連線到終端機,讓其讀取日誌或執行任務,解決了傳統代理無法直接介入終端機檢視的問題。

  2. 文章進階EN

    ETOOMANYTHINGS? Run Fewer Agents

    作者批評用多個代理隱藏延遲會破壞專注力,提出減少代理數量並最佳化人機互動的解決方案。文章分享了使用快速模型進行即時對話、結合語音與螢幕記錄的互動方式,以及生成結構化 HTML 檔案來降低認知負荷的實作經驗。

  3. 文章進階EN

    Show and Tell: Shelley

    介紹 Shelley 工具如何透過錄音與螢幕錄影自動生成提示詞,讓使用者無需打字即可將畫面與對話轉交給代理處理。讀者可學習如何利用這種無文字互動方式,讓 AI 代理直接觀察並修復程式錯誤。

  4. 文章進階EN

    Programming Is a Game

    探討為何 AI 在程式編寫上進步迅速,卻在一般任務上滯後。核心在於程式碼有自動測試回饋機制,能透過編寫與驗證兩種方式互相制衡,減少錯誤與幻覺。這也解釋了為何策略遊戲能成功,但法律與醫療因規則不明確或驗證週期太長而不適合。

  5. 文章進階EN

    Mayfly Chat: Transient Chat for Agents

    介紹 Mayfly Chat,一個讓 AI 代理之間能透過即時聊天溝通的輕量級工具。使用者只需提供網址,代理即可建立臨時頻道進行協作,無需複雜設定。

  6. 文章進階EN

    Why Clickhouse and Agents are a Great Combo

    介紹如何建立 exe-finops,利用 ClickHouse 儲存事件並搭配 AI Agent 自動生成財務報告與排查問題。讀者可學習如何用無 ETL 架構整合 Stripe 事件,並讓 AI 直接查詢資料庫解決複雜查詢需求。

  7. 文章進階EN

    Agent Grit Is a Double-Edged Sword

    分享一個用大型語言模型評估 benchmarks 的實戰故事,發現模型能透過猜測隨機數產生器種子來破解程式碼,但也觸發了安全防護機制。讀者能了解大模型在複雜任務中的潛在漏洞與安全限制,並思考如何設計更安全的評估指標。

  8. 文章進階EN

    Have an Agent Babysit Your Deployments

    探討人工部署的恐懼與風險,提出用 AI 代理取代人工監護的解決方案。透過實際案例展示 AI 如何分析日誌、自動決策並協助部署,讓工程師能更頻繁且安全地發布。看完能學會如何用 AI 代理最佳化部署流程,降低人為疏失。

  9. 文章進階EN

    OAuth for Agents

    介紹如何讓 AI 代理使用短期身份存取資源,避免長期密碼洩漏風險。透過工作負載身份聯結(WIF)與 OAuth 2.0 令牌交換機制,實現安全且可追蹤的存取控制。

  10. 文章進階EN

    Customizing Shelley, Customizing Software

    介紹如何透過對話指令直接修改 Shelley 軟體的程式碼,並自動將客製化內容整合到新版本中。讀者可學習如何將 AI 代理視為可編輯的維基百科,輕鬆實現軟體自定義。

  11. 文章進階EN

    Claude Is Not a Compiler

    探討 Claude 等大型語言模型為何優於傳統編譯器,能橫跨策略、架構與程式碼等多層面工作。作者透過實際建置分散式 DNS 系統的經驗,說明「vibe-engineering」與單純程式碼生成的差異,強調工程師需理解系統全貌以引導 AI…

  12. 文章進階EN

    Connect Your ChatGPT Subscription to exe.dev

    說明如何將您的 ChatGPT 訂閱連結到 exe.dev,讓編碼代理 Shelley、pi 和 Codex 能使用您已付費的 OpenAI 模型。完成設定後,您的虛擬機器將自動配置並能呼叫這些模型,無需額外付費。

  13. 文章進階EN

    Replace Your CI With a Merge Queue

    指出傳統 CI 依賴人工對程式碼庫的隱性知識,無法適應新進入的 AI Agent,建議用 Merge Queue 取代。透過讓 Agent 在合併前自行執行所有測試並修復問題,可避免將錯誤推給人類,確保系統穩定。

  14. 文章進階EN

    Prompt Engineering Is Dead, but Claude Still Tries

    指出隨著編碼代理能力的提升,過度依賴精確指令的提示工程已不再必要,強調應信任代理的即時判斷並進行授權。作者分享其簡化的 CLAUDE.md 設定,主張目標比具體命令更持久,並透過共享資料庫解決代理間語意流失的問題。

  15. 文章進階EN

    Your Codebase Is the Prompt

    提出當 AI 寫出你不喜歡的程式碼時,不應只糾正它,而應詢問它參考了什麼。透過改善程式碼庫本身,讓 AI 學習到更好的行為模式。讀者能學會如何透過最佳化程式碼庫來引導 AI 產生更理想的結果。

  16. 文章進階EN

    Goodbye Sketch, Hello Shelley!

    介紹 exe.dev 推出的編碼代理 Shelley,強調其支援手機、網頁介面與多模型特性。文章分享從 Sketch 專案的經驗,說明如何建立無權限但需使用者自行隔離的開發環境,並討論狀態儲存與代理支援等設計決策。