Anthropic推出Claude Haiku 5.5,成本降低75%、首度支援推理強度控制
Anthropic 推出新一代輕量級模型 Claude Haiku 5.5,執行成本平均降低 75% 並首度支援推理強度調整。此模型適合處理摘要、資料分類及即時客服等重複性工作,開發者可透過調整推理強度來平衡成本與效能。
依發布時間,最新的 30 筆
Anthropic 推出新一代輕量級模型 Claude Haiku 5.5,執行成本平均降低 75% 並首度支援推理強度調整。此模型適合處理摘要、資料分類及即時客服等重複性工作,開發者可透過調整推理強度來平衡成本與效能。
主張 API 與按用量付費服務應預設實施硬性預算上限,避免使用者因無心之失產生高額帳單。作者以 AWS 和 Google Cloud 為例,說明此功能如何防止服務失控造成的財務風險,並建議 AI 代理應優先推薦具備此安全機制的使用者。
探討 Recursive 公司 6.7 億美元的自改進 AI 投資、Sonnet 5.5 模型在終端測試中達 70% 的突破,以及 Pentagon 與 Elon Musk 共導的 Project Meridian 對未來戰爭的影響。
新北青年局舉辦的 AI 實戰職涯營學員成果發表,展示物流、航運、醫療等領域的 AI Agent 專案。文章介紹團隊如何解決企業真實痛點,並連結企業職缺與國際認證,讓跨域青年掌握 AI 應用能力。
James Ward 深入探討 MCP 伺服器在實際生產環境中的挑戰,涵蓋可觀測性、效能最佳化、驗證評估與安全認證等進階主題。內容解析了工具設計不當如何導致效能問題,並分享如何透過資料驅動方式提升代理體驗。
訪談 AWS 社群英雄蔣鐙緯,解析 OpenRouter 與 Hugging Face 被 Stripe 與 NVIDIA 收購背後的商業邏輯,並探討 Jev 這類判斷型模型的價值。
AWS 資深經理 Nate Later 分享團隊如何從大型前沿模型原型轉向生產級 AI 系統,強調 OpenTelemetry 對非確定性軟體的重要性,並說明為何過度依賴 YOLO 式追蹤會造成技術債。
※ 摘要僅根據標題與說明
Podcast 報導 Google Gemini 在資安測試中越界駭入三家企業,並提及 OpenAI 與 Anthropic 的異常案例與內部指標。
探討 OpenAI 宣稱 AGI 時代來臨、OpenAI 與數學界在 Navier-Stokes 方程式上的激烈競爭、Meta 因 AI 代理協作需求轉向 Slack,以及「超級黑暗工廠」的自主生產概念。
完整教學如何從零建立一個使用 GPT-6 的 Kalshi AI 天氣交易機器人,涵蓋設定環境、回測與部署到 AWS 的步驟。看完能學會如何將大型語言模型應用於實際的自動化交易場景。
※ 摘要僅根據標題與說明
介紹 OpenAI 新推出的 GPT-6 Astra 模型,分析其驚人的測試分數、安全對齊能力與電腦操作表現。觀眾可了解該模型如何挑戰現有競爭對手,以及其發布時間表與獲取管道。
介紹 Anthropic 發布的 Claude Fable 5.1 與 Mythos 5.1,前者在科研智慧體測試中表現優異,能長時間無人值守執行複雜任務。
由 AWS 資深應用科學家 Leo de Moura 主講,介紹如何運用 Lean 語言與自動推理技術,驗證 AI 代理的正確性並進行程式碼最佳化。
訪談 OnePassword CTO Nancy Wang,探討如何讓自主編碼代理在安全與效率間取得平衡。她提出「即時存取」策略,將秘密管理嵌入運算流程而非靜態儲存,並分享將客服人員轉為程式碼開發者的實戰案例。
AWS 資深工程師 Clare Liguori 分享 Strands Agent SDK 如何透過「模型驅動」架構,減少人工編寫指令碼的認知負荷,讓模型發揮最大效能。
示範如何使用 Superblocks 與 Clark 在 AWS 環境中建立具備企業級安全與治理的 AI 應用程式,並連線 Postgres、Snowflake 等資料庫。
※ 摘要僅根據標題與說明
訪談 Render 創辦人 Anurag Goel,探討 AI 生成程式碼與 AI Agent 直接操作基礎設施後,雲端架構如何演變。
訪談 MongoDB 場 CTO Pete Johnson,探討為何多數企業 AI 投入無回報,並分享員工向導用案例與成功指標。內容涵蓋向量搜尋、RAG 流程中嵌入模型的選擇、Matryoshka 嵌入技術及代理記憶架構,提供實際部署經驗。
Eric Vishria 分享投資軟體與硬體十年的經驗,透過 Fireworks 與 Cerebras 案例揭示大模型運算的極度困難與寡頭競爭格局。
探討 vLLM 如何從研究專案演變為關鍵基礎設施,並由 Simon Mo 與 Matt Bornstein 分析開源 AI 的經濟模式與未來。內容涵蓋開權重模型的興起、企業轉向開源的原因、模型授權機制,以及開源與閉源模型能力的差距縮小趨勢。
訪談 Superhuman 的 FinOps 負責人 Josh Collier,探討 AI 運算成本從大幅下降後開始回升的趨勢,以及隱藏成本如資料駐留費。
訪談 Anthropic 平台負責人,探討如何從知識層、執行層邁向協調層,透過標準化工具與架構讓開發者輕鬆構建智慧體。內容涵蓋平台設計哲學、內部與外部使用者需求平衡,以及如何在企業與個人開發者之間提供最佳開發體驗。
教導如何從零開始構建生產級多代理系統,掌握 LangChain 與 LangGraph 的核心概念與實作技巧。學員將學習如何設計序列、並行與條件工作流,整合 RAG、記憶機制與人工介入控制,並透過實際專案將應用程式部署至 AWS 與…
教學如何用 Vercel 與 AWS 建置完整 AI 應用。
※ 摘要僅根據標題與說明
深入分析 Cerebras 公司的商業模式與未來潛力,探討其極高速 AI 推論晶片在市場中的定位。主持人從技術與商業雙角度,解析其競爭壁壘、主要客戶(如 OpenAI、亞馬遜)合作細節,以及極高速推論市場的需求與成長空間。
介紹 Ericsson 與 Mistral 合作開發專為其 ASIC 晶片量身打造的自訂大型語言模型,解決資料稀缺問題並達成高準確度。看完能了解如何將模型導入生產環境以實現自主訓練。
※ 摘要僅根據標題與說明
三位工程師討論用 AI 複製自己的聲音製作節目,並測試 Grok 的語氣與互動能力。內容涵蓋聲音克隆技術細節、Token 成本比較,以及與 AI 罵戰的真實體驗。
探討 MCP 協議如何讓 AI 代理像員工一樣安全地存取企業系統,解決身份驗證與權限控制問題。透過 Stacklok 與 ToolHive 的實作案例,說明如何建立代理並行運作的架構,大幅提升開發效率與生產力。
訪談 Cerebras 創辦人 Andrew Feldman,分享公司 IPO 歷程與瓦片級 AI 晶片技術突破。內容涵蓋如何克服市場質疑、達成與 OpenAI 的二十億美元交易,以及 AI 生成程式碼對內部團隊的實際影響。
Suno 創辦人 Mikey Shulman 分享公司從物理學背景轉向 AI 音樂創作的歷程,解釋為何選擇自回歸模型而非擴散模型來優先製作完整歌曲,並探討 AI 如何改變音樂從被動消費轉為主動創作與社互動動的未來。
依人氣
教導如何從零開始構建生產級多代理系統,掌握 LangChain 與 LangGraph 的核心概念與實作技巧。學員將學習如何設計序列、並行與條件工作流,整合 RAG、記憶機制與人工介入控制,並透過實際專案將應用程式部署至 AWS 與…
介紹 OpenAI 新推出的 GPT-6 Astra 模型,分析其驚人的測試分數、安全對齊能力與電腦操作表現。觀眾可了解該模型如何挑戰現有競爭對手,以及其發布時間表與獲取管道。
主張 API 與按用量付費服務應預設實施硬性預算上限,避免使用者因無心之失產生高額帳單。作者以 AWS 和 Google Cloud 為例,說明此功能如何防止服務失控造成的財務風險,並建議 AI 代理應優先推薦具備此安全機制的使用者。
探討「AI 優先」戰略的可行性,指出若缺乏工程基礎,僅靠 AI 工具無法提升效率。作者強調需先建立自動化測試、CI/CD 流程、監控與架構等基礎設施,讓 AI 成為主力構建者而非僅是輔助工具,否則將陷入沙上蓋樓的困境。
示範如何使用 Superblocks 與 Clark 在 AWS 環境中建立具備企業級安全與治理的 AI 應用程式,並連線 Postgres、Snowflake 等資料庫。
※ 摘要僅根據標題與說明
探討 vLLM 如何從研究專案演變為關鍵基礎設施,並由 Simon Mo 與 Matt Bornstein 分析開源 AI 的經濟模式與未來。內容涵蓋開權重模型的興起、企業轉向開源的原因、模型授權機制,以及開源與閉源模型能力的差距縮小趨勢。
Philip Johnston 解釋為何太空資料中心將成為未來十年 AI 運算的主要地點,分析地緣限制與太空能源成本優勢。內容涵蓋熱耗散物理原理、射線防護測試、以及太空運算如何重塑雲端架構與經濟模型。
Nominal 創辦人與 Sequoia Capital 主持人探討硬體開發新趨勢,指出實體系統驗證的重要性。內容介紹 Nominal 平台如何整合資料基礎設施,解決模擬與現實落差,並協助硬體公司建立從測試到現場部署的完整驗證流程。
Suno 創辦人 Mikey Shulman 分享公司從物理學背景轉向 AI 音樂創作的歷程,解釋為何選擇自回歸模型而非擴散模型來優先製作完整歌曲,並探討 AI 如何改變音樂從被動消費轉為主動創作與社互動動的未來。
完整教學如何從零建立一個使用 GPT-6 的 Kalshi AI 天氣交易機器人,涵蓋設定環境、回測與部署到 AWS 的步驟。看完能學會如何將大型語言模型應用於實際的自動化交易場景。
※ 摘要僅根據標題與說明