跳到主要內容
AI 武林
文章進階中文

Anthropic 推 Haiku 5.5,電腦操作測試超車 GPT-6 Luna,小模型能接手哪些 Agent 工作?

來源 TechOrange 科技報橘

讀原文(在新分頁開啟原站)連到 TechOrange 科技報橘

摘要

Anthropic 推出新模型 Claude Haiku 5.5,API 價格調降 90% 並大幅提升電腦操作成功率,在測試中超越 GPT-6 Luna。文章分析小模型如何承接高頻、成本敏感的多步驟任務,並探討其作為大型模型子代理的應用場景。

Anthropic launches Claude Haiku 5.5 with 90% price cuts and improved computer operation capabilities, positioning it as a cost-effective subagent for high-frequency tasks.

摘要、重點與章節標題由語言模型整理,細節(誰說的、數字、先後)可能有誤;要引用請以原始內容為準。

重點

  • Haiku 5.5 電腦操作成功率達 72.4%,超越 GPT-6 Luna。
  • API 價格調降 90%,適合大量高頻且成本敏感任務。
  • 可作為大型模型的子代理,處理範圍明確的輔助工作。

提到的工具與公司

  • Claude Haiku 5.5
  • GPT-6 Luna
  • OSWorld 2.1
  • Terminal-Bench 4.0
  • Asana
  • Opus 5.5
  • Sonnet 5.5
  • Rogo

適合誰看

正在規劃 AI Agent 架構或評估模型成本效益的企業決策者與開發者。

摘要依據

依據
文章全文

為什麼排在這裡

人氣
0.35
新鮮
1.00

在主題頁與搜尋結果裡,名次由相關、人氣、新鮮三個分數決定;這一頁沒有搜尋的關鍵字,所以沒有相關分數。排序怎麼算

摘要由 AI 根據原文產生,可能有誤;完整內容請看原站。讀原文(在新分頁開啟原站)