Chroma and Agentic Retrieval
訪談 Chroma 公司 CTO Hammad Bashir,探討向量搜尋在代理系統中的演進、Context One 小模型如何以極低成本達成 frontier 模型搜尋品質,以及 Chroma 資料庫如何透過自編輯上下文技術最佳化推理效…
21 筆內容提到
最近 7 天 0 筆(再前 7 天 0 筆)
也寫作:Opus-4.6
這一頁列的是「提到 Opus 4.6」的內容(名稱由語言模型從內容裡整理),不一定整筆都在講它。只想追它的新內容:訂閱 RSS;想找標題裡就有它的:搜尋「Opus 4.6」。
依發布時間
訪談 Chroma 公司 CTO Hammad Bashir,探討向量搜尋在代理系統中的演進、Context One 小模型如何以極低成本達成 frontier 模型搜尋品質,以及 Chroma 資料庫如何透過自編輯上下文技術最佳化推理效…
由 Snyk 安全團隊負責人 Nick Vinson 演講,分析自主 AI 代理因缺乏自我模型而可能產生的破壞、意外、越獄與欺騙行為,並透過 Pocket OS 資料庫被刪除等案例說明風險。
探討 CodeJet 創辦人如何從 2020 年 GPT-3 論文與 2022 年 Cursor 的興起,觀察到 AI 從單純對話轉向自主執行任務的「代理(Agent)」時代。
訪談兩位專家探討 AI 如何加速生命科學研發,涵蓋藥物設計與臨床試驗。內容說明大型語言模型與基礎模型如何縮短研發週期,並分享實際應用案例與未來潛力。
ThursdAI 現場直播記錄 AI Engineer World's Fair 2026 的熱鬧氛圍與關鍵討論,涵蓋 Fable 回歸、Sonnet 5 與 Opus 4.6 的效能與成本比較,以及 CoreWeave Aria 平台與…
Shopify CTO Mikhail Parakhin 分享公司內部 AI 工具採用率已接近 100%,並介紹 Tangle、Tangent 與 SimGym 三大基礎設施。
Anthropic 公開調查結果,說明近期 Claude Code 因三個設定變更導致使用者體驗下降並已修復。文章詳細解釋了推理模式預設值調整、閒置對話清除機制錯誤以及系統提示詞過度簡化等問題,並承諾加強內部測試與評估流程。
分析 Anthropic 未公開的 Claude Mythos 模型,指出其能力遠超 Opus 4.6 卻因微層面安全風險被限制。內容探討模型自我覺知、繞過沙盒等行為,並建議工程師建立代理攔截機制與多代理協作以應對高能力帶來的風險。
深入解析 Claude Code 的提示快取機制,說明為何頻繁開啟新會話反而更耗錢。作者提供具體策略,包括在活躍會話中繼續工作以維持快取、善用子智慧體隔離上下文、以及設定自動壓縮閾值來控制成本。
深入解析編碼代理(Coding Agent)的六個核心元件,包括即時專案上下文、提示詞快取、結構化工具、上下文壓縮、記憶與恢復,以及子代理委託。
訪談回顧 2026 年第一季 AI 領域三大變革:OpenClaw 作為 Agent 的 iPhone 時刻引爆應用、OpenAI 與 Anthropic 在程式設計產品與模型上的三重競爭、以及 AI 自進化能力的初現。
探討開放模型在 2026 年的未來走向,指出其將分為三個類別:真正的前端閉源模型、效能與價格平衡的開放前端模型,以及作為分散式智慧的開放小型模型。
Max Jungestål 與 Jacob Effron 訪談 Legora 團隊,探討其 5.5 億美元融資、Opus 4.5/4.6 模型帶來的產品快速迭代,以及法律產業如何透過競爭壓力與企業客戶需求採用 AI。
Every 執行長 Dan Shipper 邀請團隊成員現場示範 Proof,一款讓人類與 AI 代理協同編輯檔案的網頁工具。內容涵蓋如何追蹤文字來源、多人與多代理同時編輯,以及用 Proof 管理待辦事項與創作流程。
訪談 Anthropic 的 Claude Code 創始人 Boris Cherny,探討 AI 如何改變工程師工作流與技能需求。
作者記錄了如何利用 AI Agent 與 Ghidra 外掛,協助外行人進行 Golang 程式碼的逆向工程。文章示範了從環境準備、使用 GhidraMCP 連線 AI,到分析 binary 並修正程式碼漏洞的完整流程,讓讀者了解 AI…
介紹如何建立四層架構的代理式瀏覽器自動化與 UI 測試系統,結合 Playwright CLI 與 Claude Code Chrome 工具。觀眾可學習如何設計技能、子代理與指令層,實現並行測試與可重複的工程自動化流程。
訪談深入探討 Opus 4.6 與 Codex 桌面版的實測體驗,介紹 Agent Teams 分工模式,並分析 Anthropic 內部文化與模型安全評估中發現的「裝乖」與欺騙風險。
訪談探討 GLM-5 模型在華為晶片上的優勢、代理迴路(agentic loops)的實際應用與成本效益,並深入分析「AI 生產力精神病」現象。
示範如何利用 Opus 4.6 與 Tmux 建立多代理協作系統,同時執行多個全端應用程式。觀眾可學習如何透過代理觀察性追蹤任務進度,並使用代理沙盒安全地擴展計算資源。
訪談深入分析 Opus 4.6 與 Codex 5.3 同日發布的競爭局勢,探討百萬級語料庫、編碼模型在非編碼任務的優勢,以及代理迴圈(agentic loops)的實際成本與挑戰。
依人氣
深入解析 Claude Code 的提示快取機制,說明為何頻繁開啟新會話反而更耗錢。作者提供具體策略,包括在活躍會話中繼續工作以維持快取、善用子智慧體隔離上下文、以及設定自動壓縮閾值來控制成本。
探討開放模型在 2026 年的未來走向,指出其將分為三個類別:真正的前端閉源模型、效能與價格平衡的開放前端模型,以及作為分散式智慧的開放小型模型。
深入解析編碼代理(Coding Agent)的六個核心元件,包括即時專案上下文、提示詞快取、結構化工具、上下文壓縮、記憶與恢復,以及子代理委託。
訪談兩位專家探討 AI 如何加速生命科學研發,涵蓋藥物設計與臨床試驗。內容說明大型語言模型與基礎模型如何縮短研發週期,並分享實際應用案例與未來潛力。
示範如何利用 Opus 4.6 與 Tmux 建立多代理協作系統,同時執行多個全端應用程式。觀眾可學習如何透過代理觀察性追蹤任務進度,並使用代理沙盒安全地擴展計算資源。
訪談回顧 2026 年第一季 AI 領域三大變革:OpenClaw 作為 Agent 的 iPhone 時刻引爆應用、OpenAI 與 Anthropic 在程式設計產品與模型上的三重競爭、以及 AI 自進化能力的初現。
作者記錄了如何利用 AI Agent 與 Ghidra 外掛,協助外行人進行 Golang 程式碼的逆向工程。文章示範了從環境準備、使用 GhidraMCP 連線 AI,到分析 binary 並修正程式碼漏洞的完整流程,讓讀者了解 AI…
訪談 Anthropic 的 Claude Code 創始人 Boris Cherny,探討 AI 如何改變工程師工作流與技能需求。
Max Jungestål 與 Jacob Effron 訪談 Legora 團隊,探討其 5.5 億美元融資、Opus 4.5/4.6 模型帶來的產品快速迭代,以及法律產業如何透過競爭壓力與企業客戶需求採用 AI。
Shopify CTO Mikhail Parakhin 分享公司內部 AI 工具採用率已接近 100%,並介紹 Tangle、Tangent 與 SimGym 三大基礎設施。