※ 摘要僅根據標題與說明
Koala聊开源
Bilibili ・ 華語圈 ・ 簡體中文 ・ B 級 ・ 4.4 萬 訂閱 ・ 26 筆內容 ・ 最近更新 2026/10/06
講開源的頻道:「技术杂谈」評 agent 工具(DeepSeek Harness 滿月的亮點與風險)、科技週報、長時間 vibe coding 實錄
最受歡迎
依人氣
- 2.2 萬次觀看
- 2影片進階中文
为什么我不让 AI 客服直接回复用户?新思路构建可信赖的 AI 客服|录屏精简版
分享一個實際執行的 AI 客服案例,透過「先審後發」機制解決幻覺與錯誤回覆問題。觀眾可學習如何在人機協作架構下,平衡效率與可追溯性。
3,727次觀看※ 摘要僅根據標題與說明
- 3影片進階中文
科技周报|Google 的 Agent 运行时;JS/TS 代码体检工具;可嵌入的 Office SDK
介紹 Google 的 Agent 運算時、JS/TS 程式碼檢查工具與可嵌入 Office SDK 的技術動態。
3,914次觀看※ 摘要僅根據標題與說明
※ 摘要僅根據標題與說明
- 2,271次觀看
※ 摘要僅根據標題與說明
- 3,243次觀看
※ 摘要僅根據標題與說明
- 7影片進階中文
Agent Core 灵活切换,我们用一天时间化解了客户的 Claude Code 后门焦虑|录屏精简版
分享 Neutree Agent Platform 如何在一日內整合 Goose 作為第三種 Agent Core,解決客戶對 Claude Code 後門的擔憂。
※ 摘要僅根據標題與說明
- 8影片進階中文
如何科学评估 AI —— 评估基础概念与方法
從應用方視角解釋科學評估的重要性,梳理資料集、評估物件、輸出、打分器與結果五大核心要素。結合 CMMLU、BFCL 與 Alpaca 等案例,講解選擇題、工具呼叫及 LLM Judge 等四種常見評估方法,幫助建立工程化評估框架。
6,872次觀看※ 摘要僅根據標題與說明
- 4,044次觀看
※ 摘要僅根據標題與說明
- 3,300次觀看
※ 摘要僅根據標題與說明
最新內容
依發布時間
- 影片進階中文
复刻 Claude Dreaming,强化 Agent 记忆写入与整理能力|录屏精简版
介紹如何複刻 Claude 的 Dreaming 機制,將 Agent 記憶整理為 Memory Reflect。觀眾可學習離線記憶整理、增量讀取與 Merge、Supersede、Synthesize 三種語義的實現方法。
4,640次觀看※ 摘要僅根據標題與說明
- 影片進階中文
为什么我不让 AI 客服直接回复用户?新思路构建可信赖的 AI 客服|录屏精简版
分享一個實際執行的 AI 客服案例,透過「先審後發」機制解決幻覺與錯誤回覆問題。觀眾可學習如何在人機協作架構下,平衡效率與可追溯性。
3,727次觀看※ 摘要僅根據標題與說明
- 影片進階中文
科技周报|Google 的 Agent 运行时;JS/TS 代码体检工具;可嵌入的 Office SDK
介紹 Google 的 Agent 運算時、JS/TS 程式碼檢查工具與可嵌入 Office SDK 的技術動態。
3,914次觀看※ 摘要僅根據標題與說明
- 2,271次觀看
※ 摘要僅根據標題與說明
※ 摘要僅根據標題與說明
- 2.2 萬次觀看
※ 摘要僅根據標題與說明
- 3,243次觀看
※ 摘要僅根據標題與說明
- 3,300次觀看
※ 摘要僅根據標題與說明
- 影片進階中文
Agent 评估实战,从 sonnet 切换至 deepseek v4 flash|录屏精简版
拆解如何從真實會話構建測試場景,並從工具副作用、根因品質與 Token 成本等維度評估 Agent。透過對比不同模型,展示如何最佳化效能並降低 Token 支出。
※ 摘要僅根據標題與說明
- 4,044次觀看
※ 摘要僅根據標題與說明
- 影片進階中文
Agent Core 灵活切换,我们用一天时间化解了客户的 Claude Code 后门焦虑|录屏精简版
分享 Neutree Agent Platform 如何在一日內整合 Goose 作為第三種 Agent Core,解決客戶對 Claude Code 後門的擔憂。
※ 摘要僅根據標題與說明
- 影片進階中文
Prompt 评估实战,基于评估数据,降低 200 倍 token 消耗|录屏精简版
演示如何從真實 Agent 會話中構建評估資料集,透過自動化實驗比較不同 Prompt 方案。觀眾可學習如何在品質、成本與速度之間做出商業決策。
※ 摘要僅根據標題與說明
- 影片進階中文
如何科学评估 AI —— 评估基础概念与方法
從應用方視角解釋科學評估的重要性,梳理資料集、評估物件、輸出、打分器與結果五大核心要素。結合 CMMLU、BFCL 與 Alpaca 等案例,講解選擇題、工具呼叫及 LLM Judge 等四種常見評估方法,幫助建立工程化評估框架。
6,872次觀看※ 摘要僅根據標題與說明
- 影片進階中文
科技周报|DeepSeek 正式版 V4-Flash;2G 内存跑 26B 模型;自托管的迷你 Heroku
介紹 DeepSeek V4-Flash 模型如何在 2G 記憶體上執行,以及自託管迷你 Heroku 的用法。
6,085次觀看※ 摘要僅根據標題與說明
- 3,187次觀看
※ 摘要僅根據標題與說明
- 影片進階中文
科技周报|2.8 万亿参数开源旗舰;在 Claude Code 里调用 Codex;手机上跑的 1-bit 大模型
介紹 2.8 兆參數開源旗艦模型、Claude Code 呼叫 Codex 以及手機執行的 1-bit 大模型。
4,508次觀看※ 摘要僅根據標題與說明
- 影片進階中文
Agent 平台工程实践:数据面灵活解耦|录屏精简版
探討企業級 Agent 平台如何透過控制面與資料面解耦,實現擴展、異構與網路隔離。透過對比 Anthropic CMA 的 Self-hosted Sandbox 與 Neutree Agent Platform 架構,解析下一代平台設計…
3,766次觀看※ 摘要僅根據標題與說明
- 影片進階中文
科技周报|TS 高速编译器正式发布;AI 时代的 curl;笔记本跑 744B 大模型
介紹 TS 高速編譯器、AI 時代的 curl 工具用法,以及膝上型電腦執行 744B 大模型的實作。
※ 摘要僅根據標題與說明
- 3,455次觀看
※ 摘要僅根據標題與說明
- 4,194次觀看
※ 摘要僅根據標題與說明



















