看影片(在新分頁開啟原站)連到 YouTube・Jason Liu
摘要
Simon 分享如何利用物件儲存架構支援大規模向量搜尋,解決傳統資料庫在 RAG 工作負載下的瓶頸。透過 JIT 快取與記憶體加速,將查詢時延從數百毫秒降至數毫秒,並提供實際案例與混合搜尋策略。
Simon discusses building trillion-scale vector search on object storage to optimize RAG systems and reduce query latency.
這筆內容還沒有取得字幕或內文,這段摘要只根據標題與說明欄產生,可能不夠準確;實際內容請以原站為準。
提到的工具與公司
適合誰看
正在構建或最佳化大規模 RAG 系統、需要處理海量向量資料的 AI 工程師與架構師。
摘要依據
- 講者
- Jason Liu
- 依據
- 標題與說明欄(還沒有取得字幕或內文)
為什麼排在這裡
- 人氣
- 0.11
- 新鮮
- 0.27
在主題頁與搜尋結果裡,名次由相關、人氣、新鮮三個分數決定;這一頁沒有搜尋的關鍵字,所以沒有相關分數。排序怎麼算
相關內容
- 1017: Vector Search, Agentic Memory and Effective RAG, with MongoDB’s Pete JohnsonPodcast ・ Super Data Science ・ 57 分鐘
- Querying 3 billion vectors文章 ・ Vicki Boykis
- Retrieval After RAG: Hybrid Search, Agents, and Database Design — Simon Hørup Eskildsen of TurbopufferPodcast ・ Latent Space ・ 1 小時 1 分
- Retrieval Augmented Generation (RAG) Explained: Embedding, Sentence BERT, Vector Database (HNSW)影片 ・ Umar Jamil ・ 49 分鐘
- Ep 71: CEO of TurboPuffer Simon Eskildsen on Building Smarter Retrieval, AI App Must-Have Features & Current State of Vector DBsPodcast ・ Unsupervised Learning ・ 51 分鐘
- 我把775篇收藏塞进4MB向量库:一个比Karpathy Wiki更能"翻箱底"的RAG skill文章 ・ 鸟窝
摘要由 AI 根據標題與說明欄產生(還沒有取得原文),可能有誤;完整內容請看原站。看影片(在新分頁開啟原站)
