向量库不再囤数据:Milvus 3.0 零拷贝直读数据湖 - Jackeyzhe

Wait 5 sec.

【摘要】做 RAG 的人大概都经历过这么个流程:数据在 S3 上的 Parquet 文件里躺着,你得先把它读出来,跑一遍 Embedding 模型,再把向量写进 Milvus。原始数据一份,向量数据又一份。数据湖一份,向量库一份。 然后问题就来了。数据更新了怎么办?向量过期了怎么办?两份数据怎么同步?半夜跑 阅读全文