開發生態
Amazon DynamoDB 推出原生向量搜尋,支援最高 4096 維度,免除獨立向量資料庫需求
InfoQ 中國多家報導
尚未逐項核實
多個報導來源提及此事;未必是彼此獨立的證據。
Amazon DynamoDB 推出原生向量搜尋功能,允許開發者將嵌入向量與應用資料儲存在同一張表中,並透過新的 SearchVectors API 直接執行近似最近鄰查詢。此更新移除了過去需將資料同步至獨立向量資料庫的資料管線,大幅簡化 AI 應用架構。
該功能採用無伺服器模式,可自動橫向擴展。AWS 首席布道師 Jeff Barr 指出,系統能擴展至數兆個向量規模,同時維持個位數的毫秒級延遲。
規格方面,向量索引沒有儲存限制,支援最高 4096 維度,提供歐幾里得距離、餘弦距離與內積三種距離函數,並支援帶有過濾條件的相似度搜尋(內聯過濾)。
計費模式除了標準 DynamoDB 費用外,向量索引會依據「寫入索引」、「搜尋時處理」以及「儲存」的資料量,按位元組計量並以 GB 為單位額外收費。官方建議透過降低維度、減少索引投影、不在結果中返回嵌入向量,以及進行選擇性分區來控制成本。
原生向量搜尋現已在所有 DynamoDB 服務區域開放,支援 Standard 與 Standard-IA 資料表類別。開發團隊也計畫未來透過相容 DynamoDB 的 ExtendDB 轉接器,提供本機開發與自託管部署支援。
讀原始報導背景
向量搜尋通常依賴近似最近鄰(Approximate Nearest Neighbor)演算法,能在不保證每次都回傳絕對最近點的情況下,快速找出相似的資料點。這種技術常被用於預測分析與分類,而現在開發者可直接在 DynamoDB 中執行這類查詢,無需額外維護獨立的向量資料庫。
來源
- AI 前線infoq.cn
- zh.wikipedia.org
本期分類