Google 發布 EmbeddingGemma 2 多模態嵌入模型:740M 參數支援圖文音影,採 Apache 2.0 開源
支援 MRL 動態降維,純文字推論僅需 191MB 記憶體。瀏覽器 WebGPU 查詢耗時 20 至 70 毫秒,專為終端離線 RAG 打造。
Google DeepMind綜合 3 家一手來源
53 則值得知道的變化
支援 MRL 動態降維,純文字推論僅需 191MB 記憶體。瀏覽器 WebGPU 查詢耗時 20 至 70 毫秒,專為終端離線 RAG 打造。
新模型基於 Gemini 3.6 Flash,提升文字渲染與角色一致性,已於各項 Google 產品推出,舊版將於 2026 年 10 月退役。
該模型基於 Qwen 架構,單次請求可處理圖文影音,官方 API 處理百萬 token 僅需 3 秒,權重採條件開源。