ESP32執行2,890萬參數模型
開發者在約 8 美元的 ESP32-S3 上離線執行 2,890 萬參數語言模型,端到端速度約為 9.5 tok/s,並公開韌體、訓練、量化與實驗程式碼。模型運用源自 Gemma 的 Per-Layer Embeddings,將其中 2,500 萬個參數留在 flash 查詢表,使 4-bit 模型以 14.9MB 容量部署於微控制器。
Hacker News
22 則值得知道的變化
開發者在約 8 美元的 ESP32-S3 上離線執行 2,890 萬參數語言模型,端到端速度約為 9.5 tok/s,並公開韌體、訓練、量化與實驗程式碼。模型運用源自 Gemma 的 Per-Layer Embeddings,將其中 2,500 萬個參數留在 flash 查詢表,使 4-bit 模型以 14.9MB 容量部署於微控制器。
據量子位報導,科沃斯已全面開源具身智慧機器人「八界」,開放六自由度機械臂、輪式底盤、底層系統原始碼,以及 OpenClaw、Hermes 等 AI 代理。科沃斯並在蘇州成立「八界開源智創空間」,向開發者、高校與科研人員免費開放平台,線上社群也提供原始碼、控制平台及技能模組。
據量子位現場訪談,RSS 2026研究者認為具身智慧產業仍未成熟,VLA與世界模型也非相互取代,而可能形成混合架構。討論指出,世界模型能否有效支援機器人動作,以及資料的篩選、配比與整理,可能比單純擴大資料量更關鍵。這些觀點來自個別研究者與從業者,彼此亦有分歧,尚不代表產業共識。