跳到主要內容
2026-08-06 日報
開發生態

新創 Infinity 透過 AI 代理僅 10 小時生成類 CUDA 軟體,DeepSeek 同步開源 TileKernels 算子庫

量子位單一來源
尚未逐項核實

目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據報導,成立僅一年的 AI 軟體新創 Infinity 透過其 AI 研究代理「Ignition」,僅耗時 10 小時便為 AI 晶片新創 d-Matrix 搭建出一套「類 CUDA 軟體」。 Ignition 能夠自動生成 GPU Kernel、執行測試、尋找錯誤、測量效能,並根據回饋自動改寫程式碼形成閉環。該工具主要針對推論(Inference)側,為不同晶片生成與最佳化推論 Kernel,目標是開發支援多種晶片的通用推論函式庫。Infinity 藉此技術已獲得 1500 萬美元融資,估值達 1 億美元。 與此同時,DeepSeek 也開源了 GPU 算子庫「TileKernels」,透過 TileLang 語言編寫以減少手動撰寫底層 CUDA 程式碼的工作量。官方文件顯示,TileLang 已規劃 v0.2.0 版本,並被應用於 BitBLAS 與 AttentionEngine 專案中。 針對此技術路線,業界看法分歧。韓國 AI 晶片公司 Rebellions 商務長 Marshall Choy 認為,推論市場不需如訓練般嚴苛的叢集協同,將成為開源軟體的競爭場域。然而,INT21 創辦人 Bing Xu 指出,AI 生成程式碼雖快,但驗證其在各種邊界情況下的正確性與穩定性極慢,驗證工具鏈才是 CUDA 真正的護城河。Modular 執行長 Chris Lattner 也表示,晶片軟體缺乏公開訓練資料,且生產級最佳化才是決定效能的關鍵,AI 代理帶來的僅是漸進式改進。 此外,NVIDIA 開發者生態副總裁 Ankit Patel 證實,NVIDIA 內部同樣正使用 AI 代理來加速 CUDA 的開發與大規模驗證。
讀原始報導

背景

輝達(NVIDIA)耗時近 20 年打造的 CUDA 軟體生態系,一直是其在 AI 晶片市場難以撼動的護城河。近期新創公司 Infinity 僅用 10 小時便透過 AI 代理(AI Agent)為特定晶片生成底層推理程式碼,DeepSeek 也開源了基於 TileLang 撰寫的 GPU 算子庫。這顯示業界正積極從推理端切入,尋求降低手寫底層程式碼成本並繞過 CUDA 鎖定效應的替代方案。

來源