Llama 3
6 則報導橫跨 6 期2026-08-04 起
2026-09-16量子位
Meta 提出位元組級蒸餾方案 End-Of-Token 準確率上限提升 4%,另傳將推無鏡頭眼鏡 Luna
2026-08-26Reddit r/LocalLLaMA
網友開發 Llama.cpp 自適應推測分支,稱 Qwen3.8 推論速度最高提升 50%
2026-08-25科技新報 AI
美光於 Hot Chips 2026 示警 AI 記憶體牆惡化:HBM 故障導致 Meta Llama 3 訓練中斷達 17%
2026-08-23Reddit r/LocalLLaMA
Llama.cpp 釋出 0.2.0 版本,同步提供 b10566 預先編譯檔案
2026-08-22VentureBeat
Nvidia 提出跨模型 KV Cache 轉移技術,以線性映射免除重新計算,速度最高提升 25 倍
2026-08-04AI 科技評論