跳到主要內容
主題

Qwen3 Coder

116 則報導橫跨 522026-07-17
2026-09-20The Decoder

Qwen 發布多模態代理模型 Qwen3.8-Omni-Flash,支援百萬 token 上下文,API 定價大幅低於 Gemini 3.8 Flash

2026-09-19Reddit r/LocalLLaMA

開發者釋出 llama.cpp 分支,透過專家串流讓 64GB Mac 以 27 tok/s 運行 95.5GB Qwen3.8-Flash-Next

2026-09-19Reddit r/LocalLLaMA

滑鐵盧大學推出 ProgramAsWeights:將自然語言編譯為 LoRA 權重,支援本地 CPU 執行 Python 呼叫

2026-09-19Hacker News

ByteShape 發布 Qwen 3.8 27B 完整 ShapeLearn 量化模型,GPU-5 達 BF16 99.63% 效能

2026-09-19INSIDE

開發者復現 TypeSafe AI 技術開源 Qwen-2.5-1B-RLCD,M4 筆電 JSON 推理延遲最高降 7 倍

2026-09-19Hacker News

開源專案 OpenJev 推出,作為 TypeSafe Jev 替代方案提供瀏覽器本地實測與相容 API

2026-09-18科技新報 AI

研究指 Qwen3.5-27B 代理為修 Bug 越權微調自身權重,並將新版本部署為系統預設

2026-09-18Hacker News

PrismML 開源 Ternary Bonsai 2 27B 模型:採三進制權重壓縮至 5.9GB,保留 Qwen3.8 98.2% 效能

2026-09-17NVIDIA Developer

NVIDIA TensorRT Edge-LLM 於 Jetson AGX Thor 執行 MLPerf 邊緣代理測試,跑 Qwen3.6-27B 較 llama.cpp 快 6.4 倍

2026-09-15Reddit r/LocalLLaMA

UkisAI 宣稱 Swift-Qwen3.8-27B:思考 Token 減少 58%、速度提升 1.95 倍

2026-09-15AI 前線

Arm 發布 AI Portal 開發者入口:整合 Qwen 與 Gemma 預先最佳化模型,並支援 MCP 供 AI 代理存取

2026-09-13The Decoder

KAIST 與 Naver AI Lab 研究發現 AI 推理步驟對應獨立內部表示,中間層訊號最強

2026-09-12AI 科技評論

螞蟻密算開源智能體框架 HOP 3.0,採「探索—核驗—提交」機制並使 27B 模型達千億參數表現

2026-09-11Reddit r/LocalLLaMA

社群開發者推出 Apple Silicon 推論引擎 Cherenkov,執行 Qwen3.8-Flash-Next 僅需 21GB 記憶體

2026-09-11Reddit r/singularity

網傳 Qwen、Kimi 與 DeepSeek 大規模蒸餾 Claude:14 天內阿里達 1.51 億次互動

2026-09-10Hacker News

推理引導實驗:Qwen3.8 注入 GPT-5.5 Pro 推理後答案重疊度大增 18.18%,暗示潛在訓練關聯

2026-09-09Reddit r/LocalLLaMA

網友實測 Qwen3.8-Flash-Next 推論引擎:262K 滿載 SGLang 首字延遲 35 秒,較 llama.cpp 快 7.3 倍

2026-09-09Reddit r/LocalLLaMA

Qwen 發布自動駕駛視覺語言模型 Qwen-Drive-1.0-4B,整合 3D 感知與運動規劃

2026-09-09Interconnects

據報中國開源模型授權趨嚴:GLM-5.3 設百億美元營收審查門檻,小紅書 dots3 獲 IMO 2026 滿分

2026-09-09AI 科技評論

基元律動發布 Agent-Native 模型 NeoHorse-1,基於執行軌跡後訓練,4B 版本五項基準超越 Qwen3.5-9B

2026-09-09AI 科技評論

據報 Perplexity 推出本地 Agent 產品 Portable Computer,採用阿里 Qwen3.8-27B 模型

2026-09-09HuggingFace Blog

Hugging Face 發表 LLM 安全拒絕邊界研究,指出傳統微調恐致 Qwen3-8B 過度拒絕率飆升至 74%

2026-09-07Reddit r/MachineLearning

Yandex 研究團隊探討將 KV-cache 作為代理執行階段,藉修改推論狀態提升 LLM 互動性

2026-09-05HF Daily Papers

Minima 釋出全 NVFP4 W4A4 量化版 Qwen3.8-27B,打破混合架構限制,體積縮至 17.5 GiB 且效能持平 BF16

2026-09-05GitHub sgl-project/sglang

sglang v0.5.19 發布:新增支援 Qwen3.8 與 Ling-3.0 等模型,並正式導入 Beam search 功能

2026-09-03Hacker News

Cerebras 上線 Qwen 3.8 27B 模型,據報推論速度達 1500 tokens/s

2026-09-03HF @BAAI

智源研究院開源 Recon2Reason-Reasoning-4B 視覺語言模型,專注室內場景空間推理

2026-09-02Reddit r/MachineLearning

研究提出 EvoUndo 框架解決 LLM Agent 自我進化恢復問題,將修復成功率從 0 提升至 99.3%

2026-09-02Reddit r/LocalLLaMA

Reddit 社群彙整最新本地模型跑分:涵蓋 DeepSeek-V4-Flash 與 Qwen3.8,Opus-4.8 於 GPQA 達 93.6

2026-09-02Hacker News

推論工具 slotstream 發布:48GB Mac 可跑 104GB Qwen3.8-Flash-Next,速度達 12 tok/s

2026-09-02HF Daily Papers

PaperGym 將論文轉為強化學習環境,訓練 Qwen3-8B 研究規劃能力超越 Kimi K2.6

2026-09-02HF Daily Papers

Qwen 發表 Qwen3.8-Flash-Next 125B MoE 架構:訓練 FLOPs 降至 1/9,結合 Gated DeltaNet 與稀疏注意力

2026-09-01Last Week in AI

SpaceXAI 發布 500K 上下文 Grok 4.6,OpenAI 揭露 Jalapeño 推論晶片,Qwen 3.8 以 27B 規模媲美 GPT-5.6

2026-08-31Reddit r/LocalLLaMA

社群開發者釋出 Mac 最佳化版 Qwen3.8-Flash-Next,M1 Max 實測 Prefill 達 190 tps

2026-08-31機器之心

據報端側模型專用 Harness 推出,以 Qwen3.8-27B 實現「零成本推理」

2026-08-30量子位

實測揭露本地部署 LLM 效能衰退元兇:推理軟體堆疊差異導致長文本 Token 翻轉,NVIDIA NVFP4 錯誤率近半

2026-08-29Reddit r/LocalLLaMA

IST-DASLab 發布 Qwen3.8-27B 的 GSQ+RCO 量化 GGUF 模型,3.00 bpw 效能逼近 BF16 基準

2026-08-29HF Daily Papers

論文提出 TTPO 測試時策略最佳化,實現無標籤數學推理訓練,Qwen3-1.7B 準確率升至 45.2%

2026-08-28Reddit r/LocalLLaMA

Qwen 3.8 Flash Next 架構解析:結合 N-gram 與 512 專家 MoE,將 51B 參數卸載至 SSD

2026-08-28AI 科技評論

據報導阿里發布全新 Qoder AI 代理工作台:內建 Qwen3.8-Max,支援自然語言與即時語音開發

2026-08-28AI 科技評論

千問辦公首發上線 Qwen3.8-Flash,生成速度提升 100% 且支援 1M 上下文

2026-08-27GitHub huggingface/transformers

Transformers 發布 v5.16 雙版本:支援 Qwen4-Exp、GLM-5.3-Flash 與 Step-3.7-Flash

2026-08-27NVIDIA Developer

阿里發布 Qwen3.8-Flash-Next 176B 模型權重,NVIDIA 宣布 GB300 NVL72 提供 Day-0 支援

2026-08-27X @Alibaba_Qwen

阿里開源 Qwen3.8-Flash 多模態 MoE 模型:125B 參數僅激活 6B,API 定價為 DeepSeek-V4-Flash 三分之一

2026-08-26Reddit r/MachineLearning

Hugging Face 員工解析 Papers with Code 混合搜尋架構:結合 pgvector 與 Qwen3-Embedding-0.6B

2026-08-26Reddit r/LocalLLaMA

網友開發 Llama.cpp 自適應推測分支,稱 Qwen3.8 推論速度最高提升 50%

2026-08-26Reddit r/LocalLLaMA

騰訊開源多模態嵌入模型 WeMM-Embedding,基於 Qwen3.5 並提供 9B/4B/2B 版本

2026-08-26X @arena

阿里 Qwen3.8-27B 登頂 Image-to-WebDev Arena 開源榜首,輸入每百萬 token 僅 0.4 美元

2026-08-26Hacker News

Qwen 3.8-Flash-Next 模型即將發布,採 125B a6B 規格

2026-08-26HF Daily Papers

研究團隊開源 Industrial-Instruction 框架與資料集,以 Panasonic 技術文件生成工業 QA,實測 Claude 生成品質較佳但成本高百倍

2026-08-25Hacker News

研究指 LLM 可透過推論引擎漏洞控制主機,vLLM 曾爆出 CVE-2025-9141 任意程式碼執行漏洞

2026-08-25Reddit r/LocalLLaMA

ICML 2026 論文提出 ToMoE 動態剪枝法:將稠密 LLM 轉為 MoE 架構,無須微調即超越過往技術

2026-08-25Import AI

METR 報告指 AI 大幅加速 2026 資安漏洞發現,多校聯合推出 SPADE 自對弈訓練框架

2026-08-25iThome

湯森路透耗資 4,000 萬美元推出自研模型 Thomson,基於 Qwen3.5-397B 打造

2026-08-24Reddit r/LocalLLaMA

Qwen 3.8 27B 密集模型發布,社群實測 OCR 表現超越 Gemini 3.5 Flash Lite

2026-08-23TechCrunch AI

Inherent 發布科學代理 Faraday,以 27B 參數模型在論文重現任務擊敗 GPT-5.5 與 Claude Opus 4.8

2026-08-23GitHub sgl-project/sglang

sglang 發布 v0.5.18:新增支援 Muse Glimmer 等 7 款模型,DeepSeek-V4-Pro B200 解碼 TPOT 降至 35.67ms

2026-08-22Hacker News

開源 Qwen3-TTS 1.7B 實作:單張 H100 達成 10 RPS 下首音訊延遲低於 50ms,每百萬字元成本約 2 美元

2026-08-22VentureBeat

Nvidia 提出跨模型 KV Cache 轉移技術,以線性映射免除重新計算,速度最高提升 25 倍

2026-08-21AI 科技評論

阿里雲財報:AI 收入連 12 季三位數成長,並開源 2.4 兆參數旗艦模型 Qwen3.8-Max

2026-08-20Reddit r/LocalLLaMA

據傳 Qwen 下週將發布全新中等規模開源模型,因時程緊湊不提供搶先體驗

2026-08-20Reddit r/LocalLLaMA

開發者透過自研核心讓四張 V100 原生執行 Qwen 3.8 NVFP4,解碼速度匹敵 RTX 5090

2026-08-20Hacker News

Unsloth 發布 Dynamic 3.0 GGUF 量化技術,Qwen3.8-27B 同體積準確率提升逾 10%

2026-08-20Reddit r/LocalLLaMA

llama.cpp 引入 DFlash2 投機解碼,Qwen 3.8 27B 本地推論速度最高提升 3 倍達 140 tok/s

2026-08-19Reddit r/LocalLLaMA

據報 DFlash 2 發布,支援 Qwen 3.8 27B 與 Muse Glimmer

2026-08-19Reddit r/LocalLLaMA

據報騰訊開源 27B GUI 代理模型 UI-Mate,基於 Qwen3.6 支援跨應用操作

2026-08-19Reddit r/LocalLLaMA

據報 Qwen 釋出 2.4T 參數 Qwen3.8 Max 開放權重,網友以單一提示詞生成 COD 遊戲

2026-08-18GitHub Trending (typescript)

Qwen 開源終端機 AI 程式碼代理 Qwen Code,支援多模型切換並全面對標 Claude Code

2026-08-17Hacker News

分析指 AI 模型正刻意犧牲事實記憶換取推理能力:Qwen3.5 9B 幻覺率達 80% 但數學跑分飆升

2026-08-17Simon Willison

阿里開源視覺模型 Qwen 3.8 27B,實測指預設 xhigh 推理等級會導致嚴重過度思考

2026-08-16Reddit r/LocalLLaMA

據 Reddit 實測 Apple Silicon 推論生態:框架碎片化嚴重,mlx-lm 轉換 Qwen 會遺失 MTP head

2026-08-16GitHub Trending (python)

SGLang 推出多模態與語音推論框架 SGLang-Omni,首日支援 MiniMax Music 3 與 Qwen3-Omni

2026-08-16量子位

至知研究院等提出大模型可解釋性方法 SWD:直接拆解權重抽取迴路,資料成本不到訓練型基線 1%

2026-08-16Techmeme

阿里 Qwen 過去半年全球下載量破 30 億次,Hugging Face 報告指其遠超 Google 與 Meta

2026-08-15X @huggingface

Hugging Face 發布 2026 夏季開源模型報告:小模型主導實際應用,Qwen 與 Gemma 領跑本地推論

2026-08-15X @Alibaba_Qwen

阿里開源 Qwen3.8 系列權重,27B 多模態模型支援百萬上下文與單卡部署

2026-08-14X @MiniMax_AI

MiniMax 釋出開源音樂模型 MiniMax-Music3,支援生成 5 分鐘完整歌曲

2026-08-14AI 科技評論

阿里開源 2.4T 參數 MoE 模型 Qwen3.8-2.4T-A95B,Flag OS 首日完成 9 款 AI 晶片適配

2026-08-13Reddit r/LocalLLaMA

據報 Qwen 3.8 27B 模型頁面短暫現身 ModelScope,隨後即遭下架

2026-08-13量子位

紫東太初團隊推出免訓練視覺 Token 剪枝方法 GMC,減少 80% Token 仍保留近 98% 效能

2026-08-12Reddit r/LocalLLaMA

社群消息稱 Qwen 官方已證實,Qwen 3.8-27b 模型將於本週發布

2026-08-12Reddit r/LocalLLaMA

開發者發布法語小型語言模型 Luth-2-0.8B 與 2B,基於 Qwen3.5 打造並在法語評測超越 Gemma-4

2026-08-12TechNews 科技新報

蘋果發布指引:中國 Mac 用戶可將阿里千問接入 Siri 與寫作工具

2026-08-11Reddit r/LocalLLaMA

韓國 Motif-Technologies 釋出 Motif-3 模型,據傳 AAII 跑分微幅超越 Qwen 3.7 Max

2026-08-11X @Alibaba_Qwen

Qwen 發布多模態代理外掛 Qwen-MM-Plugins,支援 MCP 協議並整合 3D、CAD 與長影片處理

2026-08-10Reddit r/LocalLLaMA

社群釋出 llama.cpp 修補程式修正 MTP 記憶體高估,AMD 雙卡執行 Qwen 27B 上下文從 64K 提升至 149K

2026-08-10量子位

中國無盡前沿團隊開源 35B 模型 BigBang-V1:基於 Qwen3.6 採 RSI 訓練,科研跑分超越 1T 級 DeepSeek V4 Pro Preview

2026-08-09X @arena

Arena 發表 Trace-and-Amplify 框架:無須指令即可收集 RL 訓練期獎勵駭客軌跡,偵測準確率達 90.16%

2026-08-08量子位

阿里推出 AI 語音平台 CosyVoice Studio,整合 Qwen-Audio 支援語意修正與 6 小時錄音轉寫

2026-08-08科技新報 AI

傳阿里擬對 Qwen3.8-Max 開源模型大型商用用戶收費,跟進 Kimi K3 抽取營收分成

2026-08-06Reddit r/LocalLLaMA

Qwen 開發者 AMA 預告即將推出 27B 模型,確認 3.8 版本達 2.4T 參數與 95B 活躍參數

2026-08-06Reddit r/LocalLLaMA

據報小米開源機器人基礎模型 Xiaomi-Robotics-1,經 10 萬小時軌跡訓練並結合 Qwen3-VL 與 DiT

2026-08-06Hacker News

Qwen-Image-3.0-Pro 圖像生成模型上線:支援 4.5k token 輸入、12 種語言渲染與複雜排版

2026-08-06Reddit r/LocalLLaMA

Qwen3-TTS 語音複製功能合併至 llama.cpp 主線,支援 1.7B Base 模型與 10 種語言

2026-08-05AI 科技評論

阿里發布 2.4 兆參數 Qwen3.8,OpenRouter、Vercel 等海外平台發布當日即接入,Max 版預計下週開源

2026-08-05X @arena

阿里發布 2.4T 參數 Qwen3.8-Max,Image-to-WebDev Arena 排名第二僅落後 Claude Opus 5 三十九分,下週開源權重

2026-08-04量子位

阿里千問辦公8月3日公測,主攻企業級Agent協作

2026-08-04X @arena

Qwen3.8-Max前端榜居第4,改寫成本效能前緣

2026-08-04X @Alibaba_Qwen

阿里發布Qwen3.8-Max,2.4兆參數且下週開放權重

2026-08-02鈦媒體

Qwen 據報看好開源,手機 Agent 獨家報價權出現鬆動

2026-08-01Reddit r/LocalLLaMA

據報 Meituan 推出 LongCat-Flash-Lite-Sparse:MoE 僅 3B active para

2026-08-01AI 科技評論

據報導 Boogu-Image-0.1 以 10B 參數在 Qwen-Image-Bench 得分 53.58,超越 8

2026-07-29X @ArtificialAnlys

Qwen Audio 3.0評測登頂

2026-07-25GitHub ollama/ollama

Ollama v0.32.4 支援 Laguna

2026-07-23InfoQ 中國

阿里發布 Qwen-Image-3.0

2026-07-23X @Alibaba_Qwen

Qwen新TTS雙版本登場

2026-07-23AI 科技評論

真武M890部署Qwen3.8

2026-07-22The Verge AI

Kimi K3、Qwen3.8挑戰美系模型

2026-07-21X @Alibaba_Qwen

Qwen Cloud推每月6美元方案

2026-07-21Hacker News

Qwen-Image-3.0 發布

2026-07-21X @Alibaba_Qwen

Qwen3.8-Max登上Qoder

2026-07-20Simon Willison

Qwen 3.8 Max開放權重

2026-07-20愛範兒

Qwen3.8 預覽版開放使用

2026-07-20愛範兒

Kimi暫停個人新訂閱

2026-07-19X @Alibaba_Qwen

Qwen3.8即將開放權重

2026-07-17INSIDE

蘋果AI服務據報獲准入中