一龍馬/AI 情報站讀懂消息背後的脈絡
星期四
搜尋

Qwen3.8-2.4T-A95B 登上 Hugging Face 後在 HN 引發大量討論

中文摘要

但本次可讀到的原文內容主要是模型頁面的片段與聊天模板,沒有完整模型卡、評測表或授權細節可供確認。社群討論把焦點放在模型規模與部署門檻:有人指出完整 BF16 約 4.9TB、1-bit 量化約 397GB,並稱其為 95B active 的 MoE;也有人提醒不要把 1-bit 量化結果直接等同於完整模型能力。另有留言提到開源版本移除視覺能力、脈絡上限為 250k,但這些都來自 HN 討論,不能視為已由原文證實。

一龍馬判讀

如果社群描述屬實,這類超大 MoE 開源模型會把「中型公司可自架 frontier-like 模型」推得更近,但硬體、量化損失與功能刪減仍是採用前必須驗證的風險。AI 團隊不應只看榜單或貼文熱度,至少要等完整模型卡、授權與可重現評測出來再規劃部署。

原文節錄

Hacker News · Philpax

Qwen/Qwen3.8-2.4T-A95B · Hugging Face Hugging Face Models Datasets Spaces Buckets new Docs Enterprise Pricing Website Tasks HuggingChat Collections Languages Or

取得部分原文 · 不代表內容已獨立查證

查看原文 閱讀社群討論
完整收錄文字與來源

Qwen3.8-2.4T

收錄日期
2026-08-13
來源
Hacker News Firebase API
抓取時間
2026/08/13 05:40(台北)
來源資料
385 分 · 79 則討論