一龍馬/AI 情報站讀懂消息背後的脈絡
星期四
搜尋

Baseten 宣布 Nemotron 3.5 Lightning 在 day 0 上線,並主打長時間運行的 agents

中文摘要

相較於類似大小的開放模型,Baseten 稱它有 4 倍吞吐量、成本低 50%、生產測試中輸出 token 少 63.4%,並具備 30B MoE、3B active 與 1M token context length。這些數字來自 Baseten 貼文,未提供完整對照模型名單與測試條件。

一龍馬判讀

若團隊的瓶頸是長上下文 agent 的推論成本與延遲,Baseten 的數據提供了值得實測的候選方案。限制在於「類似大小」與「生產測試」定義不明,採購或遷移前應用自家資料重跑評估。

原文節錄

NVIDIA AI · @NVIDIAAI

Baseten (@baseten) NVIDIA Nemotron 3.5 Lightning is live on Baseten day 0!…

取得全文 · 不代表內容已獨立查證

查看原文
完整收錄文字與來源

Baseten (@baseten) NVIDIA Nemotron 3.5 Lightning is live on Baseten day 0! This is the fastest open model in its class, built for long-running agents. Compared to similar-sized open models, it offers: - 4x higher throughput - 50% lower cost - 63.4% fewer output tokens in production testing - 30B MoE architecture (3B active) - 1M token context length — https://nitter.net/baseten/status/2087173719873446192#m

收錄日期
2026-08-13
來源
Nitter RSS(公開貼文)
抓取時間
2026/08/13 06:12(台北)