一龍馬/AI 情報站讀懂消息背後的脈絡
星期五
搜尋

Composio 稱 DeepSeek V4 Flash 是這組測試中速度最突出的模型,在 30 個任務裡有 19 個任務最快

中文摘要

已完成任務的中位耗時分別為:DeepSeek V4 Flash 2 分 12 秒、Kimi K3 2 分 35 秒、GLM 5.3 2 分 54 秒、GLM 5.3 Flash 3 分 15 秒、DeepSeek V4 Pro 4 分 41 秒。這裡比較的是「完成任務」的中位時間,沒有涵蓋失敗任務的成本或完整分布。

一龍馬判讀

若任務需要高頻執行或人機協作即時回饋,DeepSeek V4 Flash 的速度優勢會直接轉成等待時間與基礎設施成本差異。不過只看完成任務的中位數,可能低估失敗率或長尾延遲帶來的使用體驗問題。

原文節錄

Composio · @composio

R to @composio: DeepSeek V4 Flash was the fastest model on 19 of the 30 tasks.…

取得全文 · 不代表內容已獨立查證

查看原文
完整收錄文字與來源

R to @composio: DeepSeek V4 Flash was the fastest model on 19 of the 30 tasks. Median time per completed task: DeepSeek V4 Flash — 2m12s Kimi K3 — 2m35s GLM 5.3 — 2m54s GLM 5.3 Flash — 3m15s DeepSeek V4 Pro — 4m41s

收錄日期
2026-08-28
來源
Nitter RSS(公開貼文)
抓取時間
2026/08/28 06:11(台北)