一龍馬/AI 情報站讀懂消息背後的脈絡
星期六
搜尋

這篇研究以一台配備消費級 NVIDIA GPU 的改裝工作站,搭配 Proxmox、Ollama 與 Open WebUI,測量多個開源模型的本機推論

本期第 13/24 則

中文摘要

作者報告在有限的對話式寫程式與文件助理工作負載下,穩定吞吐量為每秒 29–65 個 token,但速度排名與正確性排名並不一致。可讀證據是論文摘要與方法節錄,不能據此認定所有舊 Windows 10 電腦都能取代雲端前沿模型。

一龍馬判讀

對想在地端處理敏感文件的中小團隊提供一個可參照的低成本路線,但換硬體、換模型或換任務就要重測,部署前須先驗證正確性與吞吐量。

原文節錄

Hacker News

Correctness, assessed against three established public benchmarks with gold answers

取得部分原文 · 不代表內容已獨立查證

查看原文 閱讀社群討論
完整收錄文字與來源

Reusing obsolete Windows 10 PCs for on-premises large language model inference

收錄日期
2026-10-10
來源
官方 RSS+Hacker News Algolia API
抓取時間
2026/10/10 06:00(台北)