一龍馬/AI 情報站讀懂消息背後的脈絡
星期五
搜尋

Needle 2 是 Cactus Compute 發布的 45M 參數小型模型

Python · ⭐ 4,910 · 🍴 332 · 🔥今日 +768

中文摘要

目標是工具呼叫、裝置操作與結構化抽取;README 說整個模型是一個 14MB binary,完整 session 約用 28MB RAM。它的 Python 套件提供 inference、LoRA fine-tuning 與 export,安裝後可用裝飾器描述工具,模型以 JSON 回傳工具呼叫,並以 byte-level grammar 依 schema 約束輸出。成熟度線索是 README 提供 quickstart、欄位約束、Pydantic extraction、Hugging Face 權重與 arXiv 設計論文;但 benchmark 結論是作者自述,尚不能取代在目標硬體上的延遲、準確率與失敗模式測試。

一龍馬判讀

手機、穿戴裝置、智慧家庭與機器人若要本機工具呼叫,14MB/約 28MB RAM 這種規格會改變可部署範圍。限制也很清楚:256-token sliding window 與小模型容量代表它適合窄任務,不該被當成通用對話模型。

原文節錄

cactus-compute/needle

![Needle](assets/banner.png) # Needle 2 Needle 2 is an open 45M-parameter model for tool calling, device use and structured extraction.

取得部分原文 · 不代表內容已獨立查證

查看原文
完整收錄文字與來源

14MB foundation model for tiny devices; phones, wearables, smart home, and robots.

收錄日期
2026-08-14
來源
github.com/trending
抓取時間
2026/08/14 05:50(台北)
來源資料
Python · ⭐ 4,910 · 🍴 332 · 🔥今日 +768