一龍馬/AI 情報站讀懂消息背後的脈絡
星期三
搜尋

探索情報

搜尋情報

一次搜尋 X、HN、GitHub、AI 產業日報與日期歷史。

「Agent」找到 1083 筆不同情報第 1/55 頁
GitHub 趨勢跨 15 天 · 2026-08-08–2026-10-05#11取得全文

agent-skills 把規格、規劃、實作、測試、審查到上線的資深工程流程,打包成寫碼代理程式可直接遵循的技能包

addyosmani/agent-skills

README 載明全包共 25 個技能,對應 9 個斜線指令:/spec、/plan、/build、/test、/constraints、/review、/webperf、/code-simplify、/ship,可一次全裝或單獨安裝。單獨安裝只複製技能目錄、不含儲存庫層級共用檢查表,作者將此列為已知可攜性缺口。

一龍馬判讀適合想統一團隊寫碼紀律、減少代理程式跳過測試與審查的專案。取捨是流程明顯變重,小改動也可能被多道驗證拖慢,導入前要先確認目標工具的安裝方式。

比對原文節錄
Production-grade engineering skills for AI coding agents.
GitHub 趨勢跨 18 天 · 2026-08-22–2026-10-04#03取得部分原文

ECC 是把規劃、測試、實作、審查、記憶與持續學習包成一套代理人工作系統的開源專案,主打一次安裝、跨多種程式撰寫工具使用

affaan-m/ECC

README 列出包含 68 個代理人、293 項技能、94 個相容指令,以及 hooks、規則、記憶與 AgentShield 安全掃描。Claude Code 為目前支援最完整的主力環境,其餘為能力受限的轉接器,安裝前需先看支援矩陣。

一龍馬判讀想統一多工具 AI 開發流程的團隊可用它減少每次重寫提示詞的成本,但多重安裝方式並存容易造成重複設定,導入時要只選一條路徑。

比對原文節錄
Access to 68 agents, 293 skills, and 94 legacy command shims
GitHub 趨勢跨 17 天 · 2026-08-08–2026-10-04#12取得全文

mattpocock/skills 是一組體積小、可改造、可組合的工程用代理技能,主張不把流程整包交給框架接管

mattpocock/skills

內容涵蓋需求追問、共用詞彙、測試驅動開發、除錯、規格撰寫、票證拆分、實作與程式碼審查,並區分使用者觸發與模型自動觸發兩類。安裝分成官方外掛自動更新與用 skills.sh 複製成可修改檔案兩種路線,兩者擇一即可。

一龍馬判讀想保留主導權、逐步改造自家工作流程的使用者可參考此專案;採用前需先執行初始設定,並自行決定更新節奏。

比對原文節錄
These skills are designed to be small, easy to adapt, and composable.
GitHub 趨勢跨 15 天 · 2026-08-20–2026-10-04#11取得全文

Superpowers 是給程式開發代理使用的整套開發方法與可組合技能,強調先釐清需求、送審設計並切分任務再實作

obra/superpowers

README 明列支援 Claude Code、Codex、Cursor、Gemini CLI 與 Copilot CLI 等十多種工具,核心為 TDD、YAGNI、子代理分工與審查流程。本次 README 主要說明設計主張與安裝方式,未提供效能或品質的實測資料。

一龍馬判讀已在用 AI 撰寫程式碼的團隊可用它把流程規範化,省下重複下提示詞的成本;代價是流程較重,小任務可能反而變慢。

比對原文節錄
Superpowers is a complete software development methodology for your coding agents
GitHub 趨勢跨 14 天 · 2026-08-26–2026-10-05#04取得全文

Ponytail是作者主張讓AI代理寫更少程式碼的規則與技能組,主張先判斷是否需要新增,再依序複用既有程式碼、標準函式庫與原生平台能力

DietrichGebert/ponytail

作者在README說明,54%是指新增程式碼行數平均減少54%,來自Haiku 4.5、12項任務各4次的作者測試。94%只是日期選擇器這類過度實作的單一個案,已精簡的程式則幾乎沒有差異。

一龍馬判讀對想壓住AI過度建構的團隊,它把精簡原則做成可安裝的審查流程。取捨是實際刪減幅度要看自身任務重做驗證,且其安全說法僅限作者測試範圍。

比對原文節錄
~54% is the mean across 12 feature tasks (Haiku 4.5, n=4);
GitHub 趨勢跨 7 天 · 2026-08-24–2026-09-07#04取得部分原文

Nous Research 的 Hermes Agent 是可自行部署的完整代理執行環境,整合終端介面、跨工作階段記憶、技能建立與更新、排程、自動化、子代理及多種通訊平台

NousResearch/hermes-agent

它可切換 Nous Portal、OpenRouter、OpenAI、自架端點等模型來源,並支援本機、Docker、SSH、Singularity、Modal、Daytona 與 Vercel Sandbox 等執行後端。README 宣稱技能會在使用中自我改進,但本次摘錄沒有基準測試或獨立稽核可驗證其學習品質與安全性;原生 Windows 已支援,Termux 則仍需避開不相容的語音相依套件。

一龍馬判讀Hermes 將代理從單機聊天工具推向可長期運作、跨平台接收任務的服務,適合自架與自動化情境;相對地,持久記憶、終端工具、通訊閘道及無人值守排程會放大憑證外洩與誤執行風險,部署時需落實命令核准與隔離。

比對原文節錄
Skills self-improve during use.
GitHub 趨勢跨 7 天 · 2026-08-27–2026-09-02#10取得部分原文

技能的作用是替代理提供經整理的工具文件、範例與多步驟流程,而不是另造一個基礎模型;另有獨立的 K-Dense BYOK 桌面研究工作區,可自備 API 金鑰並選用 40 多個模型

K-Dense-AI/scientific-agent-skills

Scientific Agent Skills 是一套可攜式科學研究代理技能庫,README 列出 163 個現成技能,涵蓋生物資訊、基因體、醫藥、藥物研發、分子動力學與科學機器學習等工作流程,可供 Cursor、Claude Code、Codex 與支援 Agent Skills 或 Agent Plugins 標準的客戶端載入。技能的作用是替代理提供經整理的工具文件、範例與多步驟流程,而不是另造一個基礎模型;另有獨立的 K-Dense BYOK 桌面研究工作區,可自備 API 金鑰並選用 40 多個模型。來源對資料庫數量的說法不一致,頁首與介紹提到 100+,後文則寫 78+,且現有節錄不足以驗證使用人數或每項技能的實際可靠度。

一龍馬判讀研究團隊可把常見科學工具與資料庫操作標準化為代理技能,降低每次重寫提示與串接腳本的成本。涉及醫療、藥物與研究結論時,技能文件和自動測試不能取代資料授權檢查、方法驗證、可重現性審查與領域專家把關。

比對原文節錄
# Scientific Agent Skills [![License: MIT](https://img.shields.io/badge/License-MIT-yellow.svg)](LICENSE.md) [![Version]…
GitHub 趨勢跨 3 天 · 2026-08-24–2026-08-27#16取得部分原文

VoltAgent/awesome-agent-skills 是一個彙整 Agent Skills 的清單型 GitHub repo

VoltAgent/awesome-agent-skills

README 稱收錄 1497+ 個技能,來源包含 Anthropic、Google Labs、Vercel、Stripe、Cloudflare、Netlify、Trail of Bits、Sentry、Expo、Hugging Face、Figma 等官方團隊與社群作品。專案主張自己是人工挑選、不是大量 AI 生成,並標示可搭配 Claude Code、Codex、Gemini CLI、Cursor、GitHub Copilot、Windsurf 等工具使用。從 README 來看,它比較像索引與導覽,而不是單一可執行框架;目前可見證據不足以判斷每個技能的品質、授權一致性或實際維護狀況。

一龍馬判讀對使用 AI coding agent 的開發者來說,這類清單把分散在各工具與廠商的技能入口集中起來,可降低找範例與整合文件的成本。風險在於 curated 清單仍需逐項驗證安全性、相容性與更新頻率,不能因為收錄品牌多或星數高就直接導入生產流程。

比對原文節錄
A collection of official Agent Skills from leading development teams and the community.
GitHub 趨勢跨 6 天 · 2026-08-10–2026-10-06#12取得全文

Agency Agents 自稱提供 230 多組 AI 代理人設定檔,每組以 Markdown 定義專長、人設、工作流程與交付範例,涵蓋工程、設計、行銷與資安等分工

msitarzewski/agency-agents

README 強調可透過桌面 App 或安裝指令帶入 Claude Code、Cursor、Codex 等工具,另有轉換指令產生各工具格式。這些仍是提示範本與流程文件,並非已驗證的專家能力,效果取決於底層模型與使用方式。

一龍馬判讀對想快速套用團隊提示範本的人可省下整理成本;導入前應抽查實際產出品質,並注意第三方代理指示不應被當成可信指令執行。

比對原文節錄
A complete AI agency at your fingertips
GitHub 趨勢跨 5 天 · 2026-09-15–2026-10-06#06取得全文

Agent Reach 是依平台路由整合公開資訊讀取與搜尋的 Python CLI 能力層,實際讀取由 Agent 直接呼叫上游工具完成

Panniantong/Agent-Reach

README 列出以 Jina Reader、yt-dlp、gh CLI、bili-cli、OpenCLI 等組成首選加備援後端,並以體檢命令檢查各通道狀態。網頁、YouTube、B站搜尋等可零設定使用,Reddit、Facebook、Instagram、小紅書與 Twitter 搜尋或完整讀取則需瀏覽器登入態或手動匯出憑證,且須面對平台反爬蟲與登入態失效限制。

一龍馬判讀想幫 Cursor、Claude Code、OpenClaw 接公開網頁與影音資料的使用者可省掉選型與除錯時間,但憑證保管、平台規範與服務條款風險仍由使用者自行承擔。

比對原文節錄
Give your AI agent eyes to see the entire internet.
AI 產業日報#13取得部分原文

AgentSight 是以 eBPF 為核心的本機優先觀測工具,把提示、模型呼叫與工具決策連結到行程、檔案與網路等實際系統行為

Hacker News

專案說明稱它不需 SDK 或代理伺服器即可觀察 Claude Code、Codex、Gemini CLI 等既有工具,並提供 SQLite 儲存、報表查詢與網頁介面。依可讀 README 判斷,完整擷取仍依賴 Linux 與 root 權限,且 Cursor 等 Electron 應用與部分靜態連結 SSL 有明確限制。

一龍馬判讀對需要除錯代理人重試迴圈、耗時步驟與 token 消耗的使用者而言,它補足了應用層追蹤看不到的系統邊界,但導入前須評估權限、效能開銷與敏感資料落盤的保管方式。

比對原文節錄
AgentSight is a local-first top / strace -like observability tool for AI agents.
AI 產業日報#04取得部分原文

AgentTrace 的 README 將專案定位為 AI 代理工作流程的可觀測性 SDK 與儀表板,可追蹤多步驟工具呼叫、呈現延遲,並在工具參數格式錯誤時嘗試自動修復

Hacker News

其架構以 Pydantic 驗證、Groq 推論修復、FastAPI 搭配 SQLite 儲存追蹤資料,前端則使用 Next.js;README 也提供線上展示與本機啟動指令。雖然專案自稱「Production-Grade」,提供的節錄未呈現測試覆蓋率、修復準確率、資安邊界或擴充性資料,成熟度仍不能只靠這項宣稱判定。

一龍馬判讀執行期自動修復可減少代理因參數錯誤而中斷,但錯誤修補也可能悄悄改變工具呼叫語意;採用者需要審計紀錄、失敗回退與敏感資料外送 Groq 的治理措施。

比對原文節錄
AgentTrace catches these failures and auto-repairs them at runtime.
AI 產業日報#04取得部分原文

產品頁宣稱資料不離開 Mac、無帳號與遙測,並可沿用既有 Claude Code 或 Codex 訂閱;HN 標題標示 MIT 授權

Hacker News

Superagent 是一款讓程式開發代理在 Mac 上持續工作的開源應用,整合可操作的真實瀏覽器、iOS 模擬器、可跨重啟保留的對話,以及每項任務各自使用 Git worktree 的工作流程。產品頁宣稱資料不離開 Mac、無帳號與遙測,並可沿用既有 Claude Code 或 Codex 訂閱;HN 標題標示 MIT 授權。現有證據主要是產品方展示,HN 尚無留言,未提供獨立測試來驗證穩定性、安全邊界或所列效能案例。

一龍馬判讀它試圖把寫程式代理從終端機對話擴展成可操作瀏覽器與 iPhone 模擬器的本機工作台,可能減少前端及行動版驗證的人工作業。代理能控制瀏覽器、程式碼分支與模擬裝置也擴大權限風險,團隊應先檢查原始碼、沙箱設計及憑證處理方式。

比對原文節錄
Superagent · スーパーエージェント · a home for your agent S u p e r a g e n t スーパーエージェント Click to skip Superagent スーパーエージェント Docs…
GitHub 趨勢重點摘要

另一條線是「本機優先/自架」重新受到重視,從 Apache Maka、OpenClaw、claude-obsidian、OpenHuman 到…

GitHub 趨勢

這期最明顯的共同趨勢,是 AI agent 正從單一聊天或 IDE 外掛,轉向本機代理、長期記憶、技能模組、市集與跨通訊渠道的完整工作流;Claude Code、Codex、MCP、Agent Skills 幾乎成了多數新專案的整合語言。另一條線是「本機優先/自架」重新受到重視,從 Apache Maka、OpenClaw、claude-obsidian、OpenHuman 到…

AI 產業日報#11取得部分原文

從證據看,專案目前只有 4 次 commit,仍偏早期,且評分依賴 LLM 裁判,本身會帶來穩定性與可重現性的限制

Hacker News

AgentCheck 是一個針對 AI agent 的回歸測試工具,主打用 pytest 風格的 YAML 定義測試,對接 CLI 指令、HTTP 端點或 Python callable,並用 LLM-as-judge 依照文字準則給出通過/失敗與理由。README 強調它不是 Langfuse、Braintrust、Arize 這類正式線上觀測平台,而是放進 GitHub Actions 的部署前檢查,目標是避免 prompt、工具或模型更動後悄悄破壞既有行為。從證據看,專案目前只有 4 次 commit,仍偏早期,且評分依賴 LLM 裁判,本身會帶來穩定性與可重現性的限制。

一龍馬判讀對正在把 agent 放進產品流程的開發者來說,這類 git-native 測試補上了「上線前先抓退化」的缺口;但若團隊需要正式監控、稽核或量化評估,README 自己也把範圍切得很窄,不能當成完整評測平台。

比對原文節錄
GitHub - rez-99/agentcheck: Regression testing for AI agents — pytest-style YAML tests, LLM-as-judge scoring, and diff-a…
AI 產業日報#13取得部分原文

tmux-agent-switcher 是一個 tmux 側邊欄外掛

Hacker News

用來在多個 tmux session/window 之間切換,並標示 Claude Code、Codex、OpenCode 這類 AI coding agent 的狀態。README 說它以被動方式讀取 tmux 與 process table,不包裝、不啟動 agent;狀態包含 Working、Blocked、Idle,並提供全螢幕 popup、即時預覽、tab 狀態指示與 Vim-aware 快捷鍵。成熟度線索上,專案有 README、MIT 授權、測試目錄與 8 次提交,但仍是小型工具;需求包含 tmux 3.3 以上、bash、ps,若平台沒有預建 binary 則需要 Rust toolchain。

一龍馬判讀當開發者同時開多個本機 AI coding agent,真正卡住的不是模型能力,而是注意力管理;這個工具改變的是在終端機內巡檢與接手 agent 的方式。限制是它依賴 tmux 與行程偵測,團隊若不用這套工作流就很難受益。

比對原文節錄
GitHub - Ymirke/tmux-agent-switcher: Tmux sidebar plugin for managing agents · GitHub / " data-turbo-transient="true" />…
GitHub 趨勢跨 5 天 · 2026-08-08–2026-08-12#17

PrimeIntellect-ai/prime-agent 是一個自我改進的 RLM 代理,用于編碼工作流和長時間自治任務

PrimeIntellect-ai/prime-agent

PrimeIntellect-ai/prime-agent 是一個自我改進的 RLM 代理,用于編碼工作流和長時間自治任務

一龍馬判讀這個代理對於開發者和企業來說很重要,因為它提供了一種簡單的方式來自動化和優化工作流

比對原文節錄
A self-improving RLM agent for coding workflows and long-running autonomous tasks.
AI 產業日報#05取得部分原文

Keen Code 是以 Go 撰寫的 CLI coding agent

Hacker News

repo 將它描述為 context-aware、efficient 與 agentic-engineered。可讀頁面主要是 GitHub 專案框架,尚不足以確認其模型支援、權限策略或長任務可靠度。

一龍馬判讀早期 coding agent 很容易在 demo 可用、工程細節不足。採用前應先看 source、release、測試、sandbox 與 transcript,而不是只看 Show HN 標題。

比對原文節錄
…context aware and efficient CLI based coding agent written in Go mochow13/keen code A context aware and efficient CLI ba…
AI 產業日報#08取得部分原文

graph2agent 把 Mermaid 圖轉成 deterministic rich text

Hacker News

明列節點、邊、分支、拓樸與圖形無法證明的語意,讓人保留圖、Agent 取得顯式脈絡。網站宣稱在固定的 330 份 private contracts paired benchmark 中,exact-comprehension failures 由 121 降到 60。

一龍馬判讀這是用編譯式前處理減少模型猜圖的實用方向,且不需要模型呼叫。數字只來自單一 frozen 私有 benchmark,仍需在不同 Mermaid 類型與 coding 任務重現。

比對原文節錄
graph2agent turns supported Mermaid diagrams into deterministic rich text that coding agents can follow. Measured: 50.41…