一龍馬/AI 情報站讀懂消息背後的脈絡
星期一
搜尋

Telem AI 發表一篇自家量測研究,主張 AI agent 實際付出的網頁搜尋延遲常被一般 benchmark 低估,因為快取查詢與全新查詢差距很大

中文摘要

文章稱他們比較 9 個搜尋 API,在同一輸出契約下各發 150 個全新查詢,冷啟動 median TTFB 從 320ms 到 3.9s、相差 12 倍;同一供應商若查詢 90 秒前見過可到 105ms,但從未見過則為 3,937ms,形成 37 倍差距。文中也指出尾端延遲會改變排序,例如 Serpapi p95 為 13.6 秒、是自身 median 的 3.5 倍;Exa 的 LLM-written summary 欄位相較 extractive highlights,延遲與價格都更高。

一龍馬判讀

對會拆任務、平行查很多次的研究型 agent 來說,搜尋 API 的 p95 與快取命中假設會直接決定使用者等待時間與成本。不過這是供應商 Telem AI 的研究摘要,完整方法、地理位置與供應商名單需看原文細節,不能把它當成中立標準排行榜。

原文節錄

Hacker News

The Web-Search Latency Your Agent Actually Pays - Telem AI $20 in free credits for every new user.

取得部分原文 · 不代表內容已獨立查證

查看原文 閱讀社群討論
完整收錄文字與來源

The Web-Search Latency Your Agent Pays

收錄日期
2026-08-24
來源
官方 RSS+Hacker News Algolia API
抓取時間
2026/08/24 06:00(台北)