一龍馬/AI 情報站讀懂消息背後的脈絡
星期三
搜尋

官方稱在標準影片分析基準上,最多可減少 88% token、降低 66% 成本並提升 7% 準確率,應用包括亞秒級片段檢索、異常偵測與精確計數

中文摘要

Google DeepMind 為 Gemini 3.7 Flash、3.6 Flash 與 3.5 Flash-Lite 推出代理式影片理解,模型可動態搜尋、掃描特定片段,並聯合檢視畫面、音訊與逐字稿,不再只按固定影格率讀完整影片。官方稱在標準影片分析基準上,最多可減少 88% token、降低 66% 成本並提升 7% 準確率,應用包括亞秒級片段檢索、異常偵測與精確計數。功能已透過 Gemini API、Google AI Studio 與 Gemini Enterprise Agent Platform 開放影片上傳及 YouTube 影片使用,但節錄未交代各項上限分別出現在哪些資料集與工作負載。

一龍馬判讀

處理監視影像、媒體素材或長影片的團隊,可能以更低推論成本定位關鍵片段;不過「最多」數字不能視為所有影片都能達成,導入前仍須用自家內容測量準確率、延遲與費用。

原文節錄

Google DeepMind

Introducing Agentic Video in Gemini Skip to main content Introducing agentic video understanding with Gemini Innovation & AI Products & platforms Company news F

取得部分原文 · 不代表內容已獨立查證

查看原文
完整收錄文字與來源

Introducing agentic video understanding with Gemini

收錄日期
2026-09-02
來源
官方 RSS+Hacker News Algolia API
抓取時間
2026/09/02 06:00(台北)
來源資料
官方來源