Google DeepMind、Gemini を活用したエージェント型動画理解機能を発表
Google DeepMind、Gemini を活用したエージェント型動画理解機能を発表
| 項目 | 内容 |
|---|---|
| ジャンル | AI |
| 日付 | 2026-09-02 |
| 元記事 | Google DeepMind Blog |
要約
Google DeepMind は9月1日、Gemini を基盤としたエージェント型動画理解の新機能を発表した。エージェントワークフローを通じて AI が動画コンテンツをリアルタイムで解析・行動に結びつける能力を持つとされる。従来の動画 AI が単純な分類・字幕生成に留まっていたのに対し、本機能は長尺動画を自律的に解析してタスクを遂行するマルチステップ処理が可能である。動画監視・コンテンツ審査・スポーツ解析・産業検査など幅広い応用が期待される。Gemini の動画理解能力と自律エージェント機能の組み合わせにより、Google は OpenAI と Anthropic に対して企業向けマルチモーダル AI 市場でのポジションを強化しようとしている。