Googleは、同社のAIモデル「Gemini」におけるビデオ解析機能を強化し、エージェントベースの新しいアプローチを導入したことを発表しました。この技術革新により、動画コンテンツの解析に伴うトークン消費量を大幅に削減することが可能となります。
今回発表されたのは、動画を全フレーム単位で解析する従来の処理ではなく、AIエージェントが情報の重要性を自律的に判断し、必要な部分のみを処理するインテリジェントな解析プロセスです。この最適化により、解析にかかるトークン使用量を最大で88%削減することに成功しました。
動画データは膨大な情報量を含むため、これまで大規模言語モデルでの処理には高い計算コストとトークン消費が課題となっていました。新技術では、AIエージェントが動画ストリームを動的に監視し、関連性の高い情報のみを抽出・解析することで、情報の正確性を維持しつつ計算リソースの過剰な消費を防ぐ設計となっています。
本技術の実装により、Geminiを利用した動画解析コストが大幅に抑えられることで、より長時間の動画分析や、リアルタイム性が求められるアプリケーションへの導入が期待されます。