NTTドコモビジネスは10月6日、さまざまなデバイスから映像を収集・蓄積・分析し、現場の変革を支援する映像AIプラットフォームサービス「docomo business SIGN VPaaS」について、AI解析機能の強化を発表した。
具体的には、映像データから現場の課題や改善ポイントをAIが自動で可視化し改善策を提案する「AIエージェント型UI」と、機密性の高い映像データをユーザー専用の映像AI解析環境でセキュアに解析できる「プライベート映像AI解析基盤」を提供。
これにより、映像データから現場の課題や改善ポイントを効率的に把握できるようになり、継続的に生産性向上や品質改善、安全対策の強化などにつなげられるという。
AIエージェント型UI
AIエージェント型UIは、「docomo business SIGN VPaaS」内で統合管理している映像データや検知データをAIが分析し、現場の課題発見から改善施策の提案、効果予測、次のアクションの提示までを支援する機能。
まずは複数のデバイス設置拠点から収集した映像データや検知データを集約し、インジケータや検知映像、AIによるサマリーを用いて運営状況を可視化可能。これにより、改善が必要な事象や現場で発生している課題をリアルタイムで把握できる。
次に、映像データや検知データの分析結果をもとに、AIが改善施策の提案、期待効果の予測、次に取るべきアクションを提示する。
映像データを活用した継続的な業務改善を実現するとともに、業界や業務に応じた柔軟なカスタマイズにも対応する。
プライベート映像AI解析基盤
プライベート映像AI解析基盤は、同サービスとNTTドコモビジネスが提供するGPUクラウドサービス「GPUaaS」を連携させ、個人情報や製造ノウハウなどの機密情報を含む映像データをユーザー専用環境で解析できる機能。
これにより、従来はAI活用が難しかった機密性の高い映像データにおいても、セキュリティやガバナンス要件に対応しながら業務改善に活用できるようになる。
外部のパブリックなマルチモーダルLLMやVLM(Vision Language Model)に加え、標準で利用可能なGemmaモデルや、ユーザーが利用中のモデルも利用可能。用途や要件に応じて最適なモデルを選択できるため、より柔軟な映像解析環境を実現する。
機能拡大の背景
近年、監視カメラやウェアラブルカメラなどで取得される映像データは、防犯や品質管理、安全確保、製造効率の向上など、さまざまな用途で活用されている。
しかし映像データは膨大な量となるため人手で分析する際の負荷が大きく、現場の課題発見や業務改善に十分活用されないまま保管・破棄されるケースも少なくない。
LLMやVLMの進化により、映像データを業務改善に活用する可能性が広がる一方で、個人情報や機密情報を含む映像については、外部クラウドへの持ち出しやAIによる分析に慎重な対応が求められるため、映像データの利活用が十分でない課題が残されている。

