さくらインターネットは10月8日、企業が保有する生成AIモデルを専有環境で運用できるフルマネージドのAIモデルサービングサービス「さくらのAI Engine プライベートエディション」の提供を開始したと発表した。企業向けに、推論基盤の構築から運用・監視までを一貫して提供し、生成AIの本番運用を支援する。
同サービスは「さくらのAI Engine」の技術基盤を活用し、顧客が利用する生成AIモデルを同社のGPU基盤上でホスティングしてAPI経由で利用できるようにするもの。独自開発モデルやファインチューニング済みモデル、オープンウェイトモデルなどを顧客専用の環境で運用できる。
生成AI活用はPoCから本番運用の段階へ
近年、企業による生成AI活用はPoC(概念実証)段階から実運用フェーズへと移行しつつある。一方で、独自開発したAIモデルやファインチューニング済みモデルを安定稼働させるには、高性能GPU基盤の確保や運用体制の整備が必要となる。
また、金融や公共分野など高いセキュリティ要件が求められる領域では、データを外部に持ち出さない運用や国内完結型インフラへのニーズが高まっている。
こうした背景から同社は、企業が生成AIモデルを安全かつ安定的に利用できる専有環境の提供に乗り出した。
国産GPU基盤上でAIモデルを専有運用
新サービスでは、同社のGPU基盤上に顧客専用環境を構築することで、他テナントの利用状況に左右されない安定した推論実行環境を実現する。入力データやモデル資産を外部へ出さない運用に対応するほか、閉域接続もサポートする。さらに国内データセンターで運用することで、セキュリティやコンプライアンスへの対応を強化した。
また、入力データや生成結果はAI学習には利用されず、機密情報を扱う用途でも利用できるという。
フルマネージドサービスで運用負荷を軽減
推論基盤の構築から運用・監視、障害対応まではさくらインターネットが担う。そのため利用企業はインフラ運用ではなく、AIモデルの開発やサービス提供に注力できるとしている。
料金体系はGPU単位の月額定額制を採用。トークン利用量に応じて費用が変動する従量課金型サービスとは異なり、コストを予測しながら運用できる点を特徴としている。価格は個別問い合わせとなる。
同サービスは、社内向け生成AI環境の構築や特定顧客向けサービスの提供基盤、自社開発AIサービスのAPI公開基盤などを主な利用シーンとして想定している。