平素より、生成AI向け推論API基盤「さくらのAI Engine」をご利用いただき、誠にありがとうございます。
このたび、企業が保有する生成AIモデルを専有環境で運用できるフルマネージドのAIモデルサービングサービス「さくらのAI Engine プライベートエディション」の提供を開始しました。
本サービスは、「さくらのAI Engine」の技術基盤を活用し、お客さまが利用する生成AIモデルを当社GPU基盤上でホストし、API経由で利用可能とするフルマネージドのモデルサービングサービスです。
独自開発モデルやファインチューニング済みモデル、オープンウェイトモデルなどを、お客さま専用の環境で運用することが可能です。
また、GPU専有環境での提供により、他テナントの影響を受けることなく安定した推論実行環境を実現するとともに、推論基盤の構築から運用・監視までを当社が一貫して提供することで、お客さまはAPIサーバーの運用から解放され、AIモデルの活用に注力することが可能となります。

さくらインターネットでは、今後もお客さまのニーズに応じたモデルの拡充を検討してまいります。
引き続き「さくらのAI Engine」ならびに「さくらのAI Engine プライベートエディション」をよろしくお願い申し上げます。
サービスの特徴
・用途に応じたモデルを柔軟にホスティング
独自開発モデルやファインチューニング済みモデル、オープンウェイトモデルなど、用途に応じた生成AIモデルを専有環境で利用できます。
・フルマネージドで運用負荷を軽減
推論基盤の構築から運用・監視、障害対応まで当社が担い、お客さまはモデル活用やサービス開発に集中できます。
・定額制で利用可能
GPU単位の月額定額制により、トークン利用量に応じた料金変動を気にすることなく利用できます。
・専有環境・閉域接続に対応
入力データやモデル資産を外部に出さない運用が可能で、閉域接続にも対応します。
国内データセンターで運用することで、高いセキュリティ要件に対応します。
・入力データはAI学習に利用されない
入力データおよび生成結果はAI学習に利用されず、機密情報を扱う用途で利用できます。
利用シーン
・クローズド環境での利用
社内利用や特定顧客向けサービスなど、アクセス制限を設けた環境で生成AIを利用できます。
・自社AIサービスの提供基盤
保有する生成AIモデルをAPI経由で外部ユーザー向けのサービスとして提供できます。
・定額制でコストを予測しやすい運用を実現
GPU単位の月額定額制により、利用量を予測しづらいAIサービスにおいてもコストを把握しやすく、
安定した運用が可能となります。
ご利用方法
提供開始日
2026年10月8日(木)
お申し込み方法
フォームよりお問い合わせください。
お問い合わせ
本件に関するご質問や、導入のご相談については、弊社サポートまたは以下のフォームよりお問い合わせください。


