さくらインターネットは2026年10月8日、企業が使う生成AIモデルを専有環境で運用できる「さくらのAI Engine プライベートエディション」の提供を始めました。モデルをさくらのGPU基盤に預けて、API経由で使うサービスです。料金はGPU単位の月額定額制で、金額は公表されていません。公式のニュースリリースとサービスページから、中身を整理します。
何を提供するサービスか
公式の発表は、これを「フルマネージドのAIモデルサービングサービス」と説明しています。AIモデルサービングとは、AIモデルをサーバー上で動かし、他のシステムから呼び出せる形で提供することです。
お客さまが使うモデルをさくらインターネットのGPU基盤にホスティングし、API経由で利用できるようにします。推論基盤の構築から運用・監視、障害対応までを、さくらインターネットが担います。
預けられるモデルは、独自開発モデル、ファインチューニング済みモデル、オープンウェイトモデルです。ファインチューニングは、既存のモデルに自社のデータを追加で学習させて調整することです。サービスページは、オープンウェイトモデルの例にKimiとGemmaを挙げています。
さくらのAI Engine プライベートエディションのサービスページ上部出典: さくらインターネット(引用)
既存の「さくらのAI Engine」とどう違うか
さくらインターネットには、すでに「さくらのAI Engine」があります。公式のサービスページによると、こちらは基盤モデルを載せたGPUサーバーで推論を実行するAPIサービスです。サービスページの図では、プライベートエディションは専有GPU基盤、AI Engineは共有GPU基盤と描き分けられています。
| 項目 |
プライベートエディション |
さくらのAI Engine |
| GPU基盤 |
専有 |
共有 |
| 使うモデル |
自社で持ち込む(オープンウェイト、ファインチューニング済みなど) |
提供されるモデルから選ぶ |
| 料金 |
GPU単位の月額定額(金額は個別見積り) |
従量課金。無償枠あり |
| 開始のしかた |
問い合わせて見積り |
会員IDと「さくらのクラウド」のプロジェクトを作って利用 |
出典は、2つのサービスページです(2026年10月9日時点)。AI Engineの従量課金は、たとえばgpt-oss-120bで入力0.15円・出力0.75円(いずれも税込・1万トークンあたり)と公表されています。プライベートエディションの料金は、これと同じ表では比べられません。
料金・データの扱い・接続方法
発表とサービスページに書かれている条件を、項目ごとに並べます。
- 料金: GPU単位の月額定額制です。トークンの利用量で料金は変わらないと説明しています。金額は「詳細はお問い合わせください」とあり、公表されていません。
- 提供開始日: 2026年10月8日(木)です。
- データの扱い: 入力データと生成結果はAI学習に利用されません。サービスページは、保存されないゼロデータリテンション(ZDR)だと説明しています。
- 接続: 専有環境と閉域接続に対応します。入力データやモデル資産を外部に出さない運用ができると説明しています。
- 場所: 国内のデータセンターで運用します。
- モデルのバージョン: 特定のバージョンを使い続けることもできると、サービスページに書かれています。
- 他社モデルとの併用: OpenAIやAnthropicなどの外部モデルと組み合わせる構成例が載っています。
発表に書かれていないこと
次の点は、ニュースリリースにもサービスページにも書かれていません(2026年10月9日時点)。
- 月額の金額、最低利用期間、契約の単位
- 専有されるGPUの種類と枚数、選べる構成の幅
- 稼働率などの品質保証(SLA)と、障害時の対応時間
- 閉域接続の具体的な方式と、追加費用の有無
- 持ち込めるモデルの条件や、ライセンスの確認を誰が行うか
発表には、複雑なAPI仕様や特殊なモデル構成を希望する場合は相談してほしいとあります。選べる範囲は、問い合わせで確かめる必要があります。
影響する会社・しない会社
- 影響する: 独自開発やファインチューニング済みのモデルを持ち、社内や顧客向けのAPIとして動かしたい会社です。利用量が増えても料金が変わらない定額制は、予算を立てやすい形です。
- 影響する: 顧客情報や社内文書を扱う業務に、生成AIを使いたい会社です。専有環境、閉域接続、学習に使わない旨の説明は、社内の審査で確認する材料になります。
- 影響する: すでに「さくらのAI Engine」やさくらのクラウドを使っていて、利用量が増えて従量課金の見通しが立たない会社です。定額に切り替えるかを検討する材料になります。
- 影響しない: 汎用のチャットAIや、決まったモデルで足りる会社は、いま使っているサービスのままで構いません。自社でモデルを用意する前提のサービスで、モデルの選定と持ち込みを自社で行う必要があるためです。
- 影響しない: 利用がまだ少ない会社は、従量課金で無償枠のあるAI Engineのほうが小さく始められます。月額定額の金額は個別見積りで、少量利用でこちらが安くなるとは発表からは判断できません。
情シスが今日やること
- 持ち込みたいモデルがあるかを現場に確認します。 独自開発・ファインチューニング済み・オープンウェイトのどれを使うのか、候補を挙げてもらいます。モデルがない場合は、このサービスの前に、使うモデルを決める作業が要ります。
- いまのAI利用量を集計します。 月のトークン量、同時に使う人数、使う時間帯を、いま使っているサービスの管理画面で確認します。定額と従量のどちらが合うかは、この数字がないと比べられません。
- データの扱いの条件を社内ルールと照らします。 入力する情報の区分、国内完結が必要か、閉域接続が必要かを整理します。「学習に使われない」の説明が、約款や契約書にどう書かれるかは、見積りの段階で質問します。
- 問い合わせで聞く項目を一覧にします。 月額、最低期間、GPUの構成、SLA、閉域接続の方式と費用、障害時の連絡手順を書き出します。上の「発表に書かれていないこと」をそのまま質問リストにできます。
- 見積りが出るまで本番の申込みはしません。 金額が公表されていないため、予算の承認は見積りを受け取ってからにします。社内の承認者には、価格が未公表であることを先に伝えておきます。
生成AIを社内で使う決まりの作り方は、生成AIの社内ルールのテンプレートにまとめています。サービス選びの全体像は、業務で使う生成AIサービスの地図も参考になります。