さくらのAI Engineは、さくらインターネットが提供する、基盤モデルを搭載したGPUサーバーで推論を実行して結果を返すAPIサービスです。GPUなどのインフラを自分で用意せずに、AIアプリケーションの開発やコーディング支援に使えます。
主な機能
モデルの実行と通信はすべて国内クラウドで完結し、ZDR(Zero Data Retention)に対応しているため、入力データは学習にも保存にも使われません。APIはOpenAI互換のChat Completions API、Responses API、Anthropic互換のMessages APIの3種類で、既存のライブラリをそのまま使えます。Messages APIを使えばClaude Codeなどのツールからも直接呼び出せますが、現在このAPIで使えるモデルはプレビュー版のKimi-K2.6のみです。
提供機能はテキスト生成、音声の文字起こし、テキストのベクトル化、テキスト読み上げ、ドキュメント管理・検索(RAG)です。テキスト生成ではgpt-oss-120bやllm-jp-3.1-8x13b-instruct4などを使え、申請すればNECのcotomi v3やPFNのPLaMoといった国産のクローズドモデルも利用できます。ブラウザ上のPlaygroundで複数のモデルを比べられます。
料金の形
料金は「基盤モデル無償プラン」と「従量課金プラン」の2つで、どちらにも毎月リセットされる無料枠があります。たとえばgpt-oss-120bは1ヶ月あたり3,000リクエストまで無料で、超過分は従量課金プランでInput 0.15円、Output 0.75円(いずれも10,000トークンあたり・税込)です。無償プランで無料枠を超えるとレート制御がかかり、自動で従量課金には切り替わりません。
注意点
利用にはさくらインターネットの会員ID(電話番号認証あり)と、クレジットカードを登録した「さくらのクラウド」のプロジェクトが必要です。


