Basetenは、AIモデルを本番環境で動かすための推論(インファレンス)プラットフォームです。独自のBaseten Inference Stackで、モデルの実行速度、クラウドをまたいだ可用性、開発者の作業のしやすさを両立させることを掲げています。
主な機能
Dedicated inferenceでは、オープンソース、独自開発、ファインチューニング済みのモデルを、推論向けに作られたインフラ上で大規模に動かせます。Model APIsは、あらかじめ最適化されたオープンモデルをAPIですぐに試せる仕組みで、新しいモデルの評価や試作に向きます。Trainingでは強化学習を含むモデルの学習を行い、同じ基盤でそのまま推論に回せます。用途別には、ComfyUIのワークフローを含む画像生成、文字起こしと話者分離、リアルタイムの音声合成、埋め込み、複数モデルを組み合わせるBaseten Chainsにそれぞれ最適化があります。
配置の選択肢
フルマネージドのBaseten Cloudのほか、自社のVPCに置くセルフホスト、両方を組み合わせるハイブリッドを選べます。フォワードデプロイエンジニアが試作から本番まで最適化を手伝う体制もあります。
料金
Basicプランは月額$0の従量課金で、GPUやCPUのインスタンスを使った分だけ分単位で支払います。Model APIsはトークン数に応じた入力・出力の単価で課金されます。Proは高需要GPUへの優先アクセスや専任サポートが付き、Enterpriseでは独自のSLAやセルフホストに対応します。SOC 2 Type IIの認証とHIPAA準拠をうたっています。日本語での利用は公式サイトで確認できません。


