Bedrock 料金は1トークンから課金|モデル別単価と実質0円で試す手順 (2026年版)

Bedrock 料金は1トークンから課金|モデル別単価と実質0円で試す手順 (2026年版)

この記事のポイント Amazon Bedrock(アマゾンベッドロック)の料金は、モデルを呼び出した分だけ払う従量課金です。「毎月◯◯トークンまで無料」という常時無料枠はなく、1トークン目から課金が始まります。ただし新規AWSアカウントに付く最大200ドル相当のクレジットを充てれば、Nova 2 MicroやClaude Haiku級のモデルは自己負担ほぼゼロで検証できます。単価の決まり方、用途別の月額試算、請求が一気に跳ねる3つの条件、コンソールで今日触る手順まで、まとめて整理しました。

Amazon Bedrockとは、AWSが提供する生成AIの基盤モデルを、ひとつのAPIからまとめて呼び出せるフルマネージドサービスです。料金は使ったトークン量に応じた従量課金で、月額固定でも常時無料枠でもありません。

AWSの請求画面を開いて、想像していた額と桁が違って手が止まった。Bedrockの料金を調べている人の多くは、その一歩手前にいます。

先に答えを出します。Bedrockは使った分だけ払う従量課金で、月額でも定額でもありません。そして常時無料枠はありません。1トークン目から課金されます。

ただし、無料で試す道は残っています。新規AWSアカウントに付くクレジットです。ここが分かれ目。

Amazon Bedrockは、Claude・Amazon Nova・Llamaなど多数の基盤モデル(AIの土台になる大規模モデル)を、ひとつの窓口からまとめて呼び出せるAWSのサービスです。GPUサーバーを自前で用意しなくていいのが最大の強み。サービスの全体像はAmazon Bedrockのツールページにもまとめています。

30秒でわかる要点:無料枠ゼロ、クレジットで実質0円

Bedrock専用の常時無料枠は存在しません。無料で試す現実解は、新規アカウントのクレジットを使い切ることだけです。

  • モデル呼び出しに常時無料枠は無い(1トークン目から従量課金)
  • 新規AWSアカウントの最大200ドル相当クレジットが事実上の無料枠
  • 最安クラスのNova 2 Micro級なら、検証は数十円から数百円で終わる
  • コンソールの「Playgrounds」ならコード不要で今日試せる

請求が想定外に膨らむ主因は、Provisioned Throughput・Knowledge Bases・Agentsの3つ。通常の従量課金でも呼び出し回数が積み上がれば高額になりますが、そちらは出力上限と予算アラートの設定でほぼ防げます。手順だけ知りたい人は、後半の「今日コンソールで試す手順」まで飛ばして大丈夫です。

まずは、そのメーターがどう回るのかを押さえます。

料金はどう決まる?入力と出力を別々に数えます

Bedrockの請求額は、AIに送った文字(入力)とAIが返した文字(出力)を、それぞれトークン単位で数えて決まります。

トークンとは、AIが扱う文字のかたまりのことです。日本語なら1文字がおおよそ1〜2トークン。単価は「1,000トークンあたり◯ドル」または「100万トークンあたり◯ドル」で表示されます。

見落としやすいのが、入力と出力で単価が違うという点。ほとんどのモデルで、出力側が数倍高く設定されています。AIに長々と喋らせるほど、請求は重くなります。

AWSの公式料金ページには、こんな計算例が載っています。Cohere Commandに6,000トークンを送って2,000トークンを返させた場合。

6,000 ÷ 1,000 × 0.0015ドル + 2,000 ÷ 1,000 × 0.002ドル = 0.013ドル

1回あたり2円弱。これが1日1万回なら、月に約30万回で3,900ドル前後まで伸びます。単価の小ささに油断すると、回数で殴られる構造。

日本語の文章は、何トークンになるのか

トークンという単位のままでは、自分の業務に置き換えられません。日本語1文字を1.5トークンとして換算すると、量の感覚がつかめます。

日本語の文書おおよその文字数換算トークン数
問い合わせメール1通400字約600
ブログ記事1本4,000字約6,000
1時間の会議の書き起こし20,000字約30,000
就業規則などの規程1本50,000字約75,000

つまり、1時間の会議録を丸ごと投げる処理は「3万トークンの入力」です。この数字を単価に掛ければ、1回いくらかが自分で出せます。

料金を抑えるコツは、拍子抜けするほど単純です。送る文章を短く、返させる文章はもっと短く。 出力トークン数の上限(max tokens)を設定するだけで、請求額はかなり変わります。

では、そのメーター単価はモデルごとにどれだけ違うのか。

モデル別の単価はどれくらい差がある?10倍以上ひらきます

Bedrockのモデル単価は、軽量モデルと最上位モデルで桁がひとつ変わります。検証段階でいきなり最上位を叩くのは、お金の無駄です。

単価を読むときは、前提を3つセットで確認してください。モデル名・リージョン・入力/出力の別です。この3つのどれかがずれると、同じ「Bedrockの単価」でも数字が噛み合いません。とくにリージョンは要注意で、東京リージョンと米国のリージョンでは扱えるモデルも単価も別物になります。

下の表は、2026年時点の代表的なモデルの立ち位置を整理したものです。単価は改定が入るため、金額は必ず公式のAWS Bedrock料金ページで、自分が使うリージョンを選んだ状態で確認してください。

モデル系統立ち位置公開されている単価の目安向いている用途
Amazon Nova 2 Micro最速・最安のテキスト専用入力1,000トークン$0.0001〜分類・ログ処理・定型返信
Amazon Nova 2 Lite高速なマルチモーダルMicroより上、Proより下画像込みの軽い処理
Claude Haiku軽量・高速中位モデルより安いチャット・下書き・大量処理
Claude Sonnet 5高性能の主力100万トークン$2 / $10(後述)高品質な文章・コード生成
Claude Opus最上位Sonnetより明確に高い難しい推論・専門タスク

つまり、Nova 2 Microの入力単価は100万トークンあたり0.1ドル相当から。同じ100万トークンでも、上位モデルとは支払いの感覚がまるで違います。

要約や分類のような定型作業なら、Nova 2 Microで十分に戦えます。品質が足りなければ1段ずつ上げる。この順番なら、200ドルのクレジットは驚くほど長持ちします。最上位モデルは、その真価が出る難しいタスクに温存するのが賢いやり方です。

Claude Sonnet 5の料金は100万トークンあたり入力$2 / 出力$10です。 発表時は2026年8月末までの導入価格とされていましたが、2026年8月10日にこの水準が恒久価格になりました($3 / $15への移行は撤回)。

Claude系をAPIから直接呼ぶ選択肢とも比べたいなら、Claude APIの料金と使い方をまとめた記事を先に読むと、Bedrock経由にする意味がはっきりします。実際の機能やプランはClaude APIのツールページにも整理してあります。

月にいくらかかる?よくある3つの使い方で試算しました

単価表だけでは予算が組めません。そこで、社内でよく出てくる3つの使い方を、公開されている単価から計算しました。

試算の前提を先に置きます。ここを変えれば結果も変わるので、自分の数字に差し替えて読んでください。

  • 単価はClaude Sonnet 5の100万トークンあたり入力$2 / 出力$10
  • 比較用にAWS公式の計算例が使う1,000トークンあたり入力$0.0015 / 出力$0.002の水準を併記
  • 日本円は1ドル150円で換算。バッチ推論・割引は未適用
使い方月間の入力/出力トークンSonnet 5級の月額公式計算例の単価水準なら
社内Q&Aボット(月2,000回)400万 / 100万$18(約2,700円)$8(約1,200円)
問い合わせの自動分類(月3万件)1,500万 / 150万$45(約6,750円)$25.5(約3,800円)
議事録の要約(月200本)400万 / 40万$12(約1,800円)$8(約1,200円)

つまり、想像より安いというのが正直なところです。個人の検証や小さな社内ツールなら、月額は数千円のレンジに収まります。

1件あたりで見るともっと極端です。4,000字の記事1本を要約させる処理は、Sonnet 5級の単価でおよそ0.022ドル。日本円で3円ほどです。人が読んで要約する時間を思えば、比較になりません。

ここで気をつけたいのは、桁が変わる条件のほうです。呼び出し回数が10倍になれば料金も10倍になります。 社内ツールが全社に開放された瞬間に請求が跳ねるのは、この単純な比例のせい。想定利用者数が増えるときは、必ず試算をやり直してください。

なぜ無料枠がないのか? 設計思想が「本番前提」だから

Bedrockのモデル推論に無料枠が無いのは、このサービスが最初から企業の本番運用を前提に設計されているからです。

公式の料金ページを開くと、説明はStandard・Flex・Priority・Reservedという課金階層から始まります。「Free」の文字はどこにもありません。書き忘れではなく、意図してそう作られています。

ここで多くの人がつまずくのが、AWS全体の「無料利用枠」との混同です。S3やLambdaには無料枠がありますが、Bedrockのモデル推論は対象外。「AWSは無料枠があるからタダだろう」と踏むと、初回の請求で数百円から数千円を見ることになります。

それでも「Bedrock無料枠」で探す人が絶えない理由は、たぶんこうです。欲しいのは無料枠という制度ではなく、無料で試す方法のほう。そして、そちらはちゃんと存在します。

実質0円で試すには? 新規アカウントのクレジットを使い切る

AWSは新規アカウント向けにクレジットを付与する方式を採っており、このクレジットはBedrockのモデル料金にも充てられます。金額は最大200ドル相当。

条件と有効期限は改定されるため、申し込み前にAWS無料利用枠の公式ページで必ず確認してください。ここを読まずに始めると、期限切れのクレジットを当てにすることになります。

200ドルというのは、Nova 2 Micro級で試す限りはかなり余裕のある額です。プロトタイプを作って、社内デモまで通して、それでも残る。逆に、Provisioned Throughputを1日でも起動すれば一瞬で溶けます(次の章)。

クレジットを長持ちさせる使い方は3つ。

  • 検証は最安モデルから。品質不足を確認してから上げる
  • 出力トークンの上限を必ず設定する(設定なしは事故のもと)
  • 使い終わったリソースはその日のうちに止める

ここまでの整理を挟みます。

ここまでの整理:Bedrockに無料枠は無い。単価は入力と出力で別。モデルによって10倍以上ひらく。無料で触るには新規アカウントのクレジットを使う。ここまでを守れば、月の請求は数百円で収まります。跳ねるのはこの先の3つだけ。

請求が跳ねるのはどんなとき? 3つの落とし穴

Bedrockで「思っていた額と違う」が起きるのは、ほぼこの3つが原因です。従量課金の外側にある、時間課金と付帯サービス。

1. Provisioned Throughput(プロビジョンドスループット)

モデルの処理能力を時間単位で確保する契約です。従量課金ではなく時間課金。使わなくても、起動している限り課金され続けます。

公開されている参考値では、Titan Text Liteのコミットメントなしが1時間あたり7.10ドル。1か月(720時間)まわすと約5,112ドルです。Titan Text Expressのコミットメントなしは1時間20.50ドルで、720時間なら約14,760ドル。検証目的でうっかり有効化すると、200ドルのクレジットはExpressなら半日、Liteでも1日あまりで消えます。

コミットメント期間を付ければ単価は下がります(Titan Text Liteの場合、1か月契約で6.40ドル、6か月契約で5.10ドル)。ただしこれは本番トラフィックが読める段階の話。検証中に触るものではありません。

2. Knowledge Bases(ナレッジベース)

社内資料をAIに読ませて答えさせる仕組み(RAG)をマネージドで用意してくれる機能です。便利な代わりに、裏側でベクトルDBやストレージが別料金で動きます。Bedrockの単価表だけを見ていると、この分が見えません。RAG関連の選択肢を並べて比べるならAI検索・リサーチカテゴリのツール一覧が参考になります。

3. Agents(エージェント)

AIに複数の手順を自動で実行させる機能です。1回の指示で内部的に何度もモデルを呼ぶため、呼び出し回数が読めないのが怖いところ。動きはBedrock Agentsのページで確認できますが、コスト管理の観点では検証の最後に回すべき機能です。

3つに共通するのは、「単価が高い」のではなく「課金の単位が違う」こと。ここを理解していれば、事故は防げます。

料金を半分に近づける打ち手

同じ処理でも、呼び方を変えるだけで支払いは大きく変わります。効果が大きい順に3つ。

バッチ推論を使う。 公式の料金階層には、オンデマンド推論と比べて50%安い価格でまとめて処理する仕組みが用意されています。即答が要らない用途。夜間の一括要約、大量データの分類、記事の下書き生成。なら、これを使わない理由がありません。リアルタイム性を捨てるだけで半額。破格です。

Flex / Priorityを使い分ける。 Standardのほかに、遅延を許容する代わりに安いFlex、優先処理のPriorityが用意されています。全部を同じ階層で回すのは、全員をタクシーで送るようなもの。

指示文を短くする。 毎回同じ長い前置きを送っているなら、それは毎回課金されています。共通部分を削るだけで入力トークンは目に見えて減ります。地味に効きます。

打ち手効きめ向いている場面
バッチ推論大(最大50%減)即答不要の一括処理
モデルの格下げ大(10倍以上の差)分類・要約・定型文
出力上限の設定すべての用途
指示文の圧縮小〜中同じ前置きを毎回送っている場合

先ほどの試算に当てはめると、月3万件の分類は夜間バッチに逃がすだけで月額が半分近くまで落ちます。どの処理を即答にするかは、機能要件ではなく料金の話です。

つまり、コスト削減はチューニングではなく設計の問題です。どの処理をどの階層に流すかを最初に決めておけば、あとから慌てて絞る必要はありません。LLM全体の支出を見直したい場合は、コストを下げる乗り換え先の整理も併せてどうぞ。

請求を監視する仕組みは、触る前に作る

料金の事故は、単価を間違えて起きるのではありません。気づくのが遅れて起きます。 最初のAPI呼び出しより先に、次の4つを用意してください。

  1. AWS Budgetsで月額の予算とアラートを設定する。しきい値は50%・80%・100%の3段が扱いやすい
  2. Cost Explorerでサービス別の内訳を見る癖をつける。Bedrockの行だけを日次で追う
  3. コスト配分タグを付けて、検証用と本番用の支出を最初から分ける
  4. アプリ側で出力トークン上限1日の呼び出し回数上限を持つ

このうち効きめが大きいのは4番目です。予算アラートは事後の通知ですが、アプリ側の上限は事故そのものを止めます。無限ループでモデルを呼び続ける不具合は、誰でも一度は書きます。

タグ付けを後回しにすると、あとから「どのチームがいくら使ったのか」を復元できません。分けるのは最初だけがラクです。

今日コンソールで試す手順

コードを1行も書かずに、ブラウザだけでBedrockの応答を確認できます。所要時間は10分ほど。

ステップ1: リージョンを選ぶ

AWSマネジメントコンソールにログインし、右上でリージョンを切り替えます。東京リージョンで使えるモデルは限られるため、目的のモデルが無ければバージニア北部を選んでください。単価もリージョンごとに違います。

ステップ2: モデルの利用申請を出す

サービス検索で「Bedrock」を開き、左メニューの「Model access」へ。使いたいモデルにチェックを入れて申請します。多くは即時に通り、一部は承認待ちになります。

ステップ3: Playgroundsで応答を見る

「Playgrounds」から「Chat」を開き、モデルにNova 2 Microなどの最安クラスを選びます。質問を投げれば、その場で応答が返ってきます。ここまでで課金されるのは数円分。

ステップ4: 請求額を見ながら触る

同時に「Billing」を開き、発生額を眺めておいてください。いくら使ったかを見ながら触る習慣がつくと、その後の運用が変わります。ここを飛ばす人ほど、翌月に驚きます。

APIから呼ぶ段階に進むなら、AWS CLIの認証設定とIAM権限(AmazonBedrockFullAccessなど)が必要です。ここから先はアプリ側の設計に入るので、AIチャットボットカテゴリのツール一覧で自分のユースケースに近いモデルを絞ってから進めると迷いません。

他のクラウドや直販APIと、どう選び分ける?

同じモデルを呼ぶ窓口は、Bedrockだけではありません。選択肢は大きく3つに分かれます。

窓口向いているケース気をつける点
Amazon BedrockすでにAWSで動いている、複数ベンダーを比べたい常時無料枠なし。付帯機能の料金が見えにくい
モデル提供元の直販API1社のモデルだけを深く使う請求と認証が別建てになる
他社クラウド経由既存の契約先に寄せたい使えるモデルの顔ぶれが違う

判断の順番はシンプルです。どのモデルを使うかより先に、請求と権限をどこに寄せたいかを決めてください。 社内の監査や稟議は、単価より契約先の数で重くなります。

Anthropicの直販単価はClaude Sonnet 5が100万トークンあたり入力$2 / 出力$10。Bedrock側の単価は前述のとおり公式料金ページで確認する前提です。Google側の考え方と並べたいならVertex AIの料金ガイド、Microsoft側の環境を知りたいならAzure AI Studioのガイドが近道です。

編集部の評価

公開されている料金体系とリサーチ結果をもとに、率直な評価を書きます。

良いところ。 複数ベンダーのモデルを1つの請求と1つの認証でまとめられる点は、他に代えがききません。Claude、Nova、Llamaを比較しながら選べる環境を自前で作ろうとすれば、契約も監査もばらばらになります。企業で使うなら、この一元化だけで価値があります。バッチ推論で50%減という選択肢が最初から用意されているのも、コスト設計がしやすい。

微妙なところ。 料金の見通しの悪さは正直イマイチです。単価表を読んだだけでは、Knowledge BasesやAgentsを組んだときの総額がまるで読めません。「トークン単価は安いのに請求が跳ねた」という声が出るのは、たいてい従量課金の外側が原因。ここは公式の説明がもっと親切であるべきところ。

Provisioned Throughputは要注意。 時間課金であることが単価表の並びからは伝わりにくく、検証目的で触ると一撃でクレジットが消えます。個人や小さいチームは、当面まったく触らないのが一択です。

結論。 個人の検証なら「クレジット+最安モデル+Playgrounds」で十分。企業導入なら、単価の比較より先に、どの処理をバッチに逃がせるかを決めるほうが効きます。

よくある質問(FAQ)

Q. Bedrockに無料枠はありますか?

モデル推論の常時無料枠はありません。1トークン目から課金されます。無料で試すなら、新規AWSアカウントに付与される最大200ドル相当のクレジットを使う方法が現実解です。条件は公式ページで確認してください。

Q. 1回の呼び出しでいくらかかりますか?

モデルと文章量しだいです。AWS公式の計算例では、Cohere Commandに6,000トークンを送って2,000トークンを返させて0.013ドル。Nova 2 Micro級ならさらに安く、入力1,000トークンあたり0.0001ドルからという水準です。

Q. 使わなければ料金は0円ですか?

モデル推論だけを使っている場合は、呼び出さなければ0円です。ただしProvisioned Throughputを有効化していると、呼び出しがなくても時間で課金され続けます。Knowledge Basesも、裏側のストレージやベクトルDBが動いていれば別途かかります。

Q. 東京リージョンと海外リージョンで料金は違いますか?

違います。単価はリージョンごとに設定されており、使えるモデルの顔ぶれも同じではありません。料金ページを見るときは、必ず自分が使うリージョンを選んだ状態で数字を読んでください。

Q. 日本語は英語より高くつきますか?

同じ内容を書くと、日本語のほうがトークン数は増えやすい傾向があります。単価そのものは言語で変わりませんが、消費するトークン量で差が出る形です。1文字を1〜2トークンとして換算し、多めに見積もっておくと安全です。

Q. Claude Sonnet 5の値引きはいつまでですか?

公式料金ページの記載では、100万トークンあたり入力$2 / 出力$10です。発表時は導入価格の扱いでしたが、2026年8月10日に恒久価格化されています。

Q. 使いすぎを防ぐ設定はありますか?

AWS Budgetsで予算額とアラートを設定しておくのが基本です。あわせて、出力トークンの上限設定と、Provisioned Throughputを有効化しないこと。この3つで、想定外の請求はほぼ防げます。

Q. Azure OpenAIやVertex AIと比べて安いですか?

単価だけで優劣は決まりません。同じモデルでも階層(Standard / Flex / バッチ)で倍近く変わるためです。比較するなら、自社の処理が即答を必要とするかどうかで先に切り分けたほうが早い。エンタープライズ視点の比較はAzure OpenAIとBedrockの比較記事にまとめています。

次に読むならこれ

Google側の料金体系と並べて検討したいなら、Vertex AIの料金ガイドが近道です。同じ「クラウド経由でモデルを呼ぶ」構造でも、無料枠の考え方と課金単位が違います。2社を並べて見ると、自分の使い方にどちらが向いているかが一気にはっきりします。機能面から押さえたい場合はVertex AI自体の入門ガイドから読むとつながります。

各ツールの公式サイト(一次情報)

料金・機能・対応範囲は各社公式が一次情報です。本記事は公開時点の検証に基づきますが、最新かつ正確な条件は必ず各公式ページで確認してください。