// ARTICLE · AIツールの使い方
Claude APIの使い方と料金|始め方4手順
// この記事を書いた人
株式会社Global Design Factory 代表取締役
高橋 遼
北海道大学工学部でAIによる自然言語処理を研究。P&Gにてビッグデータ解析・消費者分析を担当した後、伊良コーラのマーケティング責任者を経て、現在は株式会社Global Design Factory代表取締役として、中小企業を中心にAIを活用した業務効率化・自動化を支援。

Claude API は、Anthropic の AI モデル「Claude」を自社のシステムや業務ツールからプログラムで呼び出すための仕組みです。claude.ai の Pro や Max といったサブスクリプションとは別の契約で、使ったトークン量に応じて課金される従量制です。サブスクに入っていても API の利用分は含まれず、別途 Claude Console でクレジットを購入する必要があります。無料で試せるかについては、公式の料金ページに「新規ユーザーにはテスト用に少額の無料クレジットが付与される」と書かれていますが、金額や条件は明記されていないため、本格的に使うなら有料クレジットの購入が前提になると考えてください。この記事では、Claude API の始め方(アカウント作成から APIキー発行まで)、curl・Python・TypeScript での最初のリクエスト、モデル別の料金と費用の抑え方、利用上限の仕組み、業務での使いどころと注意点を、2026年9月時点の公式ドキュメントに沿って順に説明します。
先に結論:Claude API の料金・無料枠・サブスクとの違い
細かい手順に入る前に、よく聞かれる3つの疑問への答えをまとめておきます。
| 疑問 | 答え(2026年9月時点) |
|---|---|
| サブスク(Pro・Max など)に API は含まれる? | 含まれません。API は Claude Console で別に支払います |
| 料金の仕組みは? | 入力・出力のトークン量に応じた従量課金です。基本はクレジットの前払いです |
| 無料で使える? | 新規ユーザーに少額の無料クレジットが付与されると公式に記載があります。金額は公開されていません |
| いちばん安いモデルの単価は? | Claude Haiku 4.5 で、100万トークンあたり入力1ドル・出力5ドルです |
| 迷ったらどのモデル? | 公式の推奨は Claude Opus 5.5 です |
サブスクと API が別であることは、Anthropic のヘルプセンターの記事「有料の Claude プランがあるのに、なぜ API と Console に別途支払いが必要なのか」で明言されています。有料プランはチャット体験を強化するもので、Claude API や Console へのアクセスは含まない、という説明です。
無料クレジットについては、Claude API の公式料金ページのよくある質問に「New users receive a small amount of free credits to test the API.(新規ユーザーは API を試すための少額の無料クレジットを受け取れます)」とあります。ただし「small amount」とだけ書かれていて金額の記載はなく、恒常的な無料枠(毎月一定量まで無料といった仕組み)についての記載もありません。試しに数回呼び出す程度なら足りる可能性がありますが、社内システムに組み込んで継続的に使う場合は、クレジットを購入する前提で計画してください。
Claude API とは
Claude API は、https://api.anthropic.com で提供される REST API です。公式の API 概要によると、中心になるのはメッセージを送って Claude の応答を受け取る Messages API(POST /v1/messages)で、ほかに大量のリクエストを非同期でまとめて処理する Message Batches API、送信前にトークン数を数える Token Counting API、使えるモデルの一覧を取得する Models API、ファイルを一度アップロードして何度も参照できる Files API などがあります。
Claude API でできること
現行モデルはどれも、テキストと画像の入力、テキストの出力、多言語、ツール使用に対応しています。公式の機能一覧に載っている主な機能を、業務で使う場面に引き寄せて整理すると次のとおりです。
- テキスト生成・要約・分類:問い合わせへの回答文、議事録の要約、文書の分類など、文章を扱う処理の中心です
- 画像の読み取り:JPEG・PNG・GIF・WebP の画像を入力できます。スクリーンショットや図表、書類の画像を読ませて内容を説明させる使い方です。Vision のドキュメントによると、API では1リクエストに最大600枚(コンテキストウィンドウが200Kトークンのモデルは100枚)まで送れます。なお、画像を読むことはできても、画像を生成・編集することはできません
- PDF の読み取り:PDF のテキストと図表をまとめて解析できます
- ツール使用(Function calling):自社で定義した関数やAPIを Claude に呼び出させる機能です。Web検索・Webページ取得・コード実行のように Anthropic 側で動くサーバーツールもあります
- 構造化出力:指定した JSON スキーマに沿った形で結果を返させる機能で、システム連携で後処理しやすくなります
- 長いコンテキスト:Opus 5.5・Sonnet 5・Fable 5.1 は最大100万トークン、Haiku 4.5 は20万トークンまでを一度に扱えます
- 引用(Citations):渡した資料のどの部分を根拠に答えたかを示させる機能で、社内文書を使った回答の検証に役立ちます
自社のツールを Claude に呼び出させる仕組みは、ツール使用の公式ガイドで説明されています。Claude が「この関数をこの引数で呼んでほしい」という tool_use ブロックを返し、アプリ側で実際に処理して結果を tool_result として送り返す、という往復の流れです。
claude.ai(チャット)との違い
普段使っている claude.ai のチャットと Claude API は、同じ Claude のモデルを使っていても、役割も契約も異なります。
| 項目 | claude.ai(Free・Pro・Max など) | Claude API |
|---|---|---|
| 使い方 | ブラウザ・デスクトップ・スマホのアプリで会話 | 自社のプログラムから HTTP リクエストで呼び出し |
| 料金 | 月額固定のサブスク(Pro は月20ドル) | 使ったトークン量に応じた従量課金 |
| 管理画面 | claude.ai | Claude Console(platform.claude.com) |
| 向いている用途 | 個人やチームが対話しながら使う場面 | 社内システム・業務ツール・自社サービスへの組み込み |
| 会話の履歴 | アプリが保持 | API 自体は保持しません。毎回の履歴はアプリ側で送ります |
最後の行は、API を初めて使うときに戸惑いやすい点です。Messages API の使い方ガイドには「Messages API はステートレスで、常に会話の履歴全体を API に送る」と書かれています。チャットのように続けて質問させたい場合は、前のやり取りを自分のプログラムで保存し、次のリクエストにまとめて入れて送ります。履歴が長くなるほど入力トークンが増えて料金にも響くので、設計の段階で意識しておくと後で困りません。
サブスクのプランごとの違いを知りたい場合は、Claudeのプラン比較(Free・Pro・Max・Team)にまとめています。
Claude API の始め方:APIキー発行までの4ステップ
API を使い始めるまでの流れは、次の4ステップです。画面の項目名は Claude Console の公式ドキュメントに記載された表記に合わせています。
- Claude Console のアカウント作成
- 支払い方法の登録とクレジットの購入
- APIキーの発行
- APIキーを環境変数に設定
ステップ1:Claude Console のアカウントを作る
platform.claude.com にアクセスし、サインインするか、アカウントがなければ新しく作成します。claude.ai のアカウントとは別に管理される開発者向けの画面で、APIキー・請求・利用状況・利用上限をここで扱います。
なお、Claude API は提供地域が決まっています。公式の提供地域一覧には日本も含まれているので、日本からそのまま契約できます。
ステップ2:支払い方法を登録してクレジットを購入する
Claude API の支払いは、基本的にクレジットの前払い方式です。ヘルプセンターの「Claude API の利用料金の支払い方法」によると、手順は次のとおりです。
- Admin または Billing の権限を持つアカウントで Console にログインします
- Settings > Billing を開きます
- Buy credits をクリックし、購入したい金額を入力して確定します
購入したクレジットはすぐに使えるようになり、API・Console のプレイグラウンド・Claude Code(Console 経由で使う場合)の利用分に充てられます。成功したリクエストだけが課金され、失敗したリクエストには料金がかかりません。
同じ記事には、次の点も書かれています。
- 残高が指定額を下回ったら自動で買い足す「auto-reload(自動チャージ)」を Billing ページで設定できます
- クレジットの有効期限は購入日から1年で、延長はできません
- 購入したクレジットは返金されません
- 営業チームと請求書払いの契約を結んだ組織は、月末締めの後払い請求になります
有効期限が1年あるとはいえ返金はされないので、最初は検証に必要な分だけを購入し、利用量が見えてから増やすのが安全です。
ステップ3:APIキーを発行する
APIキーの取得方法に関する公式ドキュメントに沿って、次の順で発行します。
- Console の Settings → API keys を開きます
- Create key をクリックします
- キーに名前を付け、有効期限(expiration)を選び、Linked account に自分またはサービスアカウントを設定します。必要ならワークスペースも指定します
- 表示されたキー(
sk-ant-で始まる文字列)をコピーし、安全な場所に保管します
キーの全体が表示されるのは作成時の1回だけです。なくした場合は Console で再表示できないため、新しいキーを作り直します。
キーには種類があります。自分の開発用に使う「personal key(個人キー)」と、CI や本番サービスなど複数人で共有する処理に使う「service account key(サービスアカウントキー)」です。公式は「自分の開発には個人キー、共有するものにはサービスアカウントキー」を勧めています。個人キーは、その人が組織を離れると使えなくなるので、社内システムの本番運用に個人キーを使うと、担当者の異動や退職でシステムが止まる原因になります。
有効期限は、認証の公式ドキュメントによると、3時間・1日・7日・30日のプリセット、任意の期間、または無期限(Never)から選べます。期限は作成後に変更できず、期限切れのキーは再有効化できません。検証用のキーは短めの期限にしておくと、消し忘れても被害が広がりにくくなります。
ワークスペースは、用途や環境ごとにキーと利用上限を分けるための単位です。たとえば「検証用」と「本番用」でワークスペースを分けておくと、検証で使いすぎても本番に影響しないように上限を設定できます。
ステップ4:APIキーを環境変数に設定する
発行したキーは、コードに直接書かず、環境変数 ANTHROPIC_API_KEY に設定します。公式の SDK はこの環境変数を自動で読み込みます。macOS や Linux のターミナルなら次のとおりです。
export ANTHROPIC_API_KEY="your-api-key-here"
your-api-key-here の部分に、ステップ3でコピーしたキーを入れます。本番環境では、クラウドのシークレット管理サービスなどに保存し、アプリの起動時に環境変数として渡す形が一般的です。
最初のリクエストを送る:curl・Python・TypeScript
ここからは、公式のクイックスタートに沿って、実際に Claude API を呼び出します。どの方法でも、送る内容は「使うモデル」「出力の上限トークン数(max_tokens)」「メッセージ」の3つが基本です。モデルIDは、公式が迷ったら最初に使うよう勧めている claude-opus-5-5 にしています。費用を抑えたい場合は claude-sonnet-5 や claude-haiku-4-5 に置き換えても同じコードで動きます。
curl で呼び出す
ターミナルから直接 HTTP リクエストを送る方法です。SDK を入れる前に、キーが正しく使えるかを確かめるのに向いています。
curl https://api.anthropic.com/v1/messages \
-H "content-type: application/json" \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-d '{
"model": "claude-opus-5-5",
"max_tokens": 1000,
"messages": [
{
"role": "user",
"content": "社内報に載せる、AI活用の注意点を3つ挙げてください。"
}
]
}'
ヘッダーは3つとも必須です。x-api-key に APIキー、anthropic-version に API のバージョン(2023-06-01)、content-type に application/json を指定します。認証は Authorization: Bearer ヘッダーでも送れ、公式の API 概要では x-api-key を「従来方式として引き続きサポート」と位置づけています。
Python で呼び出す
Python では公式 SDK の anthropic パッケージを使います。仮想環境を作ってインストールします。
mkdir claude-quickstart && cd claude-quickstart
python3 -m venv .venv && source .venv/bin/activate
pip install anthropic
quickstart.py を作り、次のコードを書きます。
import anthropic
client = anthropic.Anthropic() # 環境変数 ANTHROPIC_API_KEY を自動で読み込む
message = client.messages.create(
model="claude-opus-5-5",
max_tokens=1000,
messages=[
{
"role": "user",
"content": "社内報に載せる、AI活用の注意点を3つ挙げてください。",
}
],
)
for block in message.content:
if block.type == "text":
print(block.text)
python quickstart.py で実行すると、Claude の回答が表示されます。
TypeScript(Node.js)で呼び出す
TypeScript では @anthropic-ai/sdk を使います。
mkdir claude-quickstart && cd claude-quickstart
npm init -y
npm pkg set type=module
npm install @anthropic-ai/sdk
quickstart.ts を作り、次のコードを書きます。
import Anthropic from "@anthropic-ai/sdk";
const client = new Anthropic(); // 環境変数 ANTHROPIC_API_KEY を自動で読み込む
const message = await client.messages.create({
model: "claude-opus-5-5",
max_tokens: 1000,
messages: [
{
role: "user",
content: "社内報に載せる、AI活用の注意点を3つ挙げてください。"
}
]
});
for (const block of message.content) {
if (block.type === "text") {
console.log(block.text);
}
}
npx tsx quickstart.ts で実行します。公式 SDK は Python・TypeScript のほか、C#・Go・Java・PHP・Ruby 向けも提供されています。SDK を使うと、認証やバージョンのヘッダーを自動で付けてくれるほか、リトライやタイムアウトの処理も任せられます。
レスポンスの見方
curl で呼び出すと、次のような JSON が返ってきます(公式のクイックスタートに載っている形です)。
{
"model": "claude-opus-5-5",
"id": "msg_013mHbppMPd2PrVJzGMZPt2D",
"type": "message",
"role": "assistant",
"content": [
{
"type": "text",
"text": "(ここに回答の本文が入ります)"
}
],
"stop_reason": "end_turn",
"stop_sequence": null,
"stop_details": null,
"usage": {
"input_tokens": 21,
"output_tokens": 305
}
}
見るべき項目は3つです。
- content:回答の本文です。配列になっていて、
typeがtextのブロックに文章が入ります。ツール使用を有効にしていればtool_useのブロックが入ることもあります - stop_reason:回答が終わった理由です。
end_turnなら Claude が自然に回答を終えたことを示します。max_tokensの場合は、指定した上限に達して途中で切れているので、上限を引き上げるか依頼内容を分けます - usage:このリクエストで使った入力トークン数(
input_tokens)と出力トークン数(output_tokens)です。料金はこの数字から計算されるので、運用を始めたらログに残しておくと費用の把握に役立ちます
古いサンプルコードを使うときの注意
インターネット上には古いモデル向けのサンプルが多く残っています。現行モデルでは、そのままでは動かない書き方があるので気をつけてください。
temperature・top_p・top_kは、Claude 4.7 以降のモデルでは既定値以外を指定すると 400 エラーになります。出力の傾向はプロンプトで指示します- 回答の冒頭をこちらで書いておく「プリフィル」は、Claude 4.6 以降のモデルでは使えず、400 エラーになります。形式をそろえたい場合は構造化出力やシステムプロンプトで指示します
- 以前の「extended thinking」で思考量を
budget_tokensで指定する方法は、Opus 4.6・Sonnet 4.6 で非推奨になり、それ以降のモデルでは受け付けられません
モデルの選び方:4つの現行モデルを比べる
Claude API で使える現行モデルは4つです。公式のモデル一覧の内容を表にすると次のとおりです。
| 項目 | Claude Fable 5.1 | Claude Opus 5.5 | Claude Sonnet 5 | Claude Haiku 4.5 |
|---|---|---|---|---|
| 公式の位置づけ | 高難度の推論・長時間のエージェント作業向け | 長時間のエージェント型コーディングや知的作業向け | 速度と知能のバランスが最良 | 最速で、最先端に近い知能 |
| 相対的な速さ | 遅め | 中程度 | 速い | 最速 |
| 料金(100万トークンあたり 入力/出力) | 10ドル/50ドル | 4ドル/20ドル | 2ドル/10ドル | 1ドル/5ドル |
| API のモデルID | claude-fable-5-1 | claude-opus-5-5 | claude-sonnet-5 | claude-haiku-4-5-20251001(別名 claude-haiku-4-5) |
| コンテキストウィンドウ | 100万トークン | 100万トークン | 100万トークン | 20万トークン |
| 最大出力 | 12.8万トークン | 12.8万トークン | 12.8万トークン | 6.4万トークン |
| 信頼できる知識の時点 | 2026年6月 | 2026年6月 | 2026年1月 | 2025年2月 |
公式の推奨は「どのモデルを使うか迷ったら、まず Claude Opus 5.5 から始める。高い effort にしても Opus 5.5 で足りない場合や、高難度の推論・長時間のエージェント作業には Claude Fable 5.1 を使う」というものです。
業務の組み込みに当てはめると、次のような考え方になります。
- まず品質を確かめたい段階:Opus 5.5 で試し、期待どおりの結果が出るかを確認します
- 件数が多く、1件ごとの処理が単純なもの(問い合わせの振り分け、定型的な要約、データ抽出など):Sonnet 5 や Haiku 4.5 に下げても品質が保てるかを比べます
- 難しい判断や長い手順を自律的にこなすエージェント:Opus 5.5、足りなければ Fable 5.1
料金ページの「コスト最適化」の項でも、単純なタスクには Haiku、本番の多くの処理には Sonnet、最も複雑な推論には Opus を選ぶよう勧めています。
モデルごとの得意分野や使い分けは、Claudeのモデル比較(現行4モデル)で詳しく比べています。Opus と Sonnet のどちらにするかで迷っている場合はClaude OpusとSonnetの違いを、低コストのモデルを検討している場合はClaude Haiku 4.5の特徴と使いどころも参考にしてください。なお、モデルの提供終了に関する公式ページによると、公開モデルを提供終了する場合は利用中の顧客に少なくとも60日前に通知される方針です。モデルIDを設定ファイルなどにまとめておくと、切り替えが必要になったときに対応しやすくなります。
Claude API の料金
モデル別の単価
Claude API の料金は、入力トークン(こちらから送る分)と出力トークン(Claude が生成する分)に分けて、100万トークンあたりの単価で決まります。すべて米ドル建てです。公式料金ページの現行4モデルの単価を抜き出すと次のとおりです。
| モデル | 入力 | 出力 | キャッシュ書き込み(5分) | キャッシュ読み取り |
|---|---|---|---|---|
| Claude Fable 5.1 | 10ドル | 50ドル | 12.50ドル | 0.25ドル |
| Claude Opus 5.5 | 4ドル | 20ドル | 5ドル | 0.20ドル |
| Claude Sonnet 5 | 2ドル | 10ドル | 2.50ドル | 0.20ドル |
| Claude Haiku 4.5 | 1ドル | 5ドル | 1.25ドル | 0.10ドル |
(いずれも100万トークンあたり)
出力の単価は入力の5倍です。長い文章を生成させる用途ほど、出力側の費用が大きくなります。また、Claude の「思考(thinking)」に使われたトークンも出力トークンとして課金されます。思考機能の公式ドキュメントによると、思考の文章が返ってこない場合でも課金対象で、max_tokens の上限にも含まれます。Opus 5.5 と Fable 5.1 は適応型の思考が常に有効なので、usage の output_tokens を見て、想定より増えていないかを確かめてください。費用や待ち時間を減らしたいときは effort(どれだけ手間をかけて答えるか)のパラメーターを下げる、支出に厳密な上限をかけたいときは max_tokens で制限する、というのが公式の案内です。
サブスクの Claude Code を含めた料金の全体像は、Claude Codeの料金(Pro・Max・API)でも整理しています。
トークン数の考え方
トークンは、モデルが文章を処理する単位です。公式料金ページには「英語ではおおよそ1トークン=4文字、または0.75単語。正確な数は言語や内容によって変わる」とあります。日本語の文字数とトークン数の対応について、公式に決まった換算値は示されていません。
注意したいのは、Claude Opus 4.7 以降のモデルで新しいトークナイザー(文章をトークンに分ける仕組み)が使われていることです。公式料金ページによると、同じ文章でも以前のモデルよりおよそ30%多いトークン数になります。古いモデルで測ったトークン数を流用して費用を見積もると、実際より安く見積もってしまうおそれがあります。
正確な数を知りたいときは、トークンカウントの公式ドキュメントで説明されている Token Counting API を使います。実際に送る予定のメッセージをそのまま渡すと、入力トークン数を返してくれます。このエンドポイントは無料で使え(リクエスト数の上限はあります)、使うモデルを指定して数えるので、トークナイザーの違いも反映されます。自社の文書や問い合わせ文のサンプルを何件か数えてみると、見積もりの精度が上がります。
1回あたりの料金の試算(仮定の例)
ここでは、公式の単価から計算した仮定の例を示します。実際のトークン数は、プロンプトの書き方・回答の長さ・思考の量によって大きく変わるので、目安として読んでください。
前提:社内の問い合わせに一次回答する用途で、1回あたり入力2,000トークン(指示文と質問)、出力500トークン(回答)とします。
| モデル | 入力の料金 | 出力の料金 | 1回あたり | 月1,000回の場合 |
|---|---|---|---|---|
| Claude Opus 5.5 | 0.008ドル | 0.010ドル | 0.018ドル | 18ドル |
| Claude Sonnet 5 | 0.004ドル | 0.005ドル | 0.009ドル | 9ドル |
| Claude Haiku 4.5 | 0.002ドル | 0.0025ドル | 0.0045ドル | 4.5ドル |
計算式は「入力トークン数 × 入力単価 ÷ 100万 + 出力トークン数 × 出力単価 ÷ 100万」です。たとえば Sonnet 5 なら、2,000 × 2 ÷ 1,000,000 = 0.004ドル、500 × 10 ÷ 1,000,000 = 0.005ドルで、合計0.009ドルです。実際の運用では、前述の思考トークンや会話履歴の分だけ入力・出力が増えることがあります。
Batch API で50%引きにする
すぐに結果が要らない処理なら、Message Batches API を使うと入力・出力とも50%引きになります。バッチ処理の公式ドキュメントによると、多くのバッチは1時間以内に処理が終わり、24時間以内に処理が完了しなかったリクエストは期限切れになります(期限切れになった分は課金されません)。結果は作成から29日間ダウンロードできます。
| モデル | バッチの入力 | バッチの出力 |
|---|---|---|
| Claude Fable 5.1 | 5ドル | 25ドル |
| Claude Opus 5.5 | 2ドル | 10ドル |
| Claude Sonnet 5 | 1ドル | 5ドル |
| Claude Haiku 4.5 | 0.50ドル | 2.50ドル |
(いずれも100万トークンあたり)
夜間にまとめて処理する文書の要約、過去の問い合わせデータの分類、大量の商品説明文の下書きといった用途に向いています。
プロンプトキャッシュで繰り返し部分を安くする
毎回同じ長い指示文や資料を送る場合は、プロンプトキャッシュが効きます。一度キャッシュに書き込んだ部分は、次のリクエストから安い単価で読み込まれます。公式料金ページによると、単価は次の倍率で決まります。
- 5分キャッシュの書き込み:基本入力単価の1.25倍
- 1時間キャッシュの書き込み:基本入力単価の2倍
- キャッシュの読み取り:基本入力単価の0.1倍(Opus 5.5 は0.05倍、Fable 5.1 は0.025倍)
5分キャッシュなら、1回読み取るだけで書き込みの割増分を取り戻せる計算です。プロンプトキャッシュの公式ドキュメントによると、キャッシュの有効期間は既定で5分で、使われるたびに追加料金なしで延長されます。リクエストの最上位に cache_control を1つ加えるだけで自動的にキャッシュされる「自動キャッシュ」があり、公式はまずこれから始めるよう勧めています。ただし短すぎるプロンプトはキャッシュされません(Opus 5.5 では最小512トークン)。
仮定の例として、1万トークンの社内規程を毎回送り、質問に答えさせる場合を考えます。Sonnet 5 だと、キャッシュなしでは規程部分だけで1回0.02ドルかかりますが、キャッシュから読み取れば0.002ドルです(初回の書き込みは0.025ドル)。問い合わせが短い間隔で続く用途ほど効果が大きくなります。Batch API とプロンプトキャッシュの割引は組み合わせて使えます。
そのほかの料金
- Web検索ツール:1,000回の検索あたり10ドルに加えて、検索結果の分のトークン料金がかかります
- Webページ取得ツール:追加料金はなく、取得した内容のトークン料金だけがかかります
- 米国内での推論を指定する場合:
inference_geoで米国のみを指定すると、Claude 4.6 以降のモデルではすべてのトークン料金が1.1倍になります。既定のグローバルでは通常料金です - 支払い:料金はすべて米ドル建てで、標準のアカウントでは主要なクレジットカードが使えます
利用上限(レート制限・利用ティア)の仕組み
Claude API には、使いすぎを防ぐための上限が2種類あります。レート制限の公式ドキュメントの内容を、仕組みと確認場所を中心に説明します。
2種類の上限
- 支出上限(Spend limits):組織が1か月に API で使える金額の上限です
- レート制限(Rate limits):一定時間に送れるリクエスト数やトークン数の上限です
どちらも組織単位で決まり、「利用ティア(usage tier)」によって値が変わります。
利用ティアと月の支出上限
組織は利用履歴やアカウントの状態に応じて自動的にティアに割り当てられ、使い続けるうちに上位のティアへ移っていきます。新しい組織や利用履歴の少ない組織は、標準より低い上限の「Evaluation」ティアから始まる場合があり、不正利用を防ぐための措置として説明されています。この上限は利用履歴が積み上がると自動的に引き上げられます。
標準ティアの月の支出上限は次のとおりです。
| 利用ティア | 月の支出上限 |
|---|---|
| Start | 500ドル |
| Build | 1,000ドル |
| Scale | 200,000ドル |
Scale を超える上限が必要な場合は、Custom ティアとして営業チームと個別に取り決めます。支出上限に達すると、翌月1日の0時(UTC)まで API が使えなくなり、HTTP 429 エラーが返ります。この場合はリトライしても解消しません。
これとは別に、ティアの上限より低い金額で自分たちの支出上限を設定できます。Settings > Billing の Spend limits 欄にある Adjust limit(未設定なら Set limit)から変更します。社内で予算が決まっている場合は、ここで上限をかけておくと、プログラムの不具合で大量にリクエストを送ってしまったときの被害を抑えられます。
レート制限の単位と考え方
Messages API のレート制限は、モデルごとに次の3つの単位で決まっています。
- RPM:1分あたりのリクエスト数
- ITPM:1分あたりの入力トークン数
- OTPM:1分あたりの出力トークン数
例として、Start ティアの Claude Sonnet 5 は RPM 1,000、ITPM 2,000,000、OTPM 400,000 です(2026年9月時点の公式ドキュメントの値。ティアやモデルで異なり、変更されることもあります)。
仕組みの上で知っておきたい点は次のとおりです。
- 制限は「トークンバケット方式」で、決まった時刻にリセットされるのではなく、上限まで少しずつ回復していきます。短時間に集中して送ると、1分あたりの上限内でもエラーになることがあります
- 上限を超えると 429 エラーが返り、
retry-afterヘッダーに何秒待てばよいかが示されます - 多くのモデルでは、キャッシュから読み取った入力トークンは ITPM に数えられません。プロンプトキャッシュは、料金だけでなく実質的な処理量を増やす手段にもなります
- レート制限はモデルごとに別々にかかるので、複数のモデルを使い分ければ、それぞれの上限まで同時に使えます
- 利用量が急に増えると、上限とは別の「加速制限」で 429 エラーになることがあります。本番投入の際は、少しずつ流量を増やすよう勧められています
上限の確認場所と引き上げ方
自分の組織のティアと現在の上限は、Console の Rate limits ページで確認できます。実際の利用状況は Usage ページのグラフで見られ、入力・出力トークンのレート制限に対してどれくらい余裕があるか、キャッシュがどれくらい効いているかも表示されます。上限を引き上げたい場合は、Rate limits ページの Request rate limit increase から申請します。
API のレスポンスヘッダーにも、上限と残量(anthropic-ratelimit-requests-remaining など)が含まれるので、プログラム側で残量を見ながら送信ペースを調整することもできます。
業務での使いどころの例
Claude API を業務に組み込む場面として、実務で取り入れやすいものを挙げます。いずれも、最初は人が結果を確認する運用から始め、精度を見ながら任せる範囲を広げるのが現実的です。
問い合わせの一次回答の下書き
社内のヘルプデスクや顧客からの問い合わせに対して、過去の回答例や FAQ を指示文に含め、回答の下書きを作らせる使い方です。担当者は下書きを確認・修正して送るだけになります。同じ FAQ を毎回送る構成になるので、プロンプトキャッシュとの相性がよい用途です。回答言語は、システムプロンプトで明示的に指定しておくと安定します。
文書の要約・分類
議事録、日報、アンケートの自由記述、契約書のような長い文書を要約させたり、あらかじめ決めたカテゴリーに分類させたりする使い方です。構造化出力を使えば、「カテゴリー」「要点」「対応の要否」といった項目を JSON で受け取り、そのまま社内システムに登録できます。急ぎでなければ Batch API で半額にできます。
社内ナレッジの検索と回答
社内規程やマニュアルを検索して関連する部分を取り出し、それを Claude に渡して質問に答えさせる仕組みです。引用(Citations)機能を使えば、どの文書のどの部分を根拠にしたかも示させられるので、回答が正しいかを人が確かめやすくなります。
画像・PDF の読み取り
紙の書類をスキャンした PDF や、画面のスクリーンショット、図表を読ませて内容を説明させたり、必要な項目を抜き出させたりできます。公式ドキュメントでは、小さすぎる画像や回転した画像では誤読することがある、物の個数は正確に数えられない場合がある、といった制限も示されているので、重要な数値は人が確認する運用にしてください。
コード生成・開発支援
社内ツールのコードの下書き、既存コードの説明、テストコードの作成などに使えます。開発者が手元で使うだけなら、API を自分で組み込むより Claude Code を使うほうが手軽な場合も多くあります。Claude Code の機能や始め方はClaude Codeの使い方・始め方と料金で紹介しています。
さらに一歩進めて、ツール使用を組み合わせたエージェント(自律的に複数の手順をこなす仕組み)を作りたい場合は、エージェントの実行ループを提供するClaude Agent SDKの使い方も選択肢になります。
Claude API を使うときの注意点
APIキーを漏らさない
APIキーが漏れると、第三者にあなたの組織の費用で API を使われてしまいます。公式の認証ドキュメントでは、APIキーをシークレット管理サービスに保存し、定期的に入れ替え、漏えいが疑われるキーは無効化または削除するよう求めています。実務では次の点を徹底してください。
- ソースコードにキーを直接書かず、環境変数やシークレット管理サービスから読み込みます
.envのようなキーを書いたファイルを Git にコミットしないようにします- ブラウザやスマホアプリなど、利用者の端末で動くコードにキーを埋め込まず、API はサーバー側から呼び出します
- 用途ごとにキーを分け、名前で何に使っているかを分かるようにします
- 検証用のキーには短い有効期限を設定します
漏えいが疑われるときは、Console の API keys ページでそのキーを Disable(無効化、あとで再有効化できます)または Delete(削除、元に戻せません)します。そのうえで新しいキーを発行し、使っている箇所を差し替えます。Usage ページで、身に覚えのない利用がないかも確認してください。
入力したデータの扱い
業務データを API に送る前に、データの扱いを確かめておきましょう。Anthropic のプライバシーセンターの「データはモデルの学習に使われるか」によると、Anthropic API を含む商用製品の入力・出力は、既定ではモデルの学習に使われません。例外は、フィードバックを送った場合など、利用者が明示的に共有を選んだ場合です。
保存期間については、プライバシーセンターの「組織のデータはどのくらい保存されるか」に、API の入力・出力は原則として受信または生成から30日以内にバックエンドから削除されると書かれています。ただし、利用規約に違反すると判定された場合は最長2年保存されるなどの例外があります。より厳しい要件がある場合は、ゼロデータリテンション(ZDR)の契約などが用意されていて、対象となる機能はAPI とデータ保持に関する公式ドキュメントにまとめられています。個人情報や機密情報を扱う場合は、社内の規程と照らし合わせたうえで、送る情報を必要最小限にしてください。
サブスクと API の二重課金に気をつける
見落としやすいのが、Claude Code を使っている人の二重課金です。ヘルプセンターの「Pro・Max プランで Claude Code を使う」によると、環境変数 ANTHROPIC_API_KEY が設定されていると、Claude Code はサブスクではなくその APIキーで認証し、サブスクに含まれる利用分ではなく API の従量料金が発生します。
API の検証のためにシェルの設定ファイルへ ANTHROPIC_API_KEY を書いたまま Claude Code を使うと、サブスク料金を払っているのに API 料金もかかる、という状態になりかねません。Claude Code の認証に関する公式ドキュメントによると、対話モードでは初回に APIキーを使うかどうかの確認が出ます。サブスクに戻したいときは unset ANTHROPIC_API_KEY で環境変数を外し、Claude Code の /status でどの認証方法が使われているかを確かめられます。
利用規約と出力の確認
Claude の出力は誤りを含むことがあります。特に数値や固有名詞、法律や医療に関わる内容は、人が確認してから使う運用にしてください。また、組織として本格的に導入する場合は、Anthropic の商用規約や利用ポリシーを法務担当と確認しておくと安心です。チャットを含めて社内で広く使う予定なら、Team や Enterprise といった法人向けプランもあわせて検討してください。
よくある質問
Claude API は無料で使えますか?
公式料金ページに「新規ユーザーは API を試すための少額の無料クレジットを受け取れる」と書かれていますが、金額や条件は公開されていません。毎月一定量まで無料になるような無料枠についても、公式の料金ページには記載がありません。継続的に使う場合は、Console でクレジットを購入する必要があります。企業で評価のために長めの試用をしたい場合は、営業窓口に相談するよう案内されています。
Claude Pro に入っていれば API も使えますか?
使えません。Pro・Max・Team・Enterprise の有料プランには、Claude API と Console の利用は含まれていません。API を使う場合は、Console で別に支払いの設定をします。
日本語で使えますか?
使えます。多言語対応の公式ドキュメントでは、英語の性能を100%とした場合の日本語の評価スコアが、Claude Sonnet 4.5 で96.8%、Claude Haiku 4.5 で93.5%と示されています(拡張思考を有効にした評価)。本番のアプリでは、応答言語をシステムプロンプトで明示的に指定するよう勧められています。
サブスクと API はどちらを選べばよいですか?
使う人が自分で対話しながら使うなら、月額固定のサブスクが向いています。社内システムや業務ツールに組み込み、プログラムから自動で処理させたいなら API です。両方の目的があれば両方を契約することになり、費用も別々にかかります。
1か月にいくらかかりますか?
使うモデルとトークン量で決まるので、一概には言えません。この記事の試算例(1回あたり入力2,000トークン・出力500トークン)では、Sonnet 5 で月1,000回なら約9ドルです。実際の文書でトークン数を数え、支出上限を設定したうえで小さく始めるのが確実です。
レート制限に引っかかったらどうすればよいですか?
429 エラーの retry-after ヘッダーに示された秒数だけ待ってから再送します。公式 SDK にはリトライの仕組みが組み込まれています。恒常的に足りない場合は、プロンプトキャッシュで入力トークンを減らす、モデルを分散させる、Console の Rate limits ページから上限の引き上げを申請する、といった方法があります。
まとめ
Claude API は、claude.ai のサブスクとは別契約の従量課金サービスで、Claude Console でクレジットを購入し、APIキーを発行して使います。始め方の流れは「Console のアカウント作成 → クレジット購入 → APIキー発行 → 環境変数に設定」の4ステップで、公式 SDK を使えば数行のコードで最初のリクエストを送れます。
料金は、100万トークンあたり入力1〜10ドル・出力5〜50ドルと、モデルによって幅があります。迷ったら公式推奨の Opus 5.5 で品質を確かめ、件数の多い単純な処理は Sonnet 5 や Haiku 4.5 に切り替える、急がない処理は Batch API で半額にする、繰り返し送る資料はプロンプトキャッシュで安くする、という組み合わせで費用を抑えられます。
運用を始める前に、APIキーをコードに直書きしないこと、支出上限を設定しておくこと、Claude Code を使っている人は ANTHROPIC_API_KEY による二重課金に気をつけることの3点を確認しておきましょう。まずは少額のクレジットで、自社の実際の文書や問い合わせを使って小さく試すところから始めてみてください。
// TOPICS
// RELATED








