2026年9月25日時点で、Claude API は月額固定費のない従量課金です。いちばん安い claude-haiku-4-5 が入力100万トークンあたり $1(1ドル150円換算で約150円)・出力 $5(約750円)、公式が「迷ったらこれ」と書いている claude-opus-5-5 が入力 $4(約600円)・出力 $20(約3,000円)。最初のリクエストは、コンソールでアカウントを作って API キーを 1 本発行し、curl を 1 回叩けば返ってきます。
ただし入口でつまずく人が多いのは値段ではありません。claude.ai の Pro プランを契約しても API は別会計であること、キーには 3 種類あって用途ごとに選ぶ必要があること、組織ごとに月間の支出上限(Start ティアで $500=約75,000円)とレート制限が別々にかかること。この 3 つは公式ドキュメントに書いてあるのに、日本語の入門記事ではほとんど触れられていません。
この記事は、2026年9月25日に Claude Platform の公式ドキュメントから取得した値だけを使って、Claude API の全体像・単価・始め方・上限・法人で使う前の確認事項を 1 本にまとめたものです。体験談や独自の測定値は含みません。
結論|Claude APIは従量課金、いちばん安いモデルは100万トークンあたり約150円
先に要点だけ置きます。
- 料金:入力と出力で別単価の従量課金。2026年9月25日時点の現行 4 モデルは、Fable 5.1($10/$50)、Opus 5.5($4/$20)、Sonnet 5($2/$10)、Haiku 4.5($1/$5)。すべて100万トークンあたりの米ドル建てです。
- 始め方:コンソールでアカウント作成 → キー発行 → 環境変数
ANTHROPIC_API_KEYに入れる → 公式クイックスタートのコードを実行、の 4 ステップ。SDK は Python・TypeScript・C#・Go・Java・PHP・Ruby と CLI が公式提供です。 - 上限:レート制限(毎分のリクエスト数・入力トークン数・出力トークン数)と、月間の支出上限(Start $500/Build $1,000/Scale $200,000)が別々にかかります。支出上限に当たると
retry-afterの付かない 429 が返り、翌月まで止まります。
この記事の対象読者:Claude を自社のシステムやツールに組み込もうとしている開発者・情報システム担当者・技術寄りの PM。claude.ai のチャット画面だけを使う人は、API ではなく Pro や Team のプランを見たほうが早いです。
今日やること:①コンソールでキーを 1 本作り、有効期限を「7 日」にして捨てキーで試す ②Token Counting API で自社の代表的なプロンプトのトークン数を数える ③Haiku 4.5 と Sonnet 5 の両方で同じ入力を投げ、品質差が費用差(5 倍)に見合うかを見る。
Claude APIとは|Claudeアプリ・Claude Codeとの違いを整理する
Claude API は、https://api.anthropic.com にある REST API です。公式の API 概要ページには「Claude モデルと Claude Managed Agents へのプログラムからのアクセスを提供する RESTful API」と書かれています。ブラウザで使う claude.ai とは、契約も課金も別です。

混同されやすい 3 つを並べます。数字はいずれも 2026年9月25日に公式ページから確認したものです。
| 項目 | Claude API | Claudeアプリ(claude.ai) | Claude Code |
|---|---|---|---|
| 使う人 | 開発者・システム | 個人・チームの利用者 | 開発者(ターミナル) |
| 課金 | 使ったトークン量に応じた従量課金 | 月額のプラン契約 | プラン契約か API キー |
| 価格(2026年9月25日時点) | 100万トークンあたり $1〜$50 | Free $0/Pro 月 $17(年払い・月払いは $20)/Max 月 $100 から | Pro 以上のプランに同梱 |
| 入り口 | コンソールで発行する API キー | メールアドレスでログイン | コマンドラインツール |
| 向く用途 | 自社アプリ・バッチ処理・エージェント | 調べもの・資料作成・対話 | 既存コードベースの改修 |
ここで最も多い誤解が「Pro を契約したから API も使える」というものです。公式の料金ページを見ると、個人向けプラン(Free・Pro・Max)とチーム向けプラン(Team・Enterprise)と API は別の見出しで並んでおり、相互に使い回せるとは書かれていません。API を使うなら、claude.ai とは別にコンソール(platform.claude.com)のアカウントが要ります。
逆に、チームで claude.ai を使う話であれば API ではなく Team プラン(標準シート 年払いで 1 人あたり月 $20、月払いは $25)のほうが管理は楽です。Team 相当の機能や Cowork まわりの整理はClaude Coworkの料金・使い方の解説記事にまとめてあります。
使えるモデルと単価|2026年9月25日時点の公式価格表
現行のラインアップは 4 つです。公式のモデル比較ページは「どれを使うか迷ったら、ほとんどのワークロードは Claude Opus 5.5 から始める」「難しい推論や長時間のエージェント作業、Opus 5.5 を高い effort で動かしても評価基準に届かない場合は Claude Fable 5.1」と書いています。

| モデル | API のモデル ID | 入力(100万トークン) | 出力(100万トークン) | コンテキスト | 最大出力 |
|---|---|---|---|---|---|
| Claude Fable 5.1 | claude-fable-5-1 |
$10(約1,500円) | $50(約7,500円) | 100万トークン | 12万8,000トークン |
| Claude Opus 5.5 | claude-opus-5-5 |
$4(約600円) | $20(約3,000円) | 100万トークン | 12万8,000トークン |
| Claude Sonnet 5 | claude-sonnet-5 |
$2(約300円) | $10(約1,500円) | 100万トークン | 12万8,000トークン |
| Claude Haiku 4.5 | claude-haiku-4-5 |
$1(約150円) | $5(約750円) | 20万トークン | 6万4,000トークン |
円は 1 ドル150円換算の参考値です。請求は米ドル建てなので、実際の金額は決済日のレートで変わります。
単価以外に効くのがキャッシュの読み出し単価です。同じ前置き(システムプロンプト・長い資料・ツール定義)を何度も送る使い方では、ここが総額を左右します。
| モデル | キャッシュ書き込み(5分) | キャッシュ書き込み(1時間) | キャッシュ読み出し | 基本入力に対する倍率 |
|---|---|---|---|---|
| Claude Fable 5.1 | $12.50(約1,875円) | $20(約3,000円) | $0.25(約38円) | 0.025倍 |
| Claude Opus 5.5 | $5(約750円) | $8(約1,200円) | $0.20(約30円) | 0.05倍 |
| Claude Sonnet 5 | $2.50(約375円) | $4(約600円) | $0.20(約30円) | 0.1倍 |
| Claude Haiku 4.5 | $1.25(約188円) | $2(約300円) | $0.10(約15円) | 0.1倍 |
Fable 5.1 は基本入力が Haiku 4.5 の 10 倍ですが、キャッシュ読み出しは 0.025 倍なので $0.25。一方 Haiku 4.5 のキャッシュ読み出しは $0.10 です。「高いモデルはキャッシュが効くと差が縮む」という構造になっています。キャッシュの設計はAnthropic Prompt Cachingの実装ガイドで手順を扱っています。
非同期でまとめて処理する Message Batches API を使うと、入力・出力ともに 50% 引きになります。Opus 5.5 なら $2/$10(約300円/約1,500円)、Sonnet 5 なら $1/$5(約150円/約750円)、Haiku 4.5 なら $0.50/$2.50(約75円/約375円)です。
モデル ID の扱いにも注意が要ります。公式は「4.6 世代以降で使われている日付なしの ID を含め、Claude のモデル ID はすべて固定スナップショット」と書いています。日付なし ID を「常に最新を指すエイリアス」と誤解すると設計がずれます。この落とし穴は無日付Claude IDの落とし穴を扱った記事で詳しく書きました。
始め方5手順|アカウント作成から最初の応答まで
公式のクイックスタートと API キーのページに書かれている手順をそのまま並べます。以下のコードは公式ドキュメントに掲載されている例で、当社が改変したものではありません。

手順1:コンソールのアカウントを作る。platform.claude.com にアクセスしてサインインします。claude.ai のアカウントとは別物として扱ってください。
手順2:キーの種類を決める。公式は 3 種類を挙げています。自分の開発用なら個人キー(personal key)、CI や本番サービスなど共有・自動化の用途ならサービスアカウントキー(service account key)。所有者のいないワークスペースキーは「レガシー」と明記されており、新規の連携には推奨されていません。
手順3:キーを発行する。コンソールの Settings → API keys で Create key を押し、名前・有効期限・ひも付けるアカウントを決めます。有効期限は 3 時間・1 日・7 日・30 日のプリセット、任意の期間、または「Never」から選びます。作成後に変更はできません。キーは sk-ant- で始まり、作成時に 1 回だけ全体が表示されます。見失ったら作り直しです。
手順4:環境変数に入れる。
export ANTHROPIC_API_KEY="sk-ant-api03-..."
公式 SDK はこの環境変数を自動で読みます。直接 HTTP を叩く場合は Authorization: Bearer <キー> ヘッダーに載せます(レガシーの x-api-key ヘッダーも引き続き使えます)。
手順5:最初のリクエストを投げる。公式クイックスタートの cURL の例です。
curl https://api.anthropic.com/v1/messages \
-H "content-type: application/json" \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-d '{
"model": "claude-opus-5-5",
"max_tokens": 1000,
"messages": [
{
"role": "user",
"content": "What should I search for to find the latest developments in renewable energy?"
}
]
}'
Python なら、仮想環境を作って pip install anthropic の後に次のコードです。
import anthropic
client = anthropic.Anthropic()
message = client.messages.create(
model="claude-opus-5-5",
max_tokens=1000,
messages=[
{
"role": "user",
"content": "What should I search for to find the latest developments in renewable energy?",
}
],
)
for block in message.content:
if block.type == "text":
print(block.text)
TypeScript なら npm install @anthropic-ai/sdk の後にこうなります。
import Anthropic from "@anthropic-ai/sdk";
const client = new Anthropic();
const message = await client.messages.create({
model: "claude-opus-5-5",
max_tokens: 1000,
messages: [
{
role: "user",
content: "What should I search for to find the latest developments in renewable energy?"
}
]
});
for (const block of message.content) {
if (block.type === "text") {
console.log(block.text);
}
}
応答は JSON で返り、usage に input_tokens と output_tokens が入ります。ここが課金の根拠なので、最初の 1 回から値を記録しておくと後の試算が楽です。なお anthropic-version ヘッダーは必須で、SDK 経由なら自動で付きます。
レート制限と利用ティア|Start・Build・Scaleで変わる上限
Claude API の上限は 2 種類あります。公式のレート制限ページは冒頭で「支出上限(spend limits)は組織が API に使える月額の最大コストを決める」「レート制限(rate limits)は一定時間あたりのリクエスト数の上限を決める」と、はっきり分けて説明しています。ここを混同すると障害対応を誤ります。
まず月間の支出上限です。組織は使用履歴にもとづいて自動的にティアへ割り当てられます。
| 利用ティア | 月間の支出上限 | 円換算(1ドル150円) |
|---|---|---|
| Start | $500 | 約75,000円 |
| Build | $1,000 | 約15万円 |
| Scale | $200,000 | 約3,000万円 |
| Custom | 上限なし(担当チームと個別に調整) | ― |
上限に達すると、翌月 1 日 0 時(協定世界時)まで API の利用が止まります。このとき返るのは HTTP 429 ですが、retry-after ヘッダーが付きません。SDK の自動リトライも通りません。レート制限の 429 と見分けるには、Messages API のレスポンスで error.details.error_code が enforced_spend_limit_reached かどうかを見ます。自分で上限を設定した場合は 400 番台(invalid_request_error)になります。
次にレート制限です。毎分のリクエスト数(RPM)・入力トークン数(ITPM)・出力トークン数(OTPM)がモデルごとに別枠で設定されます。
| ティア | モデル | 毎分リクエスト | 毎分入力トークン | 毎分出力トークン |
|---|---|---|---|---|
| Start | Opus 5.5/Sonnet 5/Haiku 4.5 | 1,000 | 200万 | 40万 |
| Start | Fable 5.x(5.1 と 5 の合算) | 1,000 | 50万 | 10万 |
| Build | Opus 5.5/Sonnet 5/Haiku 4.5 | 5,000 | 500万 | 100万 |
| Build | Fable 5.x(合算) | 2,000 | 150万 | 30万 |
| Scale | Opus 5.5/Sonnet 5/Haiku 4.5 | 1万 | 1,000万 | 200万 |
| Scale | Fable 5.x(合算) | 4,000 | 400万 | 80万 |
入門記事でほとんど書かれていない重要な仕様が 2 つあります。
1 つ目はキャッシュ読み出しが ITPM に数えられないことです。公式は「多くの API 事業者はキャッシュ済みも未キャッシュも合算した TPM を使うが、Claude のほとんどのモデルでは未キャッシュの入力トークンだけが ITPM に数えられる」と書き、「200万 ITPM でキャッシュヒット率 80% なら、実質的に毎分1,000万トークンの入力を処理できる」という例を挙げています(Haiku 3.5 だけは例外でキャッシュ読み出しも数えます)。キャッシュはコスト削減だけでなくスループットの拡大策でもある、ということです。
2 つ目は max_tokens の扱いです。「OTPM は実際に生成された出力トークンだけをリアルタイムに数える。max_tokens は OTPM の計算に入らないので、大きな値を設定してもレート制限上の不利はない」と明記されています。「速度制限が怖いから max_tokens を絞る」という対策は、この仕様のもとでは意味がありません。
新しい組織は、標準より低い Evaluation ティアから始まる場合があります。これは不正防止のための措置で、利用履歴が積み上がると自動的に上がる、と公式に書かれています。
APIでできること|ツール・バッチ・キャッシュ・ファイル
Claude API は「文章を生成する」だけの API ではありません。2026年9月25日時点で公式に並んでいる主な API は次のとおりです。
| API | エンドポイント | 用途 |
|---|---|---|
| Messages API | POST /v1/messages |
対話・生成の本体 |
| Message Batches API | POST /v1/messages/batches |
大量リクエストの非同期処理(50%引き) |
| Token Counting API | POST /v1/messages/count_tokens |
送信前にトークン数を数える |
| Models API | GET /v1/models |
利用できるモデルと上限の一覧取得 |
| Files API | POST /v1/files |
ファイルを一度上げて複数回使う |
| Skills API | POST /v1/skills |
独自のエージェントスキルの作成・管理 |
Agents API・Sessions API・Environments API の 3 つはベータで、Claude Managed Agents のためのものです。エージェント基盤側の考え方はClaude Managed Agentsの解説記事で扱っています。
サーバー側で動くツール(server-side tools)は追加課金が発生するものとしないものが分かれます。ここは見積もりに直結するので、公式の記載どおり整理します。
| ツール | 追加課金 | 2026年9月25日時点の公式記載 |
|---|---|---|
| Web search | あり | 1,000回の検索あたり $10(約1,500円)。検索でエラーが出た回は課金されない |
| Web fetch | なし | 取得した内容のトークン分だけ課金 |
| Code execution | 条件つき | Web search か Web fetch と併用する場合は無料。単独利用は組織あたり月1,550時間まで無料、超過分は 1 コンテナ 1 時間あたり $0.05(約7.5円) |
| Claude Managed Agents の稼働時間 | あり | セッション 1 時間あたり $0.08(約12円)。running の間だけ加算 |
クライアント側で動くツール(Bash・テキストエディタ・Computer use・Browser use・Memory)は、標準のトークン課金に加えてツール定義ぶんの入力トークンが乗ります。たとえば computer_toolset_20260801 は既定構成で約4,500トークン、browser_toolset_20260801 は約6,600トークンを入力に足す、と公式に書かれています。ツールを 1 つでも渡すと、モデルごとのツール用システムプロンプト(Opus 5.5 で286トークン、Sonnet 5 で354トークン)も加算されます。
文脈管理の機能も充実しています。5 分/1 時間のプロンプトキャッシュ、自動キャッシュ、トークン閾値での自動要約(compaction・ベータ)、文脈編集(context editing・ベータ)、トークンカウント。長い資料を扱うならFiles APIで file_id を使い回す方法も合わせて検討してください。リクエストのサイズ上限は Messages と Token Counting が 32 MB、Message Batches が 256 MB、Files API が 500 MB です。
費用試算3例|1ドル150円換算で月いくらになるか
ここから先は試算例です。公式の単価と、前提として置いたトークン数から計算したもので、実測値ではありません。自社の値に置き換えて使ってください。

試算1:社内FAQボット(Haiku 4.5)。1 日500リクエスト・20営業日、1 リクエストあたり入力2,000トークン・出力300トークンと仮定します。
| 項目 | 計算 | 金額 |
|---|---|---|
| 入力 | 2,000万トークン × $1 ÷ 100万 | $20(約3,000円) |
| 出力 | 300万トークン × $5 ÷ 100万 | $15(約2,250円) |
| 合計 | ― | $35(約5,250円) |
試算2:長文資料の要約(Sonnet 5)とキャッシュの効果。1 日100件・20営業日、入力5万トークン・出力2,000トークン。うち 4 万トークンが毎回同じ前置き(社内規程や様式の説明)だとします。
| 方式 | 内訳 | 月額 |
|---|---|---|
| キャッシュなし | 入力1億トークン $200 + 出力400万トークン $40 | $240(約36,000円) |
| キャッシュあり | 書き込み1,600万トークン $40 + 読み出し6,400万トークン $12.80 + 未キャッシュ入力2,000万トークン $40 + 出力 $40 | $132.80(約19,920円) |
キャッシュありの前提は、5 分キャッシュを 1 日20回書き直し(残り1,600回が読み出し)です。この条件では約45%の削減になり、同時に ITPM に数えられる入力も 1 億トークンから2,000万トークンへ減ります。費用とスループットの両方が同時に改善するのが、キャッシュを最初に検討すべき理由です。
試算3:問い合わせ分類1万件のバッチ処理(Haiku 4.5)。1 件あたり入力1,500トークン・出力200トークン。
| 方式 | 入力 | 出力 | 合計 |
|---|---|---|---|
| Messages API(同期) | 1,500万トークン $15 | 200万トークン $10 | $25(約3,750円) |
| Message Batches API | $7.50 | $5 | $12.50(約1,875円) |
公式の料金ページにも近い試算例が載っています。「1 万件のサポートチケットを処理する場合、1 会話あたり平均約3,700トークン、Haiku 4.5(入力 $1/出力 $5)で合計およそ $37.00」という記載です。桁感の確認に使えます。
見積もりを外さないコツは 2 つ。①POST /v1/messages/count_tokens で自社の代表プロンプトを実測してから掛け算する ②出力トークンは入力の 5 倍単価であることを忘れず、出力を短くする指示を先に入れる。キャッシュ全般の考え方はプロンプトキャッシュ実装ガイドで ChatGPT 側の実装と並べて整理しています。
2026年9月に変わった3点|入口の実装でも踏む
入門記事は情報が古くなりやすい領域です。公式のリリースノートから、今月中に起きた変更のうち最初の実装でも当たるものを 3 つ挙げます。
変更1:9月22日に Claude Opus 5.5 が公開され、標準の推奨モデルが変わった。単価は $4/$20 で、Opus 5($5/$25)より下がりました。同時に、このモデルでは thinking: {"type": "disabled"} も thinking: {"type": "enabled", ...} も 400 エラーになります。thinking フィールドは省略し、思考の深さは effort パラメータで指定する設計です。tool_choice の any と tool も 400 になるため、auto と strict tool use の組み合わせに書き換えます。古い記事のコードをそのまま claude-opus-5-5 に向けると、ここで止まります。世代をまたぐ移行の勘どころはClaude Fable 5.1 API移行ガイドと共通です。
変更2:Claude Sonnet 5 の $2/$10 が恒久価格になった。料金ページの注記に「発表時は2026年8月31日までの導入価格とされていたが、現在は標準価格。2026年9月1日に予定されていた $3/$15 への引き上げは実施されない」と書かれています。2026年夏までに書かれた日本語記事の多くは Sonnet 5 を「$3/$15」と記載しているので、見積もりを作り直す価値があります。経緯はSonnet 5料金恒久化の記事にまとめました。
変更3:9月24日から、一部カテゴリの拒否応答が課金対象に広がった。リリースノートには「stop_details.category が bio・frontier_llm・reasoning_extraction の場合、出力が 1 文字も出る前に返る拒否も課金対象に含める」とあります。生成途中の拒否はもともと課金対象でした。それ以外のカテゴリの「出力前の拒否」は引き続き課金されません。安全性フィルタに当たりやすい題材を扱うなら、請求の内訳が読めるようにログを残しておくべきです。
あわせて 9月23日にはキャッシュ診断(cache diagnostics)がベータを抜け、cache-diagnosis-2026-04-07 ヘッダーなしで使えるようになりました。リクエストに diagnostics オブジェクトを入れると、キャッシュがなぜ当たらなかったかを調べられます。
法人で使う前に決める4点|データの扱いと鍵の管理
ここは稟議で必ず聞かれる部分です。公式ドキュメントの記載だけで答えられる範囲を整理します。

1:学習利用。「API and data retention」のページには「保持されたデータが、あなたの明示的な許可なしにモデルの学習に使われることはない」と書かれています。claude.ai の Team・Enterprise プランについても、料金ページの機能比較表で「Model training: None by default(既定で学習利用なし)」と明記されています。
2:保持期間。同じページに「会話の内容(プロンプトと Claude の出力)は既定では保持されない。例外は Covered Models で、30 日の保持が必要」とあります。ここで言う Covered Models は Fable 5.1・Mythos 5.1・Fable 5・Mythos 5 で、これらは明示的な許可がない限りゼロデータ保持(ZDR)の対象外です。「最上位モデルを ZDR で」という要件がある場合は、契約前に確認が要ります。
3:ZDR と HIPAA。ZDR は組織単位で、営業チームへの申請で有効化されます。対象はメッセージ API とトークンカウント API の適格な機能、そして商用組織の API キーで使う Claude Code。対象外はコンソール(プレイグラウンド含む)、Claude Managed Agents、Free・Pro・Max の個人向けプラン、Claude for Excel、そしてコード実行ツールです。ZDR の組織では CORS が使えないため、ブラウザから直接 API を呼ぶ構成は取れず、バックエンド経由にする必要がある点も明記されています。医療情報を扱うなら ZDR ではなく HIPAA readiness(BAA 締結)が正しい選択肢である、とも書かれています。
4:鍵の設計。キーの 3 種類は「誰として振る舞うか」と「いつ止まるか」で分かれます。
| キーの種類 | 誰として動くか | 止まる条件 | 使いどころ |
|---|---|---|---|
| 個人キー | 発行した本人の権限 | 本人が組織から外れたとき(アーカイブされ復活しない) | 自分の開発・検証 |
| サービスアカウントキー | サービスアカウント | サービスアカウントがアーカイブされたとき | CI・本番サービス・エージェント |
| ワークスペースキー(レガシー) | 誰でもない(ワークスペース所属) | 期限切れ・無効化・削除・ワークスペースのアーカイブ | 新規では非推奨 |
共有用途に個人キーを使うと、その人の退職でシステムが止まります。公式が「共有・無人のワークロードには、管理者にサービスアカウントを作ってもらい、そのワークロード自身の ID を持たせる」と書いているのはこのためです。長期の鍵そのものを環境から無くしたい場合は、AWS IAM・Google Cloud・GitHub Actions・Kubernetes・Okta などの ID プロバイダーで短命トークンを発行する Workload Identity Federation という選択肢もあります。
なお、既存のクラウド契約に寄せたい場合は Amazon Bedrock・Google Cloud・Claude Platform on AWS・Microsoft Foundry 経由という道もあります。請求と IAM が統合される代わりに、機能の提供時期はプラットフォームごとに異なります。この選択はBedrock・Vertex・Foundryで使う手順の記事で比較しています。
よくある失敗4つ|❌と⭕で直す
失敗1:claude.ai の Pro を契約すれば API も使えると思っている
❌ Pro(月 $17〜$20)に入ったのに API キーが見つからない、と探し回る。
⭕ API はコンソール(platform.claude.com)で別にアカウントを作り、従量課金で使う。claude.ai のプランと API の請求は別建てです。
失敗2:API キーをフロントエンドのコードに埋める
❌ ブラウザから api.anthropic.com を直接呼ぶ実装にして、鍵が配信物に混ざる。
⭕ 自社のバックエンド経由にする。公式も ZDR 組織では CORS を使えないため「ブラウザからの呼び出しはバックエンドのプロキシ経由にする」と書いています。鍵はシークレットマネージャに置き、作成時に有効期限を設定して漏えい時の有効時間を短くします。
失敗3:古い記事のコードをそのまま最新モデルに向ける
❌ thinking を明示的に無効化するコードを claude-opus-5-5 に送り、400 エラーで止まる。
⭕ thinking は省略し、effort で深さを指定する。tool_choice は auto にして strict tool use を併用します。モデルを上げる日は、必ずリリースノートと移行ガイドを先に読むのが安全です。
失敗4:レート制限を避けるために max_tokens を小さくする
❌ 「出力上限を下げれば毎分の制限に当たりにくい」と考えて 500 などに絞り、応答が途中で切れる。
⭕ OTPM は実際に生成された出力トークンだけを数えます。公式は「max_tokens は OTPM の計算に入らないので、大きな値を設定してもレート制限上の不利はない」と明記しています。毎分の入力側を減らしたいなら、max_tokens ではなくプロンプトキャッシュに手を入れるのが正解です。
よくある質問
Claude APIは無料で使えますか?
公式の料金ページの FAQ には「新規ユーザーは API を試すための少額の無料クレジットを受け取る」と書かれています。恒常的な無料枠については、2026年9月25日時点で公式に記載がありません。企業評価のための延長トライアルは営業チームへの問い合わせ扱いです。
Claude APIとAnthropic APIは違うものですか?
同じものです。公式ドキュメントは「Claude API のための API キー(Anthropic API キーとも呼ばれる)」という書き方をしています。エンドポイントも api.anthropic.com のままです。
APIキーはどこで取得しますか?
コンソールの Settings → API keys です。Create key で名前・有効期限・ひも付けるアカウントを決めます。全体が表示されるのは作成時の 1 回だけなので、その場でシークレットマネージャに保存してください。ボタンが押せない場合は、権限が足りない可能性があります(組織の管理者に役割の変更を依頼します)。
料金はどこで確認できますか?
コンソールの Usage ページで使用量、Billing ページで請求と支出上限を確認できます。レート制限の状況は Settings の Rate limits ページ、またはレスポンスヘッダーから読み取れます。公式の説明では「請求は実際の月間使用量にもとづく」「支払いはすべて米ドル」「クレジットカードと請求書払いに対応」とされています。
どのモデルを選べばいいですか?
公式のモデル比較ページは「迷ったらほとんどのワークロードは Claude Opus 5.5 から」と書いています。費用を最優先するなら Haiku 4.5、速度と知能のバランスなら Sonnet 5、難しい推論や長時間のエージェント作業なら Fable 5.1 です。まず Sonnet 5 と Haiku 4.5 で同じ入力を投げ、品質差が 2 倍の単価差に見合うかを見るのが現実的な決め方です。
日本語はトークンを多く消費しますか?
公式は「1 トークンはおおよそ英語 4 文字、0.75 語」とだけ書いており、日本語の倍率は 2026年9月25日時点で公式に記載がありません。推測で見積もらず、POST /v1/messages/count_tokens に実際の日本語プロンプトを投げて数えてください。なお 4.7 世代以降のモデルは新しいトークナイザーを使っており、公式は「同じテキストで約30%多いトークンを生成する」と説明しています。Sonnet 4.6 以前は旧トークナイザーです。
コンテキストは100万トークンまで使えますか?
Fable 5.1・Opus 5.5・Sonnet 5 は 100万トークン、Haiku 4.5 は 20万トークンです。長いコンテキストの追加料金について、公式は「4.6 世代以降のモデルは 100万トークンのコンテキストを標準価格で含む(90万トークンのリクエストも 9,000 トークンのリクエストと同じ単価)」と書いています。
レート制限に当たったらどうすればいいですか?
429 と retry-after ヘッダーが返るので、その秒数だけ待って再試行します。ただし月間の支出上限に当たった 429 には retry-after が付かず、再試行しても通りません。error.details.error_code が enforced_spend_limit_reached かどうかで切り分けてください。急な増量でも 429 が出ることがあるため、公式は「トラフィックは段階的に増やす」ことを勧めています。
キーに有効期限は設定できますか?
作成時に 3 時間・1 日・7 日・30 日のプリセット、任意の期間、または「Never」から選べます。後から変更はできません。期限が近づくと作成者にメールが届きます(14 日以上の鍵は 7 日前、7 日以上の鍵は 1 日前)。期限切れの鍵で叩くと 401 になり、再有効化はできません。
Claude Codeのぶんも同じレート制限に入りますか?
公式のレート制限ページには「Claude Code ワークスペースの上限は別に判定される。そのワークスペースの上限を超えた Claude Code のリクエストは、retry-after ヘッダー付きの 429 を受け取ることがある」と書かれています。アプリ側のトラフィックと分けて管理する設計になっています。
バッチ処理とキャッシュの割引は重ねられますか?
公式 FAQ に「Batch API とプロンプトキャッシュの割引は組み合わせられる」と明記されています。キャッシュの倍率はバッチの 50%引きやデータ所在地の倍率と掛け合わさる、という説明です。
運営元 Uravation よりAIエージェントを構想から本番運用まで進める順番と、体制・KPIの決め方をまとめた資料を無料で公開しています。 AIエージェント導入ロードマップを受け取る(無料)
参考・出典
- Claude Platform Docs「Get started with Claude」(参照日 2026年9月25日)
- Claude Platform Docs「Models overview」(参照日 2026年9月25日)
- Claude Platform Docs「Pricing」(参照日 2026年9月25日)
- Claude Platform Docs「Rate limits」(参照日 2026年9月25日)
- Claude Platform Docs「API overview」(参照日 2026年9月25日)
- Claude Platform Docs「Get your Claude API key」(参照日 2026年9月25日)
- Claude Platform Docs「Authentication」(参照日 2026年9月25日)
- Claude Platform Docs「API and data retention」(参照日 2026年9月25日)
- Claude Platform Docs「Features overview」(参照日 2026年9月25日)
- Claude Platform Docs「Claude Platform release notes」2026年9月22日・23日・24日の項(参照日 2026年9月25日)
- Claude「Pricing」個人・チーム・API の料金ページ(参照日 2026年9月25日)
- Claude Platform Docs 日本語版「Claude を使い始める」(参照日 2026年9月25日)
まとめ|今日やる3つ
Claude API は「Claude をプログラムから呼ぶための従量課金の窓口」です。月額固定費はなく、入口の費用は 100万トークンあたり約150円から。難しいのは値段ではなく、claude.ai との会計の分離・キーの設計・2 種類の上限という、公式には書かれているのに日本語では流通していない部分でした。
- 有効期限 7 日のキーで試す。コンソールで個人キーを 1 本作り、公式クイックスタートの
curlをそのまま叩く。ここまでなら 30 分かかりません。 - 自社のプロンプトをトークンで測る。
POST /v1/messages/count_tokensに実際の日本語プロンプトを投げ、その数字で試算する。日本語の倍率を推測で置かないのが、見積もりを外さない最大のコツです。 - 本番に出す前に鍵と上限を決める。共有用途はサービスアカウントキーに、月間の支出上限は自分で低めに設定し、ZDR や HIPAA が要るかを法務と先に握る。ここを後回しにすると作り直しになります。
2026年9月25日時点で公式に記載がないのは、日本語のトークン倍率、恒常的な無料枠の有無、Fable 5.1 を ZDR で使う条件の詳細(営業チームとの個別調整)の 3 点です。判明した時点でこの記事に追記します。
この記事を読んで導入イメージが固まってきた方へ
UravationではAIエージェント導入の研修・コンサルを行っています。
記事中の料金・仕様・上限は 2026年9月25日に上記の公式ページから確認した値です。円換算は 1 ドル150円で計算した参考値で、請求は米ドル建てです。費用試算は公式の単価と記事中に明記した前提から計算したもので、実測値ではありません。仕様は変わることがあるため、実装前に必ず公式ページで最新の値を確認してください。
