Craft AI Modules の AIトークンとコスト
Craft AI ModulesおよびCraft RAGの利用コストは、AIモデルの使用量に応じてAIトークンという共通の単位で計算されます。このページでは、コスト計算の仕組みと各モデルのコストについて説明します。
利用可能なモデルの一覧については、利用可能なモデル一覧をご確認ください。
AIトークンとは
Section titled “AIトークンとは”AIトークンは、Craft AI ModulesおよびCraft RAGにおけるコスト計算の共通の基準単位です。
- 契約プランに応じて月間AIトークン消費量の上限が設けられています。Craft AI ModulesのAPI利用に加え、Craft RAG経由のLLM呼び出しやRerank・Embeddingなども、同じ月間上限にカウントされます
- 利用する機能やモデルによって、消費するAIトークン数のレート(AIトークンレート)が異なります
- 各モデルの利用コストは、プロバイダのコスト(USD)をAIトークンに換算して計算されます
たとえばAIトークンレートが入力3、出力25のモデルがあった場合、10,000トークンのテキスト入力と2,000トークンのテキスト出力をすると次のように計算されます。
-
入力のAIトークン数
- 計算:3 × 10,000 = 30,000 AIトークン
-
出力のAIトークン数
- 計算:25 × 2,000 = 50,000 AIトークン
-
合計AIトークン数
- 30,000 + 50,000 = 80,000 AIトークン
トークン数について
Section titled “トークン数について”AIモデルで処理される入力・出力のトークン数は、Vertex AI側の仕様に準拠します。詳しくはVertex AIのドキュメントをご確認ください。
Vertex AI Platform のコスト
Section titled “Vertex AI Platform のコスト”Geminiモデル
Section titled “Geminiモデル”| モデル | 項目 | AIトークンレート | AIトークン単位 |
|---|---|---|---|
| Gemini 2.5 Flash Lite | 入力(テキスト、画像、動画)(1M Token) | 1 | トークン |
| Gemini 2.5 Flash Lite | テキスト出力(回答と推論)(1M Token) | 4 | トークン |
| Gemini 2.5 Flash | 入力(テキスト、画像、動画)(1M Token) | 3 | トークン |
| Gemini 2.5 Flash | テキスト出力(1M Token) | 25 | トークン |
| Gemini 2.5 Pro | 入力(テキスト、画像、動画、音声)≤0.2M Token | 12.5 | トークン |
| Gemini 2.5 Pro | 入力(テキスト、画像、動画、音声)>0.2M Token | 25 | トークン |
| Gemini 2.5 Pro | テキスト出力(回答と推論)≤0.2M Token | 100 | トークン |
| Gemini 2.5 Pro | テキスト出力(回答と推論)>0.2M Token | 150 | トークン |
| Gemini 3 Flash Preview | 入力(テキスト、画像、動画) | 5 | トークン |
| Gemini 3 Flash Preview | 入力(音声) | 10 | トークン |
| Gemini 3 Flash Preview | テキスト出力(回答と推論) | 30 | トークン |
| Gemini 3.1 Pro Preview | 入力(テキスト、画像、動画、音声)≤0.2M Token | 20 | トークン |
| Gemini 3.1 Pro Preview | 入力(テキスト、画像、動画、音声)>0.2M Token | 40 | トークン |
| Gemini 3.1 Pro Preview | テキスト出力(回答と推論)≤0.2M Token | 120 | トークン |
| Gemini 3.1 Pro Preview | テキスト出力(回答と推論)>0.2M Token | 180 | トークン |
| Gemini 3.1 Flash-Lite Preview | 入力(テキスト、画像、動画) | 2.5 | トークン |
| Gemini 3.1 Flash-Lite Preview | 入力(音声) | 5 | トークン |
| Gemini 3.1 Flash-Lite Preview | テキスト出力(回答と推論) | 15 | トークン |
| Gemini 3.5 Flash | 入力(テキスト、画像、動画、音声) | 15 | トークン |
| Gemini 3.5 Flash | テキスト出力(回答と推論) | 90 | トークン |
| Gemini 3.1 Flash Lite | 入力(テキスト、画像、動画) | 2.5 | トークン |
| Gemini 3.1 Flash Lite | 入力(音声) | 5 | トークン |
| Gemini 3.1 Flash Lite | テキスト出力(回答と推論) | 15 | トークン |
Embeddingモデル
Section titled “Embeddingモデル”Embeddingで計上されるAIトークンは、入力テキスト(または画像)のみが課金対象です。生成されるベクトルに対する課金はありません。
Gemini Embeddings
Section titled “Gemini Embeddings”| 項目 | AIトークンレート | AIトークン単位 |
|---|---|---|
| 入力(1,000個の入力トークン) | 1.5 | トークン |
Text Embeddings
Section titled “Text Embeddings”| 項目 | AIトークンレート | AIトークン単位 |
|---|---|---|
| 入力(1,000文字) | 0.5 | 文字 |
Multimodal エンベディング
Section titled “Multimodal エンベディング”| 項目 | AIトークンレート | AIトークン単位 |
|---|---|---|
| テキスト(入力1,000文字) | 4 | 文字 |
| 画像(画像入力) | 1000 | 画像1枚 |
Rerank
Section titled “Rerank”ランキング専用モデル(Rank Service)によるRerankは、コンテンツ生成のトークンとは別に、Rerank API の呼び出しごとにAIトークンが計上されます。
| 項目 | AIトークンレート | AIトークン単位 |
|---|---|---|
| ドキュメントのランク付け | 10,000 | 1クエリ |
クエリの数え方
Section titled “クエリの数え方”1回のRerank呼び出しでは、並び替えの対象数でクエリのカウントおよびAIトークンの消費量が決まります。
- 100件以下 → 1クエリ(10,000 AIトークン)
- 101件以上 → 100件ごとに1クエリ追加
下の計算式では、この件数を「並べ替えるドキュメント数」と呼んでいます。
1回の呼び出しのクエリ数 = ⌈ 並べ替えるドキュメント数 ÷ 100 ⌉(小数点以下切り上げ)1回の呼び出しの AIトークン = クエリ数 × 10,000呼び出し1回あたりの例
| 並べ替えるドキュメント数 | クエリ数 | AIトークン |
|---|---|---|
| 100 | 1 | 10,000 |
| 132 | 2 | 20,000 |
| 401 | 5 | 50,000 |
会話シナリオ別の消費量の目安
Section titled “会話シナリオ別の消費量の目安”代表的な会話シナリオごとのトークン消費量と、月間ボリューム別の目安は次のページをご確認ください。
- Craft AI Modules利用時のAIトークン消費量の目安 — API単体の利用パターン
- Craft RAG利用時のAIトークン消費量の目安 — Craft RAGと組み合わせた会話シナリオ
料金の計算元となるプロバイダの料金については、次の公式ドキュメントをご確認ください。
- Gemini、Embeddingモデルの料金:Vertex AI での AI モデルの構築とデプロイの費用 | Google Cloud
- Rerankの料金:Vertex AI Search の料金 | Google Cloud