Pricing
AICU API is operated by AICU Inc. All prices are in USD. Usage is billed in prepaid credits called AP (AICU Points): 1 USD = 10,000 AP.
- Prepaid, budget-safe: you buy credits up front; when they run out, calls stop. No surprise bills.
- Errors are never billed. Only successful (HTTP 200) responses consume credits.
- Cache hits are free. Repeating the same input costs nothing when the cache can serve it.
- During the alpha/beta period, new accounts receive free trial credits (daily login bonus + first-use bonus) — you can evaluate every API below without payment. Credit purchase opens with the public beta on the dashboard.
Business customers who need a Japanese qualified invoice (適格請求書) can purchase via our reseller AICU Japan K.K. — contact info@aicu.jp.
Text to Speech — /v1/audio/speech
High-quality character voices (AiCuty) with Japanese pronunciation enhancement, plus raw ElevenLabs voice passthrough.
| Metric | Rate |
|---|---|
| 音声合成 | 入力テキスト 1,000 文字あたり(音声の長さではありません)。2026年9月9日から 1,000 文字 200 AP。毎週水曜に、あらかじめ告知した曲線で上がり、2027年4月7日に 2,475 AP になります |
| Models | eleven_multilingual_v2 (default, up to 10,000 chars/request) / eleven_v3 (expressive tags, up to 5,000 chars) |
Estimate before you call: POST /v1/tts/estimate.
LLM Chat — /v1/chat/completions
OpenAI 互換。単価は 1,000 トークンあたり(2026-08-18 時点。画像・音声を含む全モデルと単価の正本は GET /v1/models。各エントリに pricing・docs_url・updated_at が付きます):
| Model | USD / 1K tokens | AP / 1K tokens |
|---|---|---|
| groq-llama-3.3-70b | Free (alpha) | 0 |
| groq-llama-3.1-8b | Free (alpha) | 0 |
| llama-3.1-8b | $0.0002 | 2 |
| gpt-5-nano / qwen3-32b | $0.0005 | 5 |
| gemini-flash / llama-3.1-70b | $0.0006 | 6 |
| gpt-4o-mini | $0.0008 | 8 |
| deepseek-v3 / gpt-5.4-nano | $0.0014 | 14 |
| gpt-5-mini | $0.0023 | 23 |
| gpt-5.4-mini | $0.005 | 50 |
| sakura-kimi / gpt-5.6-luna | $0.006 | 60 |
| gemini-3.6-flash | $0.009 | 90 |
| kimi-k2.7-code | $0.0101 | 101 |
| gpt-5 | $0.0113 | 113 |
| gpt-4o | $0.0132 | 132 |
| gpt-5.6-terra | $0.016 | 160 |
| gpt-5.6-sol | $0.03 | 300 |
画像生成 — /v1/images/generations
参照画像でキャラクターの一貫性を保った生成。料金はモデル・quality・出力サイズで決まります
(プロンプトの長さでは変わりません)。
以下は gpt-image-2.5-flare での実測値(2026-09-21)です。1 回ごとの正確な額は、
レスポンスの X-AICU-AP-Cost ヘッダで必ず取得できます。
quality(1024×1024) | AP | 目安 | 生成時間 |
|---|---|---|---|
low | 700 | $0.07 | 10 秒 |
medium | 1,600 | $0.16 | 12 秒 |
high | 6,400 | $0.64 | 22 秒 |
xhigh | 11,400 | $1.14 | 24 秒 |
max | 25,600 | $2.56 | 41 秒 |
サイズは連続ではなく**段階(きざみ)**で効きます。medium の場合:
| サイズ | 画素数 | AP |
|---|---|---|
| 1024×1024 | 1.05 M | 1,600 |
| 1536×1024 | 1.57 M | 2,300 |
| 1920×1088 | 2.09 M | 2,300 |
絶対額では正方形がいちばん安いです。横長は 1 枚あたりは高くなりますが 1 画素あたりは安く、
1536×1024 と 1920×1088 は同じきざみなので、横長にするなら大きいほうを取るのが得です。
ただし high 以上では逆転し、正方形でないほうが安くなります
(high 5,100 対 6,400 / xhigh 9,200 対 11,400 / max 20,400 対 25,600)。
60 秒を超える生成について
60 秒以上かかる生成があります。 高い品質設定(xhigh / max)、参照画像つき、大きいサイズです。
アプリの中でそのまま待つ用途には向いていません。 多くの HTTP クライアントは 30〜60 秒で 接続を諦めますし、Cloudflare のエッジも 100 秒で切ります。
60 秒を超えた生成の結果は、メールでお届けします(画像を添付。鍵の所有者宛。notify_email を
指定すればその宛先にも)。"notify_on_timeout": false で辞退できますが、受け取る手段が 1 つ減ります。
その場合は応答の id(または X-AICU-Image-Id ヘッダ)を控えて、
GET /v1/images/status/{id} で回収してください。
その場で画像を表示するアプリに組み込むなら、quality は low / medium / high、
サイズは 1024x1024 にしてください。所要時間は GET /v1/images/models の
typical_latency_s_by_quality で、叩く前に分かります。
動画生成は最初から非同期です。POST /v1/video/generate が 202 と id を返し、
GET /v1/video/status/{id} で取りに行きます。
xhigh と max は、同期のリクエストが耐えられる時間を超えます。
下の「60 秒を超える生成について」を参照してください。
ほかのモデル: gpt-image-2(同等設定では 2.5 系より高く遅い)、gpt-image-2.5-sunburst
(編集制御が細かく生成は長め)、nano-banana(高速・aspect_ratio 対応)、sd3.5-large。
最新の一覧は GET /v1/images/models。
Transcription — /v1/audio/transcriptions
Whisper-based speech-to-text (whisper-large-v3-turbo), OpenAI-compatible: prompt for proper nouns, verbose_json timestamps, srt / vtt output. Up to 30 MB / 30 minutes per request. Agent-readable spec: https://api.aicu.ai/skills/stt
| Metric | Rate |
|---|---|
| Audio transcription (until 2026-09-09 05:00 UTC) | 1 AP per 10 seconds of audio (rounded up) — 1 hour ≈ 360 AP ≈ $0.04 |
| Audio transcription (from 2026-09-09 05:00 UTC) | 3 AP per 10 seconds of audio — 1 hour ≈ 1,080 AP ≈ $0.11 (notice, cost×3 policy) |
response_format=verbose_json のときは実測の duration で課金します。それ以外の形式には duration が無いので、受け取った音声の長さからの見積もりと、文字起こしの文字数からの見積もりのうち、大きいほうで課金します。課金額は毎回 X-AICU-AP-Cost ヘッダで返ります。
料金がどう計算されるか
チャット補完では、**上流モデルを呼ぶ前に多めの金額を予約し、応答が返ったら実額に精算して 差額を返金します。**返金先は引いたところと同じです(TAP から引いた分は TAP へ戻ります)。 残高が一時的に多めに減って、直後に戻るのはこのためで、異常ではありません。
予約額は「入力の見積もり + 出力の上限」を、その時点のモデル単価で AP に換算した値です。
| 部分 | 見積もり方 |
|---|---|
| 入力 | リクエスト本文(messages と tools)の UTF-8 バイト数をトークン数とみなします。GPT 系はバイト単位の BPE なので、実際のトークン数がバイト数を超えることはありません(必ず多めに出ます)。画像は 1 枚 20,000 トークン換算・1 リクエスト 20 枚まで |
| 出力 | max_tokens を使い切った場合。省略時はそのモデルの上限 |
精算では、応答が完了した時点で予約を実際の使用量に置き換えます。ストリームで usage が 取得できなかった場合のみ、実際に出力された文字列の UTF-8 バイト数から見積もり、 予約額を上限として請求します。
予約額より多く請求されることはありません。 1 回の呼び出しの確定額は、レスポンスの
X-AICU-AP-Cost ヘッダが正本です。
実務上の注意が 2 つあります。
- **
max_tokensを省略すると、そのモデルの上限を使い切った前提になるため、予約額がいちばん 大きくなります。**現実的な値を指定すると予約額が下がり、残高が少ないときに大きな要求が402 insufficient_apで弾かれにくくなります。残高が少ないときはmax_tokensを明示するのが、 実用上いちばん効きます - 画像生成は予約ではなく、上記の固定の 1 回あたり価格で課金されます
How to buy
- Sign in at api.aicu.ai/dashboard (email OTP — an account is created on first sign-in)
- Get your API key at dashboard/keys
- Purchase credits on the dashboard billing page (opens with public beta; alpha accounts run on free trial credits)
Payments are processed by Stripe. Terms: Terms of Service / Privacy Policy.
料金(日本語)
AICU API は AICU Inc. が運営しています。表示価格は USD 建てで、利用は前払いクレジット AP(1 USD = 10,000 AP)で課金されます。
- 前払い・予算化できる: 使い切ればそこで止まる。想定外の請求はありません
- エラーは課金されません(200 応答のみ課金)
- キャッシュヒットは無料(同じ入力の再実行)
- アルファ/ベータ期間中は無償のお試しクレジット(ログインボーナス・初回利用ボーナス)で全 API を評価できます
主な単価: 音声合成 = 1,000 文字 200 AP(2026年9月9日時点。毎週水曜に告知済みの曲線で改定)・LLM = 上表のモデル別単価(最新は GET /v1/chat/models)・画像生成 = 1 枚 700 AP 〜(gpt-image-2.5-flare・quality: low・1024×1024)。
適格請求書(インボイス)が必要な事業者様は、リセラーの AICU Japan 株式会社(info@aicu.jp)経由でご購入ください。