メインコンテンツまでスキップ

AICU LLM API Documentation

OpenAI互換のチャット補完API。API キー(Bearer 認証)が必須です。ダッシュボードで aicu_live_ キーを発行してください。

Base URL​

https://api.aicu.ai/v1

Quick Start​

curl -X POST https://api.aicu.ai/v1/chat/completions \
-H "Authorization: Bearer $AICU_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v3",
"messages": [{"role": "user", "content": "Hello!"}],
"max_tokens": 100
}'

🖼️ 画像入力(Vision)にも対応しています。content を配列にして image_url を渡すだけ → Vision ガイド


POST /v1/chat/completions​

OpenAI互換のチャット補完エンドポイント。

Request:

{
"model": "deepseek-v3",
"messages": [
{"role": "system", "content": "You are a helpful assistant."},
{"role": "user", "content": "Hello!"}
],
"max_tokens": 1000,
"temperature": 0.7,
"stream": false
}

Parameters:

NameTypeRequiredDescription
modelstringYesモデルID
messagesarrayYesメッセージ配列
max_tokensnumberNo最大トークン数 (default: 4096)
temperaturenumberNoサンプリング温度 0-2 (default: 1)
streambooleanNoストリーミング (default: false)

Response:

{
"id": "gen-xxx",
"object": "chat.completion",
"created": 1234567890,
"model": "deepseek-v3",
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "Hello! How can I help you today?"
},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 10,
"completion_tokens": 15,
"total_tokens": 25
}
}

Response Headers:

  • X-AICU-Model: 使用モデル
  • X-AICU-Provider: プロバイダ (openrouter/groq/aicu)
  • X-AICU-Tokens: 消費トークン数
  • X-AICU-AP-Cost: AP消費
  • X-AICU-Latency-Ms: レイテンシ

GET /v1/models — 全モデルを 1 つの一覧で​

GET /v1/models は、プラットフォームが提供する全モデル(チャット・画像・音声合成 tts・文字起こし stt)の正本です。全エントリが同じ形で、type、叩くエンドポイント、stage、単位を明記した pricing、docs_url、pricing_url、updated_at を持ちます。一覧の封筒には docs・pricing_url・最新の updated_at が付きます。GET /v1/models/:id は 1 件を返します(OpenAI 形式の retrieve。flare のような画像の別名も可)。

curl https://api.aicu.ai/v1/models # 全部
curl https://api.aicu.ai/v1/models/deepseek-v3
{
"object": "list",
"docs": "https://api.aicu.ai/docs",
"pricing_url": "https://api.aicu.ai/docs/pricing",
"updated_at": "2026-09-11",
"data": [
{ "id": "deepseek-v3", "type": "chat", "endpoint": "POST /v1/chat/completions", "stage": "beta",
"pricing": { "unit": "per_1k_tokens", "ap_in_per_1k": 9, "usd_in_per_1k": 0.0009, "ap_out_per_1k": 27, "usd_out_per_1k": 0.0027 },
"docs_url": "https://api.aicu.ai/docs/llm-api", "updated_at": "2026-08-01" },
{ "id": "gpt-image-2.5-flare", "type": "image", "endpoint": "POST /v1/images/generations",
"pricing": { "unit": "per_image", "ap_from": 700, "ap_by_size_quality": { "1024x1024": { "low": 700, "medium": 1600, "high": 6400 } } } }
]
}

stage は本番開始(2026-09-23)まで beta、以後 production。preview はまだ変更しうるモデルです。

GET /v1/chat/models​

同じ配列を type=chat で絞り込んだもの。互換性のために残しています。以下の項目は従来どおりです。

curl https://api.aicu.ai/v1/chat/models

Response:

{
"object": "list",
"data": [
{
"id": "deepseek-v3",
"owned_by": "openrouter",
"pricing": {"ap_per_1k_tokens": 14, "ap_in_per_1k": 9, "ap_out_per_1k": 27},
"stage": "beta",
"description": "汎用、コスパ良好"
}
]
}

Available Models(提供モデル)​

料金区分:

  • 🟢 無料 … 恒常的に無料(レート制限あり)
  • 🟡 期間限定無料 … α / preview 段階。2026-10-31 まで実課金なし(令和8年熊本地震 支援プログラム)。表の AP はGA後の予定単価
  • 💠 有料(予定単価) … 表の AP はGA以降に適用される参考単価

現在プラットフォーム全体が α版です。上記いずれも現時点では end-user への実課金を行っていません(利用ログは記録します)。単価は「入力 / 出力 AP per 1K tokens」。1 USD = 10,000 AP(1 AP = $0.0001)。

:::caution 金額は概算・単価は改訂されます 下表の AP と本ドキュメント中の金額は概算です(AP→USD は 10,000 AP = $1 で固定ですが、円換算は為替で動きます)。 モデル別の AP 単価は価格改訂の対象です。この表は手動更新のため、見積り・請求の根拠には 必ず GET /v1/chat/models の最新値を使ってください。 :::

🟢 無料(Groq・GA後も無料)​

ModelProvider単価用途
groq-llama-3.3-70bGroq無料高品質、レート制限あり
groq-llama-3.1-8bGroq無料高速、レート制限あり

🟡 期間限定無料(α / preview・2026-10-31 まで)​

ModelProviderin / out (AP/1K)用途
gpt-4oOpenAI76 / 300高品質マルチモーダル
gpt-4o-miniOpenAI5 / 18軽量・高速
gpt-5.6-solOpenAI150 / 900最上位。難しい推論・長い文脈
gpt-5.6-terraOpenAI80 / 450sol の半額。日常的な作業の主力
gpt-5.6-lunaOpenAI30 / 180軽量で速い。対話・要約
gpt-5.4-miniOpenAI30 / 140安価。定型の生成・抽出
gpt-5.4-nanoOpenAI6 / 40最安。分類・判定など短い作業
sakura-kimiさくらのAI Engine12 / 60国産推論 Kimi-K2.6。国内推論・学習不使用
kimi-k2.7-codeさくらのAI Engine11 / 101コーディング特化。OpenCode / Cline 互換

💠 有料(beta・予定単価)​

Gemini 系は 2026-08-01〜 下記の新単価(デフォルト gemini-flash を軽量な 2.5 Flash-Lite に、最新 gemini-3.6-flash を新設)。

ModelProviderin / out (AP/1K)用途
deepseek-v3OpenRouter9 / 27汎用、コスパ良好
gemini-flashOpenRouter3 / 12軽量・低コスト(Gemini 2.5 Flash-Lite)。2026-08-01〜
gemini-3.6-flashOpenRouter45 / 225最新・高品質(Gemini 3.6 Flash)。2026-08-01〜 新設
llama-3.1-8bOpenRouter1 / 2軽量
llama-3.1-70bOpenRouter4 / 10高品質
qwen3-32bOpenRouter4 / 10大規模コンテキスト

旧世代 gpt-5 / gpt-5-mini / gpt-5-nano も当面は利用可能ですが、新規は gpt-5.6 / gpt-5.4 系を推奨します。常に最新の一覧は GET /v1/chat/models で取得できます(この表は手動更新のため差異がある場合があります)。

推論モデル(reasoning)の注意​

GET /v1/chat/models で reasoning: true のモデル(gpt-5 系など)は、思考(reasoning)トークンも課金対象で、max_tokens を小さくすると reasoning が使い切って本文が空(content: "")で返ることがあります。

  • reasoning_effort(minimal / low / medium / high)を指定して思考量を制御できます(OpenAI 互換で素通し)。
  • 未指定の gpt-5 系は、api.aicu.ai 側で既定 minimal を適用し、短文でも本文が返るようにしています(明示すればそちらを優先)。
  • 短文生成でコストと安定性を優先するなら、非推論の gpt-4o-mini などが確実です。
curl -X POST https://api.aicu.ai/v1/chat/completions \
-H "Authorization: Bearer $AICU_API_KEY" -H "Content-Type: application/json" \
-d '{"model":"gpt-5-mini","messages":[{"role":"user","content":"140字で告知文を書いて"}],"max_tokens":600,"reasoning_effort":"minimal"}'

OpenAI SDK Compatibility​

from openai import OpenAI

client = OpenAI(
base_url="https://api.aicu.ai/v1",
api_key="aicu_live_xxx" # 要 API キー(ダッシュボードで発行)
)

response = client.chat.completions.create(
model="deepseek-v3",
messages=[{"role": "user", "content": "Hello!"}]
)
print(response.choices[0].message.content)
import OpenAI from 'openai';

const client = new OpenAI({
baseURL: 'https://api.aicu.ai/v1',
apiKey: 'aicu_live_xxx', // 要 API キー(ダッシュボードで発行)
});

const response = await client.chat.completions.create({
model: 'deepseek-v3',
messages: [{ role: 'user', content: 'Hello!' }],
});

Credits (課金)​

  • 10,000 AP = $1(USD 建て。1 AP = $0.0001。原価がドル建てのため単位もドルに揃えている)
  • 円換算は概算です(為替で動きます)。ドキュメント中の金額はすべて概算とお考えください
  • モデル別の AP 単価は価格改訂の対象です。最新は GET /v1/chat/models を参照
  • Groqモデル: 無料(レート制限あり)
  • 全エンドポイントで API キー(Bearer 認証)が必須

Rate Limits​

ProviderLimit
Groq30 RPM
OpenRouterプランに依存

トラブルシューティング​

403 は HTTP クライアントではなく、鍵の問題です​

2026-08-23 までは、Python 標準ライブラリ urllib など既定の User-Agent のままの HTTP クライアントが bot 対策で 403(Cloudflare error 1010)になることがありました。 これは解消しています。 api.aicu.ai は bot 判定の対象外になっており、 既定の urllib でも 200 が返ります(2026-09-22 実測)。User-Agent の設定は不要です。

それでも 403 が返る場合は、鍵そのものの問題です。

本文意味
{"error": "API key does not have required scope: llm", "required_scope": "llm", "current_scopes": [...]}その面の権限が鍵にありません。dashboard/keys の「権限変更」で付けてください(再発行は不要)
{"error": {"code": "unauthorized", ...}}鍵が無効化されているか、存在しません

Support​

© 2026 AICU Inc.