モデル
カタログは GET /v1/models が正です。モデルは 2 つのチームに分かれ、チームごとに経路と admission が違います。ID はそのまま model に渡します。
curl -s https://api.kotoba.cloud/v1/models -H "Authorization: Bearer $KOTOBA_API_TOKEN"
# → data[].id · team · route · availability
チームと admission
-
ブルーチーム
一般モデル。共有経路。サインイン済みの principal と無料枠、そして毎回のガードレール。
requirements: authenticated-principal · available-free-quota · guardrails
-
レッドチーム
セキュリティ研究向けに調整されたモデル。専用経路。カード本人確認・利用ポリシー同意・信頼経路・承認スコープ・無料枠、そして毎回のガードレール。
requirements: authenticated-principal · verified-ekyc-card · aup-consent · current-aml-ctf-clearance · current-trust-route · approved-research-scope · available-free-quota · guardrails
現在のカタログ
- qwen/qwen3.8-flash 提供中
ブルーチーム · 経路: shared · 出典
- z-ai/glm-5.3-flash 提供中
ブルーチーム · 経路: shared · 出典
- qwen3.8-flash-next-whitehacker 提供中
レッドチーム · 経路: dedicated · 出典
- glm5.3-flash 経路未設定
レッドチーム · 経路: dedicated · 出典
「経路未設定」のモデルは admission で名指しで拒否され、無料枠を消費しません。どのプロバイダが各経路の背後にあるかは運用設定で、ここには書きません。
モデルごとの詳細
qwen/qwen3.8-flash
共有経路の一般モデル。サインインだけで使え、本人確認は不要。標準 3 タスク(code-review / vulnerability-triage / remediation)のみ。ID は発行元のものをそのまま使います。
- チーム: ブルーチーム · 経路: shared · 提供中
- admission: サインイン済み principal・無料枠・ガードレール(標準 3 タスクのみ)
- 上限: 入力 524,288 文字 · 出力 32,768 tokens(reasoning 込み)· tools 128 · turn 256
- 応答の model は qwen/qwen3.8-flash(厳密に照合)
curl -s -X POST https://api.kotoba.cloud/v1/chat/completions -H "Authorization: Bearer $KOTOBA_API_TOKEN" \
-H "content-type: application/json" -d '{"model":"qwen/qwen3.8-flash","max_tokens":2048,"messages":[{"role":"user","content":"..."}]}'
z-ai/glm-5.3-flash
共有経路のもう一つの一般モデル。admission と上限は qwen/qwen3.8-flash と同じ。
- チーム: ブルーチーム · 経路: shared · 提供中
- admission: サインイン済み principal・無料枠・ガードレール(標準 3 タスクのみ)
- 上限: 入力 524,288 文字 · 出力 32,768 tokens(reasoning 込み)· tools 128 · turn 256
- 応答の model は z-ai/glm-5.3-flash(厳密に照合)
curl -s -X POST https://api.kotoba.cloud/v1/chat/completions -H "Authorization: Bearer $KOTOBA_API_TOKEN" \
-H "content-type: application/json" -d '{"model":"z-ai/glm-5.3-flash","max_tokens":2048,"messages":[{"role":"user","content":"..."}]}'
qwen3.8-flash-next-whitehacker
セキュリティ研究向けに調整された flash クラスのモデル。コードレビュー、脆弱性トリアージ、修正提案。答える前に推論し、ネイティブなツール呼び出しを返します。認可された研究者向けの無制限モデルで、利用ポリシー(AUP)の同意が前提です。
- チーム: レッドチーム · 経路: dedicated · 提供中
- admission: カード本人確認・利用ポリシー同意・承認スコープ(code-review は本人確認と同時に承認)・無料枠・ガードレール
- 上限: 入力 524,288 文字 · 出力 32,768 tokens(reasoning 込み)· tools 128 · turn 256
- 応答の model は qwen3.8-flash-next-cybersecurity-nvfp4(厳密に照合)
curl -s -X POST https://api.kotoba.cloud/v1/chat/completions -H "Authorization: Bearer $KOTOBA_API_TOKEN" \
-H "content-type: application/json" -d '{"model":"qwen3.8-flash-next-whitehacker","max_tokens":2048,"messages":[{"role":"user","content":"..."}]}'
glm5.3-flash
レッドチームの 2 つ目のモデル。専用経路にまだ origin が無いため、カタログには載りますが admission で名指しで拒否されます(無料枠は消費しません)。origin が立ったらこの頁の状態が「提供中」に変わります。
- チーム: レッドチーム · 経路: dedicated · 経路未設定
- admission: カード本人確認・利用ポリシー同意・承認スコープ(code-review は本人確認と同時に承認)・無料枠・ガードレール
- 上限: 入力 524,288 文字 · 出力 32,768 tokens(reasoning 込み)· tools 128 · turn 256
- 応答の model は glm5.3-flash(形と本文で検証)
curl -s -X POST https://api.kotoba.cloud/v1/chat/completions -H "Authorization: Bearer $KOTOBA_API_TOKEN" \
-H "content-type: application/json" -d '{"model":"glm5.3-flash","max_tokens":2048,"messages":[{"role":"user","content":"..."}]}'