本文へ移動
メイン ドキュメント
ドキュメント

モデル

カタログは GET /v1/models が正です。モデルは 2 つのチームに分かれ、チームごとに経路と admission が違います。ID はそのまま model に渡します。

Shell
curl -s https://api.kotoba.cloud/v1/models -H "Authorization: Bearer $KOTOBA_API_TOKEN"
# → data[].id · team · route · availability

チームと admission

現在のカタログ

「経路未設定」のモデルは admission で名指しで拒否され、無料枠を消費しません。どのプロバイダが各経路の背後にあるかは運用設定で、ここには書きません。

モデルごとの詳細

qwen/qwen3.8-flash

共有経路の一般モデル。サインインだけで使え、本人確認は不要。標準 3 タスク(code-review / vulnerability-triage / remediation)のみ。ID は発行元のものをそのまま使います。

  • チーム: ブルーチーム · 経路: shared · 提供中
  • admission: サインイン済み principal・無料枠・ガードレール(標準 3 タスクのみ)
  • 上限: 入力 524,288 文字 · 出力 32,768 tokens(reasoning 込み)· tools 128 · turn 256
  • 応答の model は qwen/qwen3.8-flash(厳密に照合)
Shell
curl -s -X POST https://api.kotoba.cloud/v1/chat/completions -H "Authorization: Bearer $KOTOBA_API_TOKEN" \
  -H "content-type: application/json" -d '{"model":"qwen/qwen3.8-flash","max_tokens":2048,"messages":[{"role":"user","content":"..."}]}'

z-ai/glm-5.3-flash

共有経路のもう一つの一般モデル。admission と上限は qwen/qwen3.8-flash と同じ。

  • チーム: ブルーチーム · 経路: shared · 提供中
  • admission: サインイン済み principal・無料枠・ガードレール(標準 3 タスクのみ)
  • 上限: 入力 524,288 文字 · 出力 32,768 tokens(reasoning 込み)· tools 128 · turn 256
  • 応答の model は z-ai/glm-5.3-flash(厳密に照合)
Shell
curl -s -X POST https://api.kotoba.cloud/v1/chat/completions -H "Authorization: Bearer $KOTOBA_API_TOKEN" \
  -H "content-type: application/json" -d '{"model":"z-ai/glm-5.3-flash","max_tokens":2048,"messages":[{"role":"user","content":"..."}]}'

qwen3.8-flash-next-whitehacker

セキュリティ研究向けに調整された flash クラスのモデル。コードレビュー、脆弱性トリアージ、修正提案。答える前に推論し、ネイティブなツール呼び出しを返します。認可された研究者向けの無制限モデルで、利用ポリシー(AUP)の同意が前提です。

  • チーム: レッドチーム · 経路: dedicated · 提供中
  • admission: カード本人確認・利用ポリシー同意・承認スコープ(code-review は本人確認と同時に承認)・無料枠・ガードレール
  • 上限: 入力 524,288 文字 · 出力 32,768 tokens(reasoning 込み)· tools 128 · turn 256
  • 応答の model は qwen3.8-flash-next-cybersecurity-nvfp4(厳密に照合)
Shell
curl -s -X POST https://api.kotoba.cloud/v1/chat/completions -H "Authorization: Bearer $KOTOBA_API_TOKEN" \
  -H "content-type: application/json" -d '{"model":"qwen3.8-flash-next-whitehacker","max_tokens":2048,"messages":[{"role":"user","content":"..."}]}'

glm5.3-flash

レッドチームの 2 つ目のモデル。専用経路にまだ origin が無いため、カタログには載りますが admission で名指しで拒否されます(無料枠は消費しません)。origin が立ったらこの頁の状態が「提供中」に変わります。

  • チーム: レッドチーム · 経路: dedicated · 経路未設定
  • admission: カード本人確認・利用ポリシー同意・承認スコープ(code-review は本人確認と同時に承認)・無料枠・ガードレール
  • 上限: 入力 524,288 文字 · 出力 32,768 tokens(reasoning 込み)· tools 128 · turn 256
  • 応答の model は glm5.3-flash(形と本文で検証)
Shell
curl -s -X POST https://api.kotoba.cloud/v1/chat/completions -H "Authorization: Bearer $KOTOBA_API_TOKEN" \
  -H "content-type: application/json" -d '{"model":"glm5.3-flash","max_tokens":2048,"messages":[{"role":"user","content":"..."}]}'