Claude・GPT・Gemini・DeepSeek・Kimi・GLM・Qwen・Groq — teai.io経由で同じプロンプトを実際に叩いて計測した生成速度と、公開価格を1ページで比較しました。
2026-08-25、teai.io本番環境から /v1/chat/completions を同一プロンプトで実行し、応答完了までの時間と出力トークン数から算出。ゲートウェイ経由の実測値であり、各社単体の理論最大値とは異なります。
| モデル | プロバイダー | 実測速度 | 入力 $/1M | 出力 $/1M |
|---|
※ Groq系(Llama 4 Maverick/Scout)は本来ハードウェア自体は爆速ですが、今回の単発実測ではゲートウェイ経由のオーバーヘッドが支配的になり、他モデルより低い値が出ました(再実行で4〜17 tok/sの幅で変動)。生データをそのまま公開しています。
※ Cerebras(GPT-OSS-120B・Qwen-3-32B)は直契約プロバイダーとして追加作業中で、teai.io上ではまもなく提供予定です。本家公表値は1,800〜3,000 tok/sで、上表の全モデルより大幅に高速です。有効化され次第この表に実測値を追加します。
wafer-scaleチップによる超高速推論が売りのCerebrasを直契約プロバイダーとして追加作業中です。 本家公表値では GPT-OSS-120B が $0.35/$0.75(per 1M tokens)、Qwen-3-32B が $0.40/$0.80 で、 いずれも1,800 tok/s超のスループットを謳っています。有効化まで今しばらくお待ちください。
teai.io経由で実際に各モデルへ同一プロンプトを送り、応答完了までの時間と出力トークン数から tok/s を算出しています。単発計測のため、ネットワーク条件・時間帯により変動します。継続的にベンチマークを回している詳細版は実測ベンチマークページもご覧ください。
クレジット制です。Freeプラン(¥0/月)はサインアップ時に100クレジット付与。Pro(¥4,350/月・30,000クレジット)、Business(¥14,800/月・100,000クレジット)もあります。全モデルとも「実費+5%」の固定マージンで課金しています。詳細は料金ページをご覧ください。
環境変数のモデルIDを変えるだけです。Claude Codeなら ANTHROPIC_MODEL、OpenAI互換クライアントなら model パラメータを差し替えます。追加のプロキシやSDK変更は不要です。