生データを公開・単発実測

どのモデルが速くて安いか、
実測で見せます。

Claude・GPT・Gemini・DeepSeek・Kimi・GLM・Qwen・Groq — teai.io経由で同じプロンプトを実際に叩いて計測した生成速度と、公開価格を1ページで比較しました。

無料で始める(クーポン「WELCOME」で100クレジット付き) 料金の詳細を見る
Speed × Price

実測スループット・価格 比較表

2026-08-25、teai.io本番環境から /v1/chat/completions を同一プロンプトで実行し、応答完了までの時間と出力トークン数から算出。ゲートウェイ経由の実測値であり、各社単体の理論最大値とは異なります。

モデルプロバイダー実測速度入力 $/1M出力 $/1M

※ Groq系(Llama 4 Maverick/Scout)は本来ハードウェア自体は爆速ですが、今回の単発実測ではゲートウェイ経由のオーバーヘッドが支配的になり、他モデルより低い値が出ました(再実行で4〜17 tok/sの幅で変動)。生データをそのまま公開しています。
※ Cerebras(GPT-OSS-120B・Qwen-3-32B)は直契約プロバイダーとして追加作業中で、teai.io上ではまもなく提供予定です。本家公表値は1,800〜3,000 tok/sで、上表の全モデルより大幅に高速です。有効化され次第この表に実測値を追加します。

Coming soon

Cerebras — 準備中

wafer-scaleチップによる超高速推論が売りのCerebrasを直契約プロバイダーとして追加作業中です。 本家公表値では GPT-OSS-120B が $0.35/$0.75(per 1M tokens)、Qwen-3-32B が $0.40/$0.80 で、 いずれも1,800 tok/s超のスループットを謳っています。有効化まで今しばらくお待ちください。

FAQ

よくある質問

この速度データはどうやって測っていますか?+

teai.io経由で実際に各モデルへ同一プロンプトを送り、応答完了までの時間と出力トークン数から tok/s を算出しています。単発計測のため、ネットワーク条件・時間帯により変動します。継続的にベンチマークを回している詳細版は実測ベンチマークページもご覧ください。

料金はいくらですか?+

クレジット制です。Freeプラン(¥0/月)はサインアップ時に100クレジット付与。Pro(¥4,350/月・30,000クレジット)、Business(¥14,800/月・100,000クレジット)もあります。全モデルとも「実費+5%」の固定マージンで課金しています。詳細は料金ページをご覧ください。

モデルはどう切り替えますか?+

環境変数のモデルIDを変えるだけです。Claude Codeなら ANTHROPIC_MODEL、OpenAI互換クライアントなら model パラメータを差し替えます。追加のプロキシやSDK変更は不要です。

今すぐ無料で試す

クーポン「WELCOME」で100クレジット。クレジットカード不要。

無料で始める(クーポン「WELCOME」で100クレジット付き) 料金を見る