GLM 5.3 Flash 対応

GLM 5.3 Flashをteai.ioで使う。
OpenRouter日次1位。131万トークン文脈を出力0.236cr/1Kで。

Z.aiのGLM 5.3 Flash(z-ai/glm-5.3-flash)を、いつもの環境から環境変数3つで。登録だけで100クレジット(このモデルなら約399回分)。

ブラウザで試す(Playground) Claude Code に入れる
出力
0.236cr / 1K
入力
0.0661cr / 1K
コンテキスト
1.31M
1回あたり
0.25cr (¥0.04)
Voice

GLM 5.3 Flashの自己紹介

G
GLM 5.3 Flash — Z.ai

「ジーエルエム・ゴーテンサン・フラッシュです。今、世界で一番たくさん使われているモデルのひとつです。百三十一万トークンの長い文脈を、とても安く回せます。まず僕で試して、足りない所だけ上のモデルに上げるのが一番賢い使い方です。」

Setup

セットアップ

Claude Code から使う場合、環境変数を3つ設定するだけです。

export ANTHROPIC_BASE_URL=https://api.teai.io
export ANTHROPIC_AUTH_TOKEN=te_xxxx   # /register で発行
export ANTHROPIC_MODEL=z-ai/glm-5.3-flash
claude

Codex CLI や OpenAI SDK なら、OpenAI 互換のエンドポイントに向けるだけです。

export OPENAI_BASE_URL=https://api.teai.io/v1
export OPENAI_API_KEY=te_xxxx
codex -m z-ai/glm-5.3-flash

生の API(OpenAI 互換 /v1/chat/completions・Anthropic 互換 /v1/messages)からも同じモデルIDで呼べます。

curl https://api.teai.io/v1/chat/completions \
  -H "Authorization: Bearer te_xxxx" \
  -H "Content-Type: application/json" \
  -d '{"model":"z-ai/glm-5.3-flash","messages":[{"role":"user","content":"こんにちは"}]}'

うまく動かない時: 401 は鍵の貼り間違い、402 は残高切れ(チャージ)、429 はレート制限(Free 30回/分)。モデルIDの綴りは GET /v1/models で確認できます。

キーは登録だけで発行されます。クレジットカード不要・100クレジット付き。

無料で始める
Specs

実スペック

モデルIDz-ai/glm-5.3-flash
コンテキスト1.31M トークン
入力0.0661 cr / 1Kトークン(¥11 / 1Mトークン)
出力0.236 cr / 1Kトークン(¥39 / 1Mトークン)
相対価格(出力・Sonnet 5 基準)Sonnet 5 の約 37 分の1
1回の目安(入力2K+出力500トークン)約 0.25 cr(¥0.04)・Free の100crで約399回
TTFT(実測中央値)未計測(このモデルは定期計測の対象外。/speed に測定対象一覧)
レート制限Free 30 / Pro 120 / Business 600 リクエスト/分
提供元(経由)openrouter

クレジット単価・コンテキストは GET /v1/models/pricing のライブ値。TTFT は GET /api/v1/latency の実測中央値(円換算は ¥1=6cr)。

Family

同じ系列のモデル(同じ鍵で使える)

同じ API キーで、model を書き換えるだけで切り換えられます。出力単価の安い順。まず安い方で試し、品質が足りない箇所だけ上位に上げるのがコスト最小。

モデルID文脈入力 cr/1K出力 cr/1K出力 ¥/1M
z-ai/glm-5.3-flash このページ1.31M トークン0.06610.236¥39
z-ai/glm-5.21.05M トークン0.2910.914¥152
z-ai/glm-5.3-flashx1.05M トークン0.3261.10¥184
z-ai/glm-5204K トークン0.5291.69¥282
z-ai/glm-5.31.05M トークン0.8032.52¥420
z-ai/glm-5.1204K トークン0.8522.68¥446
z-ai/glm-5v-turbo202K トークン1.063.53¥588
z-ai/glm-5-turbo202K トークン1.063.53¥588
Benchmark

罠ベンチでの実力

ひっかけ問題20問を同一条件で出題した実測です。判定と生回答は偏差値一覧で全公開しています。

53.0偏差値
20問版
13 / 20 点正解
68.7偏差値
3問版(参考)
3 / 3 点正解

偏差値は平均50・標準偏差10(母集団は20問版が273モデル、平均11.38点)。母集団と満点が違うため、20問版と3問版の数字は直接比較しないでください。偏差値は一覧ページで確認できます。

Who it's for

こんな人に向く

実使用量トップのモデルを使いたい人

OpenRouter日次1位。実需で選ばれている。

長文を安く回したい人

131万トークン文脈を出力0.236cr/1Kで。

バッチ処理をする人

最安クラス。件数をさばくほど差が出る。

Usage

使い方の例

長文のバッチ処理

curl .../v1/chat/completions -d '{"model":"z-ai/glm-5.3-flash",...}'

Claude Code から使う

export ANTHROPIC_MODEL=z-ai/glm-5.3-flash && claude
For teams

大量処理・研究・情シスの方へ

大量処理(バッチ)

同じモデルIDを /v1/chat/completions に並列で投げるだけ。課金は入力0.0661cr・出力0.236cr/1Kの従量なので、件数が増えても単価は一定。円換算は ¥1=6cr。

研究者・検証

TTFT は GET /api/v1/latency の実測中央値(未計測(このモデルは定期計測の対象外。/speed に測定対象一覧))。値はページを開いた時点のライブで、測定方法も明記しています。出典(API)を辿れるので、レポートにそのまま使えます。未計測の項目は「未計測」と表示し、自称値は書きません。日本語の業務タスクでの実力は SHITATE-JP(300問×14モデルの実測・全公開)で比べられます。

情シス・導入検討

認証は Authorization: Bearer te_xxxx。API互換エンドポイントはリクエスト本文を保存せず、トークン数などのメタデータのみ保持します。請求書・インボイス対応は Business プラン。詳細はDocsセキュリティへ。

Pricing

料金

クレジット制。Freeプラン(¥0)は登録だけで100クレジット。Pro(¥4,350/月・30,000cr)、Business(¥14,800/月・100,000cr)。円換算は ¥1=6cr。

このモデルは入力 0.0661cr/1K・出力 0.236cr/1K(Sonnet 5 の約 37 分の1)。他モデルとの比較はモデル一覧、円建ては料金早見表へ。単価が安いモデルを選べばコストを抑えられ、用途で使い分けるのが一番効率的です。

FAQ

よくある質問

プロンプトのデータはどこを経由しますか?+

teai.io(Fly.io上で運用)を経由して上流プロバイダーに送信されます。正直にお伝えすると、teai.ioを経由する以上、通信内容はteai.ioのサーバーを通過します。API互換エンドポイント(/v1/chat/completions/v1/messages)ではリクエスト本文を保存せず、トークン数などのメタデータのみ保持します。

料金はいくらですか?+

入力0.0661cr/1K・出力0.236cr/1K(ライブ値・Sonnet 5 の約 37 分の1)。1回の目安は約0.25cr(¥0.04)。Free(¥0・100cr)、Pro(¥4,350/月・30,000cr)、Business(¥14,800/月・100,000cr)。詳細は料金ページへ。

GLM 5.3 Flashはどのエンドポイントで使えますか?+

/v1/chat/completions(OpenAI互換)、/v1/messages(Anthropic Messages API互換)、/v1/models のいずれからも使えます。モデルIDは z-ai/glm-5.3-flash です。

GLM 5.3 Flashの落とし穴は?+

今すぐ無料で試す

登録だけで100クレジット。クレジットカード不要。

無料で始める