NVIDIAのNemotron 3 Ultra(nvidia/nemotron-3-ultra-550b-a55b)を、いつもの環境から環境変数3つで。登録だけで100クレジット(このモデルなら約40回分)。
「ネモトロン・スリー・ウルトラです。私はNVIDIAが作った、五千五百億パラメータの大きなモデルです。百万トークンの文脈を持ち、同じ点数でも他のモデルより速く答えを出します。速さと品質を両取りしたい時に選んでください。」
Claude Code から使う場合、環境変数を3つ設定するだけです。
export ANTHROPIC_BASE_URL=https://api.teai.io
export ANTHROPIC_AUTH_TOKEN=te_xxxx # /register で発行
export ANTHROPIC_MODEL=nvidia/nemotron-3-ultra-550b-a55b
claudeCodex CLI や OpenAI SDK なら、OpenAI 互換のエンドポイントに向けるだけです。
export OPENAI_BASE_URL=https://api.teai.io/v1
export OPENAI_API_KEY=te_xxxx
codex -m nvidia/nemotron-3-ultra-550b-a55b生の API(OpenAI 互換 /v1/chat/completions・Anthropic 互換 /v1/messages)からも同じモデルIDで呼べます。
curl https://api.teai.io/v1/chat/completions \
-H "Authorization: Bearer te_xxxx" \
-H "Content-Type: application/json" \
-d '{"model":"nvidia/nemotron-3-ultra-550b-a55b","messages":[{"role":"user","content":"こんにちは"}]}'うまく動かない時: 401 は鍵の貼り間違い、402 は残高切れ(チャージ)、429 はレート制限(Free 30回/分)。モデルIDの綴りは GET /v1/models で確認できます。
キーは登録だけで発行されます。クレジットカード不要・100クレジット付き。
無料で始める| モデルID | nvidia/nemotron-3-ultra-550b-a55b |
|---|---|
| コンテキスト | 1.00M トークン |
| 入力 | 0.551 cr / 1Kトークン(¥92 / 1Mトークン) |
| 出力 | 2.76 cr / 1Kトークン(¥459 / 1Mトークン) |
| 相対価格(出力・Sonnet 5 基準) | Sonnet 5 の約 3 分の1 |
| 1回の目安(入力2K+出力500トークン) | 約 2.48 cr(¥0.41)・Free の100crで約40回 |
| TTFT(実測中央値) | 未計測(このモデルは定期計測の対象外。/speed に測定対象一覧) |
| レート制限 | Free 30 / Pro 120 / Business 600 リクエスト/分 |
| 提供元(経由) | openrouter |
クレジット単価・コンテキストは GET /v1/models/pricing のライブ値。TTFT は GET /api/v1/latency の実測中央値(円換算は ¥1=6cr)。
同じ API キーで、model を書き換えるだけで切り換えられます。出力単価の安い順。まず安い方で試し、品質が足りない箇所だけ上位に上げるのがコスト最小。
| モデルID | 文脈 | 入力 cr/1K | 出力 cr/1K | 出力 ¥/1M |
|---|---|---|---|---|
nvidia/Nemotron-3-Nano-30B-A3B | 128K トークン | 0.0378 | 0.151 | ¥25 |
nvidia/nemotron-3.5-lightning | 262K トークン | 0.0706 | 0.176 | ¥29 |
nvidia/nemotron-3.5-content-safety | 131K トークン | 0.176 | 0.176 | ¥29 |
nvidia/nemotron-3-super-120b-a12b | 262K トークン | 0.0706 | 0.397 | ¥66 |
nvidia/nemotron-3-ultra-550b-a55b このページ | 1.00M トークン | 0.551 | 2.76 | ¥459 |
ひっかけ問題20問を同一条件で出題した実測です。判定と生回答は偏差値一覧で全公開しています。
偏差値は平均50・標準偏差10(母集団は20問版が273モデル、平均11.38点)。母集団と満点が違うため、20問版と3問版の数字は直接比較しないでください。偏差値は一覧ページで確認できます。
18/20を実測14.3秒。同点の他モデルは35〜53秒。
1Mトークン。分割せずに全文を渡せる。
teai.io で数少ない NVIDIA モデル。
curl .../v1/chat/completions -d '{"model":"nvidia/nemotron-3-ultra-550b-a55b",...}'export ANTHROPIC_MODEL=nvidia/nemotron-3-ultra-550b-a55b && claude同じモデルIDを /v1/chat/completions に並列で投げるだけ。課金は入力0.551cr・出力2.76cr/1Kの従量なので、件数が増えても単価は一定。円換算は ¥1=6cr。
TTFT は GET /api/v1/latency の実測中央値(未計測(このモデルは定期計測の対象外。/speed に測定対象一覧))。値はページを開いた時点のライブで、測定方法も明記しています。出典(API)を辿れるので、レポートにそのまま使えます。未計測の項目は「未計測」と表示し、自称値は書きません。日本語の業務タスクでの実力は SHITATE-JP(300問×14モデルの実測・全公開)で比べられます。
クレジット制。Freeプラン(¥0)は登録だけで100クレジット。Pro(¥4,350/月・30,000cr)、Business(¥14,800/月・100,000cr)。円換算は ¥1=6cr。
このモデルは入力 0.551cr/1K・出力 2.76cr/1K(Sonnet 5 の約 3 分の1)。他モデルとの比較はモデル一覧、円建ては料金早見表へ。単価が安いモデルを選べばコストを抑えられ、用途で使い分けるのが一番効率的です。
teai.io(Fly.io上で運用)を経由して上流プロバイダーに送信されます。正直にお伝えすると、teai.ioを経由する以上、通信内容はteai.ioのサーバーを通過します。API互換エンドポイント(/v1/chat/completions・/v1/messages)ではリクエスト本文を保存せず、トークン数などのメタデータのみ保持します。
入力0.551cr/1K・出力2.76cr/1K(ライブ値・Sonnet 5 の約 3 分の1)。1回の目安は約2.48cr(¥0.41)。Free(¥0・100cr)、Pro(¥4,350/月・30,000cr)、Business(¥14,800/月・100,000cr)。詳細は料金ページへ。
/v1/chat/completions(OpenAI互換)、/v1/messages(Anthropic Messages API互換)、/v1/models のいずれからも使えます。モデルIDは nvidia/nemotron-3-ultra-550b-a55b です。