実測レポート

hy4-previewが静かに使われ始めた — 「ベンダーロックインなし」の意味

Tencentの hy4-preview が、静かに使われ始めています。数字はこうです。初回は思考に60秒。でも2回目以降は4.7秒。コンテキストは100万トークン。入力は1Kあたり$0.834。そして昨日まで「タイムアウトする壊れたモデル」に見えていたのは、モデルではなく、こちら側の30秒制限が原因でした。この記事は、専門用語をできるだけ使わずに、「モデルを自分で選べる」ことが何を意味するかを説明します。

公開 2026-09-10
実測 teai.io経由・2026-09-10
対象 tencent/hy4-preview
▲ この記事の音声版(約44秒)。声は teai.io の KOE で生成。耳で聞きたい人はどうぞ。

まず、hy4-previewって何?

中国のTencent(テンセント)が作った、新しいAIモデルです。

ChatGPTを作っているのはOpenAI、ClaudeはAnthropic、GeminiはGoogle。それと同じで、hy4-previewはTencentが作ったAIです。特徴は3つ。

100万
トークンの記憶

本に例えると、長編小説を丸ごと覚えたまま話せる量。

$0.834
入力1Kあたり

Claudeの約5分の1。安い。

4.7秒
2回目以降の応答

初回だけ60秒。以後は速い。

「使われ始めてる」って、どういうこと?

世界中の開発者が、ClaudeやGPT以外の選択肢を探し始めています。

理由はシンプルです。1つの会社のAIだけを使い続けると、その会社に縛られるからです。これをベンダーロックインと言います。日本語にすると「業者囲い込み」。引っ越したいのに、引っ越せない状態です。

ベンダーロックインの例え話。あなたが家を借りていて、ガス会社を1社しか選べないとします。値上げされても、サービスが悪くなっても、引っ越すしかない。AIも同じで、1社のAPIに直接組み込むと、値上げ・仕様変更・サービス終了のたびに、あなたのアプリを作り直す羽目になります。

昨日まで「壊れてた」ように見えた理由

原因はモデルじゃなく、待ち時間の設定ミスでした。

teai.ioの運営が、hy4-previewにひっかけ問題を解かせたところ、09-09から一度も答えが返ってこない状態でした。エラーは「All providers failed(全経路失敗)」。

調べると、hy4-previewは「隠れ思考型」でした。答える前に、心の中で長く考えるタイプです。その考える時間が初回は60秒。ところがteai.ioは、まだ計測していないモデルには30秒しか待たない設定でした。30秒で打ち切るから、答えが出る前に「失敗」と判定していたのです。

修正して再測定した結果が、冒頭の数字です。

項目修正前修正後(実測)
初回の応答30秒で打ち切り→失敗60秒で正答
2回目以降失敗4.7秒
短い質問(max_tokens=100)空の回答「東京」と正答
ここが大事。「モデルがダメだった」と決めつけていたら、この発見はありませんでした。原因は受け側の設定でした。teai.ioのようなゲートウェイは、モデルごとの癖(考える時間・必要な余白)を吸収する場所です。あなたのアプリ側で、モデルごとの設定を全部書く必要はありません。

「自分でカスタマイズ」= 引っ越し自由

sente(先手)も同じ考え方で作られています。

teai.ioは、いろいろなAIモデルへの共通の窓口です。Claude、GPT、Gemini、hy4-preview、Kimi——どれも同じ書き方で呼べます。だから、モデルを乗り換えても、あなたのアプリは作り直さなくていい。

窓口を1つにする

アプリは「teai.io」だけを見る。裏でどのモデルが動いているかは気にしない。

モデル名を変えるだけ

乗り換えたい時は、modelの名前を書き換えるだけ。コードの構造はそのまま。

自分の鍵も使える(BYOK)

「自分のAPIキーを持ち込む」こともできます。囲い込みが、そもそも構造的に起きない。

senteのようなコーディングエージェントも、この窓口を通っています。だから「今日はhy4、明日はClaude」と、その日の気分や財布事情で選べる。GPT-6が出ても、あなたは乗り換える自由を持ったままです。

実際に呼んでみる(コピペで動く)

OpenAI互換なので、いつもの書き方でそのまま。

curl https://teai.io/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $TEAI_API_KEY" \
  -d '{
    "model": "tencent/hy4-preview",
    "messages": [{"role":"user","content":"日本の首都は? 1語で"}],
    "max_tokens": 2000
  }'

ポイントは max_tokens を1024以上にすること。隠れ思考型は、考える分の余白が必要です。ここを小さくすると、答えを書く前に力尽きて空の返事になります(これも今回の実測でわかったことです)。

まとめ — 3行で

1. hy4-previewは100万トークン・激安・初回だけ遅い、Tencentの新モデル。
2. 「壊れてる」と思われたのは受け側の30秒制限が原因で、直したら4.7秒で正答した。
3. 窓口を1つ(teai.io)にすれば、モデルは自由に乗り換えられる。ベンダーロックインなし、GPT-6が来ても自由。

hy4-previewを、今日試す

登録だけで100クレジット。OpenAI互換なので、既存のコードの model 名を変えるだけ。

teai.ioを始める →