hy4-previewが静かに使われ始めた — 「ベンダーロックインなし」の意味
Tencentの hy4-preview が、静かに使われ始めています。数字はこうです。初回は思考に60秒。でも2回目以降は4.7秒。コンテキストは100万トークン。入力は1Kあたり$0.834。そして昨日まで「タイムアウトする壊れたモデル」に見えていたのは、モデルではなく、こちら側の30秒制限が原因でした。この記事は、専門用語をできるだけ使わずに、「モデルを自分で選べる」ことが何を意味するかを説明します。
まず、hy4-previewって何?
中国のTencent(テンセント)が作った、新しいAIモデルです。
ChatGPTを作っているのはOpenAI、ClaudeはAnthropic、GeminiはGoogle。それと同じで、hy4-previewはTencentが作ったAIです。特徴は3つ。
本に例えると、長編小説を丸ごと覚えたまま話せる量。
Claudeの約5分の1。安い。
初回だけ60秒。以後は速い。
「使われ始めてる」って、どういうこと?
世界中の開発者が、ClaudeやGPT以外の選択肢を探し始めています。
理由はシンプルです。1つの会社のAIだけを使い続けると、その会社に縛られるからです。これをベンダーロックインと言います。日本語にすると「業者囲い込み」。引っ越したいのに、引っ越せない状態です。
昨日まで「壊れてた」ように見えた理由
原因はモデルじゃなく、待ち時間の設定ミスでした。
teai.ioの運営が、hy4-previewにひっかけ問題を解かせたところ、09-09から一度も答えが返ってこない状態でした。エラーは「All providers failed(全経路失敗)」。
調べると、hy4-previewは「隠れ思考型」でした。答える前に、心の中で長く考えるタイプです。その考える時間が初回は60秒。ところがteai.ioは、まだ計測していないモデルには30秒しか待たない設定でした。30秒で打ち切るから、答えが出る前に「失敗」と判定していたのです。
修正して再測定した結果が、冒頭の数字です。
| 項目 | 修正前 | 修正後(実測) |
|---|---|---|
| 初回の応答 | 30秒で打ち切り→失敗 | 60秒で正答 |
| 2回目以降 | 失敗 | 4.7秒 |
| 短い質問(max_tokens=100) | 空の回答 | 「東京」と正答 |
「自分でカスタマイズ」= 引っ越し自由
sente(先手)も同じ考え方で作られています。
teai.ioは、いろいろなAIモデルへの共通の窓口です。Claude、GPT、Gemini、hy4-preview、Kimi——どれも同じ書き方で呼べます。だから、モデルを乗り換えても、あなたのアプリは作り直さなくていい。
アプリは「teai.io」だけを見る。裏でどのモデルが動いているかは気にしない。
乗り換えたい時は、modelの名前を書き換えるだけ。コードの構造はそのまま。
「自分のAPIキーを持ち込む」こともできます。囲い込みが、そもそも構造的に起きない。
senteのようなコーディングエージェントも、この窓口を通っています。だから「今日はhy4、明日はClaude」と、その日の気分や財布事情で選べる。GPT-6が出ても、あなたは乗り換える自由を持ったままです。
実際に呼んでみる(コピペで動く)
OpenAI互換なので、いつもの書き方でそのまま。
curl https://teai.io/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $TEAI_API_KEY" \
-d '{
"model": "tencent/hy4-preview",
"messages": [{"role":"user","content":"日本の首都は? 1語で"}],
"max_tokens": 2000
}'
ポイントは max_tokens を1024以上にすること。隠れ思考型は、考える分の余白が必要です。ここを小さくすると、答えを書く前に力尽きて空の返事になります(これも今回の実測でわかったことです)。
まとめ — 3行で
2. 「壊れてる」と思われたのは受け側の30秒制限が原因で、直したら4.7秒で正答した。
3. 窓口を1つ(teai.io)にすれば、モデルは自由に乗り換えられる。ベンダーロックインなし、GPT-6が来ても自由。