8 月 20 日に OpenRouter と OpenCode に登場して以来、開発者の会話を独占してきたノーブランドの AI モデルである Ox Alpha の正体は、もはや謎ではありません。中国のZ.AIは水曜日、ブルームバーグニュースに対し、このモデルが同社のGLMシリーズの新しいバージョンであることを認め、今夜モデルの重みを公開し、誰でもダウンロードして実行できるようにすると述べた。
この承認は、AIコミュニティが今年経験した中で最も熱狂的な推測ゲームの1つを終わらせ、フラッグシップグレードの中国モデルを、同等の機能に高額な価格を設定する西側の研究機関と衝突するコースに置くことになる。 この件の詳細は、人工知能の最新情報をご覧ください。
設計どおりに機能したステルス打ち上げ
Ox Alpha は、何ができるかについてすべてを説明したリストとともに到着しましたが、誰がそれを構築したかについては何も記載されていませんでした。 OpenRouter は、これは「このプレビュー中に匿名を保つことを選択したサードパーティプロバイダー」によるものであり、コーディング、持続的なエージェント作業、実稼働ワークロードのために構築された推論モデルとして位置付けています。
仕様だけでも注目を集めるのに十分でした。100 万トークンをわずかに超えるコンテキスト ウィンドウ、テキスト、画像、およびビデオ入力のサポート、OpenRouter と OpenCode の両方を介した完全に無料のアクセスです。 OpenCode は、このモデルの 1 日あたり 100 兆トークンの処理能力を宣伝し、Nous Research は、独自のポータルが 1000 兆トークンを処理できると主張しました。
中立的なインフラストラクチャ上でフロンティア隣接モデルを匿名で実行することで、Z.AI はブランドを付ける前に、実際の使用状況データとフィルタリングされていないベンチマークの雑談を収集できるようになりました。これは、OfficeChai が発売の分析で指摘したように、中国のオープンウェイトリリースのたびに起こる割引の物語を回避する戦略です。
ヒューズに点火したベンチマークの実行
マニアは単一のデータポイントまで遡ります。リリースから 1 日以内に、開発者の Ben Davis は DeepSWE ベンチマークで非公式の 10 タスク評価を実行し、Ox Alpha の初回パス精度が 80% であると報告しました。これは、Claude Fable 5 の 65% や GPT-5.6 Sol の 52% を上回っています。
この結果はモデルを急速に広め、DeepSeek の OpenCode リーダーボードの 56 日間連続トップ記録を止めるのに十分でした。これも即座に反発を招いた。ブルームバーグの確認に対して数百件のコメントが集まったハッカーニュースでは、開発者らが注意を促し、10タスクの実行は何も解決するにはサンプルが少なすぎること、他のリーダーボードでのモデルの結果は著しくまちまちであることを指摘した。
インターネットが最初にこの事件を解明した経緯
水曜日の確認のずっと前に、コミュニティの探偵活動はすでに Z.AI (以前は Zhipu AI として知られていた) を最有力候補として決定していました。 「dax」と呼ばれる開発者は、25 のプロンプトにわたってトークナイザーのフィンガープリント テストを実行し、Ox Alpha の生のトークン カウントが 11 プローブ中 11 のプローブで GLM のトークナイザーと一致する一方、他のラボのモデルは 4 つをクリアしなかったことを発見しました。 1 桁のプローブでは、DeepSeek のトークナイザーは 98 個のトークンを書き込みましたが、GLM は 29 個を使用しました。
別の分析では、Ox Alpha が歴史的に Qwen や GLM ファミリーのモデルをつまずかせてきたのと同じ「ダーティ トークン」に遭遇し、早い段階で分野を中国の研究所に絞り込んでいたことが判明しました。もう 1 つの有力な理論、Xiaomi の MiMo チームは以前、Hunter Alpha という別名で MiMo-V2-Pro と同一のステルス起動プレイブックを実行していましたが、現在はおとりだったようです。
この暴露の賭けは自慢の権利を超えています。ニューヨーク・タイムズは火曜日、中国の研究所のモデルリリースは世界のサイバーセキュリティの準備状況をテストする可能性があると報じ、西側諸国政府がこの規模の無差別リリースをどれほど注意深く監視しているかを浮き彫りにした。
オープンウェイトによって計算が変わる理由
今夜ウェイトが発表されるというZ.AIの確認は、市場にとって重要な部分だ。同社の現在の GLM 5.3 の価格は、ファーストパーティ API で入力トークン 100 万あたり 1.40 ドル、出力トークン 100 万あたり 4.40 ドルで、81 パーセントのキャッシュ割引が適用されます。 OfficeChaiによると、新モデルはZ.AIがGLM 5以来使用してきたのと同じMITライセンスに基づいて出荷される予定だという。
欧米の API 価格の数分の 1 で公開されているフロンティア隣接コーディングとエージェントのパフォーマンスは、まさにプレミアム ラボが 2 年間を費やして回避しようとしていたプレッシャー ポイントです。また、これにより、Z.AI は中国市場の無差別重量面で DeepSeek との競争力を維持できます。中国市場では、研究室の絶対的なフロンティアに達しないものに対しては、自由にダウンロードできるモデルがデフォルトの期待となっています。
次に見るべきもの
主要な詳細は未確認のままですが、最も重要なのはパラメータ数とモデル サイズであり、このリリースがローカル デプロイメントにどれだけ実用的であるかを決定します。コミュニティの議論はすでに、モデルが量子化にどのように反応するか、そしてデータセンターの GPU ではなく消費者向けハードウェアでどの程度高速に実行されるかに焦点を当てています。
確かなことは、1週間にわたる匿名の憶測によって、マーケティング予算では買えないもの、つまり中立的な立場での公平でブランドにとらわれない検証がZ.AIに与えられたということだ。モデルに名前が付けられたので、ベンチマークはさらに混雑し、より厳密なものになりそうです。
---
AIの最新情報をお届けAIの最新ニュース、分析、ブレイクスルーを一箇所で。
AIニュースをもっと読む →