人工知能最適化のスタートアップである Refiant Inc. は、1,000 万トークンのコンテキスト ウィンドウによって導かれるロングコンテキスト AI モデルのスイートである Protea を立ち上げました。これは、同社によれば、これまで一般に公開された中で最大のものにランクされるとのことです。モデルは 2026 年 7 月 8 日に refiant.ai で公開され、待機リストや承認プロセスはありませんでした。

コンテキスト ウィンドウは、モデルが作業メモリに一度に保持できる情報量を決定します。現在、主要な AI モデルのほとんどは、パフォーマンスが低下するまでに数十万トークンしか処理できないため、開発者は大規模なデータセットを断片に分割する回避策を余儀なくされています。リファイアント氏は、プロテアがその上限を大幅に引き上げると言う。 AI モデルの発表や業界のトレンドに関する継続的な報道については、読者は当社のホームページで最新の AI ニュースを見つけることができます。

1,000 万トークンが実際に何を意味するか

1,000 万トークンのコンテキスト ウィンドウは、約 750 万単語、つまり約 15,000 ページのテキストに相当します。 Refiant は実践的な意味を明確な言葉でまとめています。エンタープライズ コードベース全体を一度にロードできるのと同様に、完全な規制アーカイブや、以前は断片的にモデルに供給する必要があった何年もの臨床試験データもロードできます。

同社はそれをさらに具体的に述べている。 1,000 万個のトークンには、1 人の電子メールと Slack メッセージを最大 5 年間、またはレポートとファイルを数十年保存できます。エンジニアリング チームは、完全なコードベースをロードして分析を 1 日で実行できます。保険会社は、データを細かく分割することなく、何年もの請求を精査することができます。

Protea は、100 万、500 万、1,000 万トークンにわたる 3 つのバージョンで利用でき、開発者はコンテキストのサイズをワークロードや予算に合わせて柔軟に調整できます。

中間者紛失問題への取り組み

大きなコンテキスト ウィンドウに伴う最も根強い課題の 1 つは、いわゆる「中間紛失問題」です。これは、モデルが入力の最初と最後では正確なままであるものの、それらのエンドポイントの間に埋もれたマテリアルを追跡できなくなるという文書化された弱点です。 Refiant 氏は、Protea はこの問題に具体的に対処していると述べていますが、同社は改善を実証する詳細なベンチマーク結果をまだ公表していません。

中間紛失問題は、ロングコンテキスト モデルの実際の採用にとって大きな障害となってきました。モデルが技術的に数百万のトークンを受け入れる場合でも、そのコンテキストの真ん中にある情報の信頼性には疑問があり、コードベース全体の分析などのタスクに対する現実世界の有用性が制限されることがよくあります。

群の最適化と進化的探索に基づいて構築

Refiant は、Viroshan Naicker、Siddharth Gutta、Mathew Haswell によって 2025 年に設立されました。 Naicker 氏は量子数学者ですが、彼の共同創設者は金融と商業スケーリングのバックグラウンドを持っています。研究チームは、現代の AI モデルは非常に非効率であり、より優れた方法がすでに自然界に存在していると主張しています。

リファイアントのアプローチは、鳥の群れ、魚の群れ、アリのコロニーで観察されるのと同じ集合知の原理である、進化の探索と群れの行動を借用している。同社は最初にこのアプローチをモデル圧縮に適用し、わずか 12 ギガバイトの RAM を搭載した MacBook Pro 上で実行できるように OpenAI の GPT-OSS-120B を縮小することに成功しました。これらの圧縮結果は、インペリアル カレッジ ロンドンおよびユニバーシティ カレッジ ロンドンのサージェント プロセス システム エンジニアリング センターとの研究提携を確保するのに役立ちました。

資金調達と将来の計画

Proteaの立ち上げは、RefiantがVoLo Earth Ventures主導で2026年初めに終了した500万ドルのシードラウンドに続くものである。南アフリカで設立されたこの企業は現在、英国に商業拠点を置いています。

ヴィロシャン・ナイカー最高経営責任者(CEO)は、ロングコンテキストAIについては1年以上話題になっているが、実際には商用化されていないと指摘した。共同創設者兼最高製品責任者のマシュー・ハズウェル氏は、顧客は待機リストを増やすよりも、テストして構築できるモデルを望んでいると付け加え、これは多くの大規模な AI ラボで採用されているゲート型アクセスのアプローチを直接批判している。

Refiantは、すでに1億トークンで社内プロトタイプを実行しているが、それをどのようにベンチマークして製品に変えるかは未解決の問題のままであると述べた。プロテアのリリースは計画されている 3 つの段階のうちの最初のもので、同社は 3 か月以内にさらなる追加を約束している。

ロングコンテキスト AI 競争が激化

Refiant は、競争が激化するロングコンテキスト AI 市場に参入します。主要な研究所はコンテキスト ウィンドウを徐々に拡大してきましたが、市販モデルのほとんどは依然として 1,000 万トークンのしきい値をはるかに下回って動作しています。待機リストなしで即時にアクセスできるようにローンチするという Refiant の決定は、大手競合他社に一般的な段階的展開アプローチとは対照的です。

同社のスウォーム最適化手法は、主に従来のトランスのスケーリングに依存する競合他社とも区別されます。自然にインスピレーションを得たアルゴリズムが生産規模で持続的なパフォーマンス上の利点を提供できるかどうかはまだわかりませんが、Refiant の圧縮実績と大学とのパートナーシップにより、このアプローチの信頼性が高まります。

AI の先を行く

Protea モデルは現在、refiant.ai で入手できます。 AI 業界の報道と分析について詳しくは、AI Buzz Wire をご覧ください。

AIニュースをもっと読む→