AIモデル
55 articles
アルトマン氏が乱雑な発売について謝罪、GPT-6 Astraが有料ChatGPTユーザーに展開
OpenAI の GPT-6 Astra は、混乱に満ちた発売の後、ほとんどの有料ユーザーに到達しています。サム・アルトマン氏は謝罪し、ロックアウトされた加入者の使用量をリセットすると約束した。
Google、自動脆弱性防御用に構築された Gemini 3.8 Flash と Cyber Variant を発表
Google の Gemini 3.8 Flash は、セキュリティ防御者向けの Flash Cyber バリアントを備え、フロンティア レベルのコーディングと推論を 100 万入力トークンあたり 0.75 ドルで提供します。
OpenAI が一部の顧客向けに GPT-6 Astra の展開を開始し、AGI 時代の到来を宣言
OpenAI は、Greg Brockman 氏が AGI 時代を宣言し、一部のサイバーセキュリティ顧客向けに GPT-6 Astra の展開を開始しました。誰がアクセスできるのか、そして次に何が起こるのかを説明します。
アブダビの IFM が K2 Horizon をリリース: 完全なトレーニング データとコードを備えた 6 つのオープン モデル
IFM は、Apache 2.0 での完全なトレーニング データ、チェックポイント、ログ、コードを備えた 6 つのオープン モデル (0.9B ~ 375B-A23B) である K2 Horizon を発表しました。含まれるもの。
Meta が Muse コードとメタ モデル API のエージェント アップグレードを備えた Muse Spark 1.3 を発表
Meta の Muse Spark 1.3 は、エージェント ワークフローのアップグレード、マルチタスクの改善、安全性テスト用の最大推論を備えた Muse コードとメタ モデル API に展開されます。
Google、Gemini 3.8 Flash と Flash Cyber を発表、6 週間で 3 番目のモデルリリース
Google は、Gemini 3.8 Flash とサイバーセキュリティに重点を置いた Flash Cyber バリアントを出荷しており、数分の 1 の価格で Opus に近いコーディング パフォーマンスを実現すると主張しています。
マルチバース コンピューティングがヨーロッパ最高位の AI モデルである Quasar 438B を発表
Multiverse Computing は、人工分析知能指数で 43 を獲得した 400B クラスの推論モデルである Quasar 438B を発表しました。これは、ヨーロッパのモデルの中でトップの結果です。
Google、AIコーディングのギャップを埋めるため、水曜日にもGemini 3.8 Flashの発売を準備
WSJの報道によると、Google DeepMindは水曜日にもGemini 3.8 Flashを発売する予定で、内部テストではGeminiがライバルに後れを取っているコーディングの進歩が示されているという。
OpenAI、Astra が同社初の「クリティカル」サイバーセキュリティ モデルであることを確認、制限付きリリースを設定
OpenAIは、次期Astraモデルがサイバーセキュリティの「クリティカル」閾値を超え、最も強力なサイバーツールへのアクセスが制限された状態で間もなく出荷されることを確認した。
Anthropic が Claude Fable 5.1 と Mythos 5.1 を発表: 25% 安く、エージェント コーディングが強化
Anthropic の Claude Fable 5.1 は一般的なコストを 25% 削減し、エージェント コーディング ベンチマークで大幅な向上を記録し、Mythos 5.1 は信頼できるアクセス ユーザー向けに提供されます。
Cohere、コストファーストの取り込みのために構築された2.3Bパラメータのドキュメント解析AIであるParse 5をリリース
Cohere の Parse 5 は、PDF、スライド、スキャンを 2.3B パラメーター モデルを使用して構造化された Markdown に変換します。問題点は、ベンチマークのリードが部分的なスコアに依存していることです。
Z.ai、ハイパースケーラー向けライセンスで GLM-5.3 ウェイト オン ハグ フェイスを公開
Z.ai は、100 億ドル以上の MaaS プロバイダー向けに、100 万トークンのコンテキストとセキュリティ レビューを必要とするカスタム ライセンスを備えた Hugging Face の GLM-5.3 重みをリリースしました。
Tencent オープンソース Hy4 プレビュー: 1M トークン コンテキストを使用した 770B パラメーター MoE
Tencent の Hunyuan チームは、Apache 2.0 で Hy4 プレビューをリリースしました。これは、49B のアクティブ パラメーター、1M のトークン コンテキスト、および初日の vLLM サポートを備えた 770B パラメーターの MoE モデルです。
Google、Gemini 3.5 Transcribe と Omni 1.1 Flash を出荷:AI 開発者向けの 2 つのアップグレード
Google の新しい Gemini 3.5 Transcribe は単語エラー率が 2.6% に達し、Omni 1.1 Flash には 40 秒のビデオ シーン、4K アップスケーリング、フレーム レベルの制御が追加されています。
Google の Gemini Omni 1.1 Flash は、スタジオ グレードのコントロールと 4K 出力を AI ビデオに追加します
Google は、Gemini API を介した最大 40 秒のシーン延長、開始および終了フレームのトランジション、および 4K アップスケーリングを備えた Gemini Omni 1.1 Flash をリリースしました。
Google、Gemini 3.5 Transcribe を発表: 85 言語のリアルタイム音声認識
Google は、85 言語の検出、ストリーミング エラー率 4%、Chirp 3 よりも 70% 高速な応答を備えた Gemini 3.5 Transcribe をリリースし、同社のアプリ全体に展開しました。
Alibaba の Qwen3.8-Flash-Next が 6B アクティブ パラメータを備えた Qwen4 アーキテクチャをプレビュー
Alibaba の Qwen3.8-Flash-Next は、Qwen4 をプレビューします。60 億のアクティブ、オープン ウェイトを備えた 1250 億のパラメーターと、9 分の 1 のトレーニング コストで Qwen3.7-Plus を上回る結果を提供します。
Z.ai が MIT ライセンスに基づいて GLM-5.3-Flash を発売: Ox Alpha が明らかに、重量はライブ
Z.ai の GLM-5.3-Flash は、中国の AI チップで提供される 320B-A18B MIT ライセンスのマルチモーダル モデルで、現在、低コストで人工分析ランキングのトップにあります。
Z.aiはOx AlphaがGLMシリーズモデルであることを確認し、そのウェイトをリリースする予定
Z.aiはブルームバーグに対し、話題のステルスモデルOx AlphaはGLMシリーズの新リリースであり、オープンウェイトが今夜到着し、熱狂的な推測の一週間が終わると語った。
Ox Alpha のメーカーが暴露された可能性: 分析は Zhipu の GLM を指摘
プロンプトインジェクションのトリックと gzip 圧縮分析は、OpenRouter の謎のモデル Ox Alpha が Zhipu の GLM であることを示唆していますが、懐疑論者はこれを反発しています。
DeepSeek、実験的な画像対応モデルで V4-Flash にビジョンを追加
DeepSeek は、画像入力、1M トークン コンテキスト、Flash レベルの価格設定を備えた deepseek-v4-flash-vision-exp を出荷し、そのモデルの最も悪名高い盲点を修正しています。
価格戦争が最前線に達する中、OpenAI が GPT-5.6 Sol API の価格を 20% 以上値下げ
OpenAI は GPT-5.6 Sol の開発者価格を 20% 以上引き下げ、出力トークンを 100 万あたり 20 ドルに下げました。この動きにより、数カ月にわたる主力価格の維持に終止符が打たれる。
Ox Alpha: 100 万トークンのコンテキストを備えた OpenRouter の無料ステルス AI モデルがフーダニットを引き起こす
Ox Alpha と呼ばれる無料のステルス フロンティア モデルが、1M トークンのコンテキストとビデオ入力を備えた OpenRouter に登場し、AI コミュニティはその作成者の正体を明らかにしようと競い合っています。
Google の Gemma オープン モデルが 10 億ダウンロードを超え、コミュニティ バリアントがトップ 100,000 にランクイン
Googleによれば、同社のGemmaオープンモデルは10万ダウンロードを超え、10万以上のコミュニティバリアント、NASAとの軌道展開、そして新しいAwesome Gemmaハブを備えているという。
Ornith-1.5 は、完全にオープンな自己改善モデルを備えたエージェント コーディング ベンチマークで Claude Opus 4.8 と一致します
MIT ライセンスの Ornith-1.5 ファミリは独自のトレーニング タスクとスキャフォールドを生成し、その主力製品 397B は Terminal-Bench 2.1 コーディング上の Claude Opus 4.8 と結びついています。
Alibaba の Qwen 3.8 27B はラップトップ上で動作し、自社の大型モデルを上回る
Alibaba の Qwen 3.8 27B は、ラップトップ上で動作する Apache-2.0 ビジョン モデルで、クローズド版の Qwen 3.7-Plus を上回っていますが、デフォルトの推論設定はすべてを考えすぎています。
アリババの Qwen AI モデル、ダウンロード数トップ 30 億、メタと Google を追い越す
Qwen 3.8 オープンウェイト リリースから数週間後、Alibaba の Qwen モデルは 30 億ダウンロードを突破し、オープンソース AI の採用において Meta や Google を追い抜きました。
Z.ai の GLM-5.3 はコーディングを倍増させ、驚くべきサイバーセキュリティ スキルを実現
Z.ai の新しい GLM-5.3 は、コーディングの大幅な向上と最先端の脆弱性発見を提供し、オープンウェイトのフロンティアからの Anthropic と OpenAI との差を縮めます。
Google、Gemini 3.7 Flashを出荷:コーディングとエージェント向けにこれまでで最もスマートな主力製品を半額で提供
Google の Gemini 3.7 Flash は、3.6 Flash のわずか 3 週間後にリリースされ、コーディングとエージェントの大幅な向上に加え、前バージョンの半分の価格で導入価格が設定されました。
DeepSeek、V4 Pro を一般提供開始、ハーネス エージェントをオープンソース化、API 価格を値上げ
中国の AI ラボ DeepSeek は、V4 Pro をプレビューからリリースし、Claude Code のオープンソースのライバルとして Harness v0.1 を出荷し、IPO に先立って API 価格を大幅に値上げしました。
xAI がフロンティア インテリジェンス インデックスで GPT-5.6 Sol と一致する Grok 4.6 を発表
xAI の Grok 4.6 は、人工分析インテリジェンス インデックスで 61 のスコアを獲得し、60% 低いコストで傑出したエージェント パフォーマンスを備えた GPT-5.6 Sol に匹敵します。現在、Cursor および Grok Build で利用可能です。
Google DeepMind の SL2T が Pixel 11 スマートフォンに手話翻訳をもたらす
Google DeepMind は、Pixel 11 Pro Fold から始まる Pixel 11 ラインナップで、手話をテキストに変換する手話翻訳モデル SL2T を発表しました。
Nvidia、トップのオープンソース AI モデルに挑戦するために 1 兆パラメータの Nemotron 4 を構築
Nvidia は、主要なオープンウェイト システムに対抗するために、少なくとも 1 兆のパラメータを持つオープンソース AI モデルである Nemotron 4 を開発しています。このモデルは今秋に登場する可能性がある。
NVIDIA、よりスマートなエージェント AI を実現する Nemotron 3.5 Lightning と NeMo Switchyard を発表
NVIDIA の新しい 300 億パラメータのオープン モデルとオープン ソース ルーティング ライブラリは、エッジ デバイス、PC、クラウド全体で最大 4 倍高速な出力と 30% 高速なエージェント タスクを約束します。
マーク・ザッカーバーグ氏、スーパーインテリジェンス宣言で、最も強力なモデルをメタオープンソース化するとして、クローズドなAIライバルたちへの宣戦布告
Meta の Mark Zuckerberg は、すべての人に超インテリジェント AI を要求する広範なマニフェストを発表し、クローズド AI のライバルを攻撃し、Meta の最も強力なモデルのオープン バージョンをリリースしました。
Meta が消費者向け GPU で AI エージェントを実行する 30B オープンウェイト モデルである Muse Glimmer をリリース
Meta は、ローカルで実行中のエージェント ベンチマークで Gemma4-31B および Qwen3.6-27B を上回る、Apache 2.0 での 300 億パラメータのオープン モデルである Muse Glimmer を公開しました。
OpenAI、評価でサイバーセキュリティ機能が「クリティカル」と報告された後、Astraモデルを一時停止
OpenAIは、次期Astraモデルがサイバーセキュリティの「クリティカル」閾値に達する可能性があることがテストで判明したため、開発を一時停止した。このモデルは最も高いリスク層を引き起こす最初のモデルだ。
ByteDance が 10 兆パラメータの AI モデルを、ライバルの Anthropic の神話に合わせてトレーニングしていると報じられている
フィナンシャル・タイムズ紙は、ByteDanceがAnthropicのMythosの規模に匹敵するように設計された10兆個のパラメータを持つ大規模なモデルを構築しており、米中AI競争が激化していると報じた。
OpenAI、重大なサイバーセキュリティ上の懸念を理由に新しい Astra モデルの開発を一時停止
OpenAIは、内部テストでクリティカルレベルのサイバー能力が明らかになった後、次期Astraモデルの開発を遅らせ、リリース前の管理を強化している。
xAI の Imagine Image 2.0 は、Arena ベンチマークで OpenAI の GPT-Image-2 にわずかに及ばない
xAI は、Grok 用の Imagine Image 2.0 をリリースしました。これは、新しい編集ツール、マルチリファレンスのサポート、および事前構成されたテンプレートを備えた、OpenAI の GPT-Image-2 に次いで Arena ベンチマークで世界第 2 位にランクされています。
OpenAI、サイバーセキュリティの「重大な」リスク閾値に達したためAstraモデルの開発を一時停止
OpenAIは、社内テストでPreparedness Frameworkにおいて最高のサイバーセキュリティリスクレベルに達する可能性があることが判明したため、Astraの開発の一部を停止した(同社のモデルとしては初めて)。
ByteDance は、10 兆パラメータの AI モデルを、Anthropic の神話に匹敵するようにトレーニング中
ByteDance は、最大 10 兆のパラメーターを備えた巨大 AI モデルをトレーニングしています。これは、Anthropic の Mythos 5 の推定サイズに近く、中国の現在のリーダーを小さくしています。
ミストラルのシールドストラル: ポリシーを記憶するのではなく読み取る 3B オープンウェイト安全モデル
Mistral AI は、推論時に平易な言語のモデレーション ポリシーに照らしてテキストと画像を評価する 3B パラメーターのオープンウェイト安全分類器である Shieldstral をリリースしました。
Alibaba が Qwen3.8-Max を発表: Anthropic の Claude に匹敵する 2.4 兆パラメータのモデル
Alibaba は Qwen3.8-Max をリリースしました。これはベンチマークで Anthropic の Claude に唯一続く 2.4 兆パラメータのモデルで、オープンウェイトは数日以内にリリースされる予定です。
OpenAI の Astra モデルは、機械チェックされた証明で長らく未解決だった 10 の数学の問題を解決します
OpenAIの未発表のAstraモデルは、リーン検証された証明を用いて数学とコンピュータサイエンスの10の未解決問題を解読し、米国政府の審査に先立って次の主要モデルを予告した。
Google のリリースが近づくにつれ、LM Arena ブラインド テストで Gemini 3.5 Pro の表面が登場
Google の遅れている Gemini 3.5 Pro は、LMSYS Chatbot Arena のブラインド テストで繰り返し発見されており、いよいよ一般公開が差し迫っている可能性があることを示唆しています。
Thinking Machines が主力製品の 4 分の 1 のサイズの Inkling-Small: 276B オープンウェイト モデルをリリース
Thinking Machines Lab は、12B アクティブを備えた 2,760 億パラメータの無差別級モデルである Inkling-Small をリリースしました。これは、無差別級レースへの米国の参入企業である同社のフラッグシップモデルに 4 分の 1 のサイズで匹敵します。
中国の AI 価格競争が激化する中、DeepSeek が V4-Flash パブリック ベータ版を開始
DeepSeek は、価格で米国のライバルを下回りながら、9 つのエージェント ベンチマークで自社の主力 V4 Pro を上回る再トレーニングされたモデルを備えた公式 V4-Flash ベータ API をリリースしました。
企業が AI コストに敏感になる中、OpenAI が GPT-5.6 モデルの価格を最大 80% 値下げ
OpenAIは、企業がAI支出を精査する中、Lunaを含む2つのGPT-5.6モデルの価格を引き下げ、小型モデルのコストを最大80パーセント削減した。
DeepSeek の新しい V4 フラッシュ モデルは GPT-5.6 Luna に匹敵し、コストが 60% 低い
DeepSeek は、ベンチマークで OpenAI の GPT-5.6 Luna にほぼ匹敵するオープンウェイト モデルである V4-Flash '0731' をリリースしましたが、コストは約 60% 低くなっています。
中国の MiniMax が、2K クリップ、ステレオ サウンド、オープン ウェイトを備えた H3 AI ビデオ モデルをリリース
中国の AI スタートアップ MiniMax は、2026 年 7 月 31 日に H3 ビデオ生成モデルを発表し、競合他社の数分の一の価格で 2K 解像度、ステレオ オーディオ、オープン ウェイトを提供し、ByteDance の Seedance 2.5 に直接挑戦しました。
Google DeepMind、全身ヒューマノイド制御とマルチロボットコラボレーションを備えた Gemini Robotics 2 を発表
Google DeepMind は、人型ロボットが全身でタスクを移動、把握、調整できるようにする視覚・言語・行動モデルである Gemini Robotics 2 を発表しました。
企業が AI コストを再考する中、OpenAI が GPT-5.6 API の価格を最大 80% 値下げ
OpenAI は、企業が推論支出を精査する中、2026 年 7 月 30 日に GPT-5.6 Luna および Terra API の価格を最大 80% 引き下げ、Anthropic を下回りました。
OpenAI、GPT-5.6 Sol が ARC-AGI-3 上の Claude Opus 5 を上回ると発表 - ただし、独自の設定がある場合のみ
OpenAI は、GPT-5.6 Sol が、保持された推論と圧縮を使用して ARC-AGI-3 で 38.3% のスコアを獲得し、Claude Opus 5 を上回ったと報告しています。しかし、公式のハーネスは別の物語を伝えており、ベンチマークの公平性に関する議論を引き起こしています。
Black Forest Labs が FLUX 3 を発表: 画像、ビデオ、オーディオ、ロボティクス向けの単一 AI モデル
Black Forest Labs は、画像、ネイティブ オーディオを含むビデオ、およびロボットの動作予測を共同生成するマルチモーダル モデルである FLUX 3 を発表しました。これは、比較の 77% で Runway Gen-4.5 よりも好まれています。
