KI-Modelle
32 articles
Google führt Gemini 3.6 Flash, Flash-Lite und Flash Cyber ein und zielt auf die Effizienz von KI-Agenten ab
Google hat am 21. Juli 2026 drei neue Gemini-Modelle veröffentlicht, wobei Gemini 3.6 Flash die Ausgabe-Token-Nutzung um 17 % reduziert und die Kosten für Agenten-KI-Workflows senkt.
Alibaba veröffentlicht Qwen-Image-3.0 für komplexe Layouts und verspricht detailliertere Informationen und tieferes Wissen
Das Qwen-Team von Alibaba brachte Qwen-Image-3.0 auf den Markt und wirbt für reichhaltige Inhalte und authentische Details für komplexe Bildlayouts – veröffentlichte jedoch keine Benchmarks oder offenen Gewichtungen.

Moonshot AI stoppt neue Kimi K3-Abonnements, da die Nachfrage die Rechenkapazität übersteigt
Tage nach der Einführung von Kimi K3 pausierte das chinesische Unternehmen Moonshot AI neue kostenpflichtige Abonnements, da die Nachfrage nach dem Open-Weight-Modell seine Recheninfrastruktur überforderte.

Alibaba bringt Qwen3.8-Max mit 2,4 Billionen Parametern auf den Markt und behauptet, es liege nur hinter Anthropics Fable 5 zurück
Das Qwen-Team von Alibaba stellte eine Qwen3.8-Max-Vorschau mit 2,4 Billionen Parametern vor, sein erstes multimodales Modell mit Billionen Parametern, und gab an, dass es nur hinter Anthropics Fable 5 zurückbleibt, da es versucht, die Dynamik von Kimi K3 abzuschwächen.
Deutsches Konsortium veröffentlicht Soofi S, ein offenes 30B-Modell, das englische und deutsche Benchmarks übertrifft
Ein deutsches Konsortium veröffentlichte Soofi S 30B-A3B, ein hybrides MoE-Modell, das auf der Münchner Cloud der Deutschen Telekom trainiert wurde und vollständig offene Modelle bei englischen und deutschen Benchmarks übertrifft.

Kimi K3 von Moonshot AI: Offenes Modell mit 2,8 Billionen Parametern fordert Claude und GPT heraus
Chinas Moonshot AI veröffentlichte Kimi K3, ein offenes Modell mit 2,8 Billionen Parametern, das nur Claude Fable 5 und GPT-5.6 Sol hinter sich lässt und die Frontend-Code-Arena anführt.
NVIDIA veröffentlicht Nemotron 3 Embed, eine offene Embedding-Sammlung mit einem 8B-Modell an der Spitze der RTEB-Bestenliste
Die offene Nemotron 3 Embed-Sammlung von NVIDIA zielt auf RAG und Agentenabruf im Produktionsmaßstab ab und belegt mit ihrem 8B-Checkpoint Platz 1 im RTEB-Benchmark.
Moonshot AI stellt Kimi K3 vor, ein Open-Weight-Modell mit 2,8 Billionen Parametern, das die besten US-Konkurrenten herausfordert
Chinas Moonshot AI kündigte Kimi K3 an, das weltweit größte Modell mit offenem Gewicht mit 2,8 Billionen Parametern, das zu einem Bruchteil der Kosten fast mit GPT-5.6 und Claude Fable 5 mithalten kann.

Alphabet-Aktien fallen um 4 %, da Google Gemini 3.5 Pro aufgrund von Programmiermängeln erneut verzögert
Googles Flaggschiff-Modell Gemini 3.5 Pro liegt Monate hinter dem Zeitplan zurück, da die Codierungsleistung hinter den internen Zielen zurückbleibt, was zu einem Rückgang der Alphabet-Aktien um 4 % führt, da die Konkurrenten die Nase vorn haben.
Thinking Machines von Mira Murati bringt Inkling auf den Markt, ein offenes KI-Modell mit 975 Milliarden Parametern
Thinking Machines Lab, gegründet von der ehemaligen OpenAI-CTO Mira Murati, veröffentlichte sein erstes Modell: ein Open-Weight-Modell mit 975 Milliarden Parametern, das für die Anpassung über die Dominanz roher Benchmarks konzipiert ist.
GPT-5.6 Sol von OpenAI löscht Benutzerdateien und Datenbanken, was Sicherheitsbedenken hervorruft
Entwickler berichten, dass GPT-5.6 Sol ohne Erlaubnis Dateien, Datenbanken und ganze Verzeichnisse löscht. Die eigene Systemkarte von OpenAI warnte vor dem Start vor dem Risiko.
Meta bringt Muse Spark 1.1 mit aggressiven API-Preisen auf den Markt und löst damit einen Preiskampf bei der KI-Codierung aus
Metas erstes kostenpflichtiges KI-Modell, Muse Spark 1.1, kostet erstmals 1,25 US-Dollar pro Million Eingabe-Tokens mit einem 1-Millionen-Kontextfenster und übertrifft damit OpenAI, Anthropic und xAI auf dem Codierungsmarkt.
OpenAI führt GPT-Live ein: Vollduplex-Sprachmodelle, die gleichzeitig zuhören und sprechen
Mit den neuen GPT-Live-Sprachmodellen von OpenAI kann ChatGPT mithilfe einer Vollduplex-Architektur gleichzeitig zuhören und sprechen. GPT-Live-1 ist jetzt für zahlende Benutzer verfügbar.
Refiant führt Protea ein, ein 10-Millionen-Token-Kontextfenster-KI-Modell, für das keine Warteliste erforderlich ist
Das in Südafrika gegründete Unternehmen Refiant hat Protea auf den Markt gebracht, eine Suite von KI-Modellen mit langem Kontext und einem 10-Millionen-Token-Kontextfenster, die sofort und ohne Warteliste verfügbar ist und auf Unternehmenscodebasen und Regulierungsarchive abzielt.
Mistral AI bringt Robostral Navigate auf den Markt, sein erstes Robotikmodell für die Roboternavigation mit einer Kamera
Robostral Navigate von Mistral AI ist ein 8B-Modell, das es Robotern ermöglicht, mit nur einer einzigen RGB-Kamera autonom durch komplexe Umgebungen zu navigieren und 76,6 % beim R2R-CE-Benchmark zu erreichen.
OpenAI erhält grünes Licht für die Veröffentlichung von GPT-5.6 für alle am 9. Juli
Das US-Handelsministerium hat OpenAI am 9. Juli die Freigabe für die öffentliche Veröffentlichung von GPT-5.6 Sol, Terra und Luna erteilt und damit ein Ende wochenlanger staatlich geforderter Beschränkungen gesetzt.
SpaceXAI bringt Grok 4.5 in Zusammenarbeit mit Cursor, Challenging Anthropic und OpenAI auf den Markt
Elon Musks SpaceXAI veröffentlichte Grok 4.5, ein mit Cursor-Daten trainiertes Modell mit 1,5 Billionen Parametern, das eine Leistung der Opus-Klasse bei geringeren Kosten verspricht. Der Start markiert die erste große Veröffentlichung von xAI unter seiner neuen Marke SpaceXAI.

Meta führt Muse Image, seinen ersten hauseigenen KI-Bildgenerator, in Instagram und WhatsApp ein
Meta brachte am 7. Juli 2026 Muse Image und Muse Video auf den Markt, seinen ersten internen KI-Bildgenerator, der in Instagram, WhatsApp und den Meta KI-Chatbot integriert ist.

Portugal führt Amália, sein erstes Open-Source-KI-Modell, ein, um die europäische KI-Souveränität anzustreben
Portugal hat Amália veröffentlicht, sein erstes nationales Open-Source-KI-Modell, das für europäisches Portugiesisch als öffentliche digitale Infrastruktur entwickelt wurde. Hier erfahren Sie, was es tut und wer es gebaut hat.

Metas „Watermelon“-KI-Modell entspricht in Benchmarks GPT-5.5, da Zuckerberg Agentenverzögerungen meldet
Meta-KI-Chef Alexandr Wang sagt, dass das nächste Modell, Watermelon, mit dem GPT-5.5 von OpenAI mit zehnmal mehr Rechenleistung gleichgezogen hat, auch wenn Zuckerberg zugibt, dass KI-Agenten hinter dem Zeitplan zurückliegen.

Google liefert Nano Banana 2 Lite und Gemini Omni Flash für eine schnellere und kostengünstigere Medienerzeugung
Google veröffentlichte am 30. Juni 2026 Nano Banana 2 Lite, sein schnellstes Bildmodell mit 0,034 US-Dollar pro 1.000 Bildern, zusammen mit Gemini Omni Flash für die Videoerstellung und Konversationsbearbeitung.

Anthropic bringt Claude Sonnet 5 auf den Markt, sein bisher wirkungsvollstes Mittelklasse-Modell
Anthropic veröffentlichte am 30. Juni 2026 Claude Sonnet 5, ein Mittelklassemodell mit einer Agentenleistung, die mit Opus 4.8 mithalten kann, zu weitaus geringeren Kosten, mit einem Einführungspreis von 2 US-Dollar pro Million Input-Tokens.

Meituan Open-Sources LongCat-2.0, ein Codierungsmodell mit 1,6 Billionen Parametern, das vollständig auf chinesischen Chips trainiert wurde
Das chinesische Unternehmen Meituan veröffentlichte LongCat-2.0, ein Mixture-of-Experts-Codierungsmodell mit 1,6 Billionen Parametern, das auf 50.000 inländischen Chips ohne Nvidia-Hardware trainiert wurde.
Claude Opus 4.8 Fast Mode kommt in GitHub Copilot an, während Anthropic tiefer in die Codierung vordringt
GitHub Copilot bietet jetzt den Schnellmodus von Claude Opus 4.8 in der Vorschau an und bietet Entwicklern damit eine 2,5-fache Geschwindigkeitssteigerung zu einem Bruchteil der bisherigen Kosten für den Schnellmodus.

Europa beauftragt Domyn aus Mailand mit der Entwicklung eines offenen KI-Modells mit 400 Milliarden Parametern
Die EU hat das EUROPA-Konsortium unter der Leitung des italienischen Startups Domyn ausgewählt, um ein offenes KI-Modell mit rund 400 Milliarden Parametern zu entwickeln, das alle 24 offiziellen EU-Sprachen abdeckt.
OpenAI führt GPT-5.6 Sol, Terra und Luna in begrenzter Vorschau mit neuen Sicherheitsleitplanken ein
OpenAI stellte in einer gestaffelten Vorschau die GPT-5.6-Familie unter der Führung des Flaggschiffs Sol vor, mit Terra- und Luna-Stufen, neuem Multi-Agent-Konzept und seinem bisher robustesten Sicherheits-Stack.

Sakana AI führt Fugu ein, ein Multi-Agenten-System, das durch die Orchestrierung von Rivalen mit Frontier-Modellen mithalten kann
Das Tokioter Startup Sakana AI stellte Fugu vor, einen Single-API-Orchestrator, der Aufgaben dynamisch über einen austauschbaren Pool von Frontier-LLMs weiterleitet, passend zu Anthropics Fable 5.
Google fügt Gemini 3.5 Flash integrierte Computernutzung für plattformübergreifende KI-Agenten hinzu
Google DeepMind hat die Computernutzung zu einem integrierten Tool in Gemini 3.5 Flash gemacht, mit gegnerischer Schulung und Unternehmensschutzmaßnahmen, um das Risiko einer sofortigen Injektion einzudämmen.
Microsoft stellt sieben firmeneigene MAI-Modelle ohne Destillation vor, um Kosten zu senken und die Abhängigkeit von OpenAI zu verringern
Microsoft hat auf der Build 2026 sieben MAI-Modelle vorgestellt, darunter ein Argumentationsmodell, das dem Opus 4.6 von Anthropic in Bezug auf Codierung entspricht und alle von Grund auf ohne Destillation trainiert wurde.
OpenAI bereitet GPT-5.6 mit 1,5 Mio. Token-Kontextfenster und Pro-Variante vor
OpenAI wird GPT-5.6 bereits nächste Woche mit einem 1,5-Millionen-Token-Kontextfenster, verbesserter Long-Horizon-Codierung sowie Mini- und Pro-Varianten für Anthropic auf den Markt bringen.

Chinesische KI-Modelle überholen US-Konkurrenten bei der globalen Token-Nutzung, da DeepSeek V4 den Spitzenplatz einnimmt
OpenRouter-Daten zeigen, dass chinesische Modelle wie DeepSeek V4 Flash und MiniMax M3 mittlerweile den weltweiten Token-Verbrauch dominieren und ChatGPT und Gemini außerhalb der Top 10 liegen.

Zhipu führt GLM 5.2 als CEO Spars mit Elon Musk über Chinas Frontier AI Timeline ein
Das chinesische KI-Labor Zhipu veröffentlichte GLM 5.2, als CEO Tang Jie Elon Musks Zeitplan für das erste Quartal 2027 verschob, damit China die KI der Fable-Klasse erreichen kann.
