KI-Modelle
55 articles
GPT-6 Astra wird für zahlende ChatGPT-Benutzer eingeführt, während Altman sich für den chaotischen Start entschuldigt
GPT-6 Astra von OpenAI erreicht nach einem chaotischen Start die meisten zahlenden Benutzer. Sam Altman entschuldigte sich und versprach, die Nutzung für gesperrte Abonnenten zurückzusetzen.
Google bringt Gemini 3.8 Flash und eine Cyber-Variante für die automatisierte Schwachstellenabwehr auf den Markt
Gemini 3.8 Flash von Google bietet Codierung und Argumentation auf Grenzniveau für 0,75 US-Dollar pro Million Eingabe-Tokens, mit einer Flash-Cyber-Variante für Sicherheitsbeauftragte.
OpenAI beginnt mit der Einführung von GPT-6 Astra für ausgewählte Kunden und verkündet damit, dass die AGI-Ära angebrochen ist
OpenAI hat mit der Einführung von GPT-6 Astra für ausgewählte Cybersicherheitskunden begonnen, wobei Greg Brockman die AGI-Ära ausgerufen hat. Hier erfahren Sie, wer Zugriff erhält und wie es weitergeht.
IFM aus Abu Dhabi veröffentlicht K2 Horizon: Sechs offene Modelle mit vollständigen Trainingsdaten und Code
IFM hat K2 Horizon auf den Markt gebracht: sechs offene Modelle (0,9B bis 375B-A23B) mit vollständigen Trainingsdaten, Prüfpunkten, Protokollen und Code unter Apache 2.0. Was es beinhaltet.
Meta bringt Muse Spark 1.3 mit Agenten-Upgrades für Muse Code und Meta Model API auf den Markt
Metas Muse Spark 1.3 wird auf Muse Code und Meta Model API mit Agenten-Workflow-Upgrades, besserem Multitasking und maximaler Argumentation für Sicherheitstests eingeführt.
Google bringt Gemini 3.8 Flash und Flash Cyber auf den Markt, die dritte Modellveröffentlichung innerhalb von sechs Wochen
Google liefert Gemini 3.8 Flash und eine auf Cybersicherheit ausgerichtete Flash-Cyber-Variante aus und behauptet, dass sie zu einem Bruchteil des Preises nahezu Opus-Codierungsleistung bietet.
Multiverse Computing bringt Quasar 438B auf den Markt, Europas höchstrangiges KI-Modell
Multiverse Computing brachte Quasar 438B auf den Markt, ein Argumentationsmodell der 400B-Klasse, das im Artificial Analysis Intelligence Index mit 43 Punkten das beste Ergebnis aller europäischen Modelle erzielte.
Google bereitet die Einführung von Gemini 3.8 Flash bereits am Mittwoch vor, um die KI-Codierungslücke zu schließen
Google DeepMind plant, Gemini 3.8 Flash bereits am Mittwoch auf den Markt zu bringen, berichtet das WSJ. Interne Tests zeigten Fortschritte bei der Codierung, bei der Gemini hinter der Konkurrenz zurückgeblieben ist.
OpenAI Confirms Astra Is Its First 'Critical' Cybersecurity Model, Sets Restricted Release
OpenAI bestätigte, dass sein kommendes Astra-Modell die „kritische“ Cybersicherheitsschwelle überschritten hat und bald mit eingeschränktem Zugriff auf seine leistungsstärksten Cyber-Tools ausgeliefert wird.
Anthropic bringt Claude Fable 5.1 und Mythos 5.1 auf den Markt: 25 % günstiger, stärker bei Agentic Coding
Claude Fable 5.1 von Anthropic senkt die Durchschnittskosten um 25 % und erzielt große Fortschritte bei Agenten-Codierungs-Benchmarks, während Mythos 5.1 für Benutzer mit vertrauenswürdigem Zugriff verfügbar ist.
Cohere veröffentlicht Parse 5, eine 2,3B-Parameter-Dokument-Parsing-KI, die für die kostenorientierte Aufnahme entwickelt wurde
Parse 5 von Cohere wandelt PDFs, Folien und Scans in strukturiertes Markdown mit einem 2,3B-Parametermodell um. Der Haken: Sein Benchmark-Vorsprung beruht auf einer Teilpunktzahl.
Z.ai eröffnet GLM-5.3 Weights on Hugging Face mit einer Lizenz für Hyperscaler
Z.ai hat GLM-5.3-Gewichte für Hugging Face mit einem 1-M-Token-Kontext und einer benutzerdefinierten Lizenz veröffentlicht, die Sicherheitsüberprüfungen für MaaS-Anbieter im Wert von über 10 Milliarden US-Dollar erfordert.
Tencent Open-Sources Hy4-Vorschau: 770B-Parameter-MoE mit 1M-Token-Kontext
Das Hunyuan-Team von Tencent veröffentlichte die Hy4-Vorschau unter Apache 2.0 – ein MoE-Modell mit 770 B Parametern, 49 B aktiven Parametern, 1 Mio. Token-Kontext und vLLM-Unterstützung vom ersten Tag an.
Google liefert Gemini 3.5 Transcribe und Omni 1.1 Flash aus: Zwei Upgrades für KI-Entwickler
Googles neues Gemini 3.5 Transcribe erreicht eine Wortfehlerrate von 2,6 %, während Omni 1.1 Flash 40-Sekunden-Videoszenen, 4K-Upscaling und Frame-Level-Steuerung hinzufügt.
Gemini Omni 1.1 Flash von Google fügt AI-Video Steuerelemente in Studioqualität und 4K-Ausgabe hinzu
Google hat Gemini Omni 1.1 Flash mit Szenenverlängerung auf bis zu 40 Sekunden, Start- und Endbildübergängen und 4K-Hochskalierung über die Gemini-API veröffentlicht.
Google bringt Gemini 3.5 Transcribe auf den Markt: Echtzeit-Spracherkennung in 85 Sprachen
Google hat Gemini 3.5 Transcribe mit 85-Sprachen-Erkennung, 4 % Streaming-Fehlerrate und 70 % schnelleren Antworten als Chirp 3 eingeführt und in allen seinen Apps eingeführt.
Alibabas Qwen3.8-Flash-Next zeigt eine Vorschau der Qwen4-Architektur mit 6B aktiven Parametern
Alibabas Qwen3.8-Flash-Next zeigt eine Vorschau von Qwen4: 125B Parameter mit 6B aktiven, offenen Gewichten und Qwen3.7-Plus-übertreffenden Ergebnissen bei einem Neuntel der Trainingskosten.
Z.ai bringt GLM-5.3-Flash unter MIT-Lizenz auf den Markt: Ox Alpha enthüllt, Gewichte live
GLM-5.3-Flash von Z.ai ist ein 320B-A18B MIT-lizenziertes multimodales Modell, das auf chinesischen KI-Chips bereitgestellt wird und jetzt die Rangliste der künstlichen Analyse zu niedrigen Kosten anführt.
Z.ai bestätigt, dass Ox Alpha ein Modell der GLM-Serie ist und seine Gewichte freigeben wird
Z.ai teilte Bloomberg mit, dass es sich bei dem viralen Stealth-Modell Ox Alpha um eine Neuveröffentlichung der GLM-Serie handele, und die offenen Gewichte seien heute Abend eingetroffen und beendeten eine Woche fieberhafter Spekulationen.
Der Schöpfer von Ox Alpha wurde möglicherweise entlarvt: Analyse deutet auf Zhipus GLM hin
Ein sofortiger Injektionstrick und eine gzip-Komprimierungsanalyse legen nahe, dass das mysteriöse Modell Ox Alpha von OpenRouter Zhipus GLM ist – doch Skeptiker wehren sich.
DeepSeek erweitert V4-Flash mit einem experimentellen bildfähigen Modell um Vision
DeepSeek liefert deepseek-v4-flash-vision-exp mit Bildeingabe, 1-Millionen-Token-Kontext und Preisen auf Flash-Ebene aus und behebt damit den berüchtigtsten blinden Fleck seines Modells.
OpenAI senkt die GPT-5.6-Sol-API-Preise um mehr als 20 %, da der Preiskampf sein Flaggschiff erreicht
OpenAI senkte die GPT-5.6 Sol-Entwicklerpreise um über 20 % und senkte die Ausgabe-Tokens auf 20 US-Dollar pro Million. Der Schritt beendet monatelanges Halten des Flaggschiffpreises.
Ox Alpha: Das kostenlose Stealth-KI-Modell von OpenRouter mit 1M-Token-Kontext löst einen Krimi aus
Ein kostenloses Stealth-Frontier-Modell namens Ox Alpha erschien auf OpenRouter mit einem 1-M-Token-Kontext und Videoeingabe, und die KI-Community bemüht sich, seinen Hersteller zu entlarven.
Die Gemma Open-Modelle von Google übertreffen eine Milliarde Downloads und sind in der Community unter den Top 100.000
Google gibt an, dass seine offenen Gemma-Modelle eine Milliarde Downloads erreicht haben, mit mehr als 100.000 Community-Varianten, Orbitaleinsätzen bei der NASA und einem neuen Awesome Gemma-Hub.
Ornith-1.5 entspricht Claude Opus 4.8 bei Agentic Coding Benchmarks mit vollständig offenen, sich selbst verbessernden Modellen
Die vom MIT lizenzierte Ornith-1.5-Familie generiert ihre eigenen Trainingsaufgaben und Gerüste – und ihr 397B-Flaggschiff knüpft Claude Opus 4.8 an die Terminal-Bench 2.1-Codierung an.
Alibabas Qwen 3.8 27B läuft auf einem Laptop und übertrifft seine eigenen größeren Modelle
Alibabas Qwen 3.8 27B ist ein Apache-2.0-Vision-Modell, das auf Laptops läuft und das geschlossene Qwen 3.7-Plus übertrifft – aber seine Standard-Argumentationseinstellung überdenkt alles.
Alibabas Qwen-KI-Modelle erreichen Top 3 Milliarden Downloads und überholen Meta und Google
Alibabas Qwen-Modelle haben die 3-Milliarden-Download-Marke überschritten und überholen Meta und Google bei der Einführung von Open-Source-KI, Wochen nach der Veröffentlichung von Qwen 3.8 Open-Weights.
GLM-5.3 von Z.ai verdoppelt die Codierung und glänzt mit verblüffenden Fähigkeiten im Bereich Cybersicherheit
Der neue GLM-5.3 von Z.ai bietet deutliche Codierungsverbesserungen und modernste Schwachstellenerkennung und verringert so die Lücke zu Anthropic und OpenAI im Open-Weight-Bereich.
Google liefert Gemini 3.7 Flash aus: sein bisher intelligentestes Arbeitstier für Codierung und Agenten zum halben Preis
Googles Gemini 3.7 Flash erscheint nur drei Wochen nach 3.6 Flash mit erheblichen Codierungs- und Agentenverbesserungen sowie einem Einführungspreis, der halb so teuer ist wie der Vorgänger.
DeepSeek führt V4 Pro zur allgemeinen Verfügbarkeit ein, nutzt Open-Source-Agenten und erhöht API-Preise
Das chinesische KI-Labor DeepSeek veröffentlicht die Vorschauversion von V4 Pro, liefert Harness v0.1 als Open-Source-Konkurrenten zu Claude Code aus und erhöht die API-Preise vor dem Börsengang deutlich.
xAI bringt Grok 4.6 auf den Markt und entspricht GPT-5.6 Sol im Frontier Intelligence Index
Grok 4.6 von xAI erreicht im Artificial Analysis Intelligence Index einen Wert von 61 und gleicht damit GPT-5.6 Sol mit herausragender Agentenleistung bei 60 % geringeren Kosten. Jetzt in Cursor und Grok Build verfügbar.
SL2T von Google DeepMind bringt Gebärdensprachübersetzung auf Pixel 11-Telefone
Google DeepMind hat SL2T vorgestellt, ein Gebärdensprache-Übersetzungsmodell, das Gebärdensprache in der Pixel-11-Reihe umwandelt, beginnend mit dem Pixel 11 Pro Fold.
Nvidia baut Nemotron 4 mit 1 Billion Parametern, um die besten Open-Source-KI-Modelle herauszufordern
Nvidia entwickelt Nemotron 4, ein Open-Source-KI-Modell mit mindestens einer Billion Parametern, um mit führenden Open-Weight-Systemen mithalten zu können. Das Modell könnte diesen Herbst eintreffen.
NVIDIA bringt Nemotron 3.5 Lightning und NeMo Switchyard für eine intelligentere Agenten-KI auf den Markt
NVIDIAs neues offenes 30-Milliarden-Parameter-Modell und die Open-Source-Routing-Bibliothek versprechen eine bis zu viermal schnellere Ausgabe und 30 % schnellere Agentenaufgaben auf Edge-Geräten, PCs und der Cloud.
Mark Zuckerberg erklärt geschlossenen KI-Rivalen im Superintelligence-Manifest den Krieg, da Meta sein leistungsfähigstes Modell als Open-Source-Lösung bereitstellt
Mark Zuckerberg von Meta veröffentlichte ein umfassendes Manifest, in dem er eine superintelligente KI für alle forderte, indem er geschlossene KI-Konkurrenten angriff und eine offene Version von Metas leistungsstärkstem Modell veröffentlichte.
Meta veröffentlicht Muse Glimmer, ein 30B Open-Weight-Modell, das KI-Agenten auf Verbraucher-GPUs ausführt
Meta veröffentlichte Muse Glimmer, ein offenes Modell mit 30 Milliarden Parametern unter Apache 2.0, das Gemma4-31B und Qwen3.6-27B bei Agenten-Benchmarks übertrifft, während es lokal ausgeführt wird.
OpenAI pausiert das Astra-Modell, nachdem Bewertungen „kritische“ Cybersicherheitsfunktionen ergeben haben
OpenAI hat die Entwicklung seines kommenden Astra-Modells unterbrochen, nachdem Tests gezeigt hatten, dass es möglicherweise die Cybersicherheitsschwelle „Kritisch“ erreicht – das erste Modell, das die höchste Risikostufe auslöst.
Berichten zufolge trainiert ByteDance ein KI-Modell mit 10 Billionen Parametern, um dem Mythos von Anthropic Konkurrenz zu machen
Die Financial Times berichtet, dass ByteDance ein riesiges 10-Billionen-Parameter-Modell entwickelt, das dem Umfang von Anthropics Mythos entspricht und den KI-Wettlauf zwischen den USA und China intensiviert.
OpenAI unterbricht die Arbeit am neuen Astra-Modell wegen kritischer Cybersicherheitsbedenken
OpenAI hat die Entwicklung seines kommenden Astra-Modells verlangsamt, nachdem interne Tests kritische Cyber-Fähigkeiten ergeben hatten, und verschärfte die Kontrollen vor der Veröffentlichung.
xAIs Imagine Image 2.0 landet in Arena-Benchmarks knapp hinter OpenAIs GPT-Image-2
xAI hat Imagine Image 2.0 für Grok veröffentlicht und belegt in den Arena-Benchmarks weltweit den zweiten Platz hinter GPT-Image-2 von OpenAI, mit neuen Bearbeitungstools, Unterstützung für mehrere Referenzen und vorkonfigurierten Vorlagen.
OpenAI unterbricht die Entwicklung des Astra-Modells, nachdem es die „kritische“ Cybersicherheitsrisikoschwelle erreicht hat
OpenAI stoppte Teile der Entwicklung von Astra, nachdem interne Tests ergaben, dass es in seinem Preparedness Framework möglicherweise die höchste Cybersicherheitsrisikostufe erreichen könnte – das erste seiner Modelle, das dies erreichte.
ByteDance trainiert ein KI-Modell mit 10 Billionen Parametern, um dem Mythos von Anthropic Konkurrenz zu machen
ByteDance trainiert ein Mega-KI-Modell mit bis zu 10 Billionen Parametern, was der geschätzten Größe von Anthropics Mythos 5 nahekommt und die derzeitigen Spitzenreiter Chinas in den Schatten stellt.
Mistrals Shieldstral: Ein 3B Open-Weights-Sicherheitsmodell, das Richtlinien liest, anstatt sie sich zu merken
Mistral AI hat Shieldstral veröffentlicht, einen 3B-Parameter-Sicherheitsklassifikator mit offenen Gewichtungen, der Text und Bilder zum Zeitpunkt der Inferenz anhand von Moderationsrichtlinien für Klartext bewertet.
Alibaba bringt Qwen3.8-Max auf den Markt: ein 2,4-Billionen-Parameter-Modell, das mit Claude von Anthropic mithalten kann
Alibaba hat Qwen3.8-Max veröffentlicht, ein Modell mit 2,4 Billionen Parametern, das in Benchmarks nur hinter Claude von Anthropic zurückbleibt und dessen offene Gewichte innerhalb weniger Tage versprochen werden.
Das Astra-Modell von OpenAI löst 10 lange ungelöste mathematische Probleme mit maschinengeprüften Beweisen
Das unveröffentlichte Astra-Modell von OpenAI löste zehn offene Probleme in Mathematik und Informatik mit Lean-verifizierten Beweisen und stellte sein nächstes großes Modell vor der Überprüfung durch die US-Regierung vor.
Gemini 3.5 Pro taucht in Blindtests der LM Arena auf, während Google kurz vor der Veröffentlichung steht
Googles verzögertes Gemini 3.5 Pro wurde wiederholt in Blindtests der LMSYS Chatbot Arena entdeckt, was darauf hindeutet, dass eine öffentliche Markteinführung endlich unmittelbar bevorsteht.
Thinking Machines bringt Inkling-Small auf den Markt: 276B Open-Weight-Modell mit einem Viertel der Größe seines Flaggschiffs
Thinking Machines Lab veröffentlichte Inkling-Small, ein Open-Weight-Modell mit 276 Milliarden Parametern und 12B aktiv, das nur ein Viertel so groß wie sein Flaggschiff ist – ein US-amerikanischer Teilnehmer im Open-Weight-Rennen.
DeepSeek startet öffentliche Betaversion von V4-Flash, während Chinas KI-Preiskampf eskaliert
DeepSeek hat die offizielle V4-Flash-Beta-API veröffentlicht, mit einem neu trainierten Modell, das sein eigenes Flaggschiff V4 Pro in neun Agenten-Benchmarks übertrifft und gleichzeitig die US-Konkurrenten beim Preis unterbietet.
OpenAI senkt die Preise für GPT-5.6-Modelle um bis zu 80 Prozent, da Unternehmen zunehmend sensibel auf KI-Kosten reagieren
OpenAI senkte die Preise für zwei GPT-5.6-Modelle, darunter Luna, und senkte damit die Kosten für kleinere Modelle um bis zu 80 Prozent, da Unternehmen ihre KI-Ausgaben genau unter die Lupe nehmen.
Das neue V4-Flash-Modell von DeepSeek entspricht GPT-5.6 Luna bei 60 % geringeren Kosten
DeepSeek hat V4-Flash „0731“ veröffentlicht, ein Modell mit offenem Gewicht, das in Benchmarks fast mit OpenAIs GPT-5.6 Luna mithalten kann und dabei etwa 60 Prozent weniger kostet.
Chinas MiniMax veröffentlicht H3-KI-Videomodell mit 2K-Clips, Stereoton und offenen Gewichten
Das chinesische KI-Startup MiniMax brachte am 31. Juli 2026 sein H3-Videogenerationsmodell auf den Markt, das 2K-Auflösung, Stereo-Audio und offene Gewichte zu einem Bruchteil der Preise der Konkurrenz bietet – und stellt damit eine direkte Konkurrenz zu ByteDances Seedance 2.5 dar.
Google DeepMind stellt Gemini Robotics 2 mit humanoider Ganzkörpersteuerung und Multi-Roboter-Kollaboration vor
Google DeepMind hat Gemini Robotics 2 auf den Markt gebracht, ein Vision-Sprach-Aktionsmodell, das es humanoiden Robotern ermöglicht, Aufgaben am gesamten Körper zu bewegen, zu erfassen und zu koordinieren.
OpenAI senkt die GPT-5.6-API-Preise um bis zu 80 %, da Unternehmen die KI-Kosten überdenken
OpenAI senkte am 30. Juli 2026 die API-Preise für GPT-5.6 Luna und Terra um bis zu 80 % und unterbot damit Anthropic, da Unternehmen ihre Inferenzausgaben genau unter die Lupe nehmen.
OpenAI sagt, dass GPT-5.6 Sol Claude Opus 5 auf ARC-AGI-3 schlägt – aber nur mit seinen eigenen Einstellungen
OpenAI berichtet, dass GPT-5.6 Sol bei ARC-AGI-3 unter Verwendung von beibehaltener Argumentation und Komprimierung 38,3 % erzielte und damit Claude Opus 5 übertraf. Aber die offizielle Nutzung erzählt eine andere Geschichte und löste eine Debatte über Benchmark-Fairness aus.
Black Forest Labs stellt FLUX 3 vor: Ein einzelnes KI-Modell für Bilder, Video, Audio und Robotik
Black Forest Labs hat FLUX 3 auf den Markt gebracht, ein multimodales Modell, das gemeinsam Bilder, Videos mit nativem Audio und Roboteraktionsvorhersagen generiert – in 77 % der Vergleiche dem Runway Gen-4.5 vorgezogen.
