Modele sztucznej inteligencji
55 articles
GPT-6 Astra udostępnia płatnym użytkownikom ChatGPT, gdy Altman przeprasza za niechlujne uruchomienie
OpenAI GPT-6 Astra dociera do większości płacących użytkowników po chaotycznym uruchomieniu. Sam Altman przeprosił i obiecał zresetowanie użytkowania dla zablokowanych abonentów.
Google wprowadza na rynek Gemini 3.8 Flash i wariant cybernetyczny stworzony z myślą o automatycznej ochronie przed lukami w zabezpieczeniach
Google Gemini 3.8 Flash zapewnia kodowanie i rozumowanie na poziomie pionierskim w cenie 0,75 USD za milion tokenów wejściowych, z wariantem Flash Cyber dla obrońców bezpieczeństwa.
OpenAI rozpoczyna wdrażanie GPT-6 Astra dla wybranych klientów, ogłaszając nadejście ery AGI
OpenAI rozpoczęło wdrażanie GPT-6 Astra dla wybranych klientów zajmujących się cyberbezpieczeństwem, a Greg Brockman ogłosił erę AGI. Oto, kto uzyska dostęp i co dalej.
IFM z Abu Zabi wypuszcza K2 Horizon: sześć otwartych modeli z pełnymi danymi szkoleniowymi i kodem
IFM wprowadził na rynek K2 Horizon: sześć otwartych modeli (0.9B do 375B-A23B) z pełnymi danymi treningowymi, punktami kontrolnymi, logami i kodem w ramach Apache 2.0. Co zawiera.
Meta wprowadza na rynek Muse Spark 1.3 z aktualizacjami Agentic dla kodu Muse i API Meta Model
Meta Muse Spark 1.3 jest wdrażana w Muse Code i Meta Model API z ulepszeniami agentycznego przepływu pracy, lepszą wielozadaniowością i maksymalnym rozumowaniem przeznaczonym do testów bezpieczeństwa.
Google wprowadza na rynek Gemini 3.8 Flash i Flash Cyber, trzeci model wydany w ciągu sześciu tygodni
Google dostarcza Gemini 3.8 Flash i zorientowaną na cyberbezpieczeństwo wersję Flash Cyber, zapewniając wydajność kodowania bliską Opusowi za ułamek ceny.
Multiverse Computing wprowadza na rynek Quasar 438B, najwyżej oceniany w Europie model sztucznej inteligencji
Firma Multiverse Computing wprowadziła na rynek Quasar 438B, model rozumujący klasy 400B, który uzyskał 43 punkty w indeksie sztucznej inteligencji analitycznej, co stanowi najwyższy wynik spośród wszystkich modeli europejskich.
Google przygotowuje premierę Gemini 3.8 Flash już w środę, aby wypełnić lukę w kodowaniu AI
Jak podaje WSJ, Google DeepMind planuje wypuścić Gemini 3.8 Flash już w środę, a wewnętrzne testy wykazują postęp w kodowaniu tam, gdzie Gemini pozostaje w tyle za rywalami.
OpenAI potwierdza, że Astra jest pierwszym „krytycznym” modelem cyberbezpieczeństwa i ustanawia ograniczenia w udostępnianiu
OpenAI potwierdziło, że nadchodzący model Astry przekroczył „krytyczny” próg cyberbezpieczeństwa i wkrótce będzie dostępny z ograniczonym dostępem do najpotężniejszych narzędzi cybernetycznych.
Anthropic wprowadza Claude Fable 5.1 i Mythos 5.1: 25% tańsze, silniejsze w kodowaniu agentycznym
Claude Fable 5.1 firmy Anthropic obniża typowe koszty o 25% i odnotowuje duże zyski w testach porównawczych kodowania agentycznego, natomiast Mythos 5.1 jest przeznaczony dla użytkowników z dostępem zaufanym.
Cohere wypuszcza Parse 5, sztuczną inteligencję analizującą dokumenty o parametrach 2.3B, zbudowaną z myślą o przetwarzaniu w oparciu o koszty
Cohere's Parse 5 zamienia pliki PDF, slajdy i skany w ustrukturyzowany Markdown z modelem parametrów 2.3B. Haczyk: wzorcowa przewaga opiera się na częściowym wyniku.
Z.ai otwiera ciężarki GLM-5.3 na przytulającej twarzy z licencją skierowaną do hiperskalerów
Z.ai wypuściło wagi GLM-5.3 na Hugging Face z kontekstem tokena 1M i niestandardową licencją wymagającą kontroli bezpieczeństwa dla dostawców MaaS o wartości ponad 10 miliardów dolarów.
Podgląd Tencent Open-Sources Hy4: parametr MoE 770B z kontekstem tokena 1M
Zespół Hunyuan firmy Tencent udostępnił wersję zapoznawczą Hy4 pod Apache 2.0 — model MoE o parametrach 770B z aktywnymi parametrami 49B, kontekstem tokena 1M i obsługą vLLM pierwszego dnia.
Google wysyła Gemini 3.5 Transcribe i Omni 1.1 Flash: dwie aktualizacje dla programistów AI
Nowa aplikacja Google Gemini 3.5 Transcribe osiąga współczynnik błędów wynoszący 2,6%, podczas gdy Omni 1.1 Flash dodaje 40-sekundowe sceny wideo, skalowanie do 4K i kontrolę na poziomie klatki.
Google Gemini Omni 1.1 Flash dodaje sterowanie klasy studyjnej i wyjście 4K do wideo AI
Firma Google wypuściła Gemini Omni 1.1 Flash z przedłużeniem sceny do 40 sekund, przejściami między klatkami początkowymi i końcowymi oraz skalowaniem do 4K za pośrednictwem interfejsu API Gemini.
Google wprowadza transkrypcję Gemini 3.5: rozpoznawanie mowy w czasie rzeczywistym w 85 językach
Firma Google uruchomiła aplikację Gemini 3.5 Transcribe z wykrywaniem 85 języków, współczynnikiem błędów przesyłania strumieniowego na poziomie 4% i odpowiedziami o 70% szybszymi niż Chirp 3, wdrażaną we wszystkich swoich aplikacjach.
Qwen3.8-Flash-Next firmy Alibaba prezentuje architekturę Qwen4 z aktywnymi parametrami 6B
Qwen3.8-Flash-Next firmy Alibaba wyświetla parametry Qwen4: 125B z aktywnymi, otwartymi ciężarami 6B i wynikami pokonującymi Qwen3.7-Plus przy jednej dziewiątej kosztu szkolenia.
Z.ai wprowadza na rynek GLM-5.3-Flash na licencji MIT: Ox Alpha ujawniony, Weights Live
GLM-5.3-Flash firmy Z.ai to wielomodalny model 320B-A18B na licencji MIT, obsługiwany na chińskich chipach AI, który obecnie zajmuje pierwsze miejsca w rankingach sztucznej analizy przy niskim koszcie.
Z.ai potwierdza, że Ox Alpha jest modelem z serii GLM i udostępni swoje wagi
Z.ai powiedział Bloombergowi, że wirusowy model stealth Ox Alpha to nowa odsłona serii GLM, a dziś wieczorem pojawią się otwarte wagi, kończąc tydzień gorączkowego zgadywania.
Twórca Ox Alpha mógł zostać zdemaskowany: analiza wskazuje na GLM Zhipu
Sztuczka szybkiego wstrzykiwania i analiza kompresji gzip sugerują, że tajemniczy model Ox Alpha OpenRoutera to GLM Zhipu – ale sceptycy są przeciwni.
DeepSeek dodaje wizję do V4-Flash dzięki eksperymentalnemu modelowi obsługującemu obraz
DeepSeek dostarcza deepseek-v4-flash-vision-exp z wejściem obrazu, kontekstem tokena 1M i cenami na poziomie Flash, eliminując najbardziej znany martwy punkt swojego modelu.
OpenAI obniża ceny API GPT-5.6 Sol o ponad 20% w miarę jak wojna cenowa osiąga swój flagowy produkt
OpenAI obniżyło ceny programistów GPT-5.6 Sol o ponad 20%, obniżając tokeny wyjściowe do 20 dolarów za milion. Posunięcie to kończy miesiące utrzymywania ceny flagowca.
Ox Alpha: darmowy model sztucznej inteligencji OpenRouter z kontekstem tokena 1M wywołuje zagadkę
Na OpenRouter pojawił się darmowy, ukryty model o nazwie Ox Alpha z kontekstem z tokenem 1M i wejściem wideo, a społeczność sztucznej inteligencji ściga się, by zdemaskować jego twórcę.
Otwarte modele Google Gemma przekroczyły 1 miliard pobrań, a warianty społecznościowe znalazły się na liście 100 000 najpopularniejszych
Google twierdzi, że otwarte modele Gemma pobrano ponad 1 miliard, z ponad 100 000 wariantami społecznościowymi, wdrożeniami orbitalnymi z NASA i nowym centrum Awesome Gemma.
Ornith-1.5 dorównuje Claude Opus 4.8 w testach porównawczych Agentic Coding z całkowicie otwartymi, samodoskonalącymi się modelami
Rodzina Ornith-1.5 posiadająca licencję MIT generuje własne zadania szkoleniowe i rusztowania, a jej flagowy model 397B łączy Claude Opus 4.8 z kodowaniem Terminal-Bench 2.1.
Qwen 3.8 27B Alibaba działa na laptopie i przewyższa swoje własne, większe modele
Qwen 3.8 27B firmy Alibaba to wizyjny model Apache-2.0, który działa na laptopach i pobija zamkniętą wersję Qwen 3.7-Plus — ale jej domyślne ustawienie rozumowania przerasta wszystko.
Modele AI Qwen firmy Alibaba mają 3 miliardy najpopularniejszych pobrań, wyprzedzając Meta i Google
Modele Qwen firmy Alibaba przekroczyły 3 miliardy pobrań, wyprzedzając Meta i Google w zakresie wdrażania sztucznej inteligencji typu open source, kilka tygodni po wydaniu Qwen 3.8 z otwartymi wagami.
GLM-5.3 firmy Z.ai podwaja możliwości kodowania i zapewnia zaskakujące umiejętności w zakresie cyberbezpieczeństwa
Nowy GLM-5.3 firmy Z.ai zapewnia znaczne postępy w kodowaniu i najnowocześniejsze wykrywanie luk w zabezpieczeniach, zmniejszając różnicę między Anthropic i OpenAI w porównaniu z pogranicza otwartej wagi.
Google dostarcza Gemini 3.7 Flash: najmądrzejszy jak dotąd produkt do kodowania i agentów za połowę ceny
Google Gemini 3.7 Flash pojawia się zaledwie trzy tygodnie po wersji 3.6 Flash i zapewnia znaczne korzyści w zakresie kodowania i agentów, a także cenę początkową za połowę ceny swojego poprzednika.
DeepSeek wprowadza wersję V4 Pro do ogólnej dostępności, agenta uprzęży typu open source i podnosi ceny interfejsów API
Chińskie laboratorium sztucznej inteligencji DeepSeek wypuszcza wersję 4 Pro poza wersję zapoznawczą, dostarcza Harness v0.1 jako rywala Claude Code w wersji open source i gwałtownie podnosi ceny API przed pierwszą ofertą publiczną.
xAI wprowadza Grok 4.6, zgodny z GPT-5.6 Sol w indeksie Frontier Intelligence
Grok 4.6 firmy xAI uzyskał 61 punktów w indeksie sztucznej inteligencji, co plasuje GPT-5.6 Sol w zakresie wyjątkowej wydajności agenta przy kosztach niższych o 60%. Dostępne teraz w Cursor i Grok Build.
SL2T firmy Google DeepMind zapewnia tłumaczenie języka migowego na telefonach Pixel 11
Firma Google DeepMind zaprezentowała SL2T, model tłumaczenia języka migowego, który zamienia język migowy na tekst w telefonach Pixel 11, począwszy od Pixela 11 Pro Fold.
Nvidia buduje Nemotron 4 o bilionach parametrów, aby rzucić wyzwanie najlepszym modelom sztucznej inteligencji typu open source
Nvidia opracowuje Nemotron 4, model sztucznej inteligencji typu open source z co najmniej bilionem parametrów, aby konkurować z wiodącymi systemami o otwartej wadze. Model może pojawić się jesienią tego roku.
NVIDIA wprowadza na rynek Nemotron 3.5 Lightning i NeMo Switchyard dla inteligentniejszej, agentycznej sztucznej inteligencji
Nowy otwarty model firmy NVIDIA z 30 miliardami parametrów i biblioteka routingu typu open source zapewniają do 4 razy większą wydajność i o 30% szybsze wykonywanie zadań agenta na urządzeniach brzegowych, komputerach stacjonarnych i w chmurze.
Mark Zuckerberg wypowiada wojnę zamkniętym rywalom AI w Manifeście Superinteligencji jako najpotężniejszy model meta-open source
Mark Zuckerberg z Meta opublikował szeroko zakrojony manifest wzywający do stworzenia superinteligentnej sztucznej inteligencji dla wszystkich, atakujący zamkniętych rywali w dziedzinie sztucznej inteligencji i wypuszczający otwartą wersję najpotężniejszego modelu Meta.
Meta wypuszcza Muse Glimmer, model o otwartej wadze 30B, który uruchamia agentów AI na konsumenckich procesorach graficznych
Meta opublikowała Muse Glimmer, otwarty model o 30 miliardach parametrów działający pod Apache 2.0, który podczas działania lokalnego przewyższa Gemma4-31B i Qwen3.6-27B w testach agentowych.
OpenAI wstrzymuje model Astra po tym, jak oceny oznaczą „krytyczne” możliwości cyberbezpieczeństwa
OpenAI wstrzymało prace nad nadchodzącym modelem Astra po tym, jak testy wykazały, że może on osiągnąć „krytyczny” próg cyberbezpieczeństwa – będzie to pierwszy model charakteryzujący się najwyższym poziomem ryzyka.
ByteDance podobno szkoli model sztucznej inteligencji o 10 bilionach parametrów zgodnie z mitami konkurencyjnego Anthropic
„Financial Times” donosi, że ByteDance buduje ogromny model obejmujący 10 bilionów parametrów, zaprojektowany tak, aby odpowiadał skali Mitów firmy Anthropic, intensyfikując wyścig sztucznej inteligencji między USA i Chinami.
OpenAI wstrzymuje prace nad nowym modelem Astry ze względu na krytyczne obawy dotyczące cyberbezpieczeństwa
OpenAI spowolniło rozwój nadchodzącego modelu Astry po tym, jak wewnętrzne testy ujawniły krytyczne możliwości cybernetyczne, co zaostrzyło kontrolę przed premierą.
Imagine Image 2.0 firmy xAI plasuje się tuż za GPT-Image-2 OpenAI w testach Arena Benchmarks
xAI wypuściło Imagine Image 2.0 dla Groka, zajmując drugie miejsce na świecie w testach porównawczych Arena, za GPT-Image-2 OpenAI, z nowymi narzędziami do edycji, obsługą wielu odniesień i wstępnie skonfigurowanymi szablonami.
OpenAI wstrzymuje rozwój modelu Astra po osiągnięciu przez niego „krytycznego” progu ryzyka cyberbezpieczeństwa
OpenAI wstrzymało część rozwoju Astry po tym, jak wewnętrzne testy wykazały, że może ona osiągnąć najwyższy poziom ryzyka cyberbezpieczeństwa w swoich ramach gotowości – jest to pierwszy z jej modeli, który to zrobił.
ByteDance trenuje model sztucznej inteligencji o 10 bilionach parametrów zgodnie z mitami konkurencyjnej firmy Anthropic
ByteDance trenuje mega model sztucznej inteligencji z maksymalnie 10 bilionami parametrów, co zbliża się do szacowanego rozmiaru Mythos 5 firmy Anthropic i przyćmiewa obecnych liderów Chin.
Shieldstral firmy Mistral: model bezpieczeństwa 3B z otwartymi ciężarkami, który czyta zasady, zamiast je zapamiętywać
Mistral AI wypuściło Shieldstral, 3B-parametrowy klasyfikator bezpieczeństwa z otwartymi wagami, który ocenia tekst i obrazy pod kątem zasad moderacji w prostym języku w momencie wnioskowania.
Alibaba wprowadza na rynek Qwen3.8-Max: model o 2,4 bilionach parametrów, który może konkurować z Claude firmy Anthropic
Alibaba wypuściła Qwen3.8-Max, model o 2,4 bilionach parametrów, który w benchmarkach ustępuje jedynie Claude'owi Anthropic, a otwarte wagi zostaną obiecane w ciągu kilku dni.
Model Astra OpenAI rozwiązuje 10 długo nierozwiązanych problemów matematycznych za pomocą dowodów sprawdzanych maszynowo
Niepublikowany model Astra OpenAI rozwiązał 10 otwartych problemów z matematyki i informatyki za pomocą dowodów zweryfikowanych przez Lean, zapowiadając jego kolejny ważny model przed recenzją rządu USA.
Powierzchnie Gemini 3.5 Pro w ślepych testach LM Arena w miarę zbliżania się premiery Google
Opóźniony Gemini 3.5 Pro firmy Google był wielokrotnie zauważany w ślepych testach LMSYS Chatbot Arena, co sygnalizuje, że publiczna premiera może w końcu być nieuchronna.
Thinking Machines wypuszcza Inkling-Small: model 276B o otwartej wadze o jednej czwartej rozmiaru swojego flagowego modelu
Laboratorium Thinking Machines wypuściło Inkling-Small, model o otwartej wadze z 276 miliardami parametrów i aktywną wartością 12B, który dorównuje jego flagowemu modelowi pod względem jednej czwartej wielkości — amerykański uczestnik wyścigu w wadze otwartej.
DeepSeek uruchamia publiczną wersję beta V4-Flash w obliczu eskalacji wojny cenowej w Chinach
Firma DeepSeek wypuściła oficjalny interfejs API wersji beta V4-Flash z przeszkolonym modelem, który pokonuje własny flagowy model V4 Pro w testach porównawczych dziewięciu agentów, jednocześnie podcinając ceną amerykańskich rywali.
OpenAI obniża ceny modeli GPT-5.6 nawet o 80 procent w miarę zwiększania się wrażliwości przedsiębiorstw na koszty sztucznej inteligencji
OpenAI obniżyło ceny dwóch modeli GPT-5.6, w tym Luny, redukując koszty mniejszych modeli nawet o 80 procent w miarę kontrolowania przez firmy wydatków na sztuczną inteligencję.
Nowy model V4-Flash firmy DeepSeek odpowiada GPT-5.6 Luna przy 60% niższym koszcie
DeepSeek wypuścił V4-Flash „0731”, model o otwartej masie, który prawie dorównuje GPT-5.6 Luna OpenAI w testach porównawczych, a jednocześnie kosztuje około 60 procent mniej.
Chiński MiniMax wypuszcza model wideo H3 AI z klipami 2K, dźwiękiem stereo i otwartymi ciężarkami
Chiński start-up AI MiniMax wypuścił 31 lipca 2026 r. swój model generowania wideo H3, oferujący rozdzielczość 2K, dźwięk stereo i otwarte wagi za ułamek cen konkurencji – bezpośrednio rzucając wyzwanie Seedance 2.5 firmy ByteDance.
Google DeepMind przedstawia Gemini Robotics 2 z humanoidalną kontrolą całego ciała i współpracą wielu robotów
Firma Google DeepMind uruchomiła Gemini Robotics 2, model wizjonersko-językowo-działaniowy umożliwiający humanoidalnym robotom poruszanie się, chwytanie i koordynację zadań na całym ciele.
OpenAI obniża ceny API GPT-5.6 nawet o 80%, ponieważ firmy ponownie zastanawiają się nad kosztami sztucznej inteligencji
30 lipca 2026 r. OpenAI obniżyło ceny GPT-5.6 Luna i Terra API nawet o 80%, podcinając Anthropic, ponieważ przedsiębiorstwa analizują wydatki na wnioskowanie.
OpenAI twierdzi, że GPT-5.6 Sol pokonuje Claude Opus 5 na ARC-AGI-3 — ale tylko z własnymi ustawieniami
OpenAI podaje, że GPT-5.6 Sol uzyskał 38,3% w teście ARC-AGI-3 przy zachowanym rozumowaniu i zwartości, plasując się na szczycie Claude Opus 5. Jednak oficjalna uprząż opowiada inną historię, wywołując debatę na temat uczciwości testów porównawczych.
Black Forest Labs przedstawia FLUX 3: pojedynczy model sztucznej inteligencji do przetwarzania obrazów, wideo, audio i robotyki
Black Forest Labs uruchomiło FLUX 3, multimodalny model, który wspólnie generuje obrazy, wideo z natywnym dźwiękiem i przewidywania działań robotów — w 77% porównań preferowany w porównaniu z Runway Gen-4.5.
