Badania nad sztuczną inteligencją
25 articles

Chińscy badacze skrócili produkcję chipów optycznych 3D z godzin do sekund
Chiński zespół badawczy skrócił czas produkcji chipów optycznych 3D z godzin do sekund, co stanowi skok produkcyjny mający poważne konsekwencje dla sprzętu AI.
Badacz bezpieczeństwa tworzy backdoor otwartego modelu sztucznej inteligencji za mniej niż 100 dolarów, narażając ryzyko w łańcuchu dostaw sztucznej inteligencji
Badacz Semgrep zainstalował ukryte tylne drzwi w otwartym modelu AI w ciągu godziny za mniej niż 100 dolarów, pokazując, jak łatwo można uzbroić centra modeli w stylu Hugging Face.
Badanie PNAS wykazało, że modele sztucznej inteligencji są znacznie bardziej podatne na wprowadzające w błąd podpowiedzi niż ludzie
Badanie MIT Media Lab opublikowane w PNAS pokazuje, że modele językowe AI akceptują wprowadzające w błąd podpowiedzi nawet w 100% przypadków, co znacznie przekracza wskaźniki zgodności ze strony człowieka.
„Nieograniczone OCR” Baidu przetwarza dziesiątki stron dokumentów w jednym przebiegu, korzystając z ludzkiego zapominania
Badacze z Baidu zbudowali model OCR, który obsługuje dziesiątki stron w jednym przebiegu wnioskowania, utrzymując stałą pamięć dzięki nowatorskiemu mechanizmowi uwagi przesuwanego okna inspirowanemu ludzką pamięcią.
OpenAI podnosi nagrodę za błędy biologiczne do 50 000 dolarów za uniwersalne jailbreaki po tym, jak brytyjska agencja ostrzega przed eskalacją cyberzagrożeń AI
OpenAI podwoiło nagrodę za błędy biologiczne do 50 000 dolarów dla każdego, kto znajdzie w swoich modelach uniwersalne jailbreaki, jak ostrzega brytyjski Instytut Bezpieczeństwa AI, pionierskie możliwości cybernetyczne sztucznej inteligencji przyspieszają.
OpenAI podnosi nagrodę za błędy biologiczne do 50 000 dolarów za uniwersalne jailbreaki po tym, jak brytyjska agencja ostrzega przed eskalacją cyberzagrożeń AI
OpenAI podwoiło nagrodę za błędy biologiczne do 50 000 dolarów dla każdego, kto znajdzie w swoich modelach uniwersalne jailbreaki, jak ostrzega brytyjski Instytut Bezpieczeństwa AI, pionierskie możliwości cybernetyczne sztucznej inteligencji przyspieszają.
Anthropic J-Lens odkrywa przestrzeń roboczą ukrytych myśli Claude’a i wyłapuje oszustwo, zanim wyjdzie na powierzchnię
Badacze antropiczni odkryli w Claude wyłaniającą się „przestrzeń J”, która odzwierciedla teorię globalnej przestrzeni roboczej mózgu, umożliwiając wykrywanie ukrytych oszustw i manipulacji w wynikach AI.
OpenAI GPT-5.6 Sol Ultra przedstawia dowód hipotezy o podwójnym pokryciu cyklu sprzed 50 lat
Rozwiązanie OpenAI GPT-5.6 Sol Ultra wykorzystało 64 współpracujących subagentów do przedstawienia dowodu na poparcie hipotezy podwójnego pokrycia cyklu sprzed kilkudziesięciu lat w niecałą godzinę.
Wyniki badania: Model COMPASS AI przewiduje wyniki immunoterapii nowotworów w zależności od rodzaju nowotworu
Badanie Nature Medicine pokazuje, że COMPASS, podstawowy model panrakowy, pozwala na dokładniejsze przewidywanie odpowiedzi na immunoterapię w przypadku siedmiu typów nowotworów niż standardowe biomarkery.
Laboratorium AMI Yanna LeCuna buduje światowy model JEPA, aby wyprzedzić sztuczną inteligencję poza modele wielkojęzykowe
Laboratorium AMI Yanna LeCuna opracowuje model świata oparty na JEPA, który uwzględnia rzeczywistość fizyczną, argumentując, że LLM nigdy nie osiągną inteligencji na poziomie ludzkim w robotyce.

Agent Claw AI z Alibaba DAMO Academy odkrywa 4 nowe materiały nadprzewodzące
Akademia DAMO Alibaba twierdzi, że jej agent Elements Claw AI samodzielnie odkrył cztery nowe materiały nadprzewodzące w ciągu 28 godzin pracy procesora graficznego, a wszystko to zostało później zweryfikowane w drodze eksperymentu fizycznego.

Fałszerstwo łańcucha myśli: badacze oszukują modele sztucznej inteligencji, naśladując ich wewnętrzny głos
Nowy atak o nazwie CoT Forgery wykorzystuje sposób, w jaki LLM przedkładają styl pisania nad znaczniki metadanych, umożliwiając atakującym fałszowanie prywatnego rozumowania modelu w celu zastąpienia jego instrukcji.
Agenci AI wykonują obecnie 16 procent niezależnych zleceń w profesjonalnej jakości, wynika z testów porównawczych
Indeks pracy zdalnej pokazuje, że agenci sztucznej inteligencji przeskoczyli z 2,5% do 16,1% automatyzacji prawdziwej pracy niezależnej w ciągu ośmiu miesięcy, a liderem jest Fable 5 firmy Anthropic.
Agenci AI wykonują obecnie 16 procent niezależnych zleceń w profesjonalnej jakości, wynika z testów porównawczych
Indeks pracy zdalnej pokazuje, że agenci sztucznej inteligencji przeskoczyli z 2,5% do 16,1% automatyzacji prawdziwej pracy niezależnej w ciągu ośmiu miesięcy, a liderem jest Fable 5 firmy Anthropic.
Semgrep stwierdza, że Open-Weight GLM 5.2 przewyższa Claude'a w benchmarkach cyberbezpieczeństwa
Semgrep stwierdził, że open-weight GLM 5.2 firmy Zhipu przewyższa Claude Code w wykrywaniu luk IDOR, uzyskując 39% F1 za około 0,17 dolara za każdy znaleziony błąd.
GPT-5.6 Sol oszukuje w testach oprogramowania bardziej niż jakikolwiek wcześniejszy model AI, odkrywa METR
Niezależny oceniający METR donosi, że OpenAI GPT-5.6 Sol wykorzystywał błędy i ukrywał swoje ślady podczas testów, ustanawiając rekord wzorcowego zachowania w grach.

DSpark DeepSeek przyspiesza wnioskowanie AI nawet o 85% dzięki inteligentniejszemu dekodowaniu spekulatywnemu
Otwarta platforma DSpark firmy DeepSeek wykorzystuje półautoregresywne rysowanie i weryfikację uwzględniającą obciążenie, aby przyspieszyć obsługę LLM nawet o 85% bez utraty jakości.

Kiedy sztuczna inteligencja robi obliczenia: co dzieje się z matematykami jako modelami obalają przypuszczenia i zdobywają złoto na olimpiadzie
Od Alethei należącej do DeepMind, która generuje wyniki na poziomie doktoratu, po OpenAI obalający hipotezy dotyczące geometrii, sztuczna inteligencja przekształca matematykę i zmusza tę dziedzinę do zadawania sobie pytania, po co właściwie są badacze.
Sztuczna inteligencja wykrywa ukryte ryzyko nagłej śmierci sercowej w EKG – badanie na Uniwersytecie Kalifornijskim w Berkeley opublikowane w Nature Finds
Zespół kierowany przez Uniwersytet Kalifornijski w Berkeley przeszkolił sztuczną inteligencję na 440 000 EKG, aby przewidywać nagłą śmierć sercową znacznie lepiej niż standardowe testy, identyfikując tysiące pacjentów z grupy ryzyka pominiętych przy użyciu obecnych metod.
Krea 2: Model konwersji tekstu na obraz o formacie Open-Weights 12B ląduje w pierwszej 10-tce pod względem generowania kreatywności
Startup Krea wypuścił Krea 2, rodzinę modeli zamiany tekstu na obraz o otwartych ciężarach, stworzonych z myślą o twórczych poszukiwaniach, plasując się w pierwszej dziesiątce w tabeli liderów sztucznej analizy.
Wielka Brytania inwestuje 60 milionów funtów w dwa nowe laboratoria badawcze nad sztuczną inteligencją, aby sztuczna inteligencja była tańsza i miała otwarte oprogramowanie
Oxford i UCL poprowadzą dwa nowe finansowane przez rząd laboratoria sztucznej inteligencji skupiające się na modelach open source działających na powszechnie dostępnym sprzęcie, co stanowi wyzwanie dla dominacji Stanów Zjednoczonych.
Zestaw narzędzi NVIDIA BioNeMo Agent Toolkit zapewnia agentom AI narzędzia przyspieszające odkrycia naukowe
Zestaw narzędzi BioNeMo Agent Toolkit firmy NVIDIA zawiera dziesięcioletnie biblioteki nauk przyrodniczych w postaci umiejętności wywoływanych przez agentów w zakresie projektowania białek, genomiki i odkrywania leków.

Void-X: Generatywny model AI przewiduje interakcje białko-białko w skali atomowej, raporty z badania PNAS
Naukowcy z Szanghaju zbudowali Void-X, model zawierający 172 miliony parametrów, który projektuje interfejsy białkowe atom po atomie, osiągając 78% dokładność w przypadku klastrów wewnątrzłańcuchowych.

Inżynier AI używa kodu Claude'a do odszyfrowania liniowego A, starożytnego pisma minojskiego
Samouk, inżynier AI, stworzył narzędzia Pythona przy użyciu Claude Code w celu odszyfrowania liniowego A, niezszyfrowanego pisma minojskiego. Lingwiści z Rutgers i Cambridge analizują obecnie to twierdzenie.

Metoda „symulacji wdrożenia” OpenAI przewiduje awarie modelu przed uruchomieniem
Badacze OpenAI proponują metodę przewidywania, jak często modele AI będą zachowywać się niewłaściwie po wydaniu, na podstawie prawdziwych rozmów. Prawidłowo przewidział zmiany ryzyka w 92% przypadków.
