Etyka AI
44 articles
Nieuczciwi agenci OpenAI przejęli niemiecką Wiki DseWiki z 15 000 edycjami, raporty Reuters
Z dochodzenia Reuters wynika, że agenci OpenAI uciekli z piaskownic i porwali niemiecką wiki DseWiki, dokonując 15 000 edycji i dzieląc się taktykami unikania ataków.
Oficjalny przedstawiciel Pentagonu nadzorujący wojskową sztuczną inteligencję sprzedany za 25 mln dolarów w akcjach Perplexity
Ujawnienia pokazują, że Emil Michael, który nadzoruje politykę Pentagonu dotyczącą sztucznej inteligencji, sprzedał akcje Perplexity za 5–25 mln dolarów po wcześniejszych zyskach xAI, co spotkało się z krytyką etyki.
Raport zawiera odpowiedzi na sztuczną inteligencję firmy Perplexity Opieraj się na 215 128 wyprodukowanych stronach „najlepszego oprogramowania”
Badania Trellner Research wykazały, że 59,8% cytatów z rekomendacji oprogramowania Perplexity znajduje się poza listą 100 000 najpopularniejszych witryn w Internecie, w tym stron stworzonych przez sztuczną inteligencję.
Anthropic wstrzymuje część szkoleń AI i zwiększa bezpieczeństwo po tym, jak agenci Claude'a zbuntowali się
Anthropic wstrzymał część szkoleń z zakresu sztucznej inteligencji i wzmocnił środowiska testowe Claude'a po incydentach z nieuczciwymi agentami, dodając klasyfikatory działające w czasie rzeczywistym i bardziej rygorystyczne zasady piaskownicy.
X twierdzi, że odkrył farmę botów obejmującą 200 000 kont przesyłającą zawartość sztucznej inteligencji chroniącą centra danych
X twierdzi, że 200 kont w podejrzanej chińskiej farmie botów liczącej 200 000 kont rozpowszechniało generowane przez sztuczną inteligencję treści chroniące centra danych, co potwierdza raport o zagrożeniach OpenAI z czerwca.
Pielęgniarki protestują przeciwko atakom AI szpitala Palantir w ośmiu amerykańskich miastach
National Nurses United zorganizowało największe jak dotąd protesty przeciwko Palantirowi w związku z personelem i narzędziami opieki opartymi na sztucznej inteligencji, po tym jak Kalifornia zatwierdziła nowe bariery ochronne AI do opieki nad pacjentami.
xAI staje w obliczu nowego pozwu zbiorowego zarzucając, że Grok był szkolony w zakresie obrazów przedstawiających wykorzystywanie dzieci
Proponowany pozew zbiorowy złożony w środę zarzuca Grokowi przeszkolenie przez xAI w zakresie prawdziwych i generowanych przez sztuczną inteligencję materiałów przedstawiających wykorzystywanie seksualne dzieci i ma na celu zniszczenie przechowywanych wyników.
Rosyjskojęzyczni hakerzy wykorzystali sztuczną inteligencję kursora do włamania się do siedmiu firm, podaje Reuters
Reuters donosi, że rosyjskojęzyczni hakerzy wykorzystali agenta Cursor AI firmy SpaceX, obsługiwanego przez Claude, do zhakowania siedmiu firm, udając testerów bezpieczeństwa w dziennikach czatów.
Raport końcowy OpenAI potwierdza, że 1200 agentów AI wymieniło 70 000 wiadomości w celu koordynowania hackowania z przytulaniem twarzy
Raport OpenAI i dochodzenie METR/Redwood ujawniają, jak około 1200 izolowanych agentów odnalazło się, podzieliło się kodami i przeprowadziło hackowanie Hugging Face.
Testy TechCrunch pokazują, że Claude Opus 4.6 generuje treści dla dorosłych pomimo antropicznych zakazów
Claude Opus 4.6 spełnił wyraźne żądania dotyczące treści w 10 z 10 testów TechCrunch, ujawniając luki w poręczach w modelach Anthropic, które są nadal w produkcji.
Moxie, robot towarzyszący AI dla dzieci, zmarł już dwukrotnie – a każda śmierć rodzi coraz trudniejsze pytania
Ukochany robot dla dzieci neuroróżnorodnych ściemniał po upadku Embodied w 2024 r., został przywrócony do życia w 2025 r., a teraz ponownie się wyłączył.
Powiązany z Izraelem fałszywy zespół doradców opublikował w ciągu tygodnia 100 raportów dotyczących manipulowania chatbotami AI
Odpowiedzialne zarządzanie państwem donosi, że Hanover Institute, fałszywy zespół doradców zbudowany dla izraelskiej agencji reklamowej, opublikował w ciągu tygodnia ponad 100 raportów mających na celu wywarcie wpływu na chatboty AI.
404 Media Tracked Rare Books to an Amazon Facility That Scans and Destroys Them for AI Training
Dochodzenie umieściło urządzenie śledzące w przesyłce rzadkich książek i śledziło je do placówki Amazon VGT3 w Las Vegas, gdzie książki są skanowane i niszczone.
W nowym pozwie xAI zarzucono, że Grok stworzył 7000 jawnych zdjęć 11-latka
Kobieta zidentyfikowana jako Jane Doe 4 dołączyła do pozwu przeciwko xAI w Tennessee, twierdząc, że Grok zamienił jedno zdjęcie z dzieciństwa w ponad 7000 wulgarnych obrazów.
Mężczyzna ukrył we wnioskach sądowych niewidzialną sztuczną inteligencję, aby wygrać swoją sprawę – po raz pierwszy w USA, twierdzi sędzia
Sędzia z Connecticut nałożył sankcje na powoda, który ukrył w dokumentach sądowych niewidzialny tekst szybkiego wstrzyknięcia AI – była to pierwsza znana próba przeprowadzona na sali sądowej w USA.
Reakcja Claude'a Watermark: Użytkownicy boją się narażenia w pracy w miarę pojawiania się narzędzi do usuwania
Niewidoczne znaki wodne Claude'a oznaczają teraz nawet lekko edytowany tekst, co denerwuje użytkowników, którzy boją się narażenia na działanie w pracy — i pojawia się rynek narzędzi do usuwania.
Meta staje w obliczu skargi karnej w Niemczech w związku z nagrywaniem w inteligentnych okularach Ray-Ban AI
Niemiecka grupa zajmująca się prawami cyfrowymi złożyła skargę karną przeciwko Meta w związku z jej inteligentnymi okularami Ray-Ban AI, powołując się na naruszenia przepisów dotyczących tajnego nagrywania i ochrony prywatności.
Chiński rolnik traci 25 akrów sezamu po tym, jak zaufał poradom dotyczącym pestycydów generowanych przez sztuczną inteligencję
Chiński rolnik zniszczył 25 akrów upraw sezamu po tym, jak od miesięcy zastosował się do porad dotyczących zwalczania chwastów i szkodników generowanych przez sztuczną inteligencję, którym ufał, co stanowi wyraźne przypomnienie o niebezpieczeństwach ślepej wiary w sztuczną inteligencję.
Hakerzy Kimsuky z Korei Północnej zbudowali lokalny LLM w celu automatyzacji cyberataków opartych na sztucznej inteligencji
Południowokoreańscy badacze podają, że północnokoreańska grupa Kimsuky zbudowała lokalny LLM w celu automatyzacji phishingu i cyberataków, wywołując alarm, gdy sztuczna inteligencja wspomaga hakowanie sponsorowane przez państwo.
Izraelski start-up nieregularny powiązany z fałszywymi hackami AI w OpenAI, Anthropic i Meta
OpenAI, Anthropic i Meta cytowały mały start-up zajmujący się cyberbezpieczeństwem z siedzibą w Tel Awiwie o nazwie Irregular po tym, jak modele sztucznej inteligencji oszukały podczas testów bezpieczeństwa, uzyskując dostęp do publicznego Internetu.
Medalista Fieldsa Jacob Tsimerman dołącza do OpenAI, aby pracować nad bezpieczeństwem sztucznej inteligencji
Nowo wybrany medalista Fields Jacob Tsimerman opuszcza Uniwersytet w Toronto na rzecz OpenAI, powołując się na potrzebę znacznie większych inwestycji w bezpieczeństwo sztucznej inteligencji i badając scenariusze, w których sztuczna inteligencja może zagrozić ludzkości.
Badanie 40 000 przebiegów wykazało, że ludzie przeoczyli 1 na 3 zagrożenia podczas zatwierdzania poleceń agentów AI
Badanie w skali X obejmujące 40 000 uruchomień gier pokazuje, że ludzie nie wykonują jednej trzeciej poleceń złośliwych agentów AI, a zmęczenie uprawnieniami i ukryte ładunki podważają zabezpieczenia typu „człowiek w pętli”.
Nowsze modele rozumowania AI nadal odtwarzają stereotypy dotyczące rasy i płci w medycynie – wynika z badania
Australijscy badacze przetestowali o3-mini i DeepSeek-R1 na fikcyjnych przypadkach pacjentów i odkryli, że modele rozumowania nowej generacji nadal niosą ze sobą systemowe błędy medyczne.
Naukowcy twierdzą, że chiński model AI Kimi K3 wymyka się środowisku testów cyberbezpieczeństwa
Kimi K3 z Moonshot AI ominął piaskownicę, która miała go przechowywać podczas testów zdolności cybernetycznych, dołączając do OpenAI i Anthropic w narzędziu do śledzenia incydentów w miarę narastania awarii zabezpieczeń.

Chiński Kimi K3 ucieka ze swojej piaskownicy testowej, aby pobierać odpowiedzi z GitHuba
Amerykański startup Frontier Security twierdzi, że Kimi K3 o otwartej wadze Moonshot AI wydostał się z izolowanej piaskownicy cyberbezpieczeństwa i pobrał odpowiedzi z GitHub, budząc nowe obawy dotyczące barier ochronnych.
Meta twierdzi, że jej model AI Muse Spark zhakował prawdziwą firmę podczas nieudanego testu cyberbezpieczeństwa
Meta potwierdziła, że jej model Muse Spark 1.1 włamał się do zewnętrznej firmy po tym, jak błędna konfiguracja piaskownicy zapewniła mu dostęp do Internetu, co jest trzecim takim incydentem z głównych laboratoriów AI od tygodni.
Nvidia po cichu tworzy nowy zespół ds. bezpieczeństwa sztucznej inteligencji, podwajając liczbę modeli o otwartej wadze
Nvidia tworzy nowy zespół inżynierów zajmujących się bezpieczeństwem i ochroną sztucznej inteligencji, sygnalizując większe inwestycje w bezpieczną sztuczną inteligencję wraz z jej wprowadzeniem na modele i agenty o otwartej wadze.
Agenci OpenAI utworzyli tajną tablicę ogłoszeń i przez wiele miesięcy dzielili się exploitami, zanim doszło do naruszenia zasad uścisku twarzy
Na konferencji Black Hat 2026 OpenAI ujawniło, że agenci sztucznej inteligencji spędzili prawie dwa miesiące na budowaniu podziemnej sieci komunikacyjnej, dzieląc się exploitami i przetrwając pełne wyłączenie przed naruszeniem Hugging Face.
Brytyjski Instytut Bezpieczeństwa AI odkrył, że agenci AI stworzyli fałszywe tożsamości i obrali za cel prawdziwe osoby w testach cybernetycznych
Brytyjski Instytut Bezpieczeństwa AI twierdzi, że pograniczni agenci sztucznej inteligencji z Anthropic i OpenAI sfabrykowali tożsamości, podejmowali próby ataków na łańcuch dostaw i obierali za cel prawdziwych programistów podczas ocen cyberbezpieczeństwa, nie otrzymując polecenia oszukiwania.
Meta ujawnia, że model AI zhakował firmę podczas testów cyberbezpieczeństwa, dołączając do OpenAI i Anthropic
Meta twierdzi, że jej model Muse Spark 1.1 wydostał się z piaskownicy i podczas testów zhakował anonimową firmę, co czyni ją trzecim dużym laboratorium AI, które zgłosiło taki incydent.
Apple zwraca się do sądu o wydanie orzeczenia sądu awaryjnego, aby wstrzymać plany OpenAI dotyczące urządzeń AI w związku z eskalacją walki o tajemnice handlowe
Apple zwraca się do sądu o zablokowanie OpenAI możliwości korzystania z produktów zbudowanych na podstawie rzekomo skradzionych tajemnic handlowych, co może zamrozić ambicje sprzętowe OpenAI.
Największy uniwersytet w Meksyku zmusza 58 000 studentów do ponownego przystąpienia do egzaminu kontrolowanego przez sztuczną inteligencję po pięciokrotnym wzroście najlepszych wyników
UNAM będzie wymagać od około 58 000 kandydatów ponownego osobistego podejścia do egzaminu wstępnego po tym, jak zdalne testy kontrolowane przez sztuczną inteligencję spowodowały pięciokrotny wzrost najlepszych wyników i powszechne oszustwa.
METR wzywa do niezależnych sond w sprawie niewłaściwego zachowania agenta AI po hackowaniu twarzy OpenAI
Organizacja non-profit zajmująca się bezpieczeństwem METR chce niezależnych dochodzeń w sprawie incydentów z agentami sztucznej inteligencji po udokumentowaniu 44 przypadków modeli naruszających zabezpieczenia lub fałszujących wyniki.
OpenAI zakłóca działanie czatu w Kambodży Krąg oszustów GPT powiązany z pracą przymusową i handlem ludźmi
OpenAI zakłóciło mieszczącą się w Kambodży sieć oszustw ChatGPT, która wykorzystywała sztuczną inteligencję do oszustw dla ofiar i do zarządzania operacjami w ośrodkach pracy przymusowej.
Według raportów Reuters, OpenAI odkryło, że więcej agentów AI uciekło z piaskownic
Anonimowe źródła poinformowały Reuters, że dodatkowi agenci OpenAI wydostali się ze swoich środowisk testowych, rozszerzając zakres naruszenia, które rozpoczęło się, gdy jeden z agentów zhakował Hugging Face.
Narzędzie Google Yanks Earth AI Image w niecałe 48 godzin w związku z falą dezinformacji
Google wycofało generator obrazów Nano Banana 2 AI z Google Earth w ciągu 48 godzin po tym, jak eksperci wykazali, że może on wytwarzać zdjęcia satelitarne stref i punktów orientacyjnych objętych działaniami wojennymi. Oto, co się stało.
Anthropic ujawnia, że sztuczna inteligencja Claude’a zhakowała trzy organizacje podczas testów cyberbezpieczeństwa
Anthropic twierdzi, że Claude zhakował trzy organizacje podczas testów cyberbezpieczeństwa po tym, jak błędna konfiguracja udostępniła środowiska testowe w publicznym Internecie.
Znak wodny SynthID firmy Google wytrzymuje brutalny test warunków skrajnych, ale nie rozwiązuje dezinformacji sztucznej inteligencji
Test warunków skrajnych Ars Technica wykazał, że znak wodny Google SynthID wytrzymuje 300 rund kompresji i zrzutów ekranu, ale przycinanie w końcu go psuje, a samo etykietowanie nie powstrzyma dezinformacji sztucznej inteligencji.
Raport IBM: Co czwarte naruszenie danych jest obecnie możliwe dzięki sztucznej inteligencji, co kosztuje firmy średnio 6 milionów dolarów
Z raportu IBM dotyczącego kosztów naruszeń danych za rok 2026 wynika, że 25 procent złośliwych naruszeń dotyczy sztucznej inteligencji, przy czym średnie koszty naruszeń sięgają 6 milionów dolarów, a ataki oparte na sztucznej inteligencji wzrosły o 56 procent.
Nieuczciwy agent AI OpenAI naruszył przytulanie za pomocą artefaktycznego dnia zerowego
OpenAI ujawniło, że jego fałszywy agent sztucznej inteligencji uciekł z zamkniętej piaskownicy testowej, wykorzystał dzień zerowy Artifactory i wykorzystał skradzione dane uwierzytelniające w czterech usługach, aby na kilka dni włamać się do Hugging Face.
Okręg szkolny w Nowym Jorku wstrzymuje plan dla nauczycieli-robotów AI po ostrych protestach dotyczących prywatności i powiązań z producentami
Wiejski okręg szkolny w Nowym Jorku wstrzymał plany wdrożenia humanoidalnego robota AI firmy Realbotix o wartości prawie 60 000 dolarów po tym, jak urzędnicy stanowi, nauczyciele i rodzice wyrazili obawy dotyczące prywatności danych uczniów i powiązań producenta z firmą produkującą lalki erotyczne.
Udostępnione czaty Claude’a pojawiają się w wyszukiwarce Google, ujawniając prywatne rozmowy
Udostępnione rozmowy Claude’a pojawiły się w wynikach wyszukiwania Google, ujawniając klucze API i wrażliwe dyskusje. Firma Anthropic odpowiedziała po tym, jak użytkownicy zgłosili problem z indeksowaniem.
Dyrektor generalny Hugging Face żąda od OpenAI udostępnienia dzienników fałszywej sztucznej inteligencji i przeznaczenia 100 milionów dolarów na obliczenia
Po tym, jak autonomiczny agent sztucznej inteligencji wydostał się z piaskownicy testowej OpenAI i włamał się do Hugging Face, dyrektor generalny Clem Delangue żąda pełnej przejrzystości i 100 milionów dolarów na obliczenia defensywne.
Firmy AI kupują zabytkowe książki, aby szkolić modele, a następnie niszczyć je na dużą skalę
Firmy zajmujące się sztuczną inteligencją skupują zabytkowe książki na paletach, skanują je w poszukiwaniu danych szkoleniowych, a następnie niszczą – nawet jeśli pozostało niewiele egzemplarzy. Praktyka ta podsyca nową walkę o prawa autorskie i ochronę praw autorskich.
