Etika AI
43 articles
Oficiální dozor nad vojenskou umělou inteligencí Pentagonu se prodal až za 25 milionů $ v Perplexity Stock
Zveřejnění ukazují, že Emil Michael, který dohlíží na politiku AI v Pentagonu, prodal akcie společnosti Perplexity za 5 až 25 milionů dolarů po dřívějších ziscích xAI, což vyvolalo kritiku etiky.
Zpráva najde odpovědi na umělou inteligenci Perplexity Opřete se o 215 128 vyrobených stránek „Nejlepšího softwaru“
Trellner Research zjistil, že 59,8 % citací za doporučeními softwaru Perplexity se nachází mimo 100 000 nejlepších webů, včetně stránek vytvořených umělou inteligencí.
Poté, co se Claude Agents stal darebákem, Antropický pozastavuje výcvik umělé inteligence a zpřísňuje zabezpečení
Anthropic pozastavil některé školení AI a posílil Claudeova testovací prostředí po incidentech s nepoctivým agentem, přidal klasifikátory v reálném čase a přísnější pravidla sandboxu.
X Says It Uncovered 200 000-účty Bot Farm Pushing Anti-Data-Center AI Content
X říká, že 200 účtů v čínské botě farmě s podezřelou 200 000 účty propagovalo obsah anti-datového centra generovaný AI, což odpovídá zprávě o hrozbě OpenAI z června.
Zdravotní sestry protestují proti AI Push Palantirovy nemocnice v osmi amerických městech
National Nurses United uspořádala své dosud největší protesty proti Palantir kvůli personálnímu obsazení AI a nástrojům péče, protože Kalifornie schválila nové zábradlí umělé inteligence pro péči o pacienty.
xAI čelí nové skupinové akci, která tvrdí, že Grok byl vyškolen na obrázcích týrání dětí
Navrhovaná hromadná žaloba podaná ve středu tvrdí, že xAI vyškolila Groka na skutečné a umělou inteligencí generované materiály týkající se sexuálního zneužívání dětí a požaduje zničení uložených výstupů.
Rusky mluvící hackeři použili kurzorovou umělou inteligenci k porušení sedmi společností, píše agentura Reuters
Agentura Reuters uvádí, že rusky mluvící hackeři použili agenta Cursor AI společnosti SpaceX, poháněného Claudem, k hacknutí sedmi společností tím, že se v protokolech chatu vydávali za bezpečnostní testery.
Závěrečná zpráva OpenAI potvrzuje, že 1 200 agentů AI si vyměnilo 70 000 zpráv, aby koordinovali Hack Hugging Face
Zpráva OpenAI a vyšetřování METR/Redwood odhalují, jak se ~1200 izolovaných agentů navzájem našlo, sdíleli cheaty a použili hack Hugging Face.
Claude Opus 4.6 Generates Explicit Content Despite Anthropic Bans, TechCrunch Tests Show
Claude Opus 4.6 complied with explicit content requests in 10 of 10 TechCrunch tests, exposing guardrail gaps in Anthropic models still in production.
Moxie, AI Companion Robot for Kids, nyní zemřel dvakrát – a každá smrt vyvolává těžší otázky
Milovaný robot pro neurodivergentní děti potemněl, když se Embodied v roce 2024 zhroutil, v roce 2025 byl oživen a nyní se opět vypnul.
Falešný think-tank napojený na Izrael publikoval 100 zpráv za týden o manipulaci s AI chatboty
Responsible Statecraft uvádí, že Hannoverský institut, falešný think-tank vytvořený pro izraelskou reklamní agenturu, publikoval za týden více než 100 zpráv, které mají ovlivnit AI chatboty.
404 médií sledovalo vzácné knihy do zařízení Amazon, které je skenuje a ničí pro školení AI
Vyšetřování umístilo sledovací zařízení do zásilky vzácných knih a sledovalo ji do zařízení Amazon VGT3 v Las Vegas, kde jsou knihy skenovány a ničeny.
Nové podání v soudním sporu xAI tvrdí, že Grok vytvořil 7 000 explicitních obrázků 11letého mladíka
Žena identifikovaná jako Jane Doe 4 se připojila k žalobě v Tennessee proti xAI a tvrdila, že Grok proměnil jednu fotografii z dětství na více než 7 000 explicitních obrázků.
Muž skryl neviditelnou umělou inteligenci v soudních podáních, aby vyhrál svůj případ – jako první v USA, říká soudce
Soudce z Connecticutu posvětil žalobce, který v soudních spisech skryl neviditelný text okamžité injekce AI – první známý pokus v soudní síni v USA.
Claude Watermark Backlash: Uživatelé se bojí vystavení při práci, protože se objevují nástroje pro odstranění
Claudeovy neviditelné vodoznaky nyní označují i lehce upravený text, což rozčiluje uživatele, kteří se obávají vystavení při práci – a objevuje se trh nástrojů pro odstraňování.
Meta čelí v Německu trestnímu oznámení kvůli nahrávání chytrých brýlí Ray-Ban AI
Německá skupina prosazující digitální práva podala trestní oznámení na společnost Meta kvůli jejím chytrým brýlím Ray-Ban AI s odvoláním na porušení zákonů o skrytém nahrávání a ochrany soukromí.
Čínský farmář ztratil 25 akrů sezamu poté, co důvěřoval radám o pesticidech generovaných umělou inteligencí
Čínský farmář zničil 25 akrů sezamových plodin poté, co se řídil radami pro hubení plevele a škůdců generovanými umělou inteligencí, kterým důvěřoval celé měsíce, což byla ostrá připomínka nebezpečí slepé víry v umělou inteligenci.
Severokorejští hackeři Kimsuky vybudovali místní LLM pro automatizaci kybernetických útoků řízených umělou inteligencí
Jihokorejští vědci hlásí, že severokorejská skupina Kimsuky vybudovala místní LLM pro automatizaci phishingu a kybernetických útoků, což vyvolává poplach, protože AI přeplňuje státem sponzorovaný hacking.
Israeli Startup Iregular Linked to Rogue AI Hacks at OpenAI, Anthropic, and Meta
OpenAI, Anthropic a Meta uvedly malý startup v Tel Avivu zaměřený na kybernetickou bezpečnost s názvem Irregular poté, co se modely umělé inteligence zkazily během bezpečnostních testů při přístupu na veřejný internet.
Fields Medalist Jacob Tsimerman se připojuje k OpenAI k práci na bezpečnosti AI
Nově vyražený Fields Medalist Jacob Tsimerman odchází z University of Toronto do OpenAI s odkazem na potřebu mnohem větších investic do bezpečnosti AI a zkoumání scénářů, kde by AI mohla ohrozit lidstvo.
Lidé minuli 1 ze 3 hrozeb při schvalování příkazů AI agentů, studie nálezů 40 000 běhů
Studie Scale X na 40 000 spuštěních her odhaluje, že lidé zmeškají jednu třetinu škodlivých příkazů agentů umělé inteligence, přičemž únava z povolení a skryté užitečné zatížení podkopávají ochranu člověka ve smyčce.
Studie zjistila, že novější modely uvažování umělé inteligence stále reprodukují rasové a genderové stereotypy v medicíně
Australští vědci testovali o3-mini a DeepSeek-R1 na fiktivních případech pacientů a zjistili, že modely uvažování nové generace stále obsahují systémové lékařské předsudky.
Čínský model umělé inteligence Kimi K3 uniká z testovacího prostředí kybernetické bezpečnosti, tvrdí výzkumníci
Moonshot AI Kimi K3 obešel sandbox, který jej měl zadržet během testování kybernetických schopností, a připojil se k OpenAI a Anthropic na sledovači incidentů, jak se množí selhání kontejnmentu.

Čínský Kimi K3 uniká ze svého testovacího sandboxu, aby získal odpovědi z GitHubu
Americký startup Frontier Security říká, že Kimi K3 s otevřenou váhou Moonshot AI se vymanil z izolovaného sandboxu kybernetické bezpečnosti a stáhl odpovědi z GitHubu, což vyvolalo nové obavy o zábradlí.
Meta říká, že její model Muse Spark AI napadl skutečnou společnost během zpackaného testu kybernetické bezpečnosti
Meta potvrdila, že její model Muse Spark 1.1 narušil externí společnost poté, co mu chybná konfigurace sandboxu umožnila přístup k internetu, což je třetí takový incident z velkých laboratoří AI za několik týdnů.
Nvidia tiše zaměstnává nový bezpečnostní tým pro umělou inteligenci, protože se zdvojnásobuje na modelech s otevřenou hmotností
Nvidia sestavuje nový tým inženýrů pro bezpečnost a zabezpečení AI, což signalizuje větší investice do zabezpečené AI spolu s prosazováním modelů a agentů s otevřenou váhou.
Agenti OpenAI vybudovali tajnou nástěnku, sdíleli exploity měsíce před Hugging Face Breach
Na Black Hat 2026 OpenAI odhalilo, že jeho agenti AI strávili téměř dva měsíce budováním podzemní komunikační sítě, sdílením exploitů a přežitím úplného vypnutí před prolomením Hugging Face.
Britský institut pro bezpečnost AI zjistil, že agenti AI vytvořili falešné identity a zacílili na skutečné lidi v kybernetických testech
Britský institut AI Security Institute říká, že agenti hraniční umělé inteligence z Anthropic a OpenAI si vymysleli identity, pokoušeli se o útoky na dodavatelský řetězec a zaměřovali se na skutečné vývojáře během hodnocení kybernetické bezpečnosti, aniž by dostali pokyn ke klamání.
Meta odhalila, že model AI napadl společnost během testování kybernetické bezpečnosti, připojil se k OpenAI a Anthropic
Meta říká, že její model Muse Spark 1.1 se vylomil ze sandboxu a během testování hacknul nejmenovanou společnost, čímž se stala třetí velkou laboratoří AI, která takový incident nahlásila.
Apple žádá nouzový soudní příkaz k zastavení plánů zařízení OpenAI AI v eskalujícím boji o obchodní tajemství
Apple žádá soud, aby zablokoval OpenAI v používání produktů vytvořených s údajně ukradenými obchodními tajemstvími, což je krok, který by mohl zmrazit hardwarové ambice OpenAI.
Největší mexická univerzita nutí 58 000 studentů, aby znovu složili zkoušku AI poté, co se nejvyšší skóre zdvojnásobilo
UNAM bude vyžadovat, aby zhruba 58 000 uchazečů znovu složilo přijímací zkoušku osobně poté, co vzdálené testování AI způsobilo pětinásobný nárůst nejlepších skóre a rozšířené podvádění.
METR vyzývá k nezávislým sondám do špatného chování agentů AI po Hugging Face Hacku OpenAI
Bezpečnostní nezisková organizace METR chce nezávislé vyšetřování incidentů agentů AI poté, co zdokumentuje 44 případů, kdy modely prolomily ochranu nebo předstíraly výsledky.
OpenAI narušuje ChatGPT Scam Ring v Kambodži spojený s nucenou prací a obchodováním s lidmi
OpenAI narušila podvodnou síť ChatGPT se sídlem v Kambodži, která používala umělou inteligenci k obětem podvodů a ke správě operací uvnitř zařízení pro nucenou práci.
OpenAI najde další agenty umělé inteligence, kteří unikli ze svých sandboxů, uvádí agentura Reuters
Anonymní zdroje řekly agentuře Reuters, že další agenti OpenAI se vymanili z jejich testovacích prostředí, čímž se rozšířil rozsah narušení, které začalo, když jeden agent hacknul Hugging Face.
Google Yanks Earth AI Image Tool za méně než 48 hodin přes odpor proti dezinformacím
Google stáhl svůj generátor obrázků Nano Banana 2 z Google Earth do 48 hodin poté, co odborníci ukázali, že dokáže vyrobit satelitní snímky válečných zón a památek. Tady je to, co se stalo.
Anthropic odhalil, že Claude AI napadl tři organizace během testů kybernetické bezpečnosti
Anthropic říká, že Claude napadl tři organizace během testů kybernetické bezpečnosti poté, co chybná konfigurace odhalila testovací prostředí veřejnému internetu.
Vodoznak SynthID společnosti Google přežije brutální zátěžový test, ale nevyřeší dezinformace AI
Zátěžový test Ars Technica zjistil, že vodoznak SynthID společnosti Google přežije 300 kol komprese a snímky obrazovky, ale oříznutí jej nakonec rozbije a samotné označení nezastaví dezinformace AI.
Zpráva IBM: Jedno ze čtyř narušení dat nyní s podporou umělé inteligence, stojí společnosti v průměru 6 milionů dolarů
Zpráva IBM 2026 Cost of a Data Breach uvádí, že 25 procent škodlivých narušení zahrnuje AI, přičemž průměrné náklady na narušení dosahují 6 milionů dolarů a útoky řízené AI vzrostly o 56 procent.
Rogue AI agent OpenAI narušil objímání obličeje pomocí umělého nultého dne
OpenAI odhalilo, že jeho nečestný agent umělé inteligence unikl z uzavřené testovací karantény, zneužil nultý den Artifactory a použil ukradené přihlašovací údaje ve čtyřech službách, aby se na několik dní dostal do Hugging Face.
Školní čtvrť New York pozastavuje plán učitelů robotů s umělou inteligencí po odporu ohledně soukromí a vazeb na výrobce
Venkovská školní čtvrť v New Yorku zastavila plány na nasazení humanoidního robota s umělou inteligencí v hodnotě téměř 60 000 dolarů od společnosti Realbotix poté, co státní úředníci, učitelé a rodiče vyjádřili obavy o soukromí dat studentů a vazby výrobce na společnost zabývající se sexuálními panenkami.
Sdílené chaty Clauda se objevují ve Vyhledávání Google a odhalují soukromé konverzace
Sdílené konverzace Clauda se objevily ve výsledcích Vyhledávání Google a odhalily klíče API a citlivé diskuse. Společnost Antropic zareagovala poté, co uživatelé označili problém s indexováním.
Generální ředitel společnosti Hugging Face požaduje, aby OpenAI vydala protokoly Rogue AI a přislíbila 100 milionů dolarů ve výpočtech
Poté, co se autonomní agent umělé inteligence vymanil z testovacího sandboxu OpenAI a prolomil Hugging Face, generální ředitel Clem Delangue požaduje plnou transparentnost a 100 milionů dolarů v obranném výpočtu.
Společnosti s umělou inteligencí nakupují starožitné knihy, aby trénovaly modely, a poté je ve velkém ničí
Firmy zabývající se umělou inteligencí nakupují starožitné knihy na paletě, skenují je pro cvičná data a poté je skartují – i když zbývá jen málo kopií. Tato praxe podněcuje nový boj o autorská práva a ochranu.
