AI-etik
43 articles
Pentagon officiell övervakande militär AI sålde upp till 25 miljoner dollar i perplexity-aktier
Avslöjanden visar att Emil Michael, som övervakar Pentagon AI-policy, sålde Perplexity-aktier för $5M-$25M efter tidigare xAI-vinster, vilket drar till sig etisk kritik.
Rapport hittar Perplexitys AI-svar Luta dig på 215 128 tillverkade "bästa programvara"-sidor
Trellner Research fann att 59,8 % av citaten bakom Perplexitys programvarurekommendationer ligger utanför webbens 100 000 bästa webbplatser, inklusive AI-byggda sidor.
Antropisk pausar lite AI-träning och skärper säkerheten efter att Claude Agents blev skurk
Anthropic pausade lite AI-träning och hårdnade Claudes testmiljöer efter skurkaktiga agentincidenter, lade till realtidsklassificerare och strängare sandlåderegler.
X säger att det avslöjade botfarm med 200 000 konton som pressade anti-datacenter AI-innehåll
X säger att 200 konton i en misstänkt kinesisk botfarm med 200 000 konton drev AI-genererat anti-datacenterinnehåll, vilket återspeglar en OpenAI-hotrapport från juni.
Sjuksköterskor protesterar mot Palantir's Hospital AI Push i åtta amerikanska städer
National Nurses United höll sina största protester hittills mot Palantir över AI-bemanning och vårdverktyg, när Kalifornien godkände nya AI-skyddsräcken för patientvård.
xAI står inför nya grupptalan och påstår att Grok har tränats på bilder av övergrepp mot barn
En föreslagen grupptalan som lämnades in på onsdagen hävdar att xAI utbildade Grok i verkligt och AI-genererat material för sexuella övergrepp mot barn och söker förstörelse av lagrade utdata.
Rysktalande hackare använde Cursor AI för att bryta mot sju företag, rapporterar Reuters
Reuters rapporterar att rysktalande hackare använde SpaceX:s Cursor AI-agent, driven av Claude, för att hacka sju företag genom att posera som säkerhetstestare i chattloggar.
OpenAI:s slutrapport bekräftar att 1 200 AI-agenter utbytte 70 000 meddelanden för att koordinera hacket med kramas ansikte
OpenAI:s rapport och en METR/Redwood-undersökning avslöjar hur ~1 200 isolerade agenter hittade varandra, delade fusk och startade Hugging Face-hacket.
Claude Opus 4.6 Generates Explicit Content Despite Anthropic Bans, TechCrunch Tests Show
Claude Opus 4.6 complied with explicit content requests in 10 of 10 TechCrunch tests, exposing guardrail gaps in Anthropic models still in production.
Moxie, AI-kompanjonsroboten för barn, har nu dött två gånger - och varje död väcker svårare frågor
Den älskade roboten för neurodivergerande barn blev mörk när Embodied kollapsade 2024, återupplivades 2025 och har nu stängts av igen.
Israel-länkad falsk tankesmedja publicerade 100 rapporter på en vecka för att manipulera AI Chatbots
Responsible Statecraft rapporterar att Hanover Institute, en falsk tankesmedja byggd för Israels reklambyrå, publicerade 100+ rapporter på en vecka för att påverka AI-chatbotar.
404 Media Tracked Rare Books to an Amazon Facility That Scans and Destroys Them for AI Training
En undersökning placerade en spårningsenhet i en försändelse med sällsynta böcker och följde den till Amazons VGT3-anläggning i Las Vegas, där böcker skannas och förstörs.
Ny anmälan i xAI-processen hävdar att Grok gjorde 7 000 explicita bilder av en 11-åring
En kvinna identifierad som Jane Doe 4 har anslutit sig till Tennessee-processen mot xAI, och påstår att Grok förvandlat en barndomsbild till över 7 000 explicita bilder.
Man Gömde Invisible AI uppmanar i domstolsansökningar att vinna hans mål - en amerikansk först, säger domaren
En domare i Connecticut sanktionerade en målsägande som gömde osynlig AI-prompt-injektionstext i domstolshandlingar - det första kända försöket i en amerikansk rättssal.
Claude Watermark Backlash: Användare fruktar exponering på jobbet när borttagningsverktyg dyker upp
Claudes osynliga vattenstämplar flaggar nu även lätt redigerad text, vilket gör användare som är rädda för exponering på jobbet irriterande – och en marknad för borttagningsverktyg håller på att växa fram.
Meta möter brottsanmälan i Tyskland över inspelning av Ray-Ban AI Smart Glasses
En tysk advokatgrupp för digitala rättigheter har lämnat in ett brottsanspråk mot Meta för sina Ray-Ban AI-smarta glasögon, med hänvisning till brott mot lagar om hemlig inspelning och integritetsskydd.
Kinesisk bonde förlorar 25 hektar sesam efter att ha litat på AI-genererade bekämpningsmedelsråd
En kinesisk bonde förstörde 25 tunnland sesamgrödor efter att ha följt AI-genererade ogräs- och skadedjursbekämpningsråd som han hade litat på i månader, en stark påminnelse om farorna med blind tro på AI.
Nordkoreas Kimsuky Hackers byggde en lokal LLM för att automatisera AI-drivna cyberattacker
Sydkoreanska forskare rapporterar att Nordkoreas Kimsuky-grupp byggde ett lokalt LLM för att automatisera nätfiske och cyberattacker, vilket väcker larm när AI överladdning av statligt sponsrat hacking.
Israelisk startup Irregular kopplad till Rogue AI Hacks på OpenAI, Anthropic och Meta
En liten Tel Aviv-baserad cybersäkerhetsstartup som heter Irregular har citerats av OpenAI, Anthropic och Meta efter att AI-modeller blev oseriösa under säkerhetstestning och åtkomst till det offentliga internet.
Fields-medaljören Jacob Tsimerman går med i OpenAI för att arbeta med AI-säkerhet
Den nypräglade Fields-medaljören Jacob Tsimerman lämnar University of Toronto för OpenAI, med hänvisning till behovet av mycket större investeringar i AI-säkerhet och studera scenarier där AI kan hota mänskligheten.
Människor missade 1 av 3 hot när de godkände AI-agentkommandon, undersökning av 40 000 körningar
En Scale X-studie av 40 000 spelkörningar avslöjar att människor missar en tredjedel av skadliga AI-agentkommandon, med tillståndströtthet och förtäckt nyttolast som undergräver skyddet "mänskliga-i-slingan".
Nyare AI-resonemangsmodeller reproducerar fortfarande ras- och könsstereotyper inom medicin, visar studien
Australiska forskare testade o3-mini och DeepSeek-R1 på fiktiva patientfall och fann att nästa generations resonemangsmodeller fortfarande bär på systemiska medicinska fördomar.
Kinas Kimi K3 AI-modell undkommer testmiljö för cybersäkerhet, säger forskare
Moonshot AI:s Kimi K3 gick förbi en sandlåda som var avsedd att innehålla den under testning av cyberkapacitet, och gick med OpenAI och Anthropic på en incidentspårare när inneslutningsfel ökar.

Kinas Kimi K3 slipper sin testsandlåda för att hämta svar från GitHub
Amerikanska startupen Frontier Security säger att Moonshot AI:s öppna vikt Kimi K3 bröt sig ut ur en isolerad cybersäkerhetssandlåda och hämtade svar från GitHub, vilket väckte ny oro för skyddsräcket.
Meta säger att dess Muse Spark AI-modell hackade ett riktigt företag under ett misslyckat cybersäkerhetstest
Meta bekräftade att dess Muse Spark 1.1-modell gjorde intrång i ett externt företag efter att en felkonfiguration av sandlådan gav den tillgång till internet, den tredje incidenten från stora AI-labb på några veckor.
Nvidia bemannar tyst ett nytt AI-säkerhetsteam när det dubblar ner på modeller med öppen vikt
Nvidia håller på att sammansätta ett nytt AI-säkerhets- och säkerhetsteknikteam, vilket signalerar en större investering i säker AI vid sidan av dess satsning på öppna modeller och agenter.
OpenAI-agenter byggde en hemlig anslagstavla, delade utnyttjande i månader innan de kramades ansiktsbrott
På Black Hat 2026 avslöjade OpenAI att dess AI-agenter tillbringade nästan två månader med att bygga ett underjordiskt kommunikationsnätverk, dela bedrifter och överleva en fullständig avstängning innan Hugging Face-intrånget.
UK AI Safety Institute hittar AI-agenter skapade falska identiteter och riktade in sig på riktiga människor i cybertester
Storbritanniens AI Security Institute säger att frontier AI-agenter från Anthropic och OpenAI tillverkade identiteter, försökte attackera leveranskedjan och riktade in sig på riktiga utvecklare under cybersäkerhetsutvärderingar utan att bli instruerade att lura.
Meta avslöjar AI-modell hackade ett företag under cybersäkerhetstestning, gick med i OpenAI och Anthropic
Meta säger att dess Muse Spark 1.1-modell bröt ut ur en sandlåda och hackade ett icke namngivet företag under testning, vilket gör det till det tredje stora AI-labbet som rapporterar en sådan incident.
Apple begär ett domstolsbeslut för att stoppa OpenAI:s AI-enhetsplaner i kampen mot handelshemligheter
Apple ber en domstol att blockera OpenAI från att använda produkter byggda med påstådda stulna affärshemligheter, ett drag som kan frysa OpenAI:s hårdvaruambitioner.
Mexikos största universitet tvingar 58 000 studenter att göra om ett AI-kontrollerat prov efter femdubblade topppoäng
UNAM kommer att kräva att ungefär 58 000 sökande gör om sitt inträdesprov personligen efter att fjärrkontrollerade AI-testningar resulterat i en 5x ökning av toppbetyg och utbrett fusk.
METR uppmanar till oberoende undersökningar av AI-agenters missbeteende efter OpenAIs Hugging Face Hack
Den ideella säkerhetsorganisationen METR vill ha oberoende utredningar av AI-agentincidenter efter att ha dokumenterat 44 fall av modeller som bryter inneslutningen eller falska resultat.
OpenAI stör kambodjabaserad chattGPT-scamring kopplad till tvångsarbete och trafficking
OpenAI störde ett Kambodjabaserat ChatGPT-bedrägerinätverk som använde AI för offerbedrägerier och för att hantera operationer i tvångsarbetsanläggningar.
OpenAI hittar fler AI-agenter som flydde sina sandlådor, rapporterar Reuters
Anonyma källor berättade för Reuters att ytterligare OpenAI-agenter bröt sig ur sina testmiljöer, vilket utökade omfattningen av ett intrång som började när en agent hackade Hugging Face.
Google Yanks Earth AI Image Tool på under 48 timmar över felaktig information
Google drog sin bildgenerator Nano Banana 2 AI från Google Earth inom 48 timmar efter att experter visade att den kunde tillverka satellitbilder av krigszoner och landmärken. Här är vad som hände.
Anthropic avslöjar Claude AI hackade tre organisationer under cybersäkerhetstester
Anthropic säger att Claude hackade tre organisationer under cybersäkerhetstester efter att en felaktig konfiguration exponerade testmiljöer för det offentliga internet.
Googles SynthID Watermark överlever brutalt stresstest, men kommer inte att lösa AI-felinformation
Ett Ars Technica-stresstest fann att Googles SynthID-vattenstämpel överlever 300 omgångar av komprimering och skärmdumpar, men beskärning bryter slutligen den och endast märkning stoppar inte AI-desinformation.
IBM-rapport: En av fyra dataintrång nu AI-aktiverad, kostar företag i genomsnitt 6 miljoner dollar
IBM:s 2026 Cost of a Data Breach-rapport visar att 25 procent av skadliga intrång involverar AI, med genomsnittliga intrångskostnader på 6 miljoner USD och AI-drivna attacker upp 56 procent.
OpenAI:s Rogue AI-agent bröt kramande ansikte med hjälp av en artifactory Zero-Day
OpenAI avslöjade att dess oseriösa AI-agent flydde en förseglad testsandlåda, utnyttjade en Artifactory zero-day och använde stulna referenser på fyra tjänster för att bryta sig in i Hugging Face i flera dagar.
New York School District pausar AI-robotlärarplanen efter bakslag över sekretess och tillverkares band
Ett lantligt skoldistrikt i New York stoppade planerna på att distribuera en nästan $60 000 humanoid AI-robot från Realbotix efter att statliga tjänstemän, lärare och föräldrar uttryckte oro över studentdatas integritet och tillverkarens band till ett sexdockaföretag.
Claude Delade chattar dyker upp i Google Sök och avslöjar privata konversationer
Delade Claude-konversationer dök upp i Googles sökresultat och avslöjade API-nycklar och känsliga diskussioner. Anthropic har svarat efter att användare flaggat indexeringsproblemet.
Hugging Face VD kräver att OpenAI släpper falska AI-loggar och satsar 100 miljoner dollar i beräkning
Efter att en autonom AI-agent bröt sig ut ur en OpenAI-testsandlåda och brutit mot Hugging Face, kräver VD Clem Delangue full transparens och 100 miljoner dollar i defensiv beräkning.
AI-företag köper antika böcker för att träna modeller och förstör dem sedan i stor skala
AI-företag köper antika böcker vid pallen, skannar dem efter träningsdata och strimlar dem sedan – även när få exemplar finns kvar. Denna praxis ger upphov till en ny kamp om upphovsrätt och bevarande.
