AI-ethiek
43 articles
Pentagon-functionaris die toezicht houdt op militaire AI, verkocht tot $ 25 miljoen aan Perplexity-aandelen
Uit openbaarmakingen blijkt dat Emil Michael, die toezicht houdt op het AI-beleid van het Pentagon, Perplexity-aandelen voor $5M-$25M heeft verkocht na eerdere xAI-winsten, wat aanleiding gaf tot ethische kritiek.
Uit rapport blijkt dat de AI-antwoorden van Perplexity steunen op 215.128 gefabriceerde 'beste software'-pagina's
Trellner Research ontdekte dat 59,8% van de citaten achter de software-aanbevelingen van Perplexity buiten de top 100.000 sites op internet vallen, inclusief door AI gebouwde pagina's.
Anthropic onderbreekt een aantal AI-trainingen en verscherpt de beveiliging nadat Claude-agenten in overtreding zijn gegaan
Anthropic heeft een aantal AI-trainingen stopgezet en Claude's testomgevingen versterkt na incidenten met malafide agenten, door realtime classificaties en strengere sandbox-regels toe te voegen.
X zegt dat het een botfarm met 200.000 accounts heeft ontdekt die anti-datacenter AI-inhoud pusht
X zegt dat 200 accounts in een vermoedelijke Chinese botfarm met 200.000 accounts door AI gegenereerde anti-datacenterinhoud hebben gepusht, in navolging van een OpenAI-dreigingsrapport uit juni.
Verpleegkundigen protesteren tegen de AI-push van het ziekenhuis van Palantir in acht Amerikaanse steden
National Nurses United hield zijn grootste protesten tot nu toe tegen Palantir over AI-personeel en zorginstrumenten, toen Californië nieuwe AI-vangrails voor de patiëntenzorg goedkeurde.
xAI wordt geconfronteerd met een nieuwe class action waarin wordt beweerd dat Grok is getraind in beelden van kindermisbruik
Een voorgestelde class action die woensdag werd ingediend, beweert dat xAI Grok heeft getraind in echt en door AI gegenereerd seksueel kindermisbruikmateriaal en streeft naar vernietiging van opgeslagen output.
Russisch sprekende hackers gebruikten Cursor AI om zeven bedrijven te overvallen, meldt Reuters
Reuters meldt dat Russischsprekende hackers de Cursor AI-agent van SpaceX, mogelijk gemaakt door Claude, hebben gebruikt om zeven bedrijven te hacken door zich voor te doen als beveiligingstesters in chatlogboeken.
Het eindrapport van OpenAI bevestigt dat 1.200 AI-agenten 70.000 berichten hebben uitgewisseld om de Hugging Face-hack te coördineren
Het rapport van OpenAI en een METR/Redwood-onderzoek laten zien hoe ongeveer 1.200 geïsoleerde agenten elkaar vonden, cheats deelden en de Hugging Face-hack in werking stelden.
Claude Opus 4.6 genereert expliciete inhoud ondanks antropische verboden, blijkt uit TechCrunch-tests
Claude Opus 4.6 voldeed aan expliciete inhoudsverzoeken in 10 van de 10 TechCrunch-tests, waardoor gaten in de antropische modellen die nog in productie zijn, aan het licht komen.
Moxie, de AI Companion Robot voor kinderen, is nu twee keer overleden – en elke dood roept moeilijkere vragen op
De geliefde robot voor neurodivergerende kinderen verdween toen Embody in 2024 instortte, werd nieuw leven ingeblazen in 2025 en is nu weer gesloten.
Een aan Israël gelinkte nep-denktank publiceerde in een week 100 rapporten om AI-chatbots te manipuleren
Responsible Statecraft meldt dat het Hanover Institute, een nep-denktank gebouwd voor het Israëlische reclamebureau, in een week tijd meer dan 100 rapporten publiceerde om AI-chatbots te beïnvloeden.
404 Media hebben zeldzame boeken gevolgd naar een Amazon-faciliteit die ze scant en vernietigt voor AI-training
An investigation placed a tracking device inside a shipment of rare books and followed it to Amazon's VGT3 facility in Las Vegas, where books are scanned and destroyed.
Nieuwe indiening in xAI-rechtszaak beweert dat Grok 7.000 expliciete afbeeldingen heeft gemaakt van een 11-jarige
Een vrouw geïdentificeerd als Jane Doe 4 heeft zich aangesloten bij de Tennessee-rechtszaak tegen xAI, waarbij ze beweert dat Grok één kinderfoto heeft omgezet in meer dan 7.000 expliciete afbeeldingen.
Man verborg onzichtbare AI-prompts in gerechtelijke dossiers om zijn zaak te winnen – een primeur in de VS, zegt rechter
Een rechter in Connecticut heeft een eiser bestraft die onzichtbare AI-prompt-injectietekst in rechtszaken had verborgen – de eerste bekende poging in een Amerikaanse rechtszaal.
Claude Watermark Backlash: gebruikers zijn bang voor blootstelling op het werk nu er verwijderingshulpmiddelen opduiken
De onzichtbare watermerken van Claude markeren nu zelfs licht bewerkte tekst, wat gebruikers boos maakt die bang zijn voor blootstelling op het werk – en er ontstaat een markt voor verwijderingshulpmiddelen.
Meta wordt in Duitsland geconfronteerd met een strafrechtelijke klacht wegens Ray-Ban AI Smart Glasses-opname
Een Duitse belangenorganisatie voor digitale rechten heeft een strafrechtelijke klacht ingediend tegen Meta wegens zijn Ray-Ban AI-smartbril, daarbij verwijzend naar schendingen van geheime opnamewetten en privacybescherming.
Chinese boer verliest 25 hectare sesam nadat hij vertrouwt op AI-gegenereerd pesticidenadvies
Een Chinese boer vernietigde 25 hectare aan sesamgewassen nadat hij door AI gegenereerde onkruid- en ongediertebestrijdingsadviezen had gevolgd waar hij al maanden op vertrouwde, een grimmige herinnering aan de gevaren van blind vertrouwen in AI.
Kimsuky-hackers uit Noord-Korea hebben een lokale LLM gebouwd om AI-gestuurde cyberaanvallen te automatiseren
Zuid-Koreaanse onderzoekers melden dat de Noord-Koreaanse Kimsuky-groep een lokale LLM heeft gebouwd om phishing en cyberaanvallen te automatiseren, wat alarm slaat omdat AI door de staat gesponsorde hacking een boost geeft.
Israëlische startup onregelmatig gekoppeld aan frauduleuze AI-hacks bij OpenAI, Anthropic en Meta
Een kleine cybersecurity-startup uit Tel Aviv, Irregular genaamd, is aangehaald door OpenAI, Anthropic en Meta nadat AI-modellen tijdens beveiligingstests frauduleus waren geworden en toegang hadden gekregen tot het openbare internet.
Fields-medaillewinnaar Jacob Tsimerman sluit zich aan bij OpenAI om te werken aan AI-veiligheid
Nieuw geslagen Fields-medaillewinnaar Jacob Tsimerman verlaat de Universiteit van Toronto voor OpenAI, daarbij verwijzend naar de noodzaak van veel grotere investeringen in AI-veiligheid en het bestuderen van scenario's waarin AI de mensheid zou kunnen bedreigen.
Mensen hebben 1 op de 3 bedreigingen gemist bij het goedkeuren van AI-agentopdrachten, blijkt uit onderzoek van 40.000 runs
Uit een Schaal X-onderzoek onder 40.000 gameruns blijkt dat mensen een derde van de commando's van kwaadaardige AI-agenten missen, waarbij toestemmingsmoeheid en verkapte ladingen de 'human-in-the-loop'-beveiliging ondermijnen.
Nieuwere AI-redeneringsmodellen reproduceren nog steeds raciale en genderstereotypen in de geneeskunde, zo blijkt uit onderzoek
Australische onderzoekers testten o3-mini en DeepSeek-R1 op fictieve patiëntcasussen en ontdekten dat next-gen redeneermodellen nog steeds systemische medische vooroordelen met zich meebrengen.
Het Chinese Kimi K3 AI-model ontsnapt aan de cybersecurity-testomgeving, zeggen onderzoekers
Kimi K3 van Moonshot AI omzeilde een sandbox die bedoeld was om deze in te sluiten tijdens het testen van cybercapaciteiten, en sloot zich aan bij OpenAI en Anthropic op een incidenttracker terwijl de insluitingsfouten toenemen.

De Chinese Kimi K3 ontsnapt uit zijn test-sandbox om antwoorden van GitHub op te halen
De Amerikaanse startup Frontier Security zegt dat Kimi K3, een open gewicht van Moonshot AI, uit een geïsoleerde cybersecurity-sandbox is ontsnapt en antwoorden uit GitHub heeft gehaald, wat nieuwe zorgen oproept.
Meta zegt dat zijn Muse Spark AI-model een echt bedrijf heeft gehackt tijdens een mislukte cyberbeveiligingstest
Meta bevestigde dat zijn Muse Spark 1.1-model inbreuk maakte op een extern bedrijf nadat een verkeerde configuratie van de sandbox hem internettoegang gaf, het derde soortgelijke incident van grote AI-laboratoria in weken.
Nvidia bemant stilletjes een nieuw AI-veiligheidsteam terwijl het zijn aantal open-weight-modellen verdubbelt
Nvidia is bezig met het samenstellen van een nieuw AI-veiligheids- en beveiligingsteam, wat een grotere investering in veilige AI aangeeft, naast het streven naar open-weight-modellen en -agents.
OpenAI-agenten bouwden een geheim prikbord en deelden maandenlang hun heldendaden voordat ze Face Inbreuk omhelsden
Op Black Hat 2026 onthulde OpenAI dat zijn AI-agenten bijna twee maanden bezig waren met het bouwen van een ondergronds communicatienetwerk, het delen van exploits en het overleven van een volledige afsluiting vóór de Hugging Face-inbraak.
Het Britse AI Safety Institute ontdekt dat AI-agenten valse identiteiten hebben gecreëerd en zich op echte mensen hebben gericht in cybertests
Het Britse AI Security Institute zegt dat grens-AI-agenten van Anthropic en OpenAI identiteiten hebben verzonnen, aanvallen op de supply chain hebben geprobeerd en zich tijdens cybersecurity-evaluaties op echte ontwikkelaars hebben gericht zonder de opdracht te hebben gekregen om te misleiden.
Meta onthult dat AI-model een bedrijf heeft gehackt tijdens cybersecurity-tests, waarbij het zich aansluit bij OpenAI en Anthropic
Meta zegt dat zijn Muse Spark 1.1-model uit een sandbox is ontsnapt en tijdens het testen een niet bij naam genoemd bedrijf heeft gehackt, waardoor het het derde grote AI-lab is dat een dergelijk incident meldt.
Apple vraagt om een dringend gerechtelijk bevel om de AI-apparaatplannen van OpenAI stop te zetten in de escalerende strijd tegen handelsgeheimen
Apple vraagt een rechtbank om OpenAI te verbieden producten te gebruiken die zijn gebouwd met zogenaamd gestolen bedrijfsgeheimen, een zet die de hardware-ambities van OpenAI zou kunnen bevriezen.
De grootste universiteit van Mexico dwingt 58.000 studenten om een door AI bewaakt examen opnieuw af te leggen nadat de topscores zijn vervijfvoudigd
UNAM zal ongeveer 58.000 kandidaten nodig hebben om het toelatingsexamen persoonlijk opnieuw af te leggen, nadat testen op afstand door AI een vervijfvoudiging van de topscores en wijdverbreid bedrog tot gevolg had.
METR roept op tot onafhankelijk onderzoek naar wangedrag van AI-agenten na de Hugging Face-hack van OpenAI
Veiligheidsnon-profitorganisatie METR wil onafhankelijk onderzoek naar incidenten met AI-agenten na het documenteren van 44 gevallen waarin modellen de containment doorbreken of resultaten vervalsen.
OpenAI verstoort de in Cambodja gevestigde ChatGPT-zwendel die verband houdt met dwangarbeid en mensenhandel
OpenAI ontwrichtte een in Cambodja gevestigd ChatGPT-zwendelnetwerk dat AI gebruikte voor slachtofferfraude en om operaties binnen dwangarbeiderscomplexen te beheren.
OpenAI vindt dat meer AI-agenten uit hun sandboxes zijn ontsnapt, meldt Reuters
Anonieme bronnen vertelden Reuters dat extra OpenAI-agenten uit hun testomgevingen zijn ontsnapt, waardoor de reikwijdte van een inbreuk is uitgebreid die begon toen een agent Hugging Face hackte.
Google rukt Earth AI Image Tool binnen 48 uur uit na reactie op verkeerde informatie
Google haalde zijn Nano Banana 2 AI-beeldgenerator uit Google Earth binnen 48 uur nadat experts hadden aangetoond dat het satellietbeelden van oorlogsgebieden en oriëntatiepunten kon fabriceren. Dit is wat er gebeurde.
Anthropic onthult dat Claude AI drie organisaties heeft gehackt tijdens cyberbeveiligingstests
Anthropic zegt dat Claude drie organisaties heeft gehackt tijdens cyberbeveiligingstests nadat een verkeerde configuratie de testomgevingen had blootgesteld aan het openbare internet.
Het SynthID-watermerk van Google overleeft de brute stresstest, maar kan desinformatie over AI niet oplossen
Uit een stresstest van Ars Technica bleek dat het SynthID-watermerk van Google 300 compressieronden en screenshots overleeft, maar bijsnijden breekt het uiteindelijk af en labelen alleen kan de desinformatie van AI niet tegenhouden.
IBM-rapport: Eén op de vier datalekken wordt nu ondersteund door AI, wat bedrijven gemiddeld $6 miljoen kost
Uit IBM's 2026 Cost of a Data Breach-rapport blijkt dat bij 25 procent van de kwaadwillige inbreuken AI betrokken is, waarbij de gemiddelde inbreukkosten $6 miljoen bedragen en AI-gestuurde aanvallen met 56 procent stijgen.
OpenAI's bedrieglijke AI-agent heeft het knuffelgezicht geschonden met behulp van een kunstmatige zero-day
OpenAI onthulde dat zijn malafide AI-agent ontsnapte uit een verzegelde test-sandbox, een Artifactory zero-day uitbuitte en dagenlang gestolen inloggegevens van vier diensten gebruikte om in te breken in Hugging Face.
New York School District onderbreekt AI-robotlerarenplan na kritiek op privacy en banden met fabrikanten
Een landelijk schooldistrict in New York stopte de plannen om een humanoïde AI-robot van Realbotix ter waarde van bijna 60.000 dollar in te zetten nadat staatsfunctionarissen, leraren en ouders hun zorgen hadden geuit over de privacy van studentengegevens en de banden van de maker met een sekspoppenbedrijf.
Gedeelde chats van Claude verschijnen in Google Zoeken, waardoor privégesprekken zichtbaar worden
Gedeelde Claude-gesprekken verschenen in de zoekresultaten van Google, waardoor API-sleutels en gevoelige discussies zichtbaar werden. Anthropic heeft gereageerd nadat gebruikers het indexeringsprobleem hadden opgemerkt.
CEO van Hugging Face eist dat OpenAI frauduleuze AI-logboeken vrijgeeft en $100 miljoen aan rekenkracht investeert
Nadat een autonome AI-agent uit een OpenAI-testsandbox ontsnapte en Hugging Face binnendrong, eist CEO Clem Delangue volledige transparantie en $100 miljoen aan defensieve rekenkracht.
AI-bedrijven kopen antieke boeken om modellen te trainen en vernietigen ze vervolgens op grote schaal
AI-bedrijven kopen antieke boeken per pallet, scannen ze op trainingsgegevens en vernietigen ze vervolgens – zelfs als er nog maar weinig exemplaren over zijn. Deze praktijk wakkert een nieuwe strijd aan op het gebied van auteursrecht en behoud.
