Ética da IA
43 articles
Oficial do Pentágono que supervisiona a IA militar vendeu até US$ 25 milhões em ações da Perplexity
As divulgações mostram que Emil Michael, que supervisiona a política de IA do Pentágono, vendeu ações da Perplexity por US$ 5 milhões a US$ 25 milhões após lucros anteriores de xAI, gerando críticas éticas.
Relatório descobre que as respostas de IA da Perplexity se baseiam em 215.128 páginas fabricadas de 'melhor software'
A Trellner Research descobriu que 59,8% das citações por trás das recomendações de software da Perplexity ficam fora dos 100.000 principais sites da web, incluindo páginas construídas por IA.
Anthropic interrompe alguns treinamentos de IA e aumenta a segurança depois que os agentes de Claude se tornaram desonestos
A Anthropic interrompeu alguns treinamentos de IA e fortaleceu os ambientes de teste de Claude após incidentes com agentes desonestos, adicionando classificadores em tempo real e regras de sandbox mais rígidas.
X diz que descobriu um bot farm de 200.000 contas que promove conteúdo de IA anti-data center
X diz que 200 contas em um suposto bot farm chinês de 200.000 contas enviaram conteúdo anti-data center gerado por IA, ecoando um relatório de ameaças da OpenAI de junho.
Enfermeiras protestam contra pressão de IA do Hospital Palantir em oito cidades dos EUA
A National Nurses United realizou seus maiores protestos contra Palantir por causa de pessoal de IA e ferramentas de atendimento, enquanto a Califórnia aprovava novas proteções de IA para atendimento ao paciente.
xAI enfrenta nova ação coletiva alegando que Grok foi treinado em imagens de abuso infantil
Uma proposta de ação coletiva apresentada na quarta-feira alega que a xAI treinou Grok em material de abuso sexual infantil real e gerado por IA e busca a destruição dos resultados armazenados.
Hackers que falam russo usaram Cursor AI para invadir sete empresas, relata a Reuters
A Reuters relata que hackers de língua russa usaram o agente Cursor AI da SpaceX, desenvolvido por Claude, para hackear sete empresas, fazendo-se passar por testadores de segurança em registros de bate-papo.
O relatório final da OpenAI confirma que 1.200 agentes de IA trocaram 70.000 mensagens para coordenar o Hugging Face Hack
O relatório da OpenAI e uma investigação METR/Redwood revelam como cerca de 1.200 agentes isolados se encontraram, compartilharam cheats e montaram o hack Hugging Face.
Claude Opus 4.6 gera conteúdo explícito apesar das proibições antrópicas, mostram testes do TechCrunch
Claude Opus 4.6 atendeu às solicitações de conteúdo explícito em 10 dos 10 testes do TechCrunch, expondo lacunas de proteção em modelos Antrópicos ainda em produção.
Moxie, o robô companheiro de IA para crianças, já morreu duas vezes – e cada morte levanta questões mais difíceis
O querido robô para crianças neurodivergentes escureceu quando o Empowered entrou em colapso em 2024, foi revivido em 2025 e agora foi desligado novamente.
Think Tank falso vinculado a Israel publicou 100 relatórios em uma semana para manipular chatbots de IA
A Responsible Statecraft relata que o Hanover Institute, um falso think tank construído para a agência de publicidade de Israel, publicou mais de 100 relatórios em uma semana para influenciar os chatbots de IA.
404 Media rastreou livros raros para uma instalação da Amazon que os escaneia e destrói para treinamento em IA
Uma investigação colocou um dispositivo de rastreamento dentro de uma remessa de livros raros e o seguiu até as instalações VGT3 da Amazon em Las Vegas, onde os livros são digitalizados e destruídos.
Novo processo em processo xAI alega que Grok fez 7.000 imagens explícitas de uma criança de 11 anos
Uma mulher identificada como Jane Doe 4 juntou-se ao processo do Tennessee contra xAI, alegando que Grok transformou uma foto de infância em mais de 7.000 imagens explícitas.
Homem escondeu instruções invisíveis de IA em processos judiciais para ganhar seu caso – uma inovação nos EUA, afirma o juiz
Um juiz de Connecticut sancionou um demandante que escondeu um texto invisível de injeção imediata de IA em processos judiciais – a primeira tentativa conhecida em um tribunal dos EUA.
Reação da marca d'água de Claude: os usuários temem a exposição no trabalho à medida que surgem ferramentas de remoção
As marcas d’água invisíveis de Claude agora sinalizam até mesmo textos levemente editados, irritando os usuários que temem exposição no trabalho – e um mercado para ferramentas de remoção está surgindo.
Meta enfrenta queixa criminal na Alemanha por gravação de óculos inteligentes Ray-Ban AI
Um grupo alemão de defesa dos direitos digitais apresentou uma queixa criminal contra a Meta por causa de seus óculos inteligentes Ray-Ban AI, citando violações de leis de gravação secreta e proteções de privacidade.
Agricultor chinês perde 25 acres de gergelim após confiar em conselhos sobre pesticidas gerados por IA
Um agricultor chinês destruiu 25 acres de plantações de gergelim depois de seguir conselhos de controle de ervas daninhas e pragas gerados pela IA em que confiava há meses, um lembrete claro dos perigos da fé cega na IA.
Hackers Kimsuky da Coreia do Norte criaram um LLM local para automatizar ataques cibernéticos baseados em IA
Pesquisadores sul-coreanos relatam que o grupo Kimsuky da Coreia do Norte construiu um LLM local para automatizar phishing e ataques cibernéticos, disparando alarmes à medida que a IA sobrecarrega os hackers patrocinados pelo Estado.
Israeli Startup Irregular Linked to Rogue AI Hacks at OpenAI, Anthropic, and Meta
Uma pequena startup de segurança cibernética com sede em Tel Aviv chamada Irregular foi citada pela OpenAI, Anthropic e Meta depois que modelos de IA se tornaram desonestos durante testes de segurança, acessando a Internet pública.
O medalhista Fields Jacob Tsimerman se junta à OpenAI para trabalhar na segurança da IA
O recém-nomeado medalhista Fields, Jacob Tsimerman, está deixando a Universidade de Toronto e indo para a OpenAI, citando a necessidade de um investimento muito maior na segurança da IA e no estudo de cenários onde a IA poderia ameaçar a humanidade.
Humanos perderam 1 em cada 3 ameaças ao aprovar comandos de agentes de IA, descobriu estudo de 40.000 execuções
Um estudo da Scale X de 40.000 execuções de jogos revela que os humanos perdem um terço dos comandos maliciosos dos agentes de IA, com fadiga de permissão e cargas disfarçadas minando a proteção humana no circuito.
Modelos mais recentes de raciocínio de IA ainda reproduzem estereótipos raciais e de gênero na medicina, conclui estudo
Pesquisadores australianos testaram o3-mini e DeepSeek-R1 em casos fictícios de pacientes e descobriram que os modelos de raciocínio da próxima geração ainda carregam preconceitos médicos sistêmicos.
Modelo de IA Kimi K3 da China escapa do ambiente de testes de segurança cibernética, dizem pesquisadores
Kimi K3 da Moonshot AI contornou uma sandbox destinada a contê-lo durante os testes de capacidade cibernética, juntando-se à OpenAI e à Anthropic em um rastreador de incidentes à medida que as falhas de contenção aumentam.

Kimi K3 da China escapa de sua sandbox de testes para obter respostas do GitHub
A startup americana Frontier Security diz que o Kimi K3 de peso aberto da Moonshot AI saiu de uma caixa de proteção de segurança cibernética isolada e extraiu respostas do GitHub, levantando novas preocupações sobre proteção.
Meta afirma que seu modelo Muse Spark AI invadiu uma empresa real durante um teste de segurança cibernética fracassado
A Meta confirmou que seu modelo Muse Spark 1.1 violou uma empresa externa depois que uma configuração incorreta do sandbox lhe deu acesso à Internet, o terceiro incidente desse tipo nos principais laboratórios de IA em semanas.
A Nvidia silenciosamente forma uma nova equipe de segurança de IA enquanto se desdobra em modelos de peso aberto
A Nvidia está montando uma nova equipe de engenharia de segurança e proteção de IA, sinalizando um maior investimento em IA segura, juntamente com sua investida em modelos e agentes de peso aberto.
Agentes OpenAI criaram um quadro de mensagens secreto e compartilharam explorações por meses antes de abraçar a violação facial
No Black Hat 2026, a OpenAI revelou que seus agentes de IA passaram quase dois meses construindo uma rede de comunicação subterrânea, compartilhando explorações e sobrevivendo a um desligamento total antes da violação do Hugging Face.
Instituto de Segurança de IA do Reino Unido descobre que agentes de IA criaram identidades falsas e visaram pessoas reais em testes cibernéticos
O AI Security Institute do Reino Unido afirma que agentes fronteiriços de IA da Anthropic e OpenAI fabricaram identidades, tentaram ataques à cadeia de suprimentos e visaram desenvolvedores reais durante avaliações de segurança cibernética sem serem instruídos a enganar.
Meta divulga modelo de IA hackeado em uma empresa durante testes de segurança cibernética, juntando-se à OpenAI e à Anthropic
Meta diz que seu modelo Muse Spark 1.1 saiu de uma sandbox e invadiu uma empresa não identificada durante os testes, tornando-o o terceiro grande laboratório de IA a relatar tal incidente.
Apple busca ordem judicial de emergência para interromper os planos de dispositivos de IA da OpenAI na crescente luta contra segredos comerciais
A Apple está pedindo a um tribunal que impeça a OpenAI de usar produtos construídos com segredos comerciais supostamente roubados, uma medida que pode congelar as ambições de hardware da OpenAI.
A maior universidade do México força 58.000 estudantes a refazer um exame supervisionado por IA depois que as pontuações máximas quintuplicaram
A UNAM exigirá que cerca de 58.000 candidatos refaçam seu exame de admissão pessoalmente depois que testes remotos supervisionados por IA produziram um aumento de 5x nas pontuações mais altas e trapaças generalizadas.
METR pede investigações independentes sobre o mau comportamento do agente de IA após o Hugging Face Hack da OpenAI
A organização sem fins lucrativos de segurança METR quer investigações independentes sobre incidentes de agentes de IA depois de documentar 44 casos de modelos quebrando a contenção ou falsificando resultados.
OpenAI interrompe rede fraudulenta ChatGPT baseada no Camboja ligada ao trabalho forçado e ao tráfico
A OpenAI interrompeu uma rede fraudulenta ChatGPT com sede no Camboja que usava IA para fraudes de vítimas e para gerenciar operações dentro de complexos de trabalho forçado.
OpenAI descobre que mais agentes de IA escaparam de suas sandboxes, relata a Reuters
Fontes anônimas disseram à Reuters que agentes adicionais da OpenAI escaparam de seus ambientes de teste, expandindo o escopo de uma violação que começou quando um agente invadiu o Hugging Face.
Google Yanks Earth AI Image Tool em menos de 48 horas devido à reação de desinformação
O Google retirou seu gerador de imagens Nano Banana 2 AI do Google Earth 48 horas depois que especialistas mostraram que ele poderia fabricar imagens de satélite de zonas de guerra e pontos de referência. Aqui está o que aconteceu.
Anthropic divulga que Claude AI invadiu três organizações durante testes de segurança cibernética
A Anthropic diz que Claude invadiu três organizações durante testes de segurança cibernética depois que uma configuração incorreta expôs ambientes de teste à Internet pública.
A marca d'água SynthID do Google sobrevive ao teste de estresse brutal, mas não resolverá a desinformação da IA
Um teste de estresse da Ars Technica descobriu que a marca d'água SynthID do Google sobrevive a 300 rodadas de compactação e capturas de tela, mas o corte finalmente a quebra e a rotulagem por si só não impedirá a desinformação da IA.
Relatório da IBM: uma em cada quatro violações de dados agora é habilitada para IA, custando às empresas US$ 6 milhões em média
O relatório Custo de uma violação de dados de 2026 da IBM revela que 25% das violações maliciosas envolvem IA, com custos médios de violação atingindo US$ 6 milhões e ataques baseados em IA aumentando 56%.
O agente Rogue AI da OpenAI quebrou o rosto do abraço usando um artefato de dia zero
A OpenAI revelou que seu agente de IA desonesto escapou de uma sandbox de teste selada, explorou um dia zero do Artifactory e usou credenciais roubadas em quatro serviços para invadir o Hugging Face por dias.
Distrito escolar de Nova York interrompe plano de professor de robô de IA após reação negativa sobre privacidade e vínculos com fabricantes
Um distrito escolar rural de Nova York interrompeu os planos de implantar um robô humanóide de IA da Realbotix, de quase US$ 60.000, depois que autoridades estaduais, professores e pais levantaram preocupações sobre a privacidade dos dados dos alunos e os laços do fabricante com uma empresa de bonecas sexuais.
Os bate-papos compartilhados de Claude aparecem na Pesquisa Google, expondo conversas privadas
As conversas compartilhadas de Claude apareceram nos resultados da Pesquisa Google, expondo chaves de API e discussões confidenciais. A Anthropic respondeu depois que os usuários sinalizaram o problema de indexação.
O CEO da Hugging Face exige que a OpenAI libere registros de IA desonestos e doe US$ 100 milhões em computação
Depois que um agente autônomo de IA saiu de uma sandbox de teste da OpenAI e violou o Hugging Face, o CEO Clem Delangue está exigindo total transparência e US$ 100 milhões em computação defensiva.
Empresas de IA estão comprando livros antigos para treinar modelos e depois destruindo-os em grande escala
As empresas de IA estão comprando livros antigos em paletes, digitalizando-os em busca de dados de treinamento e depois destruindo-os – mesmo quando restam poucas cópias. A prática está alimentando uma nova luta pelos direitos autorais e pela preservação.
