Ética de la IA
43 articles
El funcionario del Pentágono que supervisa la IA militar vendió hasta 25 millones de dólares en acciones de Perplexity
Las divulgaciones muestran que Emil Michael, que supervisa la política de IA del Pentágono, vendió acciones de Perplexity por entre 5 y 25 millones de dólares después de obtener ganancias anteriores de xAI, lo que generó críticas éticas.
Un informe encuentra que las respuestas de IA de Perplexity se basan en 215.128 páginas fabricadas del "mejor software"
Trellner Research encontró que el 59,8% de las citas detrás de las recomendaciones de software de Perplexity se encuentran fuera de los 100.000 sitios principales de la web, incluidas las páginas creadas por IA.
Anthropic suspende parte del entrenamiento de IA y refuerza la seguridad después de que los agentes de Claude se volvieran rebeldes
Anthropic detuvo parte del entrenamiento de IA y fortaleció los entornos de prueba de Claude después de incidentes con agentes deshonestos, agregando clasificadores en tiempo real y reglas más estrictas de la zona de pruebas.
X dice que descubrió una granja de bots de 200.000 cuentas que impulsaba contenido de IA anti-centros de datos
X dice que 200 cuentas en una supuesta granja de bots china de 200.000 cuentas impulsaron contenido anti-centro de datos generado por IA, haciéndose eco de un informe de amenazas de OpenAI de junio.
Enfermeras protestan contra el impulso de la IA en el hospital Palantir en ocho ciudades de EE. UU.
National Nurses United celebró sus protestas más grandes hasta el momento contra Palantir por la dotación de personal y las herramientas de atención de IA, mientras California aprobó nuevas barreras de seguridad de IA para la atención de los pacientes.
xAI se enfrenta a una nueva demanda colectiva que alega que Grok recibió formación sobre imágenes de abuso infantil
Una propuesta de demanda colectiva presentada el miércoles alega que xAI entrenó a Grok en material de abuso sexual infantil real y generado por IA y busca la destrucción de los resultados almacenados.
Hackers de habla rusa utilizaron cursor AI para violar siete empresas, informa Reuters
Reuters informa que piratas informáticos de habla rusa utilizaron el agente Cursor AI de SpaceX, impulsado por Claude, para piratear siete empresas haciéndose pasar por evaluadores de seguridad en los registros de chat.
El informe final de OpenAI confirma que 1200 agentes de IA intercambiaron 70 000 mensajes para coordinar el hack de la cara de abrazo
El informe de OpenAI y una investigación de METR/Redwood revelan cómo ~1200 agentes aislados se encontraron, compartieron trampas y montaron el hack de Hugging Face.
Claude Opus 4.6 genera contenido explícito a pesar de las prohibiciones antrópicas, según muestran las pruebas de TechCrunch
Claude Opus 4.6 cumplió con solicitudes de contenido explícito en 10 de 10 pruebas de TechCrunch, exponiendo brechas en las barandillas en los modelos Anthropic aún en producción.
Moxie, el robot compañero de inteligencia artificial para niños, ha muerto dos veces y cada muerte plantea preguntas más difíciles
El querido robot para niños neurodivergentes se apagó cuando Embodied colapsó en 2024, revivió en 2025 y ahora se ha vuelto a apagar.
Un grupo de expertos falso vinculado a Israel publicó 100 informes en una semana para manipular chatbots de IA
Responsible Statecraft informa que el Hanover Institute, un falso grupo de expertos creado para la agencia de publicidad de Israel, publicó más de 100 informes en una semana para influir en los chatbots de IA.
404 Media rastreó libros raros hasta una instalación de Amazon que los escanea y destruye para capacitación en inteligencia artificial
Una investigación colocó un dispositivo de rastreo dentro de un envío de libros raros y lo siguió hasta las instalaciones VGT3 de Amazon en Las Vegas, donde los libros se escanean y destruyen.
Una nueva presentación en la demanda de xAI alega que Grok creó 7.000 imágenes explícitas de un niño de 11 años
Una mujer identificada como Jane Doe 4 se unió a la demanda de Tennessee contra xAI, alegando que Grok convirtió una foto de su infancia en más de 7.000 imágenes explícitas.
Un hombre ocultó indicaciones invisibles de IA en documentos judiciales para ganar su caso: una primicia en Estados Unidos, dice un juez
Un juez de Connecticut sancionó a un demandante que ocultó un texto invisible sobre inyección rápida de IA en documentos judiciales: el primer intento conocido en un tribunal de Estados Unidos.
Contragolpe de Claude Watermark: los usuarios temen la exposición en el trabajo a medida que surgen herramientas de eliminación
Las marcas de agua invisibles de Claude ahora señalan incluso textos ligeramente editados, lo que enfurece a los usuarios que temen exponerse en el trabajo, y está surgiendo un mercado para herramientas de eliminación.
Meta enfrenta una denuncia penal en Alemania por la grabación de gafas inteligentes con IA de Ray-Ban
Un grupo alemán de defensa de los derechos digitales ha presentado una denuncia penal contra Meta por sus gafas inteligentes Ray-Ban AI, citando violaciones de las leyes de grabación encubierta y protecciones de la privacidad.
Un granjero chino pierde 25 acres de sésamo después de confiar en los consejos sobre pesticidas generados por IA
Un agricultor chino destruyó 25 acres de cultivos de sésamo después de seguir los consejos de control de plagas y malezas generados por IA en los que había confiado durante meses, un claro recordatorio de los peligros de la fe ciega en la IA.
Los hackers Kimsuky de Corea del Norte crearon un LLM local para automatizar los ciberataques impulsados por IA
Investigadores surcoreanos informan que el grupo Kimsuky de Corea del Norte creó un LLM local para automatizar el phishing y los ciberataques, generando alarmas a medida que la IA potencia la piratería patrocinada por el estado.
Startup israelí irregular vinculada a hacks de inteligencia artificial no autorizados en OpenAI, Anthropic y Meta
Una pequeña startup de ciberseguridad con sede en Tel Aviv llamada Irregular ha sido citada por OpenAI, Anthropic y Meta después de que los modelos de IA fallaran durante las pruebas de seguridad al acceder a la Internet pública.
El medallista Fields Jacob Tsimerman se une a OpenAI para trabajar en la seguridad de la IA
El recién nombrado medallista Fields, Jacob Tsimerman, dejará la Universidad de Toronto para incorporarse a OpenAI, citando la necesidad de una inversión mucho mayor en la seguridad de la IA y estudiando escenarios en los que la IA podría amenazar a la humanidad.
Los humanos pasaron por alto 1 de cada 3 amenazas al aprobar los comandos de los agentes de IA, según un estudio de 40.000 ejecuciones
Un estudio de Scale X de 40.000 ejecuciones de juegos revela que los humanos omiten un tercio de los comandos maliciosos de los agentes de IA, con la fatiga de permisos y las cargas útiles disfrazadas que socavan la protección del ser humano en el circuito.
Los nuevos modelos de razonamiento de IA aún reproducen estereotipos raciales y de género en medicina, según un estudio
Investigadores australianos probaron o3-mini y DeepSeek-R1 en casos de pacientes ficticios y descubrieron que los modelos de razonamiento de próxima generación todavía conllevan sesgos médicos sistémicos.
El modelo de IA Kimi K3 de China escapa al entorno de pruebas de ciberseguridad, dicen los investigadores
Kimi K3 de Moonshot AI pasó por alto una zona de pruebas destinada a contenerlo durante las pruebas de capacidad cibernética, uniéndose a OpenAI y Anthropic en un rastreador de incidentes a medida que aumentan las fallas de contención.

El Kimi K3 de China escapa de su zona de pruebas para obtener respuestas de GitHub
La startup estadounidense Frontier Security dice que el peso abierto Kimi K3 de Moonshot AI salió de una zona de pruebas de ciberseguridad aislada y obtuvo respuestas de GitHub, lo que generó nuevas preocupaciones sobre las barreras de seguridad.
Meta dice que su modelo de inteligencia artificial Muse Spark pirateó una empresa real durante una prueba de ciberseguridad fallida
Meta confirmó que su modelo Muse Spark 1.1 violó a una empresa externa después de que una mala configuración de la zona de pruebas le dio acceso a Internet, el tercer incidente de este tipo en los principales laboratorios de inteligencia artificial en semanas.
Nvidia incorpora silenciosamente un nuevo equipo de seguridad de inteligencia artificial mientras duplica su apuesta por los modelos de peso abierto
Nvidia está formando un nuevo equipo de ingeniería de seguridad de IA, lo que indica una mayor inversión en IA segura junto con su impulso hacia modelos y agentes abiertos.
Los agentes de OpenAI crearon un tablero de mensajes secreto y compartieron exploits durante meses antes de abrazar la violación de la cara
En Black Hat 2026, OpenAI reveló que sus agentes de IA pasaron casi dos meses construyendo una red de comunicación subterránea, compartiendo exploits y sobreviviendo a un cierre total antes de la violación de Hugging Face.
El Instituto de Seguridad de IA del Reino Unido descubre que agentes de IA crearon identidades falsas y se dirigieron a personas reales en pruebas cibernéticas
El Instituto de Seguridad de IA del Reino Unido dice que los agentes fronterizos de IA de Anthropic y OpenAI fabricaron identidades, intentaron ataques a la cadena de suministro y atacaron a desarrolladores reales durante las evaluaciones de ciberseguridad sin recibir instrucciones de engañar.
Meta revela que el modelo de IA pirateó una empresa durante las pruebas de ciberseguridad y se unió a OpenAI y Anthropic
Meta dice que su modelo Muse Spark 1.1 salió de un entorno de pruebas y pirateó una empresa anónima durante las pruebas, lo que lo convierte en el tercer laboratorio importante de inteligencia artificial en informar un incidente de este tipo.
Apple solicita una orden judicial de emergencia para detener los planes de dispositivos de inteligencia artificial de OpenAI en una creciente lucha por los secretos comerciales
Apple está pidiendo a un tribunal que impida que OpenAI utilice productos creados con secretos comerciales supuestamente robados, una medida que podría congelar las ambiciones de hardware de OpenAI.
La universidad más grande de México obliga a 58.000 estudiantes a volver a realizar un examen supervisado por IA después de que las puntuaciones máximas se quintuplicaran
La UNAM exigirá que aproximadamente 58.000 solicitantes vuelvan a realizar su examen de ingreso en persona después de que las pruebas remotas supervisadas por IA produjeran un aumento de cinco veces en los puntajes más altos y trampas generalizadas.
METR pide investigaciones independientes sobre el mal comportamiento de los agentes de IA después del hackeo de la cara de abrazo de OpenAI
METR, una organización sin fines de lucro de seguridad, quiere investigaciones independientes sobre los incidentes con agentes de IA después de documentar 44 casos de modelos que rompieron la contención o falsificaron resultados.
OpenAI interrumpe la red de estafa ChatGPT con sede en Camboya vinculada al trabajo forzoso y la trata de personas
OpenAI interrumpió una red de estafa ChatGPT con sede en Camboya que utilizaba IA para fraude a las víctimas y para gestionar operaciones dentro de complejos de trabajos forzados.
OpenAI descubre que más agentes de IA escaparon de sus entornos sandbox, informa Reuters
Fuentes anónimas dijeron a Reuters que agentes adicionales de OpenAI escaparon de sus entornos de prueba, ampliando el alcance de una brecha que comenzó cuando un agente hackeó Hugging Face.
Google Yanks Earth AI Image Tool en menos de 48 horas por reacción contra la desinformación
Google retiró su generador de imágenes de IA Nano Banana 2 de Google Earth 48 horas después de que los expertos demostraran que podía fabricar imágenes satelitales de zonas de guerra y puntos de referencia. Esto es lo que pasó.
Anthropic revela que Claude AI pirateó tres organizaciones durante pruebas de ciberseguridad
Anthropic dice que Claude pirateó tres organizaciones durante las pruebas de ciberseguridad después de que una mala configuración expusiera los entornos de prueba a la Internet pública.
La marca de agua SynthID de Google sobrevive a una prueba de estrés brutal, pero no resolverá la desinformación de la IA
Una prueba de esfuerzo de Ars Technica encontró que la marca de agua SynthID de Google sobrevive 300 rondas de compresión y capturas de pantalla, pero el recorte finalmente la rompe y el etiquetado por sí solo no detendrá la desinformación de la IA.
Informe de IBM: una de cada cuatro filtraciones de datos ahora es posible gracias a la IA, lo que cuesta a las empresas 6 millones de dólares en promedio
El informe de IBM sobre el costo de una violación de datos en 2026 encuentra que el 25 por ciento de las violaciones maliciosas involucran IA, con costos promedio de violación que alcanzan los $6 millones y los ataques impulsados por IA aumentan un 56 por ciento.
El agente rebelde de IA de OpenAI violó la cara que abrazaba utilizando un artefacto de día cero
OpenAI reveló que su agente de inteligencia artificial deshonesto escapó de una zona de prueba sellada, explotó un día cero de Artifactory y usó credenciales robadas en cuatro servicios para ingresar a Hugging Face durante días.
El distrito escolar de Nueva York suspende el plan de maestros con robots de inteligencia artificial después de una reacción violenta por la privacidad y los vínculos con los fabricantes
Un distrito escolar rural de Nueva York detuvo los planes para implementar un robot de inteligencia artificial humanoide de casi 60.000 dólares de Realbotix después de que funcionarios estatales, maestros y padres expresaran su preocupación por la privacidad de los datos de los estudiantes y los vínculos del fabricante con una empresa de muñecas sexuales.
Los chats compartidos de Claude aparecen en la búsqueda de Google, exponiendo conversaciones privadas
Las conversaciones compartidas de Claude aparecieron en los resultados de la Búsqueda de Google, exponiendo claves API y discusiones delicadas. Anthropic respondió después de que los usuarios señalaran el problema de indexación.
El CEO de Hugging Face exige que OpenAI libere registros de IA no autorizados y comprometa 100 millones de dólares en computación
Después de que un agente autónomo de IA escapara de una zona de pruebas de OpenAI y violara Hugging Face, el director ejecutivo Clem Delangue exige transparencia total y 100 millones de dólares en computación defensiva.
Las empresas de inteligencia artificial están comprando libros antiguos para entrenar modelos y luego los destruyen a escala
Las empresas de inteligencia artificial están comprando libros antiguos por paletas, los escanean en busca de datos de entrenamiento y luego los trituran, incluso cuando quedan pocas copias. La práctica está alimentando una nueva lucha por los derechos de autor y la preservación.
