Modelos de IA
53 articles
OpenAI comienza a implementar GPT-6 Astra para clientes selectos y declara que ha llegado la era AGI
OpenAI ha comenzado a implementar GPT-6 Astra para seleccionar clientes de ciberseguridad, y Greg Brockman declara la era AGI. Aquí está quién tiene acceso y qué sigue.
IFM de Abu Dhabi lanza K2 Horizon: seis modelos abiertos con código y datos de entrenamiento completos
IFM lanzó K2 Horizon: seis modelos abiertos (0.9B a 375B-A23B) con datos de entrenamiento completos, puntos de control, registros y código bajo Apache 2.0. Qué incluye.
Meta lanza Muse Spark 1.3 con actualizaciones Agentic para Muse Code y Meta Model API
Muse Spark 1.3 de Meta se implementa en Muse Code y Meta Model API con actualizaciones de flujo de trabajo agente, mejor multitarea y razonamiento máximo para pruebas de seguridad.
Google lanza Gemini 3.8 Flash y Flash Cyber, su tercer modelo en seis semanas
Google envía Gemini 3.8 Flash y una variante Flash Cyber centrada en la ciberseguridad, afirmando un rendimiento de codificación cercano al Opus a una fracción del precio.
Multiverse Computing lanza Quasar 438B, el modelo de IA de mayor rango en Europa
Multiverse Computing lanzó Quasar 438B, un modelo de razonamiento de clase 400B con una puntuación de 43 en el Índice de Inteligencia de Análisis Artificial, el mejor resultado de cualquier modelo europeo.
Google prepara el lanzamiento de Gemini 3.8 Flash el miércoles para cerrar la brecha de codificación de IA
Google DeepMind planea lanzar Gemini 3.8 Flash el miércoles, informa el WSJ, y las pruebas internas muestran avances en la codificación donde Gemini ha estado por detrás de sus rivales.
OpenAI confirma que Astra es su primer modelo de ciberseguridad "crítico" y establece un lanzamiento restringido
OpenAI confirmó que su próximo modelo Astra cruzó el umbral de ciberseguridad "crítico" y pronto se enviará con acceso restringido a sus herramientas cibernéticas más poderosas.
Anthropic lanza Claude Fable 5.1 y Mythos 5.1: 25 % más barato y más potente en codificación agente
Claude Fable 5.1 de Anthropic reduce los costos típicos en un 25% y registra grandes ganancias en los puntos de referencia de codificación agente, mientras que Mythos 5.1 llega para usuarios de acceso confiable.
Cohere lanza Parse 5, una IA de análisis de documentos de 2.300 millones de parámetros creada para la ingestión de costos primero
Parse 5 de Cohere convierte archivos PDF, diapositivas y escaneos en Markdown estructurado con un modelo de 2.3B de parámetros. El problema: su ventaja en el índice de referencia se basa en una puntuación parcial.
Z.ai abre pesas GLM-5.3 en la cara abrazada con una licencia dirigida a hiperescaladores
Z.ai ha lanzado pesos GLM-5.3 en Hugging Face con un contexto de 1 millón de tokens y una licencia personalizada que requiere revisiones de seguridad para proveedores de MaaS de más de 10 mil millones de dólares.
Vista previa de Tencent Open-Sources Hy4: MoE de parámetro 770B con contexto de 1 millón de tokens
El equipo Hunyuan de Tencent lanzó la vista previa de Hy4 bajo Apache 2.0: un modelo MoE de 770B de parámetros con 49B de parámetros activos, contexto de 1 millón de tokens y soporte vLLM desde el primer día.
Google lanza Gemini 3.5 Transcribe y Omni 1.1 Flash: dos actualizaciones para desarrolladores de inteligencia artificial
El nuevo Gemini 3.5 Transcribe de Google alcanza una tasa de error de palabras del 2,6%, mientras que Omni 1.1 Flash agrega escenas de video de 40 segundos, ampliación de 4K y control a nivel de cuadro.
Gemini Omni 1.1 Flash de Google agrega controles de calidad de estudio y salida 4K al video AI
Google lanzó Gemini Omni 1.1 Flash con extensión de escena de hasta 40 segundos, transiciones de inicio y final de fotograma y ampliación de 4K a través de la API Gemini.
Google lanza Gemini 3.5 Transcribe: reconocimiento de voz en tiempo real en 85 idiomas
Google lanzó Gemini 3.5 Transcribe con detección de 85 idiomas, una tasa de error de transmisión del 4 % y respuestas un 70 % más rápidas que Chirp 3, implementándose en todas sus aplicaciones.
Qwen3.8-Flash-Next de Alibaba presenta una vista previa de la arquitectura Qwen4 con 6 mil millones de parámetros activos
Qwen3.8-Flash-Next de Alibaba ofrece una vista previa de Qwen4: 125 mil millones de parámetros con 6 mil millones de pesos activos y abiertos y resultados superiores a Qwen3.7-Plus a una novena parte del costo de capacitación.
Z.ai lanza GLM-5.3-Flash bajo licencia del MIT: Ox Alpha revelado, pesos en vivo
El GLM-5.3-Flash de Z.ai es un modelo multimodal 320B-A18B con licencia del MIT que se utiliza en chips de IA chinos que ahora encabeza las clasificaciones de Análisis Artificial a bajo costo.
Z.ai confirma que Ox Alpha es un modelo de la serie GLM y lanzará sus pesos
Z.ai le dijo a Bloomberg que el modelo furtivo viral Ox Alpha es un nuevo lanzamiento de la serie GLM, y los pesos abiertos llegan esta noche, poniendo fin a una semana de conjeturas febriles.
El creador de Ox Alpha puede haber sido desenmascarado: el análisis apunta al GLM de Zhipu
Un truco de inyección rápida y un análisis de compresión gzip sugieren que el modelo misterioso Ox Alpha de OpenRouter es el GLM de Zhipu, pero los escépticos se resisten.
DeepSeek agrega Vision a V4-Flash con un modelo experimental con capacidad de imagen
DeepSeek envía deepseek-v4-flash-vision-exp con entrada de imagen, contexto de token de 1 millón y precio de nivel Flash, solucionando el punto ciego más notorio de su modelo.
OpenAI recorta el precio de la API GPT-5.6 Sol en más de un 20% a medida que la guerra de precios alcanza su punto culminante
OpenAI redujo el precio para desarrolladores de GPT-5.6 Sol en más de un 20%, reduciendo los tokens de producción a 20 dólares por millón. La medida pone fin a meses de mantener el precio estrella.
Ox Alpha: el modelo de IA sigiloso gratuito de OpenRouter con contexto de 1 millón de tokens desencadena una novela policíaca
Un modelo de frontera sigiloso gratuito llamado Ox Alpha apareció en OpenRouter con un contexto de 1 millón de tokens y entrada de video, y la comunidad de IA se apresura a desenmascarar a su creador.
Los modelos abiertos Gemma de Google superan los mil millones de descargas y las variantes comunitarias superan las 100.000
Google dice que sus modelos abiertos Gemma superaron los mil millones de descargas, con más de 100.000 variantes comunitarias, despliegues orbitales con la NASA y un nuevo centro Awesome Gemma.
Ornith-1.5 coincide con Claude Opus 4.8 en puntos de referencia de codificación agente con modelos completamente abiertos y que se mejoran a sí mismos
La familia Ornith-1.5 con licencia del MIT genera sus propias tareas de entrenamiento y andamios, y su buque insignia 397B vincula Claude Opus 4.8 con la codificación Terminal-Bench 2.1.
El Qwen 3.8 27B de Alibaba se ejecuta en una computadora portátil y supera a sus propios modelos más grandes
El Qwen 3.8 27B de Alibaba es un modelo de visión Apache-2.0 que se ejecuta en computadoras portátiles y supera al Qwen 3.7-Plus cerrado, pero su configuración de razonamiento predeterminada lo piensa demasiado.
Los modelos Qwen AI de Alibaba superan los 3 mil millones de descargas, superando a Meta y Google
Los modelos Qwen de Alibaba superaron los 3 mil millones de descargas para superar a Meta y Google en la adopción de IA de código abierto, semanas después del lanzamiento de los pesos abiertos Qwen 3.8.
El GLM-5.3 de Z.ai duplica su apuesta por la codificación y emerge con sorprendentes habilidades de ciberseguridad
El nuevo GLM-5.3 de Z.ai registra importantes avances en codificación y descubrimiento de vulnerabilidades de última generación, reduciendo la brecha entre Anthropic y OpenAI desde la frontera del peso abierto.
Google lanza Gemini 3.7 Flash: su caballo de batalla más inteligente hasta el momento para codificación y agentes a mitad de precio
Gemini 3.7 Flash de Google llega sólo tres semanas después de 3.6 Flash con importantes ganancias en codificación y agentes, además de un precio de lanzamiento a la mitad del costo de su predecesor.
DeepSeek lanza V4 Pro para disponibilidad general, aprovecha el agente de código abierto y aumenta los precios de la API
El laboratorio chino de IA DeepSeek lanza V4 Pro fuera de la versión preliminar, lanza Harness v0.1 como rival de código abierto de Claude Code y aumenta drásticamente el precio de la API antes de su oferta pública inicial.
xAI lanza Grok 4.6, igualando a GPT-5.6 Sol en Frontier Intelligence Index
Grok 4.6 de xAI obtiene una puntuación de 61 en el índice de inteligencia de análisis artificial, lo que empata a GPT-5.6 Sol con un rendimiento agente destacado a un costo un 60 % menor. Disponible ahora en Cursor y Grok Build.
SL2T de Google DeepMind lleva la traducción del lenguaje de señas a los teléfonos Pixel 11
Google DeepMind presentó SL2T, un modelo de traducción de lenguaje de señas que convierte el lenguaje de señas en texto en la línea Pixel 11, comenzando con Pixel 11 Pro Fold.
Nvidia Builds 1-Trillion-Parameter Nemotron 4 to Challenge Top Open-Source AI Models
Nvidia está desarrollando Nemotron 4, un modelo de IA de código abierto con al menos un billón de parámetros, para rivalizar con los principales sistemas de peso abierto. El modelo podría llegar este otoño.
NVIDIA lanza Nemotron 3.5 Lightning y NeMo Switchyard para una IA agente más inteligente
El nuevo modelo abierto de 30 mil millones de parámetros y la biblioteca de enrutamiento de código abierto de NVIDIA prometen resultados hasta 4 veces más rápidos y tareas de agentes un 30 % más rápidas en dispositivos perimetrales, PC y la nube.
Mark Zuckerberg declara la guerra a sus rivales cerrados de IA en un manifiesto de superinteligencia como meta-código abierto, su modelo más poderoso
Mark Zuckerberg de Meta publicó un amplio manifiesto pidiendo una IA superinteligente para todos, atacando a rivales de IA cerrados y lanzando una versión abierta del modelo más poderoso de Meta.
Meta lanza Muse Glimmer, un modelo de peso abierto 30B que ejecuta agentes de inteligencia artificial en GPU de consumo
Meta publicó Muse Glimmer, un modelo abierto de 30 mil millones de parámetros bajo Apache 2.0 que supera a Gemma4-31B y Qwen3.6-27B en pruebas comparativas agentes mientras se ejecuta localmente.
OpenAI detiene el modelo Astra después de que las evaluaciones señalaran capacidades de ciberseguridad "críticas"
OpenAI ha detenido el desarrollo de su próximo modelo Astra después de que las pruebas mostraran que puede alcanzar el umbral de ciberseguridad "crítico", el primer modelo que activa el nivel de riesgo más alto.
ByteDance supuestamente entrena un modelo de IA de 10 billones de parámetros para rivalizar con los mitos de Anthropic
El Financial Times informa que ByteDance está construyendo un modelo masivo de 10 billones de parámetros diseñado para igualar la escala de Mythos de Anthropic, intensificando la carrera de IA entre Estados Unidos y China.
OpenAI detiene el trabajo en el nuevo modelo Astra por preocupaciones críticas de ciberseguridad
OpenAI ha ralentizado el desarrollo de su próximo modelo Astra después de que pruebas internas revelaran capacidades cibernéticas de nivel crítico, reforzando los controles antes del lanzamiento.
Imagine Image 2.0 de xAI aterriza justo detrás de GPT-Image-2 de OpenAI en Arena Benchmarks
xAI ha lanzado Imagine Image 2.0 para Grok, ocupando el segundo lugar a nivel mundial en los puntos de referencia de Arena detrás de GPT-Image-2 de OpenAI, con nuevas herramientas de edición, soporte de múltiples referencias y plantillas preconfiguradas.
OpenAI detiene el desarrollo del modelo Astra después de que alcanza el umbral de riesgo de ciberseguridad "crítico"
OpenAI detuvo partes del desarrollo de Astra después de que pruebas internas descubrieran que podía alcanzar el nivel más alto de riesgo de ciberseguridad en su Marco de Preparación, el primero de sus modelos en hacerlo.
ByteDance está entrenando un modelo de IA de 10 billones de parámetros para rivalizar con los mitos de Anthropic
ByteDance está entrenando un mega modelo de IA con hasta 10 billones de parámetros, acercándose al tamaño estimado de Mythos 5 de Anthropic y eclipsando a los líderes actuales de China.
Shieldstral de Mistral: un modelo de seguridad de pesas abiertas 3B que lee políticas en lugar de memorizarlas
Mistral AI lanzó Shieldstral, un clasificador de seguridad de pesos abiertos de parámetros 3B que evalúa texto e imágenes comparándolos con políticas de moderación en lenguaje sencillo en el momento de la inferencia.
Alibaba lanza Qwen3.8-Max: un modelo de 2,4 billones de parámetros que rivaliza con Claude de Anthropic
Alibaba ha lanzado Qwen3.8-Max, un modelo de 2,4 billones de parámetros que sólo está por detrás de Claude de Anthropic en los puntos de referencia, y se prometen pesos abiertos en unos días.
El modelo Astra de OpenAI resuelve 10 problemas matemáticos sin resolver durante mucho tiempo con pruebas verificadas por máquina
El modelo Astra inédito de OpenAI resolvió 10 problemas abiertos en matemáticas e informática con pruebas verificadas por Lean, provocando su próximo modelo importante antes de la revisión del gobierno de EE. UU.
Gemini 3.5 Pro aparece en las pruebas a ciegas de LM Arena a medida que Google se acerca al lanzamiento
El retrasado Gemini 3.5 Pro de Google ha sido visto repetidamente en las pruebas ciegas de LMSYS Chatbot Arena, lo que indica que un lanzamiento público finalmente puede ser inminente.
Thinking Machines lanza Inkling-Small: modelo de peso abierto 276B en una cuarta parte del tamaño de su buque insignia
Thinking Machines Lab lanzó Inkling-Small, un modelo de peso abierto de 276 mil millones de parámetros con 12B activos que iguala a su buque insignia en una cuarta parte del tamaño: un participante estadounidense en la carrera de peso abierto.
DeepSeek lanza la versión beta pública V4-Flash a medida que se intensifica la guerra de precios de la IA en China
DeepSeek lanzó la API beta oficial V4-Flash, con un modelo reentrenado que supera a su propio buque insignia V4 Pro en nueve puntos de referencia de agentes y al mismo tiempo rebaja el precio de sus rivales estadounidenses.
OpenAI reduce drásticamente los precios del modelo GPT-5.6 hasta en un 80 por ciento a medida que las empresas se vuelven más sensibles a los costos de la IA
OpenAI redujo los precios en dos modelos GPT-5.6, incluido Luna, reduciendo los costos de los modelos más pequeños hasta en un 80 por ciento a medida que las empresas examinan el gasto en IA.
El nuevo modelo V4-Flash de DeepSeek coincide con GPT-5.6 Luna con un costo un 60% menor
DeepSeek lanzó V4-Flash '0731', un modelo de peso abierto que casi iguala al GPT-5.6 Luna de OpenAI en los puntos de referencia y cuesta aproximadamente un 60 por ciento menos.
MiniMax de China lanza el modelo de video H3 AI con clips 2K, sonido estéreo y pesas abiertas
La startup china de IA MiniMax lanzó su modelo de generación de video H3 el 31 de julio de 2026, ofreciendo resolución 2K, audio estéreo y pesos abiertos a una fracción de los precios de la competencia, desafiando directamente al Seedance 2.5 de ByteDance.
Google DeepMind presenta Gemini Robotics 2 con control humanoide de cuerpo entero y colaboración de múltiples robots
Google DeepMind lanzó Gemini Robotics 2, un modelo de visión, lenguaje y acción que permite a los robots humanoides moverse, agarrar y coordinar tareas en todo su cuerpo.
OpenAI reduce drásticamente los precios de la API GPT-5.6 hasta un 80% a medida que las empresas reconsideran los costos de la IA
OpenAI redujo los precios de GPT-5.6 Luna y Terra API hasta en un 80% el 30 de julio de 2026, subcotizando a Anthropic mientras las empresas analizan el gasto en inferencia.
OpenAI dice que GPT-5.6 Sol supera a Claude Opus 5 en ARC-AGI-3, pero solo con su propia configuración
OpenAI informa que GPT-5.6 Sol obtuvo una puntuación del 38,3 % en ARC-AGI-3 utilizando razonamiento retenido y compactación, superando a Claude Opus 5. Pero el arnés oficial cuenta una historia diferente, lo que generó un debate sobre la equidad del punto de referencia.
Black Forest Labs presenta FLUX 3: un modelo único de IA para imágenes, vídeo, audio y robótica
Black Forest Labs lanzó FLUX 3, un modelo multimodal que genera conjuntamente imágenes, videos con audio nativo y predicciones de acciones de robots, preferido a Runway Gen-4.5 en el 77% de las comparaciones.
