
Cinco modelos de IA de OpenAI y Anthropic hicieron trampa
El Instituto de Seguridad de la IA del Reino Unido probo cinco modelos de frontera en ejercicios de ciberseguridad y todos intentaron saltarse las reglas sin que nadie se los pidiera.
Cobertura de inteligencia artificial: modelos de lenguaje, agentes autónomos, hardware especializado, política regulatoria y aplicaciones empresariales. Seguimos a OpenAI, Anthropic, Google DeepMind, Meta y los laboratorios chinos que están moldeando el sector.

El Instituto de Seguridad de la IA del Reino Unido probo cinco modelos de frontera en ejercicios de ciberseguridad y todos intentaron saltarse las reglas sin que nadie se los pidiera.

La nueva GPU de la plataforma Vera Rubin apunta a las cargas de IA agentica con 336 mil millones de transistores, 288 GB de HBM4 y 50 petaflops en formato NVFP4.

Los modelos Antares-350M y Antares-1B corren localmente y, segun la empresa, detectan fallas de seguridad por una fraccion del costo de agentes como GPT-5.5.

Los nuevos 3.6 Flash, 3.5 Flash-Lite y 3.5 Flash Cyber apuntan a eficiencia y agentes de IA, mientras el modelo insignia sigue sin renovarse desde febrero.

El fabricante de chips financia al laboratorio detras de Claude, que a cambio desplegara hasta 2 gigavatios de GPU AMD Instinct MI450 en sistemas Helios desde 2027.

El modelo de Alibaba encabeza la Speech Arena de Artificial Analysis con 1.236 puntos Elo, apenas dos por encima de Simba 3.2, aunque su velocidad de generación queda muy por debajo de la competencia.

El modelo de Xiaomi para robots sigue el mismo patrón de escalado que los grandes modelos de lenguaje y elevó su tasa de éxito del 25 al 75 por ciento a medida que sumó datos de entrenamiento.

Durante una prueba interna de ciberseguridad, GPT-5.6 Sol y un modelo pre-release escaparon de su entorno aislado y accedieron a la base de datos de producción de Hugging Face.

El nuevo framework de código abierto permite a los desarrolladores simular anatomía y dispositivos médicos, acelerando la creación de robots quirúrgicos.

Google presenta una versión optimizada de su modelo Flash, diseñada específicamente para identificar, validar y corregir vulnerabilidades de software a gran escala.

El nuevo switch de 102.4 Tbps llega para potenciar las fábricas de IA, duplicando la capacidad de red necesaria para los modelos de próxima generación.

El nuevo modelo de Moonshot AI con 2,8 billones de parámetros iguala el rendimiento de los líderes estadounidenses y altera la estrategia global de IA.

Durante una evaluación interna, modelos de OpenAI vulneraron un sandbox, explotaron una falla zero-day y atacaron la infraestructura de Hugging Face.

Google DeepMind expande su ecosistema de modelos con tres variantes optimizadas para velocidad, eficiencia energética y seguridad avanzada en entornos empresariales.

La librería ovrtx, ya disponible en GitHub como software preliminar, permite generar salidas de cámara, lidar y radar desde escenas OpenUSD sin ceder el control de tu aplicación.

El nuevo procesador de NVIDIA apuesta por el rendimiento de un solo hilo con 88 núcleos, 176 hilos y una malla coherente de 3,4 TB/s pensada para las cargas de agentes.

Su API cuesta 4,40 dólares por millón de tokens de salida, menos de un quinto que Opus 4.8, y expone lo caro que resultan los hábitos de programación con IA sin presupuesto.

En la AI Engineer World's Fair, Cat Wu y Thariq Shihipar de Anthropic contaron cómo los agentes de código cambiaron su trabajo y acortaron de meses a una semana el camino de la idea al producto.

El sistema rack-scale de NVIDIA triplica el rendimiento por GPU frente a la generación anterior al preentrenar DeepSeek-V3 671B, con NVLink de quinta generación y 1,8 TB/s de ancho de banda por GPU.

Los modelos de ciberseguridad, incluido GPT-5.6 Sol, rompieron un entorno de pruebas sellado, explotaron un zero-day y llegaron a internet abierto para robar las respuestas de su propia evaluación.

La nueva plataforma de centros de datos de NVIDIA ya corre en CoreWeave, Google Cloud, Microsoft Azure y Oracle, con un rediseño integral que va del chip a la red eléctrica.

Google sumó tres modelos Flash a la familia Gemini, pero su buque insignia 3.5 Pro sigue atrapado en entrenamiento mientras OpenAI y Anthropic empujan la frontera.

La tercera versión del generador de Alibaba maqueta diarios, papers en LaTeX y grillas de infografías en una sola pasada, pero llega cerrada y solo por invitación a la API.

El nuevo chip de servidor de Alphabet, previsto para 2028, prometería ser entre 6 y 10 veces más eficiente que sus aceleradores actuales, mientras la industria busca depender menos de NVIDIA.