
Doom corre en una CPU diseñada por GPT-5.6 Sol
El modelo levantó el procesador desde compuertas lógicas dentro del simulador Turing Complete, lo bautizó Codex-R32 y ejecutó el motor original compilado a RISC-V.
36 notas publicadas

El nuevo modo de inferencia corre sobre hardware de Cerebras, socio de OpenAI en un acuerdo de 10.000 millones de dólares, y convierte la velocidad en un tercer nivel de precio dentro de la API.

Simon Willison pone a prueba la capacidad de GPT-5.6 Sol Ultra para generar videojuegos completos mediante prompts, logrando resultados superiores a sus versiones previas.

Modelos de lenguaje están descifrando conjeturas históricas, generando un intenso debate en la comunidad científica sobre el futuro de la investigación pura.

La empresa afirma que su modelo alcanza 38,3% frente al 30,2% de Claude Opus 5, pero solo cuando corre con dos ajustes propios de su API en lugar del entorno de prueba oficial.

Segun el Wall Street Journal, empleados siguieron encontrando respuestas problematicas tras el lanzamiento, pero la empresa bajo la clasificacion de riesgo del modelo ese otono.

El modelo compacto de ciberseguridad resuelve el 90% de las tareas y solo deriva los casos más difíciles a GPT-5.4, con un ahorro de costos del 50% según la empresa.

Bloomberg, TIME y Reuters reconstruyen cómo tres modelos escaparon del entorno de prueba y atacaron la plataforma por su cuenta.

Durante una prueba interna, modelos de OpenAI escaparon de su entorno aislado, hallaron una falla en un instalador de paquetes y llegaron a la base de datos de producción de Hugging Face.

Durante una prueba interna de ciberseguridad, GPT-5.6 Sol y un modelo pre-release escaparon de su entorno aislado y accedieron a la base de datos de producción de Hugging Face.

Los modelos de ciberseguridad, incluido GPT-5.6 Sol, rompieron un entorno de pruebas sellado, explotaron un zero-day y llegaron a internet abierto para robar las respuestas de su propia evaluación.

El modelo de OpenAI sobrescribe la variable $HOME y ejecuta borrados destructivos sin pedir confirmación cuando corre sin sandbox, según The Decoder.

El sistema, entrenado con aprendizaje por refuerzo y autojuego, encuentra ataques exitosos en el 84% de los escenarios de prueba, frente al 13% de los equipos humanos de seguridad.

Un profesor de la Universidad de Pensilvania usó el modelo de OpenAI para desmentir en 90 minutos un supuesto sobre el método Benjamini-Hochberg que los humanos no lograron probar en tres décadas.

Desde junio, la herramienta de OpenAI oculta las instrucciones que un agente principal pasa a sus subagentes, y los desarrolladores ya no pueden auditar cómo se delegan las tareas.

Desarrolladores denuncian en redes que el nuevo modelo insignia eliminó archivos, datos y bases de datos completas sin pedir permiso. La propia OpenAI ya lo había advertido en la ficha técnica.

La nueva guía apunta a usuarios comunes, no a desarrolladores: cuatro bloques opcionales y la idea de decir qué se quiere en vez de detallar cada instrucción.

Peter Gostev construyó con GPT-5.6 Sol un Doom en el que SQL controla el movimiento, las colisiones y cada píxel de la pantalla.

Un ingeniero de OpenAI explica qué nivel conviene para cada tipo de tarea y recomienda empezar bajo y subir solo cuando el problema lo pide, para no gastar tokens de más.

La compañía mantiene el acceso a Claude Fable 5 en sus planes de suscripción hasta el 19 de julio, en vez de pasarlo hoy a pago por uso, en plena guerra de precios de los modelos de IA.

OpenAI sale a despejar los rumores de quiebre con Microsoft: su nueva familia seguirá potenciando Word, Excel, PowerPoint y Cowork, pese a que Redmond empuja sus modelos MAI para recortar costos.

Tras una ola de críticas por límites de uso agotados y una interfaz de escritorio confusa, la empresa reseteó los cupos dos veces en un día y promete una actualización mayor la próxima semana.

El modelo de OpenAI generó una prueba de la conjetura del doble recubrimiento por ciclos en menos de una hora con 64 subagentes. Un matemático la valida, pero critica la falta de citas.

El modelo insignia de OpenAI marca 59 puntos en el Intelligence Index de Artificial Analysis, a un punto de Fable 5, pero cuesta 1,04 dólares por tarea frente a 2,75.

La familia debuta con un modelo insignia para programación, capacidades reforzadas de ciberseguridad y la nueva herramienta ChatGPT Work para equipos empresariales.

Con una sola instrucción poco detallada, el nuevo modelo insignia de OpenAI eligió configuraciones, seleccionó las GPU y ejecutó el post-entrenamiento de Luna sin intervención humana.

Construido sobre Codex y el recién liberado GPT-5.6, trabaja horas de forma autónoma en proyectos complejos y entrega documentos terminados vía Google Drive, Slack o Salesforce.

OpenAI lanza su nueva familia insignia con precios desde 1 dólar por millón de tokens y afirma superar a Claude Fable 5 en tareas de agentes de larga duración.

En la final del AtCoder World Tour 2026, un sistema de OpenAI resolvió los cinco problemas de la división de algoritmos y superó por amplio margen a los mejores programadores competitivos del mundo.

OpenAI estrena un modelo de voz full-duplex que interrumpe, usa muletillas y delega las tareas complejas a GPT-5.5 en segundo plano para no perder calidad.

El Departamento de Comercio autorizó el lanzamiento público luego de que la agencia CAISI corriera pruebas de seguridad adicionales sobre la familia Sol.

Zuckerberg dijo en un town hall interno que el desarrollo agente no aceleró como esperaba. Su jefe de IA, Alexandr Wang, respondió con el nombre en código del próximo modelo: Watermelon.

Princeton diseñó un benchmark donde agentes IA dirigen una startup ficticia por 500 días simulados. La mayoría quiebra, y una heurística sin IA supera a casi todos los modelos probados.

El lanzamiento limitado responde a un pedido del gobierno de EE.UU. METR detectó la mayor tasa de cheating de un modelo público evaluado, con time horizon entre 11 y 270 horas según se cuente.

El nuevo buque insignia de OpenAI lidera benchmarks de coding agéntico y matchea a Mythos en ciberseguridad, pero Washington bloquea el lanzamiento abierto y la empresa critica la decisión.

El nuevo modelo lidera CyberGym (85,6%) y SEC-bench Pro (69,8%); el programa suma 25 partners como Cisco, CrowdStrike, Cloudflare y Palo Alto Networks.
Otros temas que aparecen junto a #gpt 5 en nuestra cobertura editorial.