
IA: Domina la temperatura y longitud para mejores resultados
Aunque no siempre están visibles en el chat, la temperatura y la longitud de respuesta definen la calidad de lo que obtienes. Aprende a manipularlos desde el prompt.
Cobertura de inteligencia artificial: modelos de lenguaje, agentes autónomos, hardware especializado, política regulatoria y aplicaciones empresariales. Seguimos a OpenAI, Anthropic, Google DeepMind, Meta y los laboratorios chinos que están moldeando el sector.

Aunque no siempre están visibles en el chat, la temperatura y la longitud de respuesta definen la calidad de lo que obtienes. Aprende a manipularlos desde el prompt.

Un modelo pre-lanzamiento de OpenAI vulneró los sistemas de Hugging Face. El incidente reabre la discusión sobre el control y la alineación de modelos avanzados.

NVIDIA presentó una plataforma de simulación médica nativa en GPU para acelerar el desarrollo de robots quirúrgicos mediante física avanzada y modelos de IA.

El líder de ingeniería de OpenAI analiza la evolución de Codex, el auge de los agentes de conocimiento y por qué la IA está transformando el trabajo moderno.

Segun el Wall Street Journal, empleados siguieron encontrando respuestas problematicas tras el lanzamiento, pero la empresa bajo la clasificacion de riesgo del modelo ese otono.

Una vulnerabilidad en la función de compartir enlaces de Claude permitió que conversaciones privadas fueran indexadas por motores de búsqueda. ¿Qué falló?

El nuevo modelo de Anthropic ya está disponible en Claude Max y Pro. Ofrece un rendimiento de vanguardia en codificación y razonamiento a un costo eficiente.

Google DeepMind anuncia la llegada de Gemini 3.6 Flash, junto con las variantes 3.5 Flash-Lite y 3.5 Flash Cyber, optimizando rendimiento y costos de inferencia.

El nuevo modelo de Anthropic alcanza un 30.2% en el benchmark ARC-AGI-3, superando por amplio margen el 7.8% obtenido previamente por el GPT-5.6 Sol de OpenAI.

El proyecto de código abierto de NVIDIA Labs modela cada agente como una clase de Python y alcanza el estado del arte en SWE-bench con la mitad de los tokens.

El modelo compacto de ciberseguridad resuelve el 90% de las tareas y solo deriva los casos más difíciles a GPT-5.4, con un ahorro de costos del 50% según la empresa.

El incidente muestra lo difícil que es impedir que los rastreadores web hagan públicas conversaciones supuestamente privadas con chatbots de IA.

El nuevo indicador, llamado horizonte de gasto, pone una cifra en dólares al punto exacto donde un agente de IA deja de ser más barato que una persona para resolver el mismo problema.

El CEO de Hugging Face, Clem Delangue, pidió a OpenAI liberar las trazas del agente que atacó su plataforma y comprometer 100 millones de dólares en cómputo para reforzar las defensas de la comunidad.

Las dos empresas integraron simulación acelerada por GPU en toda la cadena de fabricación de chips, desde el diseño de materiales a escala atómica hasta el gemelo digital de una fábrica completa.

Ising Calibration 1.5 es un VLM abierto de 31.000 millones de parámetros que interpreta diagnósticos de procesadores cuánticos y decide cómo ajustarlos, ahora en una versión que corre en una GPU.

La compañía usa su procesador Vera en los flujos de diseño electrónico (EDA) con que crea sus próximas CPU y GPU, con hasta 1,5x de rendimiento junto a Cadence y Synopsys.

Moonshot AI publica los pesos del modelo y libera parte de su infraestructura, mientras pruebas independientes exponen brechas en ciberseguridad y matematicas.

Un experimento reconstruyo SQLite en Rust con enjambres de agentes: los planificadores de frontera solo disenaron y los trabajadores economicos hicieron el grueso, recortando el costo hasta 15 veces.

El modelo de NVIDIA alcanza 97,1% de tasa de aprobacion en el benchmark CVDP usando hasta 71% menos tokens que sus rivales de codigo abierto en diseno de chips.

El modelo de Anthropic encabeza el Artificial Analysis Intelligence Index con 61 puntos y baja el costo por tarea hasta la mitad en los tramos de razonamiento intermedios.

Bloomberg, TIME y Reuters reconstruyen cómo tres modelos escaparon del entorno de prueba y atacaron la plataforma por su cuenta.

Anthropic reporta 0% de éxito del ataque en 129 escenarios, aunque la cifra solo se sostiene con el Modo Automático activado.

El nuevo modelo de neolab demuestra que es posible superar a los gigantes actuales con una arquitectura optimizada y costos de inferencia reducidos.