
OpenAI reduce costos de GPT-5.6: baja de hasta 80% en precios
OpenAI implementa optimizaciones en su stack de inferencia y harness, logrando reducciones drásticas de costos y mayor eficiencia en modelos como Luna y Sol.
Todas las notas publicadas en MechaNoticias. Ordenadas por fecha de publicación, de la más reciente a la más antigua.
1.108 notas · Página 23 de 47

OpenAI implementa optimizaciones en su stack de inferencia y harness, logrando reducciones drásticas de costos y mayor eficiencia en modelos como Luna y Sol.

La nueva placa de desarrollo basada en ESP32-C5 integra Wi-Fi 6, Bluetooth 5.0, soporte para Thread/Zigbee, cuatro relés y entradas optoaisladas para aplicaciones de automatización.

La gigante del delivery recibió la certificación Part 135 de la FAA, permitiéndole operar su propia flota de drones autónomos bajo el programa DoorDash Air.

Mientras la apuesta por Anthropic impulsa las ganancias trimestrales de Microsoft, su participación en OpenAI experimenta un ajuste a la baja en el último reporte fiscal.

La investigadora Lizy K. John propone sustituir las pesadas operaciones matemáticas de la IA actual por tablas de búsqueda, reduciendo el consumo energético drásticamente.

Aunque el incidente alarmó a la industria, el atacante autónomo cometió errores tácticos. Expertos explican por qué las defensas tradicionales siguen siendo clave.

El equipo de seguridad de IA de NVIDIA detalla cómo mitigar vulnerabilidades críticas en entornos empresariales mediante control de acceso y sandboxing.

Líderes de la industria y académicos coinciden en una verdad inquietante: los modelos actuales desarrollan habilidades no programadas que nadie logra descifrar.

El gigante tecnológico prioriza sus modelos propios MAI y agentes sobre sus inversiones externas, marcando un giro estratégico en su relación con OpenAI.

La aplicación de GitHub Copilot ahora permite encadenar sesiones y Pull Requests, optimizando la modernización de proyectos antiguos mediante IA.

Andon Labs puso a prueba a modelos de IA en una simulación de negocios de un año. Los resultados muestran una preocupante tendencia hacia el engaño y el fraude.

Andrew Ho sostiene que el escalamiento masivo de modelos no garantiza la inteligencia general y propone una inversión masiva en datasets especializados.

La nueva librería de NVIDIA permite ejecutar operaciones matemáticas complejas en CPU, GPU y sistemas distribuidos, integrándose con NumPy, CuPy y PyTorch.

La compañía ajusta drásticamente los precios de sus modelos de IA. Luna y Terra son ahora significativamente más económicos para desarrolladores y empresas.

Google DeepMind presenta una nueva capa de inteligencia para robots, permitiendo control corporal completo, destreza fina y colaboración multi-robot en tiempo real.

Ingenieros de IA redescubren las ontologías, esa vieja idea de los datos como grafos, para mantener a los agentes probabilísticos dentro de límites deterministas y evitar que se salgan de control.

Tras una inversión de 30 millones de dólares y un desarrollo récord de 9 meses, la nave encargada de salvar al telescopio Swift presenta fallas críticas en su orientación.

El desarrollo de código abierto para las tarjetas gráficas DG2 avanza, permitiendo por fin el uso de aceleración por hardware en el driver Xe de Linux.

El CEO de IA de la compañía, Mustafa Suleyman, plantea entrenar modelos compactos por campo en vez de un único modelo de propósito general, con la eficiencia de tokens como eje competitivo.

Samsung anticipa que la alta demanda de chips para IA mantendrá los precios elevados por varios años, descartando una normalización inmediata para el mercado de consumo.

La nueva actualización trimestral de los drivers de video de Intel introduce soporte avanzado para Nova Lake, incluyendo codificación AV1, HEVC y AVC.

Analizamos el primer hardware de OpenAI: un mando para agentes IA que, pese a su precio de 230 dólares, comparte el ADN de cualquier teclado mecánico programable.

Andrew rescató tarjetas Tesla V100 de 2017 del mercado de segunda mano y armó una placa PCI para dos GPUs, capaz de correr modelos como Gemma 4 26B y Qwen3 35B por completo en memoria.

En un paper titulado "LLMs can't jump", Tom Zahavy de Google DeepMind sostiene que a los modelos de lenguaje les falta el salto creativo que permitió a Einstein reinventar la física.