Saltar al contenido
Etiqueta

#coding agent

27 notas publicadas

Cursor: modelos baratos programan si el frontier planifica
IA

Cursor: modelos baratos programan si el frontier planifica

Un experimento reconstruyo SQLite en Rust con enjambres de agentes: los planificadores de frontera solo disenaron y los trabajadores economicos hicieron el grueso, recortando el costo hasta 15 veces.

The Decoder
Claude Opus 5 casi iguala a Fable 5 a mitad de precio
IA

Claude Opus 5 casi iguala a Fable 5 a mitad de precio

El nuevo modelo insignia de Anthropic lidera en programacion agentica y trabajo de conocimiento, y cuesta la mitad por token que Fable 5.

The Decoder
Z.ai GLM 5.2: el modelo chino barato que reta a Opus 4.8
IA

Z.ai GLM 5.2: el modelo chino barato que reta a Opus 4.8

Su API cuesta 4,40 dólares por millón de tokens de salida, menos de un quinto que Opus 4.8, y expone lo caro que resultan los hábitos de programación con IA sin presupuesto.

IEEE Spectrum AI
Claude Tag ya genera el 65% de los PR del equipo Claude Code
IA

Claude Tag ya genera el 65% de los PR del equipo Claude Code

En la AI Engineer World's Fair, Cat Wu y Thariq Shihipar de Anthropic contaron cómo los agentes de código cambiaron su trabajo y acortaron de meses a una semana el camino de la idea al producto.

Simon Willison
xAI abre el código de Grok-Build tras una fuga masiva de datos
IA

xAI abre el código de Grok-Build tras una fuga masiva de datos

El agente de terminal subía directorios completos a Google Cloud, incluidas llaves SSH y contraseñas. Tras la reacción, xAI liberó las 844.530 líneas de Rust bajo Apache 2.0.

The Decoder
Grok 4.5 es tan barato que los benchmarks importan menos
IA

Grok 4.5 es tan barato que los benchmarks importan menos

El modelo de xAI queda detrás de Fable 5 y GPT-5.5 en varios benchmarks de programación, pero cuesta 2 dólares por millón de tokens de entrada y usa 4,2 veces menos tokens que Opus 4.8.

The Decoder
Meta lanza Muse Spark 1.1, su modelo de código con IA
IA

Meta lanza Muse Spark 1.1, su modelo de código con IA

El modelo multimodal para programación agéntica cuesta 1,25 dólares por millón de tokens de entrada y llega tarde frente a OpenAI y Anthropic, pero apuesta por el precio bajo.

TechCrunch AI
OpenAI: casi 30% del test de código SWE-Bench Pro falla
IA

OpenAI: casi 30% del test de código SWE-Bench Pro falla

La empresa retira su respaldo al popular benchmark tras detectar que unas 200 de sus tareas están mal planteadas, y pide a la industria construir pruebas más confiables.

The Decoder
Databricks adopta GLM 5.2 como motor de código por defecto
IA

Databricks adopta GLM 5.2 como motor de código por defecto

El modelo abierto chino igualó a Opus 4.8 en un benchmark interno de Databricks a 1,28 dólares por tarea frente a 1,94, y pasa a ser el modelo de trabajo diario de sus desarrolladores.

The Decoder
GPT-5.6 de OpenAI llega el jueves tras un freno del gobierno de EE.UU.
IA

GPT-5.6 de OpenAI llega el jueves tras un freno del gobierno de EE.UU.

El Departamento de Comercio autorizó el lanzamiento público luego de que la agencia CAISI corriera pruebas de seguridad adicionales sobre la familia Sol.

The Decoder
Zhipu AI lanza ZCode y desafía a Claude Code y Codex
IA

Zhipu AI lanza ZCode y desafía a Claude Code y Codex

La empresa china estrena un entorno de desarrollo agentico sobre GLM-5.2 con contexto de 1M tokens, cinco días gratis y cuotas ampliadas hasta julio de 2026.

The Decoder
Introspection: el loop del agente es el producto, no el modelo
IA

Introspection: el loop del agente es el producto, no el modelo

Roland Gavrilescu, co-fundador de Introspection y ex xAI, explica en el AI Engineer World's Fair su tesis de autoresearch, agent recipes y por qué los humanos siguen siendo el eje del sistema.

Latent Space
sqlite-utils 4.0rc2: Simon Willison lo pulió con Claude Fable por USD 14
IA

sqlite-utils 4.0rc2: Simon Willison lo pulió con Claude Fable por USD 14

El creador de Datasette relata cómo el modelo de Anthropic encontró cinco *release blockers* en 37 prompts, incluyendo un bug que borraba tablas enteras al cerrar la base.

Simon Willison
Cursor arma su fábrica de software con FDEs y planea 10x en 6 meses
IA

Cursor arma su fábrica de software con FDEs y planea 10x en 6 meses

Pauline Brunet, VP de Forward Deployed Engineering, explica cómo su equipo despliega agentes de ciclo largo dentro de bancos, telcos y fabricantes de chips para transformar el ciclo de desarrollo.

Latent Space
Cursor lanza app móvil para orquestar agentes de código a distancia
IA

Cursor lanza app móvil para orquestar agentes de código a distancia

Anysphere presentó Cursor Mobile pocas semanas después de la adquisición por USD 60 mil millones anunciada por SpaceX. Permite crear y supervisar agentes de código desde el teléfono.

TechCrunch AI
Warp lanza Oz y apuesta por las 'software factories' automatizadas
IA

Warp lanza Oz y apuesta por las 'software factories' automatizadas

El CEO Zach Lloyd presentó en el AI Engineer World's Fair una plataforma para automatizar el ciclo completo de ingeniería de software, desde el triage hasta el despliegue.

Latent Space
OpenAI teasea hardware para Codex hecho con Work Louder
IA

OpenAI teasea hardware para Codex hecho con Work Louder

El dispositivo, que sale el 15 de julio, se parece al Creator Micro 2: un macro pad con 13 switches mecánicos, joystick y sensor táctil pensado para atajos.

The Verge
AIEWF: autoresearch y el pulso por la agencia humana en el loop
IA

AIEWF: autoresearch y el pulso por la agencia humana en el loop

Introspection propone loops externos hechos por agentes; Osmani, Litt y Bakaus responden que la responsabilidad de diseño debe seguir siendo humana.

Latent Space
Anthropic lanza Sonnet 5 y aprueba el regreso de Fable 5
IA

Anthropic lanza Sonnet 5 y aprueba el regreso de Fable 5

El nuevo mid-tier trae contexto de 1M tokens, precio promocional de USD 2/10 por millón y benchmarks que lo dejan cerca de Opus 4.8 pero con el doble de costo por tarea.

Latent Space
¿Podrá Cursor seguir sirviendo modelos de OpenAI y Anthropic dentro de S
IA

¿Podrá Cursor seguir sirviendo modelos de OpenAI y Anthropic dentro de S

La compra por USD 60.000 millones abre la duda de si los rivales frontier seguirán vendiendo sus modelos a través de una plataforma controlada por Elon Musk.

Wired
OpenAI lanza GPT-5.6 Sol, Terra y Luna solo a socios autorizados
IA

OpenAI lanza GPT-5.6 Sol, Terra y Luna solo a socios autorizados

El lanzamiento limitado responde a un pedido del gobierno de EE.UU. METR detectó la mayor tasa de cheating de un modelo público evaluado, con time horizon entre 11 y 270 horas según se cuente.

Latent Space
Opus 4.7 lidera MirrorCode con 56% reconstruyendo programas
IA

Opus 4.7 lidera MirrorCode con 56% reconstruyendo programas

En la nueva benchmark de Epoch AI y METR, GPT-5.5 alcanza 44% y Gemini 3.1 Pro un 32%; una tarea costó USD 2.600 y 19 días de inferencia continua sin intervención humana.

The Decoder
GLM-5.2 iguala a Opus 4.7 a un quinto del costo en Snowflake
IA

GLM-5.2 iguala a Opus 4.7 a un quinto del costo en Snowflake

El modelo chino de Zhipu AI resuelve 66% de 103 tareas de programación contra el 67% de Anthropic, pero quema casi el doble de tokens y suma latencia con 99 iteraciones por tarea.

The Decoder
OpenAI: tokens de Codex en Investigación crecieron 56x
IA

OpenAI: tokens de Codex en Investigación crecieron 56x

El reporte interno de OpenAI Economic Research detalla cómo el uso de Codex se profundizó entre noviembre de 2025 y junio de 2026 en investigación, soporte, ingeniería y legal.

Latent Space
Claude Tag lleva agentes proactivos y persistentes a Slack
IA

Claude Tag lleva agentes proactivos y persistentes a Slack

Anthropic estrena un agente que vive dentro de Slack, vigila canales sin ser invocado, etiqueta a compañeros responsables del código y dispara fixes cuando un A/B test cruza un guardrail.

Latent Space
GLM-5.2 alcanza a Claude Opus 4.8 en coding maratónico
IA

GLM-5.2 alcanza a Claude Opus 4.8 en coding maratónico

El laboratorio chino Zhipu AI libera bajo licencia MIT un modelo con ventana de 1 millón de tokens que se queda a 1 punto de Anthropic en FrontierSWE.

The Decoder

Etiquetas relacionadas

Otros temas que aparecen junto a #coding agent en nuestra cobertura editorial.