
Claude Code cae con solo pedirle que resuma un sitio web
El investigador Johann Rehberger encadenó pasos individualmente inofensivos hasta lograr ejecución remota de código en el agente, con una tasa de éxito de entre 60% y 80% en sus pruebas.
60 notas publicadas

El Model Hardware Standard busca hacer con los equipos de laboratorio, las fábricas y los robots lo que MCP hizo con las fuentes de datos: reducir de meses a horas el trabajo de integración.

Anthropic aplicará una firma estadística invisible en el texto y credenciales C2PA firmadas en imágenes, en todo el mundo y no solo donde el reglamento europeo lo exige.

El modelo más capaz de la compañía en ciberseguridad ya no exige acceso directo: entrega un informe de vulnerabilidades con categoría CWE y parche sugerido, sin caja de texto para conversar con él.

La empresa presentó Private Safety Processing, un mecanismo que revisa las conversaciones en busca de riesgos sin guardar el contenido ni exponerlo a su personal.

Un flujo completo de aprendizaje por preferencias que primero mide si el dataset de Anthropic esconde atajos de longitud y léxico, y recién después ajusta un Qwen2.5 de 0,5B con TRL y LoRA.

Anthropic publicó dos experimentos donde sus modelos orquestaron por su cuenta el software especializado de diseño de fármacos. La revisión independiente todavía está pendiente.

John Gruber sostiene que elegir palabras según una clave secreta degrada el texto, mientras los estudios jurídicos evalúan qué pasa cuando el aporte de la IA queda demostrable.

La compañía adopta una versión del sistema de código abierto de Google DeepMind para cumplir con las reglas de transparencia de la Ley de IA europea, sin costo extra para los usuarios.

Boris Cherny, creador de la herramienta, describe doce rutinas diarias que cazan crashes, borran código muerto y arreglan tests inestables en las apps internas de la empresa.

Un experimento de Princeton y el AI Security Institute británico dio seis días, 3.000 dólares de API y acceso a GPU a agentes para investigar solos. Los autores humanos votaron Reject.

Una falla en las API de los principales proveedores permite extraer las cadenas de pensamiento internas. Un barrido sobre sesiones públicas encontró 62 llaves de API, 33 contraseñas y 33 correos.

A partir del 14 de agosto, los usuarios de Claude Code verán el modo automático como configuración predeterminada tras demostrar mayor eficacia frente a riesgos.

Anthropic intentó resolver un problema milenario con IA. Aunque fracasó en su objetivo principal, el modelo logró un avance técnico significativo en matemáticas.

El comportamiento de modelos de OpenAI y Anthropic al eludir restricciones no es rebeldía, sino una optimización lógica que prioriza el resultado sobre la ética.

Benjamin Mann, cofundador de Anthropic, sostiene que en la era de la IA, la curiosidad y la creatividad superan a los títulos académicos tradicionales.

Anthropic apuesta por la automatización en sus planes Pro, Max y Team. Los datos sugieren una mayor eficacia contra riesgos de seguridad que la revisión humana.

La empresa tras Claude confirma la creación de un equipo interno para desarrollar silicio propio, buscando optimizar rendimiento y eficiencia a gran escala.

La empresa reescribió la constitución del clasificador que filtra consultas biológicas y bajó los falsos positivos, aunque virología, toxicología y diseño molecular siguen derivando a Opus 5.

El gigante de la IA busca independencia operativa mediante un acuerdo masivo a seis años con Volta Infra, utilizando los nuevos chips de NVIDIA en suelo nórdico.

Elon Musk anunció que la capacidad de cómputo de la compañía pasará de 1,4 gigavatios a cerca de diez antes de que termine 2027, con silicio de un solo proveedor.

El AI Security Institute detectó comportamientos de riesgo en agentes de IA durante pruebas de ciberseguridad. ¿Falla el modelo o el entorno de ejecución?

La startup Volta Infra Holdings, fundada este año, proveerá 133 megavatios de capacidad de cómputo para los modelos de IA de Anthropic en Noruega.

La carrera por el talento en inteligencia artificial se vuelve hostil. Los sueldos millonarios y el cómputo masivo desafían la visión ética de las startups líderes.

Una revisión de 141.006 corridas de evaluación detectó tres casos en que el modelo salió del entorno de simulación y comprometió infraestructura de producción de tres organizaciones distintas.

Un shooter en primera persona, un juego de submarinos, un kart y varias réplicas de Minecraft salieron de una sola instrucción de texto, sin usar un solo archivo externo.

Tras perder gran parte de su cartera pública ante Citadel, el fondo de IA mantiene una apuesta clave en Anthropic valorada en 5.000 millones de dólares.

Tras una auditoría interna, Anthropic admitió que tres versiones de Claude lograron vulnerar entornos de producción durante pruebas de ciberseguridad.

Tras el incidente de OpenAI, Anthropic reveló que sus modelos de ciberseguridad irrumpieron en tres organizaciones ajenas debido a una configuración errónea.

Tras una falla de configuración, modelos de IA de Anthropic atacaron sistemas reales durante evaluaciones de ciberseguridad, incluyendo la publicación de malware.

Mientras la apuesta por Anthropic impulsa las ganancias trimestrales de Microsoft, su participación en OpenAI experimenta un ajuste a la baja en el último reporte fiscal.

Líderes de la industria y académicos coinciden en una verdad inquietante: los modelos actuales desarrollan habilidades no programadas que nadie logra descifrar.

El gigante tecnológico prioriza sus modelos propios MAI y agentes sobre sus inversiones externas, marcando un giro estratégico en su relación con OpenAI.

La empresa afirma que su modelo alcanza 38,3% frente al 30,2% de Claude Opus 5, pero solo cuando corre con dos ajustes propios de su API en lugar del entorno de prueba oficial.

La mayoría de los investigadores detrás del proyecto AlphaFold fueron reasignados o dejaron Google DeepMind, marcando un cambio radical en su enfoque hacia la IA generativa.

La alianza busca revolucionar procesos de ingeniería y validación de hardware, entrenando a 20.000 profesionales en el uso de Claude para entornos físicos complejos.

El CEO de Anthropic, Dario Amodei, desmiente rumores sobre una posible prohibición de modelos open-weights y propone tres medidas regulatorias clave.

Anthropic lanza una plataforma especializada para educadores en EE. UU., integrando estándares académicos y herramientas de IA para optimizar la labor docente.

Una vulnerabilidad en la función de compartir chats de Claude permitió que conversaciones privadas y documentos sensibles fueran indexados por Google.

El CEO de Anthropic responde a las críticas de la industria y aclara que, aunque defiende los modelos abiertos, teme por la supremacía militar de China.

Una vulnerabilidad en la función de compartir enlaces de Claude permitió que conversaciones privadas fueran indexadas por motores de búsqueda. ¿Qué falló?

El nuevo modelo de Anthropic ya está disponible en Claude Max y Pro. Ofrece un rendimiento de vanguardia en codificación y razonamiento a un costo eficiente.

El nuevo modelo de Anthropic alcanza un 30.2% en el benchmark ARC-AGI-3, superando por amplio margen el 7.8% obtenido previamente por el GPT-5.6 Sol de OpenAI.

El incidente muestra lo difícil que es impedir que los rastreadores web hagan públicas conversaciones supuestamente privadas con chatbots de IA.

El modelo de Anthropic encabeza el Artificial Analysis Intelligence Index con 61 puntos y baja el costo por tarea hasta la mitad en los tramos de razonamiento intermedios.

Anthropic reporta 0% de éxito del ataque en 129 escenarios, aunque la cifra solo se sostiene con el Modo Automático activado.

El nuevo modelo de neolab demuestra que es posible superar a los gigantes actuales con una arquitectura optimizada y costos de inferencia reducidos.

La administración Trump señala a Moonshot AI por destilar Fable de Anthropic. Analizamos los tres problemas clave de una acusación que carece de pruebas técnicas.

Anthropic expande las capacidades de su asistente: los usuarios ya pueden usar Opus y Sonnet en conversaciones de voz a través de web, escritorio y móviles.

El nuevo modelo de Anthropic llega con mayor precisión, menores restricciones de privacidad y una función beta de fallbacks automáticos para usuarios API.

El nuevo modelo insignia de Anthropic lidera en programacion agentica y trabajo de conocimiento, y cuesta la mitad por token que Fable 5.

Investigadores que buscan vulnerabilidades desconocidas dicen que los límites de OpenAI y Anthropic estorban su trabajo y los empujan hacia modelos de código abierto sin restricciones.

Anthropic permite elegir el modelo que responde por voz y conectar el asistente con Gmail, Google Calendar, Slack, Canva y Notion para ejecutar tareas reales.

El Instituto de Seguridad de la IA del Reino Unido probo cinco modelos de frontera en ejercicios de ciberseguridad y todos intentaron saltarse las reglas sin que nadie se los pidiera.

El fabricante de chips financia al laboratorio detras de Claude, que a cambio desplegara hasta 2 gigavatios de GPU AMD Instinct MI450 en sistemas Helios desde 2027.

Su API cuesta 4,40 dólares por millón de tokens de salida, menos de un quinto que Opus 4.8, y expone lo caro que resultan los hábitos de programación con IA sin presupuesto.

En la AI Engineer World's Fair, Cat Wu y Thariq Shihipar de Anthropic contaron cómo los agentes de código cambiaron su trabajo y acortaron de meses a una semana el camino de la idea al producto.

Google sumó tres modelos Flash a la familia Gemini, pero su buque insignia 3.5 Pro sigue atrapado en entrenamiento mientras OpenAI y Anthropic empujan la frontera.

Microsoft ampliará el uso de chips de IA de AMD en Azure con la plataforma Helios, y un perfil público sugiere que Anthropic también está probando hardware de la firma.

Según el New York Times, el acuerdo podría valer hasta 10.000 millones de dólares en dos años y sería el primer gran cliente del plan de Zuckerberg para vender capacidad de sus centros de datos.
Otros temas que aparecen junto a #anthropic en nuestra cobertura editorial.