Saltar al contenido
Etiqueta

#deepseek

20 notas publicadas

DeepSeek V4 Pro 0813 llega solo por API y sin anuncio
IA

DeepSeek V4 Pro 0813 llega solo por API y sin anuncio

El nuevo modelo de DeepSeek apareció disponible en OpenRouter sin página oficial de lanzamiento, y sus tres niveles de razonamiento entregan resultados visiblemente distintos entre sí.

Simon Willison
El costo de la IA cae un 43%: la guerra de precios se acelera
IA

El costo de la IA cae un 43%: la guerra de precios se acelera

El costo promedio por millón de tokens ha bajado drásticamente en dos meses, impulsado por modelos abiertos de origen chino y una competencia feroz en el sector.

Xataka
Claude Code es el framework más rápido pero el más costoso
IA

Claude Code es el framework más rápido pero el más costoso

Un análisis de Composio revela que, aunque Claude Code es el framework más veloz para agentes, su ejecución es casi tres veces más cara que la de sus competidores.

The Decoder
DeepSeek V4-Flash: la IA que cuesta 100 veces menos que Fable 5
IA

DeepSeek V4-Flash: la IA que cuesta 100 veces menos que Fable 5

La nueva apuesta de DeepSeek promete eficiencia extrema con un costo de apenas tres centavos por test, sacudiendo el mercado de modelos frente a gigantes como OpenAI y Anthropic.

Xataka
Kimi K3, Inkling y Laguna empujan la frontera abierta
IA

Kimi K3, Inkling y Laguna empujan la frontera abierta

El recuento número 23 de Interconnects reúne uno de los lotes más cargados de modelos de pesos abiertos, con licencias que van desde Apache 2 hasta acuerdos comerciales obligatorios.

Interconnects
DeepSeek V4-Flash: el nuevo estándar en eficiencia de IA
IA

DeepSeek V4-Flash: el nuevo estándar en eficiencia de IA

DeepSeek lanza una actualización clave en su modelo V4-Flash, optimizando capacidades de agentes y eficiencia de costos sin alterar su arquitectura base.

Latent Space
Deepseek Flash: IA de bajo costo que desafía a OpenAI
IA

Deepseek Flash: IA de bajo costo que desafía a OpenAI

La nueva versión del modelo Deepseek Flash alcanza un rendimiento competitivo frente al GPT-5.6 Luna de OpenAI, reduciendo costos operativos hasta en un 60%.

The Decoder
DeepSeek-V4-Flash: Rendimiento superior y bajo costo
IA

DeepSeek-V4-Flash: Rendimiento superior y bajo costo

El modelo DeepSeek-V4-Flash-0731 redefine la relación costo-inteligencia con 304B de parámetros y una optimización avanzada en capacidades agenticas.

Simon Willison
Lanzan Laguna S 2.1: Supera a Deepseek v4 Pro y es más barata
IA

Lanzan Laguna S 2.1: Supera a Deepseek v4 Pro y es más barata

El nuevo modelo de neolab demuestra que es posible superar a los gigantes actuales con una arquitectura optimizada y costos de inferencia reducidos.

Latent Space
GB300 NVL72: récord de 1.648 TFLOPs por GPU entrenando MoE
IA

GB300 NVL72: récord de 1.648 TFLOPs por GPU entrenando MoE

El sistema rack-scale de NVIDIA triplica el rendimiento por GPU frente a la generación anterior al preentrenar DeepSeek-V3 671B, con NVLink de quinta generación y 1,8 TB/s de ancho de banda por GPU.

NVIDIA Developer
Modelos abiertos ya alcanzan a los cerrados en cibercapacidad
IA

Modelos abiertos ya alcanzan a los cerrados en cibercapacidad

Un análisis del Instituto británico de Seguridad en IA advierte que la brecha en capacidades cibernéticas cayó de seis a diez meses a solo cuatro a siete, y a una fracción del costo.

The Decoder
Modelos de IA que 'sobrepiensan': un nuevo riesgo de seguridad
IA

Modelos de IA que 'sobrepiensan': un nuevo riesgo de seguridad

Investigadores de Zhejiang y Alibaba demostraron que prompts lógicamente inconsistentes pueden inflar las respuestas de los modelos de razonamiento hasta 26 veces: un vector de denegación de servicio.

IEEE Spectrum AI
JAX descarga activaciones al host y sube 57% el rendimiento
IA

JAX descarga activaciones al host y sube 57% el rendimiento

El host offloading libera memoria HBM al mover activaciones a la RAM del sistema, con hasta 57% más rendimiento al entrenar modelos como DeepSeek-V3 671B en NVIDIA Grace Blackwell.

NVIDIA Developer
Modelos chinos superan el 30% en OpenRouter por su bajo costo
IA

Modelos chinos superan el 30% en OpenRouter por su bajo costo

DeepSeek y Z.ai ya representan más del 30% del tráfico semanal en OpenRouter, con picos de 46%, gracias a precios entre 60% y 90% más bajos que los de OpenAI o Anthropic.

The Decoder
Baidu presenta OCR ilimitado que lee decenas de páginas de una vez
IA

Baidu presenta OCR ilimitado que lee decenas de páginas de una vez

El modelo rediseña la atención (R-SWA) para mantener el KV cache constante y procesar más de 40 páginas sin degradación de memoria ni velocidad.

The Decoder
26 mil alumnos chinos: la IA baja 24% las notas de examen
IA

26 mil alumnos chinos: la IA baja 24% las notas de examen

Un estudio panel de 30 meses documenta cómo el uso de asistentes IA acelera la tarea pero desploma los puntajes en exámenes cerrados; el daño en la prueba de acceso tarda dos años en aflorar.

The Decoder
OpenAI corta a la mitad el costo de ChatGPT para invitados
IA

OpenAI corta a la mitad el costo de ChatGPT para invitados

The Information reveló que la compañía optimizó la inferencia para visitantes sin cuenta y bajó a unos pocos cientos las GPU NVIDIA necesarias.

The Decoder
NVIDIA baja hasta 5x el costo por token de DeepSeek V4 en Blackwell
IA

NVIDIA baja hasta 5x el costo por token de DeepSeek V4 en Blackwell

El stack full-stack de inferencia sobre GB300 combina Dynamo, TensorRT-LLM, NVFP4 y NVLink para multiplicar por 20 el throughput por GPU y desplomar el costo por token.

NVIDIA Blog
SGLang sirve DeepSeek-V4 en GB300 con 5x más throughput
IA

SGLang sirve DeepSeek-V4 en GB300 con 5x más throughput

Dos meses después del lanzamiento, el stack abierto pasó de 2.200 a 11.200 tok/s/GPU a la misma interactividad gracias a KV Compression V2, W4A4 MegaMoE y CUDA graphs rompibles en el prefill.

PyTorch Blog

Etiquetas relacionadas

Otros temas que aparecen junto a #deepseek en nuestra cobertura editorial.