
Gemma Translator: intérprete sin nube sobre una Raspberry Pi 5
Tres ingenieros de Google liberaron el código, el STL de la carcasa y las instrucciones de un traductor de voz que corre Gemma 4 E2B en local, sin enviar audio a ningún servidor.
57 notas publicadas

El primer modelo abierto de la compañía en más de un año llega con licencia Apache 2.0, cabe en una tarjeta de 24 GB y apunta a empresas medianas antes que a la frontera.

PyTorch habilita el modelo abierto de 30 mil millones de parámetros de Meta en GPU NVIDIA y Mac con silicio de Apple, con decodificación especulativa DFlash y contexto de 128K tokens.

El tutorial oficial de Raspberry Pi mide 433,17 tokens por segundo de prefill con Gemma 3 270M sobre la placa de 8 GB, sin enviar una sola consulta a la nube.

Mirror Me presenta un perro robot cuadrúpedo de alto rendimiento que promete un ensamblaje sencillo y una plataforma abierta para entusiastas de la robótica.

Con 30 mil millones de parámetros y licencia Apache 2.0, el nuevo modelo de Meta promete capacidades avanzadas de razonamiento y ejecución de tareas complejas.

El costo promedio por millón de tokens ha bajado drásticamente en dos meses, impulsado por modelos abiertos de origen chino y una competencia feroz en el sector.

El CEO de Meta plantea un futuro con agentes de IA personales y modelos abiertos. Analizamos si esta propuesta busca democratizar el poder o consolidar su imperio.

La nueva actualización de NVIDIA para Jetson permite flujos de trabajo de video programables, emulación T3000 y soporte avanzado de codificación Python.

El gigante tecnológico presenta un modelo ligero de pesos abiertos y una herramienta para optimizar costos de ejecución en agentes de IA, impulsando su ecosistema.

NVIDIA expande su familia Nemotron con un modelo de 30B parámetros diseñado para agentes inteligentes, optimizado para ejecución local y menores costos.

NVIDIA expande su ecosistema con el modelo Nemotron 3.5 Lightning y la biblioteca NeMo Switchyard para optimizar el despliegue de agentes IA autónomos.

El framework Qt expande sus capacidades con un módulo de Edge AI, permitiendo ejecutar tareas de visión artificial en plataformas embebidas de alto rendimiento.

Meta retoma el desarrollo de modelos de pesos abiertos con Muse Glimmer, un sistema de 30B optimizado para tareas complejas y uso de herramientas bajo licencia Apache 2.0.

Un proyecto maker que combina Raspberry Pi, micrófonos USB y el modelo BirdNET para clasificar especies y generar arte visual con los visitantes de tu jardín.

La nueva actualización de la API Vulkan introduce la extensión VK_EXT_cooperative_matrix_maintenance1, optimizando el rendimiento en machine learning e inferencia.

El resumen semanal de robótica incluye drones de carga pesada en el desafío de DARPA, helicópteros marcianos de la NASA y avances en manos humanoides.

Ante el alza de precios en discos duros y SSD, un entusiasta recurre a la tecnología BDXL para gestionar su biblioteca musical de forma económica y segura.

Tras ser ignorado por el fabricante, un entusiasta logró tomar control total de una máquina vending usada mediante ADB y chatbots de IA.

El CEO de SpaceX ratifica que su infraestructura de computación de alto rendimiento utilizará exclusivamente hardware de NVIDIA para sus proyectos espaciales.

El distribuidor tecnológico Avnet y la firma Weston Robot presentan una solución autónoma de inspección equipada con procesadores AMD Ryzen AI para entornos industriales.

Huawei presenta el MateBook Pro S, un portátil de 798 gramos con procesador Kirin XE90 y HarmonyOS, marcando un hito en su independencia tecnológica frente al veto de EE. UU.

Un teclado macro programable con pantalla LCD, encoder rotativo y 9 teclas mecánicas, diseñado para gestionar herramientas de IA y comandos de voz.

Un dispositivo de 4.2 pulgadas con ESP32-S3, soporte de voz y firmware abierto para proyectos de domótica, recordatorios y asistentes inteligentes.

El nuevo sistema generativo omnimodal MiniMax-H3 ya tiene soporte para Apple Silicon. Analizamos los requisitos de hardware y el proceso de instalación vía MLX.

El nuevo modelo VLA de 34 mil millones de parámetros combina razonamiento y acción para transformar el desarrollo y la validación de vehículos autónomos.

Con 2.4 billones de parámetros y arquitectura MoE, el nuevo modelo de Alibaba demuestra que las restricciones de exportación no frenaron el avance chino.

Tim Cook anticipa que la versión avanzada del asistente integrará un modelo de suscripción premium para usuarios con alta demanda de procesamiento.

DeepSeek lanza una actualización clave en su modelo V4-Flash, optimizando capacidades de agentes y eficiencia de costos sin alterar su arquitectura base.

Liquid AI presenta dos nuevos modelos encoder diseñados para superar a los estándares actuales en tareas de procesamiento de lenguaje, manteniendo alta velocidad en CPUs.

La nueva actualización del SDK de video de NVIDIA introduce mejoras críticas en la transcodificación, eficiencia de bitrate y acceso preciso a frames para flujos de trabajo en IA.

Análisis profundo sobre el diseño de arquitecturas de modelos de IA, el rol del group size y cómo maximizar el rendimiento en hardware NVIDIA para inferencia.

El nuevo modelo de razonamiento de Thinking Machines prioriza la eficiencia sobre el tamaño, logrando un alto rendimiento con solo 12 mil millones de parámetros activos.

Velxio permite ejecutar firmware real de ESP32 en un navegador, integrando componentes analógicos, digitales y agentes de IA para un desarrollo eficiente.

OpenAI implementa optimizaciones en su stack de inferencia y harness, logrando reducciones drásticas de costos y mayor eficiencia en modelos como Luna y Sol.

La investigadora Lizy K. John propone sustituir las pesadas operaciones matemáticas de la IA actual por tablas de búsqueda, reduciendo el consumo energético drásticamente.

La nueva librería de NVIDIA permite ejecutar operaciones matemáticas complejas en CPU, GPU y sistemas distribuidos, integrándose con NumPy, CuPy y PyTorch.

El nuevo módulo de expansión de Luxonis integra GPIO, relés y CAN Bus a las cámaras OAK4, permitiendo un control directo de maquinaria sin necesidad de un PLC externo.

Investigadores de Berkeley presentan una capa de traducción que permite adaptar kernels de CUDA a MLX, logrando mejoras de rendimiento de hasta 20x.

InHand Networks presenta sus nuevas computadoras de placa única (SBC) de tamaño compacto, diseñadas para visión artificial industrial y capacidades de IA local.

Aprende a desplegar un asistente de programación validado bajo tu propio control, garantizando soberanía de datos y seguridad en el ciclo de desarrollo.

Un nuevo diseño de receptor óptico utiliza haces de luz para transferir parámetros de modelos de IA directamente a la memoria, reduciendo el consumo energético.

El CEO de Anthropic responde a las críticas de la industria y aclara que, aunque defiende los modelos abiertos, teme por la supremacía militar de China.

La plataforma NVIDIA Jetson permite a desarrolladores llevar modelos de IA de frontera a cualquier lugar, combinando alto rendimiento y portabilidad extrema.

NVIDIA presentó una plataforma de simulación médica nativa en GPU para acelerar el desarrollo de robots quirúrgicos mediante física avanzada y modelos de IA.

El nuevo robot cuadrúpedo de Unitree combina patas articuladas con ruedas para superar obstáculos complejos y alcanzar velocidades de hasta 21,6 km/h.

El nuevo modelo de neolab demuestra que es posible superar a los gigantes actuales con una arquitectura optimizada y costos de inferencia reducidos.

NVIDIA presenta ModelExpress, una solución para optimizar el ciclo de vida de los pesos de modelos mediante RDMA P2P, eliminando cuellos de botella en almacenamiento.

BFL presenta FLUX 3, un modelo multimodal capaz de generar video con audio, texto y controlar robots, superando a competidores como Gemini Omni y Grok Imagine.

El nuevo modelo de Poolside destaca en tareas de programación mediante un enfoque en persistencia y razonamiento, superando a sistemas mucho más masivos.

Autoridades estadounidenses acusan a Moonshot de copiar tecnología de Anthropic, pero investigadores sugieren que el desarrollo del modelo es mucho más complejo.

Aprende a configurar un entorno de aprendizaje reforzado en menos de cinco minutos, evalúa tu línea base y genera un adaptador LoRA descargable para tus proyectos.

El proyecto de código abierto respaldado por AMD completa su Lemonade Router, que dirige cada consulta al modelo adecuado según reglas, similitud semántica o un LLM que actúa como enrutador.

El equipo del proyecto abierto para acelerar modelos en la NPU Ryzen AI se une a AMD, y el código sigue bajo licencia MIT.

La nueva versión del software de IA local de AMD lleva su agente de correo más allá del triaje: sigue los mensajes pendientes, redacta respuestas con tu estilo y agenda tareas.

El fundador de Osmantic dio dos talleres en el AI Engineer World's Fair sobre cómo desplegar LLM open source en workstations propias, con público que fue de estudiantes a ejecutivos de Intel.

El workbench agrupa más de 60 habilidades preconfiguradas en genómica, proteómica y química, corre local en macOS o Linux y escala a cientos de GPUs vía SSH o HPC.
Otros temas que aparecen junto a #ia local en nuestra cobertura editorial.