Ciencia y Tecnología

8 de agosto de 2026

Compartir

Google revela un traductor portátil e independiente que procesa voz en tiempo real sin conexión a internet

Diseñado sobre una minicomputadora Raspberry Pi 5 y potenciado por el modelo de IA Gemma 4 E4B, el dispositivo permite interpretar discursos y transmisiones localmente. La compañía liberó el código fuente en GitHub para que cualquier usuario pueda construir el suyo.

Photo of author

Escribe: redactor_1

Google dio un paso clave en el desarrollo de hardware accesible e inteligente al presentar

Google dio un paso clave en el desarrollo de hardware accesible e inteligente al presentar un prototipo de traductor portátil capaz de procesar conversaciones, discursos y transmisiones en tiempo real sin depender de una conexión a internet.

A diferencia de las herramientas convencionales que envían el audio a servidores remotos en la nube, este equipo realiza todo el procesamiento de voz y traducción de forma 100% local, lo que lo convierte en una solución ideal para viajes, conferencias o zonas con conectividad nula o inestable.

Cómo funciona: inteligencia artificial en miniatura

El dispositivo utiliza como “cerebro” una Raspberry Pi 5 —una minicomputadora del tamaño de una tarjeta de crédito— ensamblada dentro de una carcasa modular impresa en 3D.

El procesamiento lingüístico está a cargo de Gemma 4 E4B, un modelo de inteligencia artificial de peso abierto y multimodal diseñado específicamente para ejecutarse en equipos con recursos de memoria limitados. El sistema se apoya en el entorno LiteRT-LM para optimizar el rendimiento y utiliza la tecnología Moonshine text-to-speech para la síntesis de voz.

El flujo de trabajo es completamente fluido e integrado:

  • Captación de audio: Un micrófono integrado recibe las palabras habladas de un discurso, reunión o transmisión.
  • Procesamiento local: El modelo Gemma convierte la voz a texto y genera la traducción al instante sin salir del equipo.
  • Salida multimodal: El resultado se muestra de forma simultánea en una pantalla integrada y se reproduce en audio mediante un altavoz.

Control físico y diseño intuitivo 

El prototipo fue diseñado para ofrecer una experiencia de uso sencilla e inmediata. Cuenta con un botón físico para iniciar la escucha activa y una perilla o selector giratorio que permite elegir el idioma de destino de manera rápida.

Gracias a este formato, basta con acercar el dispositivo a la fuente de sonido —como los parlantes de un evento o una pantalla— para recibir la traducción leída o escuchada en tiempo real.

Un proyecto de código abierto para armar en casa 

Aunque Google no comercializará este traductor como un producto masivo de consumo, los ingenieros responsables del desarrollo compartieron todo el código fuente y las instrucciones de compilación en la plataforma GitHub.

La iniciativa demuestra el avance de los modelos de IA de peso abierto (open weight), capaces de ejecutar tareas complejas de procesamiento de lenguaje natural en hardware pequeño y de bajo costo, marcando una tendencia donde la inteligencia artificial deja de depender exclusivamente de los grandes centros de datos.


Seguinos en

Youtube.

Destacadas