robotica.esrobotica.es

Conversar con Reachy Mini usando un ordenador de casa

Reachy Mini puede conversar con modelos locales. Qué ordenador necesita, cómo se conecta por wifi y qué debes preparar para hablar sin enviar la conversación a la nube.

·Redacción Robotica.es
4 min de lectura
Fotografía oficial de Reachy Mini Wireless blanco, con las dos antenas levantadas y el mecanismo del cuello visible, sobre fondo claro.

Reachy Mini puede escuchar y responder sin enviar la conversación a la nube si conectas su aplicación a modelos que se ejecutan en un ordenador de casa. El robot pone los micrófonos, el altavoz y los gestos; el ordenador convierte la voz en texto, genera la respuesta y la vuelve a pronunciar. Es un proyecto para quien quiere configurar software y mantener ese equipo encendido durante la conversación.

Hugging Face explicó esta posibilidad en mayo. Esta guía reúne la documentación actual y sus requisitos; no es una prueba propia ni una función recién anunciada. El objetivo es distinto al de las mejoras de sonido y seguimiento facial de Reachy Mini 1.10: elegir dónde se procesa lo que dices.

Primero, reservar equipo para los modelos

El proyecto speech-to-speech [en] ofrece dos configuraciones completamente locales de partida:

Configuración documentadaMemoria que aconseja prever
Mac con Apple Silicon y modelo de lenguaje cuantizado.16 GB o más de memoria unificada.
Linux con GPU NVIDIA y el modelo de lenguaje sin cuantizar del ejemplo.24 GB de memoria gráfica, además de la RAM del sistema.

Son estimaciones para planificar una conversación, no mínimos medidos ni garantías de fluidez. El modelo elegido y la longitud del diálogo cambian el consumo.

El ordenador tampoco viene incluido en el robot. La tienda de Pollen Robotics [en] ofrece Reachy Mini Wireless por 435 €, en kit con Raspberry Pi CM4, cámara, cuatro micrófonos y altavoz. Incluye herramientas para montarlo sin soldadura. España figura entre los destinos; la ficha avisa de expedición de hasta 90 días y calcula cargos de importación al finalizar el pedido. Esa cifra no debe interpretarse como el total entregado en casa.

Que Wireless pueda ejecutar aplicaciones por sí mismo no significa que su placa sustituya al ordenador previsto para estos modelos de conversación.

Conectar la voz antes de añadir más funciones

El tutorial de conversación local de Hugging Face [en] propone probar primero la voz en el ordenador y conectar después el robot. Así puedes comprobar si entiende y responde a un ritmo aceptable antes de investigar un problema de wifi o movimiento.

La Conversation App [en] necesita el SDK de Reachy Mini y su servicio de control en marcha; su ejemplo de instalación utiliza Python 3.12. En sus ajustes de conexión se elige el servidor local. Si la aplicación corre en Wireless y los modelos en el portátil, hay que introducir la dirección del portátil dentro de la red doméstica. localhost señalaría al propio robot. El servidor también debe aceptar conexiones desde esa red.

Compartir nombre de wifi no basta siempre. En un montaje documentado por Curtis Burkhalter y un equipo de HP, NVIDIA, Hugging Face y Pollen [en], la red del recinto bloqueaba la comunicación entre dispositivos. Es una experiencia de integración distinta del tutorial doméstico, pero explica por qué una red de invitados con aislamiento puede impedir que ambos equipos se encuentren.

Hablar español y decidir si usar la cámara

Los componentes de voz contemplan el español: NVIDIA lo incluye entre los 25 idiomas de Parakeet TDT 0.6B v3 [en], encargado de transcribir, y Qwen3-TTS CustomVoice también lo admite para generar voz [en]. Eso no certifica la calidad del diálogo completo: también interviene el modelo que redacta las respuestas. Conviene ensayar nombres propios y frases habituales en español antes de dar el montaje por preparado.

La aplicación permite arrancar sin capturar imágenes mediante --no-camera. Analizar lo que ve utiliza una herramienta separada y depende del modelo conectado. Para una primera conversación, prescindir de esa captura reduce las funciones que hay que comprobar a la vez.

Sin nube exige revisar también las herramientas

Speech-to-speech admite una modalidad híbrida: reconoce y sintetiza voz en casa, pero manda la transcripción, instrucciones e historial a un proveedor externo. Esa opción requiere conexión y puede generar cargos de API. Para mantener el diálogo local, el modelo de lenguaje también debe ejecutarse en tu equipo.

Antes de desconectar internet, hay que iniciar la configuración elegida con conexión para descargar todos sus recursos. La Conversation App incluye además herramientas de búsqueda web y meteorología alojadas fuera; pueden desactivarse desde el acceso a herramientas. Elegir voz local no convierte esas consultas en operaciones sin internet.

La comprobación útil es ensayar la conversación con la salida a internet cortada y conservar la red entre ordenador y robot. Si tu interés está en experimentar con un robot de escritorio, esa prueba permite descubrir dependencias pendientes antes de confiar en el montaje para una demostración.

Fuentes

Más artículos