Las cosas se están moviendo tan rápido en el espacio de la IA que una categoría entera puede tener un ciclo de vida de auge y caída de unas pocas semanas. Ese parece haber sido el caso de los dispositivos de hardware dedicados a la IA, como el Rabbit r1 o el Humane Pin, pero ¿tienen un salvador en el horizonte?
Uno de los mayores problemas de estos dispositivos era la latencia. Simplemente tomó demasiado tiempo obtener una respuesta razonable a una consulta para que fuera utilizable. Lo perdonamos en una aplicación gratuita o en una que cuesta unos pocos dólares, pero no en un dispositivo independiente que cuesta cientos.
Como resultado, ambos dispositivos fueron objeto de críticas casi universales y críticas terribles de todo el espectro de los medios tecnológicos, pero siempre pensé que su mayor problema era llegar temprano.
Algunos de los problemas de latencia se podían solucionar con el almacenamiento en caché, pero el gran problema era que los modelos de visión eran demasiado lentos. Con el nuevo GPT-4o de OpenAI e incluso con Gemini Flash de Google, el respiro puede ser posible, eso si pueden dar una buena segunda primera impresión.
¿Por qué GPT-4o es tan útil para el hardware de IA?
GPT-4o está entrenado para entrar y salir multimodal desde el principio. Esto significa que tiene capacidades de visión significativamente mejores, así como una comprensión de voz, vídeo y texto. También es efectivamente un modelo nuevo, entrenado desde cero utilizando GPT-4 como guía para que sea más rápido.
George Kedenburg III, líder de diseño de productos de Humane, acudió a X para decir que ya han visto una mejora notable en las pruebas con GPT-4o en comparación con las generaciones anteriores.
Por ejemplo, ha habido una disminución del 14 % en la latencia, un 28 % de respuestas más cortas y un 33 % menos de respuestas malas. “Más allá de los números, todo parece más inteligente y preciso”, escribió.
Puedes ver todo esto si pruebas GPT-4o en ChatGPT. Responde significativamente más rápido, es menos detallado y parece más capaz en comparación con versiones anteriores.
El CEO de Rabbit, Jesse Lyu, fundador de Rabbit, dijo que también se están mudando a GPT-4o, declarando que: “El juego no se está matando entre sí, todos trabajan sobre los mismos cimientos. Una vez que los cimientos son sólidos, el edificio sobre será muy diferente.”
¿No es el hardware de IA un truco tonto?

Si bien el hardware dedicado a la IA puede parecer un truco, especialmente ahora que sabemos que el r1 es solo una aplicación de Android, creo que es un indicador temprano de cómo accederemos al conocimiento en el futuro.
Esto me pone en desacuerdo con Jason England de Jugo Mobile, quien declara con orgullo que “la mejor manera de usar este asistente es en ese dispositivo que ya está en su bolsillo: un teléfono inteligente”.
No se equivoca. El teléfono inteligente es una excelente manera de interactuar con asistentes inteligentes como ChatGPT Voice, Gemini Live o cualquier cosa que Apple lance en la WWDC, pero es un recurso provisional.
Lo que vimos con la actualización de primavera de OpenAI es un cambio hacia un futuro de IA menos intervencionista en la forma en que utilizamos la tecnología. Un enfoque en la voz y la visión por encima del ingreso de texto, con una IA capaz de comprendernos a nosotros y al mundo que habitamos, proporcionando un vínculo para facilitar nuestra comunicación con la tecnología.
El papel facilitó la plasmación de ideas (no más cinceles ni piedras) y las máquinas de escribir facilitaron aún más el proceso. El microprocesador puso ordenadores en todos los hogares y los teléfonos inteligentes los pusieron en todas las manos. El acceso a la tecnología se vuelve más simple y abstracto con cada generación.
¿Pero seguramente es demasiado tarde para Rabbit y Humane?

Anteriormente dije que mi factor de forma ideal para interactuar con la IA es un par de gafas inteligentes, idealmente con un recubrimiento de película para proporcionar una pantalla, pero el audio como el de Meta Ray-Ban está bien.
Quiero un comunicador inspirado en Star Trek que funcione, así que REALMENTE espero que logren resolver muchos problemas, incluido el calor y la latencia.
Lo que Humane y Rabbit tienen es un proceso, un flujo de trabajo y un sistema que facilita la interacción con la IA, al menos entre bastidores.
Ambos tienen serios problemas en cuanto a la forma en que interactúas con ellos. Sería mejor reemplazar la rueda de desplazamiento y el botón del Rabbit con una voz mejorada, ya que ambos lo hacen engorroso y las personas que usan el proyector del Pin dicen que es más problemático de lo que vale; eso también debería centrarse en las respuestas de voz.
Si combinas los procesos que han desarrollado para interactuar con la información y la idea de dejar de escribir como concepto con un modelo de IA más inteligente como GPT-4o, entonces empiezas a ver algunos brotes verdes para el hardware de IA.
El problema para ambas empresas es dar esa segunda primera impresión. El lanzamiento con todos los problemas de latencia deficiente, imprecisiones y problemas con los estilos de respuesta dejó una mala impresión y superar eso será una lucha. Pero no creo que debamos descartar el concepto.
Si bien el Rabbit r1 puede parecer inútil en la superficie, especialmente porque todo se puede replicar en un teléfono inteligente, podría tener un gran futuro como dispositivo para niños. Una forma de encontrar información rápidamente sin depender de un teléfono inteligente y muchas otras aplicaciones.
Para Humane Pin: quiero un comunicador inspirado en Star Trek que funcione, así que REALMENTE espero que logren resolver muchos problemas, incluido el calor y la latencia. Combinado con las capacidades de voz de GPT-4o y su traducción en vivo, esto podría volver a la vida.
Pero soy optimista en materia de tecnología y no creo que haya “un dispositivo que los gobierne a todos”. Mi opinión es que la gente querrá diferentes factores de forma que les resulten cómodos. Para algunos, siempre será un dispositivo parecido a un teléfono inteligente, para otros, un simple pin en la camisa.
- OpenAI y Reddit anuncian un acuerdo para brindar ‘información oportuna y relevante’ a ChatGPT
- Gemini Live: qué funciones están disponibles ahora y qué vendrá pronto
- Cuidado, Snapdragon: Nvidia y MediaTek pueden unirse para fabricar chips para computadoras portátiles con inteligencia artificial