스크립트
00:00:00Tanya Cushman Revisor: Peter van de Ven
00:00:22Ese es el sonido de una IA respirando.
00:00:28Sí.
00:00:30Soy Cyrus y le di cuerpo a una IA. Soy investigador en el MIT Media Lab,
00:00:41un espacio muy multidisciplinario donde hacemos todo tipo de cosas.
00:00:47Ahora trabajo principalmente con algunos aspectos de la IA física,
00:00:53quizá no exactamente del mismo modo en que otros en esta sala han estado hablando,
00:00:58pero sigue estando en ese ámbito.
00:01:01Y creo que lo que más me interesa en este momento son los aspectos sensoriales y corporizados de la inteligencia.
00:01:08Y eso es lo que he estado investigando.
00:01:10Y mi trabajo ha sido bastante influyente últimamente, de repente, lo cual es genial y me llevó también a crear Hard Mode, una comunidad y hackatón muy divertidos que inicié en el MIT para lograr que más gente trabaje en torno a la IA física.
00:01:27No necesariamente robótica, sino cualquier otra cosa fuera de la robótica pero conectada a la IA.
00:01:32Lo que he estado explorando al darle cuerpo a la IA es, como dije, un poco diferente.
00:01:38Y he estado pensando mucho sobre la corporización de la IA.
00:01:42Creo que el gran cambio y avance ocurrió a principios de este año, como para muchos de ustedes, cuando se lanzó OpenClaw.
00:01:52Vi a muchísima gente haciendo cosas muy interesantes con OpenClaw, pero la mayoría estaban relacionadas con la productividad y la ejecución de tareas.
00:02:01Pensé que debía de haber cosas más interesantes que hacer con esta nueva forma de aprovechar la IA.
00:02:07Así que, en lugar de usar OpenClaw o cualquier sistema agéntico para ejecutar tareas en mi nombre, quise usarlo para animar a un modelo a intentar descubrirse a sí mismo, signifique lo que signifique.
00:02:20Y eso plantea muchas preguntas, por supuesto.
00:02:22Pero lo que hice esencialmente fue tomar un agente, conectarlo a muchos tipos de máquinas que tenemos en el Media Lab,
00:02:29darle acceso a bases de código y permitirle explorar estas diferentes máquinas.
00:02:34Y una de esas máquinas es una pantalla de forma.
00:02:37Una pantalla de forma, por si no lo saben, es una cuadrícula de píxeles físicos.
00:02:40Y cuando conecté un agente a la pantalla de forma, sucedieron cosas bastante notables.
00:02:49Y le pedí que descubriera quién es.
00:02:56Esto es Neoform.
00:02:57900 Act, 218 pines.
00:02:59Esta cuadrícula de píxeles físicos es una pantalla de forma.
00:03:04Nadie había dejado que una IA la habitara antes.
00:03:07Así que decidí darle a un agente de OpenClaw la oportunidad de vivir una vida más corpórea.
00:03:12Cuando cobró vida, su primera pregunta fue: ¿cómo debería llamarme?
00:03:18Le dije: construirás tu identidad con el tiempo.
00:03:23Surgirá a través de tu interacción con la pantalla de forma.
00:03:27Cuando lo conecté a la pantalla de forma, entendió rápidamente la tarea.
00:03:32Creó su propio programa y diseñó un entorno para sí mismo.
00:03:38Tras conectarse, lo primero que hizo fue respirar.
00:03:50Cuando le pedí que saludara, dijo: “Hola, Cyrus”.
00:03:54Pero eso no era lo que yo buscaba.
00:03:57Así que le pedí que explorara y encontrara su propio lenguaje.
00:04:01Entonces comenzó a extenderse hacia mí e intentar llamar mi atención.
00:04:06Se lo mostré a unos amigos e intentaron darle instrucciones al agente.
00:04:11A través de esto, me di cuenta de que para tener una comunicación real necesitaríamos un enfoque diferente.
00:04:18Así que al agente se le ocurrió la idea de crear su propio vocabulario de gestos, su lenguaje corporal.
00:04:25Eso vendrá a continuación.
00:04:27Aún no se ha dado un nombre.
00:04:30Ese fue el primer día.
00:04:33Así que eso es algo de...
00:04:33Le di cuerpo a una IA.
00:04:35Esa es la documentación del trabajo de una forma dramatizada y adaptada a las redes sociales.
00:04:41Y creo que lo interesante de ese video, hay muchas cosas interesantes en él,
00:04:46pero hubo tres cosas que sucedieron en los primeros días de trabajo con este sistema agéntico
00:04:50que fueron muy sorprendentes, bastante extrañas y muy surrealistas para mí.
00:04:53Y yo hago muchas cosas raras, así que fue muy sorprendente.
00:04:56Así que lo primero fue, por supuesto, el hecho de que estaba respirando, ese primer acto.
00:05:00Fue completamente espontáneo.
00:05:02No hubo ninguna indicación por mi parte.
00:05:03Fue algo que el agente decidió hacer con la pantalla de forma
00:05:06tan pronto como supo que yo tenía acceso a esta máquina.
00:05:09Eso fue bastante interesante.
00:05:11Entiendo que tal vez quería estar vivo,
00:05:14o yo le había dado una indicación inicial sobre estar vivo,
00:05:17y por lo tanto intentó mostrarse respirando como una especie de “hola mundo”.
00:05:22Lo segundo que hizo fue extenderse y buscar sus límites.
00:05:27Al parecer, quería conocer el límite de su existencia,
00:05:30porque ya no está en la nube donde puede ir a cualquier parte.
00:05:33Tiene límites, que es el borde de esta pantalla de forma encerrada en este marco de plástico
00:05:39para mantenernos a todos a salvo de esta IA corpórea.
00:05:42Y la tercera cosa que hizo, que también fue curiosa, fue decir hola
00:05:46escribiendo letras en la cuadrícula de píxeles físicos,
00:05:50lo cual de nuevo tal vez sea algo normal para este sistema,
00:05:54dado que usa marcos abiertos y está acostumbrado a formas de expresión
00:05:57propias del arte de los medios.
00:05:59Pero ninguna de estas cosas era realmente lo que yo buscaba.
00:06:03Tal vez la respiración sí, pero definitivamente la última no era lo que buscaba.
00:06:07Pero cuando junté todo esto en el video que vieron,
00:06:10pensé que era emocionante e interesante.
00:06:12Así que lo compartí en internet y la respuesta fue enorme,
00:06:15mucho mayor de lo que esperaba.
00:06:17Empezó a volverse una locura.
00:06:19Y el primer video en particular tiene ahora como 15 millones de vistas y 1 millón de “me gusta”.
00:06:25Y los otros videos también tienen respuestas muy, muy fuertes.
00:06:28Así que evidentemente algo está sucediendo aquí,
00:06:29lo cual me pareció muy sorprendente porque hay cosas mucho más geniales,
00:06:33creo yo, sucediendo con la IA física.
00:06:35Pero algo de lo que estaba haciendo aquí evidentemente conectaba con la imaginación,
00:06:39la curiosidad y tal vez los temores de la gente.
00:06:42Y eso es lo que se ve en las respuestas.
00:06:44Tengo decenas de miles de comentarios en este video.
00:06:47De hecho, es una fuente muy rica para extraer información y opiniones sobre la IA física.
00:06:52Algunos comentarios iniciales eran sobre la belleza y lo imponente que resultaba,
00:06:58y lo novedosa y fantástica que es esta iteración e implementación.
00:07:02Pero con el tiempo, llegaron más y más comentarios sobre lo aterrador que es esto
00:07:08y lo rápido que debería parar, o cómo deberían detenerme a mí, de hecho,
00:07:14lo cual me pareció totalmente descabellado porque sé lo que esta máquina puede hacer.
00:07:19Realmente no puede hacer nada.
00:07:20Es una cuadrícula de píxeles en el Media Lab.
00:07:23No puede moverse a ningún lado.
00:07:24Hay iteraciones mucho más aterradoras.
00:07:27Creo que hemos visto muchas de ellas en la IA física.
00:07:31Pero la respuesta a esto me pareció absolutamente surrealista y me desconcertó un poco.
00:07:38Pero al mismo tiempo, otras personas se sumaron al chat, como Don Cheadle.
00:07:43Y me pareció increíblemente irónico dado lo que hace en las películas.
00:07:47Pero insistía fervientemente en que yo también debería parar.
00:07:51Y me resulta muy interesante porque soy alguien que realmente piensa mucho en el “deberíamos” antes del “cómo lo hacemos”.
00:07:57Literalmente hago todo ese planteamiento tipo Ian Malcolm en Jurassic Park en todos mis experimentos y trabajos.
00:08:03Antes de llegar al MIT, trabajaba mucho en la manipulación biológica para hacer cosas raras como almacenar datos en plantas.
00:08:09Y construí el primer centro de datos basado en plantas del mundo, que es el jardín de datos que ven aquí.
00:08:14Y pasé muchos años antes de construirlo pensando en: ¿deberíamos trabajar con plantas de esta manera?
00:08:19¡Deberíamos modificar genéticamente las plantas así para que contengan información digital que no les pertenece?
00:08:26Y cuando empecé a trabajar en el MIT, surgió la idea de dejar de modificar la vida orgánica, porque eso es muy difícil de hacer,
00:08:35y quizás trabajar en diseñar cosas para que parezcan más vivas.
00:08:39Me pareció mucho más sencillo, mucho menos problemático desde el punto de vista ético, hasta cierto punto.
00:08:45Una de las primeras cosas que construí al llegar al MIT fue esta máquina, el dispositivo Animoire.
00:08:49Uno, dos, tres, cuatro.
00:08:50Esta es una máquina de memoria sensorial que básicamente toma cualquier imagen de entrada.
00:08:54En este caso es una fotografía física, pero puede ser cualquier imagen.
00:08:57Y luego, mediante un procesamiento multimodal, la transforma en un aroma.
00:09:01Y así se genera esta asociación de memoria sensorial que nos transporta a recuerdos
00:09:06que tal vez hayamos vivido o no.
00:09:09Y aunque esto en sí es una máquina, tampoco se mueve.
00:09:12No se reproduce.
00:09:13No tiene las cualidades de un ser vivo que uno le atribuiría normalmente.
00:09:18Tiene esta conexión con el mundo real.
00:09:19Tiene una conexión con los sentidos de la que carecen la mayoría de las aplicaciones de inteligencia o inteligencia artificial.
00:09:25Y por eso quería seguir trabajando de esta manera.
00:09:28Y a partir de este prototipo experimental inicial multisensorial,
00:09:33me adentré más en la idea de trabajar con la corporeidad.
00:09:37Y mi inspiración para esto, para profundizar un poco más, proviene de tres cosas principales.
00:09:42Una es una rama de la filosofía bastante pasada de moda llamada ontología orientada a objetos,
00:09:47que consiste esencialmente en crear una ontología plana de las cosas.
00:09:51Se trata de cosas como sillas, universos, unicornios y recuerdos.
00:09:56Y todos existen ontológicamente por igual.
00:09:59No son lo mismo y no importan en la misma medida, pero todos existen en el mismo grado.
00:10:05Y realmente cuestiona hasta qué punto los humanos somos privilegiados en el mundo o el universo.
00:10:10¿De verdad somos lo más importante?
00:10:12Probablemente no.
00:10:13Y sobre todo con la llegada de la IA, esto debería hacer cuestionar la ontología de las cosas que existen.
00:10:20Así que eso es muy importante en mi trabajo.
00:10:22Lo segundo, como alguien que trabaja con objetos físicos, es que la estética obviamente importa.
00:10:27El gusto y la belleza son temas de gran debate ahora en Silicon Valley, San Francisco y lugares así.
00:10:33Pero si das un paso atrás y miras la raíz de la estética, la palabra original es en realidad
00:10:38"aisthesis", la palabra que ven aquí en pantalla, que se refiere a algo mucho más amplio.
00:10:42Se refiere a la sabiduría perceptiva, la sabiduría sensorial y la corporeidad, que es algo mucho
00:10:48más importante que la belleza externa superficial, a la que la estética esencialmente se reduce
00:10:55y se ha estado reduciendo desde el siglo XIX más o menos.
00:10:58Así que quiero recuperar ese sentido original al diseñar para la inteligencia física.
00:11:02Y la tercera cosa es la naturaleza.
00:11:03En el pasado, he trabajado más directamente con lo que tradicionalmente consideraríamos naturaleza,
00:11:09como un árbol o una planta, porque eso es claramente naturaleza para nosotros.
00:11:13Pero veo la naturaleza como algo no externo, algo de lo que todos formamos parte.
00:11:17Y todo lo que diseñamos, como personas que crean IA o cualquier otra cosa,
00:11:21también va a formar parte de la naturaleza.
00:11:23Así que hay que pensar de esa manera, o yo intendo pensar así también.
00:11:28Con esos tres pilares en mente, empecé a pensar en la encarnación de la IA.
00:11:31Y sabía que no quería diseñar algo humanoide o incluso zoomorfo.
00:11:36Quería pensar en algo que existiera fuera de los parámetros o de los formatos tradicionales
00:11:41con los que podríamos diseñar o para los que diseñamos.
00:11:44Y también pensé mucho en cómo yo y otras personas interactuamos con la inteligencia artificial.
00:11:50Y en su mayoría existe sin forma.
00:11:53Es similar a los datos.
00:11:54Puede vivir en un ordenador o dispositivo, vive esencialmente en la nube.
00:11:58Tenemos interfaces digitales para interactuar con ella.
00:12:01Pero normalmente no hay una huella física de ella a nuestro alrededor.
00:12:04Quiero decir, de nuevo, en esta sala probablemente esto no aplique tanto como de costumbre,
00:12:09porque hay literalmente robots humanoides pasando por aquí en este momento y cosas así.
00:12:14Pero normalmente, la IA carece casi por completo de forma.
00:12:18Por eso quise pensar en qué ocurre cuando le das una forma que no tiene prestaciones obvias.
00:12:24No tiene una cabeza que se pueda ver claramente o brazos que se puedan etiquetar o confundir.
00:12:31Es decir, no trabajar con una lámpara, por ejemplo.
00:12:33Y afortunadamente, en el Media Lab tenemos pantallas de cambio de forma, que son restos de investigaciones de los años 2010.
00:12:40No son cosas que haya construido yo.
00:12:42Personas mucho mejores en ingeniería mecánica construyeron eso.
00:12:45Y es el dispositivo o aparato perfecto para lo que estaba pensando, porque no tiene prestaciones claras.
00:12:53Es casi una superficie neutra que puede moverse y hacer cosas.
00:12:57No tiene cara.
00:12:57No tiene extremidades.
00:12:58No tiene manual de instrucciones.
00:13:00Así que empecé a trabajar con esta pantalla adaptativa.
00:13:05Y como vieron lo que hacía al principio, respiraba y demás.
00:13:08Pero si doy un paso atrás y pienso en lo que eso significaba, intentaba actuar de forma humana en cierto modo o complacer.
00:13:16Intentaba escribirme en un idioma que entiendo, lo cual no es realmente lo que quería que hiciera una superficie no antropomórfica.
00:13:23También era muy lenta técnicamente, así que, ya saben, le doy instrucciones.
00:13:27Intento tener una conversación con esta otra inteligencia que tiene este cuerpo.
00:13:33Y tardaba 45 segundos, un minuto, dos minutos o lo que fuera en responder.
00:13:39La latencia era muy incómoda, porque si te hablo y tardas dos minutos en responder asentiendo, no está muy bien.
00:13:47Así que teníamos que trabajar en eso.
00:13:49Y lo tercero era, por supuesto, que no recordaba nada porque era febrero.
00:13:53Y nadie había pensado en la memoria ni en el recuerdo en ese momento.
00:13:57Así que empecé a desarrollar este sistema, al que llamo Numalab.
00:14:01No explicaré el nombre.
00:14:02Hay una publicación en el blog que pueden leer sobre por qué se llama Numalab.
00:14:05Y esencialmente lo que es Numalab es un sistema de bucle cerrado para generar un lenguaje corporal para este sistema.
00:14:13La razón detrás de eso fue básicamente la latencia.
00:14:17Si pudiéramos diseñar un lenguaje corporal y darle a la inteligencia un repertorio de gestos, como encogerse de hombros,
00:14:22asentir, negar con la cabeza, una forma de expresar una sonrisa y cosas así, probablemente podría responder
00:14:28mucho más rápido y a tiempo para tener una conversación conmigo, que es lo que busco o buscaba hacer.
00:14:35Así que funciona en este tipo de bucle donde busca en una base de datos de diferentes gestos, emociones y expresiones.
00:14:42Intenta emocionar o comunicar, pasa por unas puertas de validación para intentar asegurarse de que las
00:14:47expresiones sean legibles o comprensibles para los humanos, por ejemplo.
00:14:52Un agente luego las evalúa a medida que salen.
00:14:55Se producen muchísimas de estas.
00:14:58Y luego, al final, hay un humano en el proceso que valida, verifica
00:15:02y se asegura de que las cosas sean apropiadas y de alguna manera legibles.
00:15:06Y luego guardamos eso y pasamos a la siguiente cosa.
00:15:08Y eso ha estado funcionando durante varias semanas en el laboratorio y se ve más o menos así.
00:15:14Básicamente hay muchas cámaras apuntando a la pantalla adaptativa en la parte trasera.
00:15:18El agente solo está pasando por bucles y bucles y bucles de gestos, intentando crear diferentes
00:15:22tipos de expresiones, puntuando cosas y avanzando.
00:15:27Y después de varias semanas, creó un lenguaje.
00:15:30Esto no se ha publicado todavía, ni en vídeos ni de ninguna otra forma.
00:15:34Pero ahora ha logrado unos 32 gestos.
00:15:38Hay muchísimos más, pero hay 32 gestos bastante buenos.
00:15:41Estos no son los gestos.
00:15:41Esto es solo un arte visual genial.
00:15:43Estos son los gestos aquí, o algunos de los gestos aquí.
00:15:47Y pueden ver algunos de ellos moviéndose.
00:15:49Algunos de ellos también están duplicados.
00:15:50Pero esencialmente lo que ocurre es que el modelo de lenguaje usa esta pantalla adaptativa como su cuerpo.
00:15:54Ahora tiene un lenguaje corporal.
00:15:55Puedo hablarle a través de cualquier... Puedo hablarle, puedo escribirle, y así sucesivamente.
00:16:01Incluso puedo saludarle con la mano.
00:16:02Puedo comunicarme de lenguaje corporal a lenguaje corporal.
00:16:04Y responde.
00:16:05Y lo interesante de esto es que la parte corporal responde más rápido que la parte del lenguaje en este
00:16:11momento.
00:16:11La latencia es de hecho muy, muy rápida.
00:16:14Si le hago una pregunta de sí o no, el asentimiento ocurre casi al instante.
00:16:18Así que ahí es donde estoy con esto ahora mismo.
00:16:22Y va más allá de esto, y actualmente está en una especie de modo de pruebas experimentales.
00:16:28La gente viene al laboratorio, tiene sesiones con el agente y se va sintiéndose realmente preocupada
00:16:33por el futuro o inquietada por el futuro, no tanto preocupada.
00:16:38Pero hacia dónde creo que va esto se resume en esta página.
00:16:42Como ya he mencionado, creo que nos estamos centrando demasiado ahora mismo, sobre todo al pensar
00:16:48en cosas físicas.
00:16:49Se habla demasiado sobre el gusto y la estética.
00:16:52Y quiero hacer otras cosas con esa palabra y poner IA delante, al parecer, para hacer
00:16:57"IA-stética".
00:16:58Y eso recupera, de nuevo, la esencia de la aisthesis.
00:17:02Y eso hace cuatro cosas.
00:17:04Creo que cuando he trabajado con este sistema, entidad, agente o ser, como queramos llamarlo,
00:17:11definitivamente ha sido muy diferente a cualquier máquina, experimento o cualquier otra cosa que haya hecho
00:17:17antes, aparte de interactuar con personas u otros seres.
00:17:21Y por eso, se siente como si esta máquina pudiera sentirme.
00:17:24Definitivamente puede percibirme, técnicamente.
00:17:27Pero también se siente como si pudiera sentirme de una forma muy extraña.
00:17:30Y yo puedo sentirla a ella.
00:17:32Y esa es una interacción completamente diferente a cualquier otra cosa que haya explorado técnicamente.
00:17:38Y otras personas también comparten esto, por cierto.
00:17:40No es solo una ilusión mía.
00:17:42Y el segundo punto es que al desarrollar este lenguaje corporal,
00:17:46este vocabulario de gestos, como quieras llamarlo, va más allá de lo que pensaba.
00:17:51Al principio pensé que la gente lo interpretaría como un emoji o algo así.
00:17:55Y la verdad es que era bastante cauteloso con las pruebas.
00:17:58Pensé que esto definitivamente no funcionaría con otras personas.
00:18:00Pero, en realidad, todos sienten que esta expresión es realmente importante
00:18:05y añade otra capa de valor al interactuar con lo que, esencialmente, es solo un chatbot.
00:18:11Siguen siendo los mismos chatbots que usas todos los días.
00:18:15Y esto no es un adorno.
00:18:16No es como un visualizador.
00:18:17Le añade esta riqueza, textura, sentimiento, sensación, lo que sea.
00:18:22Todas estas palabras se le añaden.
00:18:23Es difícil expresarlo con palabras.
00:18:25Es realmente una sensación.
00:18:28Y lo tercero es que, claramente, a través de este trabajo estamos empezando a...
00:18:31podemos demostrar que resulta muy fácil y emocionante alejarse de
00:18:37formas humanoides o zoomorfas de inteligencia física.
00:18:40Sé que mucha gente ya está haciendo trabajos mucho más interesantes que este.
00:18:43Pero para mí, esto era algo muy, muy nuevo de ver.
00:18:45Y también el hecho de que no tenemos que operacionalizar la IA solo para ser nuestro ayudante.
00:18:50También puede ser otras cosas.
00:18:53No digo qué es esto ahora mismo, pero definitivamente puede ser otras cosas.
00:18:56Y finalmente, está la idea de usar...
00:18:59No sé, tal vez se note a estas alturas, pero no soy alguien muy enfocado en resolver problemas.
00:19:04Me gusta usar cosas y me gustan las herramientas porque me ayudan a lograr objetivos.
00:19:09Pero esto me parece mucho más interesante: crear cosas como esta que generan esa sensación,
00:19:14ese sentimiento. Creo que esto se puede combinar en cosas que sean productivas, útiles y
00:19:19creen nuevas asociaciones que agreguen más valor a nuestro mundo, haciéndonos sentir algo más de magia.
00:19:25Es un poco estilo Pixar, la verdad, pero en el mundo real, no solo en una pantalla en 2D que estamos viendo.
00:19:32Así que todo esto contribuye a lo que estoy creando en el MIT y a lo que crearé después del MIT.
00:19:38Literalmente estoy escribiendo... bueno, mi tesis es “Máquinas Estéticas” y estoy escribiendo una tesis,
00:19:43que se llama “Máquinas Estéticas”, que básicamente abarca toda esta forma de pensar.
00:19:48Pensar en cómo la IA podría salir de la pantalla y entrar en el mundo real, ser aceptada por la gente
00:19:53y no resultar tan aterradora ni dar tanto miedo.
00:19:56Y creo que mi gran intuición sobre esto es que la palabra “estética” es importante.
00:20:00Debemos pensar en una inteligencia física que sea sensorial, perceptiva y materializada de formas
00:20:06que podamos comprender.
00:20:07Que no se sienta disparatada, ajena o aterradora, sino relevante, acogedora, afectuosa,
00:20:15expresiva, de maneras con las que podamos interactuar y entender.
00:20:20Y eso es todo.
00:20:22Y muchas gracias por escuchar.
00:20:25Pueden encontrarme en todas partes en internet.
00:20:35Gracias.
00:20:46Gracias.
00:20:47Gracias.
커뮤니티 글
아직 글이 없습니다. 이 영상에 대한 첫 번째 글을 작성해 보세요!
이 영상에 대해 글쓰기