Este SO Agéntico de Claude Code x Obsidian será el nuevo meta

스크립트

00:00:00estás usando Claude Code en Obsidian de la manera incorrecta o, al menos, apenas estás rascando la superficie
00:00:05podemos usar Obsidian para mucho más que solo rastrear archivos Markdown para nosotros; en su lugar, podemos usarlo
00:00:11para crear un centro de comandos para todo nuestro SO en la nube, un sistema que incluye un conjunto de habilidades y
00:00:16automatizaciones, una capa de memoria y una interfaz visual encima de todo ello que nos brinda información que
00:00:22simplemente no puedes obtener con la terminal o la aplicación de escritorio. ¿Mencioné también que podemos darle
00:00:27capacidades de voz totalmente locales? Pero, ¿cómo hacemos esto de una manera que realmente aporte valor y no
00:00:31degenere en un espectáculo visual sin sustancia? Bueno, eso es exactamente lo que cubriremos hoy y,
00:00:37al final de este video, comprenderás cómo construir esto tú mismo. Ahora, si has seguido este
00:00:42canal durante un tiempo, sabes que hemos pasado por algunas iteraciones de este SO de Claude; no hace
00:00:47mucho tiempo se veía más o menos así, que era una versión basada en web, y antes de eso teníamos una versión de Obsidian
00:00:54Ahora, lo interesante de la versión basada en web que teníamos eran las capacidades de voz, una configuración de voz
00:00:59totalmente local que nos permitía obtener respuestas muy rápidas y controlar algunas cosas a través de nuestro
00:01:03micrófono. Ahora bien, lo que he hecho es esencialmente actualizar el centro de comandos de Obsidian e incorporar
00:01:10las mejores partes de la versión web y combinarlas en lo que ves aquí. Esto nos da todo el poder
00:01:16de Obsidian; he incluido una configuración de voz que estuvo muy inspirada en lo que vemos en Codex y en el
00:01:23modo de voz de ChatGPT, y ahora tenemos un lugar único para todo lo que queremos hacer con Claude Code. Pero, ¿qué
00:01:29nos aporta realmente todo esto que no obtengamos dentro de la terminal o dentro de la aplicación de escritorio?
00:01:32Tenemos que responder a esa pregunta, o de lo contrario todo esto carece un poco de sentido. Comencemos por el lado
00:01:37visual con lo que estamos viendo realmente. Lo primero es que nos ofrece un vistazo simple a
00:01:41cualquier métrica individual que queramos. Lo que realmente quiero recalcar aquí es que esto es 100% personalizable,
00:01:46así que cualquier cosa que quieras poder ver, puedes colocarla aquí dentro; este es solo un complemento personalizado de Obsidian
00:01:51que Claude Code me construyó. Si quiero algún tipo de perspectiva sobre lo que estoy haciendo con el uso de mis tokens,
00:01:56puedo ver todas mis métricas en los canales de redes sociales, puedo ver mi horario extraído de mi
00:02:01Google Calendar; a partir de eso, desglosa tareas específicas para mí y también obtengo información en cuanto a
00:02:07mis titulares matutinos. Justo aquí puedes ver diferentes automatizaciones y habilidades que puedo ejecutar con el clic
00:02:12de un botón, y tengo diferentes pestañas aquí que profundizan en estos diversos informes que ejecuto
00:02:18a diario; por ejemplo, este es mi informe de investigación, este proviene de una automatización de inteligencia matutina que me proporciona
00:02:24todos los repositorios en tendencia de GitHub basados en los últimos siete días, los últimos 30 días, y luego también puedo ver
00:02:29videos atípicos en YouTube, diferentes ángulos de contenido, y después obtengo una vista continua de lo que es tendencia en
00:02:35Hacker News. Cuando miro mi pestaña de audiencia, esta analiza cómo está funcionando mi contenido específico
00:02:40en YouTube, qué está funcionando, qué no y por qué; y como esto es Obsidian, no estoy limitado solo a
00:02:45esto, puedo usar la terminal dentro de Obsidian, y esta es en parte la razón por la que me gustan estos modos de voz, porque
00:02:51puedo abrir esto en cualquier momento y decir algo como: abre la terminal
00:02:57y genial, ahí está. Ahora, esta cosa tiene funciones de voz reales, así que si digo algo como: oye, ¿cuál fue
00:03:03la noticia de IA más importante de hoy? Claude lanzó una marca de agua a nivel de modelo implementada globalmente ayer,
00:03:13invisible, sobrevive al copiar y pegar, activada por la Ley de Inteligencia Artificial de la UE. El arnés de DeepSeek también explotó a 109
00:03:23mil estrellas en dos días y está dominando las tendencias de GitHub. Así que es genial poder pedirle comandos de
00:03:32hacer dentro de Obsidian, como dije: abre mi terminal o lo que sea, y puedo hacerle preguntas
00:03:37sobre informes que ya he ejecutado. Es por eso que fue relativamente rápido; no tuvo que tomar mi
00:03:41comando, salir a la web, buscar esa información, procesarla y luego responder; se ha programado para
00:03:47analizar estos informes que ya he ejecutado, nuevamente, algo como mi informe de investigación, y luego responder rápidamente
00:03:50preguntas al respecto. Lo otro genial del modo de voz es que funciona incluso cuando no estoy dentro
00:03:54de Obsidian; digamos que he cambiado de pestaña, estoy haciendo otro trabajo en otra parte, como por ejemplo, estoy dentro de la aplicación de escritorio de Claude,
00:04:00pero quiero hacerle una pregunta sobre algo, esencialmente quiero invocar a Claude para que me hable
00:04:05de viva voz, de nuevo, muy similar a lo que hacemos con el modo en vivo de GPT que puedes usar dentro de Codex; esta es
00:04:10una herramienta realmente buena. Así que en este caso, simplemente pulso la combinación de teclas y puedo preguntar algo como: ¿cuál es la cosa
00:04:16más importante en mi agenda para hoy?
00:04:23Tu compromiso más importante hoy es la revisión de los entregables del patrocinador para Warp a las 11 a. m., luego la llamada
00:04:30de coaching de Chase AI Plus a las 3 p. m., pero todo el día gira realmente en torno al bloque de grabación de la demo del orbe de voz
00:04:37a las 9:30, que es el enfoque principal. Y así, como ves ahí, puedo hacer preguntas sobre diferentes
00:04:46cosas y puede responder rápidamente. Ahora, este tipo de modo de voz no solo responde
00:04:52preguntas sobre, ya sabes, informes que tengo en marcha; en realidad puede invocar a Claude en segundo plano y
00:04:57ejecutar una versión sin interfaz gráfica del mismo, de modo que si estuviera haciendo otra cosa y luego realmente quisiera que Claude Code
00:05:02procediera a hacer algo relativamente profundo, como: oye, adelante y comienza, ya sabes, a planificar
00:05:07este proyecto o comienza, ya sabes, a hacer una investigación profunda sobre X, Y y Z, procedería a hacerlo; lo haría
00:05:12en un modo sin cabeza. Ahora, la respuesta de voz no sería tan rápida porque tiene que, ya sabes,
00:05:16ir y hacerlo realmente y luego responder, pero para estas tareas rápidas que extraen información
00:05:21que ya he encontrado, es relativamente fluido y, de nuevo, todo esto es local, es un modo de voz local
00:05:27que se ejecuta en mi GPU, y te mostraré más o menos cómo está configurado, pero en general creo que en términos
00:05:31de la página visual, ese es el valor que esta especie de configuración de SO contenedor en Obsidian
00:05:37te está aportando, lo cual creo que es bastante genial, especialmente el modo de voz cuando estás en otra pestaña, porque
00:05:40poder interactuar de viva voz con Claude Code incluso cuando estás en otra ventana y demás, de una manera que
00:05:44es similar, de nuevo, a ese modo de voz de GPT, es algo que quería traer, porque el modo de voz dentro
00:05:48de la aplicación de escritorio de Claude simplemente no está a la altura. Así que eso es lo que la interfaz de usuario y el modo de voz están
00:05:53aportando realmente a la mesa. La segunda cosa que realmente aporta valor en una configuración de SO de Claude
00:05:57es esa columna vertebral de habilidades y automatizaciones; ves todas estas habilidades aquí que han sido, ya sabes,
00:06:03esencialmente convertidas en botones que puedo pulsar en cualquier momento o puedo hacer que se ejecuten mediante el modo
00:06:07de voz, y eso es genial. El verdadero valor es que he tomado todo lo que hago en mi día a día y
00:06:12los he convertido en habilidades y automatizaciones, lo cual es un concepto bastante simple, pero muy poca gente lo hace
00:06:16correctamente. Lo que estás viendo aquí es una visualización de todas las habilidades y automatizaciones
00:06:21que ejecuto, y el concepto es relativamente simple: tienes una serie de tareas que realizas a diario y
00:06:28semanualmente, tanto a nivel personal como en tu trabajo. Estas tareas se dividen en diferentes dominios;
00:06:34para mí, eso incluye cosas como memoria, productividad, investigación, contenido, mi comunidad, mis ventas de agencias, y así
00:06:41sucesivamente. Dentro de cada uno de estos dominios hay cosas específicas que hago; para la investigación, por ejemplo, tengo
00:06:48un flujo dedicado a YouTube, investigo a fondo temas específicos, tengo elementos que van a mi base de datos
00:06:53LightRAG, tengo mi análisis de tendencias matutino, que es esencialmente ese informe que viste antes, quiero
00:06:57poder ver a mis competidores, etc., etc., etc. Podría hacer todo esto manualmente o, después de averiguar cómo
00:07:04quiero que funcione realmente de forma manual, los convierto en habilidades, y una vez que se han convertido en habilidades, me pregunto
00:07:09¿tiene sentido que esto sea una automatización? Si la respuesta es sí, eso es lo que hago ahora. Hacer esto no tiene
00:07:14nada que ver realmente con un SO de nube en el panel de Obsidian; dijiste que esto es solo una mejor práctica
00:07:18que todos deberían estar haciendo. Sin embargo, construir esto es lo que constituye esencialmente la base del
00:07:26SO de nube; si no tienes esto, crear algo así carece un poco de sentido, como ¿qué estamos haciendo
00:07:31aquí? No hay información que vaya a viajar por aquí, no vas a poder invocar
00:07:34habilidades y automatizaciones específicas de manera regular; esto se convierte en un espectáculo visual
00:07:39si no tenemos esta base, así que esta es la sustancia real y profundizaremos en las mejores
00:07:44prácticas para crear algo así para ti, porque en realidad no es difícil.
00:07:47Y por último, pero no menos importante, tenemos la capa de memoria de Obsidian, que creo que la gente suele
00:07:52malinterpretar; el punto central de la capa de memoria de Obsidian no es necesariamente potenciar
00:07:57de forma increíble a Claude Code como vemos todas estas cosas y nos entusiasmamos muchísimo con: oh por Dios, mira
00:08:02este gráfico, se ve súper genial, es como un GraphRAG; en realidad no es como un GraphRAG, de hecho
00:08:06lo que hace Obsidian es organizar la información en archivos Markdown para ti, el humano,
00:08:12y hay un pequeño beneficio tangencial para el propio Claude Code. Ese beneficio tangencial para
00:08:19Claude Code entra en juego cuando tenemos miles de archivos y hemos configurado nuestra bóveda de Obsidian de
00:08:25una manera que realmente tiene sentido; esto le facilita a Claude Code navegar para darnos respuestas precisas
00:08:29rápidamente, lo que esencialmente nos ahorra tokens y mejora un poco el rendimiento, y eso es enteramente el resultado
00:08:34de cómo lo configuras. Lo que ves aquí es ese sistema RAG de Obsidian de Karpathy que ves en todas partes, y esta es más o menos
00:08:40la plantilla para ello, y de nuevo, entraremos en más detalles sobre cómo lo configurarías porque no tienes que hacerlo
00:08:45exactamente como lo hizo Karpathy, pero hay algunos fundamentos que podemos extraer de ello. Así que eso es lo que el
00:08:50Obsidian más el SO de nube hace, eso es lo que te aporta y lo que no puedes obtener dentro de
00:08:54la terminal o dentro de la aplicación de escritorio. Y ahora hablemos de cómo crearías esto realmente
00:09:00para ti mismo, pero primero una breve palabra del patrocinador de hoy: yo. Así que acabo de lanzar una versión totalmente nueva de mi
00:09:06Clase Magistral de Claude Code, y es la forma número uno de dominar esta herramienta, especialmente si no vienes de
00:09:11un trasfondo técnico, nos enfocamos en casos de uso reales y prácticos para que puedas aprender los fundamentos
00:09:17y luego aplicarlos en cualquier proyecto personal que desees. Actualmente tenemos
00:09:22una oferta en la membresía, así que si quieres unirte, revisa el enlace en el comentario fijado, puedes encontrarlo
00:09:26dentro de Chase AI Plus. Ahora, antes de explicar cómo crear tu propia habilidad y columna vertebral de automatización
00:09:31para tu Cloud OS, déjame guiarte a través de la configuración de voz para que entiendas cómo funciona realmente.
00:09:37Así que en este ejemplo, dices: “Oye, ¿cuáles son las noticias más importantes de IA de hoy?”. Este comando de voz
00:09:46va al módulo de voz, llámalo Jarvis o como quieras, y esa grabación de voz se transcribe
00:09:53a través de Faster Whisper, que es un repositorio de código abierto que funcionará en tu computadora y hace la transcripción.
00:09:59a partir de ahí tu voz se convierte en palabras y esas palabras se envían a Haiku 4.5, usé Haiku
00:10:06porque es el modelo más pequeño, económico y rápido. También tenemos la capacidad, si quieres, de reemplazar Haiku
00:10:12por cualquier tipo de modelo local. La razón por la que no tengo la configuración local es porque
00:10:16le regalo esta misma configuración a las personas que puedes encontrar dentro de Chase AI Plus, y no sé
00:10:21necesariamente cuál será su hardware, por lo que la potencia de su modelo local puede variar mucho. Así que
00:10:26Haiku es un estándar agradable, pero si tienes el hardware para ello, podrías cambiarlo por realmente
00:10:30lo que quieras, meter Qwen, lo que sea, lo que sea. Entonces, ¿cuáles son las noticias más importantes sobre IA? Se convierte en texto,
00:10:35ese texto va a Haiku y Haiku ahora descubre a dónde enrutarlo, y esto se divide en tres niveles.
00:10:40Así que el nivel uno son las habilidades: si le dijera, ya sabes, a Jarvis, oye, quiero que ejecutes el informe de inteligencia
00:10:47matutino, bueno, eso se enrutará al nivel uno y sabe que solo tendrá que ejecutar
00:10:51una habilidad, no tiene que agregar ninguna otra palabra, solo ejecutar la habilidad, solo hacer lo que se le dice
00:10:55y luego avisarme cuando termine. El nivel dos es: oye, solo quiero que extraigas métricas, así que eso es
00:11:01lo que estamos pidiendo aquí, estoy diciendo cuáles son las noticias más importantes de IA de hoy, quiero que simplemente mire un informe que
00:11:05ya existe, así que si pregunto sobre noticias, sabe que puede ir esencialmente a la pestaña de investigación, echar un
00:11:11vistazo a nuestro informe de inteligencia matutino y hacerme saber estas cosas. Separamos este nivel específico porque
00:11:15queremos que sea rápido, no quiero que haga ninguna búsqueda o investigación por su cuenta, solo encontrar
00:11:19lo que ya existe y decírmelo, así que eso es a lo que iría este comando en el nivel dos. Luego tenemos
00:11:24el nivel tres, y aludí a esto antes: si abro el modo de voz y digo, oye, quiero que continúes,
00:11:28abre Claude 3.5, quiero que comiences a hacer una investigación profunda sobre las tareas X, Y y Z y luego presentes
00:11:32un plan de acción; bueno, eso no es una habilidad específica, eso no es una métrica, necesitamos realmente como
00:11:38abrir una instancia real de Claude Code y eso es lo que esto va a hacer, va a hacerlo
00:11:42completamente de forma desatendida, va a ejecutar todas las cosas y luego va a informar cuando
00:11:45haya terminado. Así que esto se convierte en una especie de comodín, esto requiere la mayor potencia y obviamente va
00:11:49a ser el más lento. Ahora, una vez que ejecuta cualquiera de estas tareas, ya sea en el nivel uno, dos o tres,
00:11:54obviamente la respuesta va a ser en texto, pero queremos que sea una respuesta de voz,
00:11:59así que ahí es donde entra Kokoro, nuevamente una herramienta de código abierto que luego se envía de vuelta aquí arriba
00:12:06y luego nos responde con, ya sabes, lo que sea que vaya a decir. Así es como funciona el modo de voz:
00:12:11dices un comando, se transcribe, se enruta, se ejecuta el comando, se convierte en voz, se envía de vuelta hacia arriba
00:12:18y en realidad es lo suficientemente simple y, como dije, podrías hacer esto 100% local si quisieras
00:12:22simplemente reemplazando Haiku por tu modelo local de preferencia. Ahora hablemos de las habilidades, tengo
00:12:28algunas de las que uso más comúnmente aquí mismo, así que en cualquier momento quiero ejecutarlas y tengo esta pestaña
00:12:32abierta, puedo hacer clic en ellas y, como viste al pasar por el modo de voz, podemos activarlas fácilmente
00:12:37con solo decir el nombre a través del sistema de voz, ni siquiera tenemos que tener la pestaña abierta, pero la
00:12:42pregunta es ¿cómo creamos realmente estas habilidades y cómo deberían verse esas habilidades? Por suerte,
00:12:46es complicado, el flujo de trabajo para hacer esto es en realidad bastante sencillo: el paso uno es definir
00:12:52las tareas. ¿Qué es lo que realmente haces en tu día a día que podamos codificar? Recuerda que uno de los problemas
00:12:59con la IA es que es intrínsecamente no determinista: le digo que haga una cosa y le indico que haga esa
00:13:05misma cosa 10 veces diferentes y lo abordará de 10 maneras distintas. Si en su lugar puedo especificar la forma en que
00:13:11quiero que se hagan las cosas y especificar un estado final, podemos convertir eso en una habilidad y esencialmente codificarla,
00:13:16hacerla lo más determinista posible, pero tenemos que saber cuáles son esas tareas. Así que la forma en que
00:13:21podemos hacer eso es, bueno, por suerte en realidad tenemos algunas opciones para hacerlo: la primera opción es que simplemente
00:13:27le damos un flujo de conciencia, de acuerdo, vas a encender tu micrófono y vas a
00:13:33largarle todo a Claude Code y explicarle lo que haces todos los días y lo que haces todas las semanas. Basándonos en esa
00:13:39conversación, luego le vamos a pedir a Claude Code: oye, acabo de darte un montón de información sobre lo que hago,
00:13:44¿qué partes de eso podemos convertir en habilidades? y luego las convierte en habilidades por ti. La segunda
00:13:50forma de hacer esto es hacer que examine tus registros reales, todo lo que haces dentro de Claude Code,
00:13:55cada llamada a herramientas, cada comando, cada texto se registra en tu computadora; podemos hacer que
00:14:01Claude Code revise estos registros de los últimos 30, 60 o 90 días y extraiga habilidades de ahí. Esto
00:14:07es realmente agradable porque tenemos una idea en nuestra mente, ¿verdad?, sobre lo que realmente hacemos,
00:14:13¿pero cuál es la realidad de eso?, ¿para qué usas literalmente a Claude Code? Vamos a poder
00:14:18ver esto en los registros y e idealmente harías el paso número tres, que es una combinación de ambas
00:14:22cosas, ¿verdad? Haces el flujo de conciencia, le dices a Claude Code lo que crees que
00:14:27haces realmente y este crea habilidades a partir de eso, luego echamos un vistazo a los registros mismos y extraemos eso y,
00:14:33en combinación con esas dos cosas, comienzas a construir este repertorio de habilidades. Ahora, ¿qué habilidades
00:14:40convertimos en automatizaciones? A menudo eso va a ser bastante evidente, ¿verdad? ¿Es algo que
00:14:46necesitas ejecutar todos los días a una hora específica? Bueno, entonces conviértelo en una automatización, conviértelo en una rutina
00:14:51que esté a un comando de distancia, solo le dices a Claude Code que lo haga por ti. Ahora, cuando se trata de automatizaciones y
00:14:56habilidades, realmente la mejor práctica es mantenerlo como una habilidad primero durante un tiempo, asegurarte de verdad de que esto
00:15:01esté funcionando de la manera que deseas y luego, una vez que estés contento con los resultados que estás obteniendo
00:15:05con las habilidades, procedemos a convertirlo en una automatización completa que ya no ejecutamos manualmente,
00:15:10sino que simplemente hace lo suyo. Podemos ir aún más profundo con esto, aunque no voy a hacer eso en esta
00:15:15lección, y esencialmente empezar a agregar algunos principios de ingeniería de bucles donde echamos un vistazo
00:15:19a estas automatizaciones y esa ejecución, las comparamos con sus resultados pasados y construimos algún tipo de
00:15:25sistema donde se vuelve auto-mejorable, ¿verdad? Le damos algún tipo de objetivo específico, algún tipo de
00:15:29criterio que intenta alcanzar y si esa automatización no lo logra, podemos seguir ajustando, pero eso es
00:15:34un poco más avanzado; solo comprende que ahí es donde puedes llegar con esto, pero todo se basa en las
00:15:39habilidades, ¿verdad? ¿Podemos codificar lo que haces todos los días en una habilidad? La respuesta es sí y es simple. A
00:15:46partir de ahí, integrar eso en tu Cloud OS es realmente tan simple como esto: ¿cuáles usas
00:15:50a diario? Y en cuanto a la sección del modo de voz, ya sabe qué habilidades existen, así que no hay nada que
00:15:56tengas que hacer realmente ahí, recuerda que como es Haiku, es Claude, tiene una lista de todo lo que haces
00:16:00en segundo plano y esas habilidades también van a formar la base de cómo se ve siquiera tu centro
00:16:04de comandos aquí, ¿verdad? Todo lo que ves aquí es esencialmente algún tipo de habilidad o algún tipo de
00:16:08automatización, ya sea extraer mi horario de Google, ya sean los titulares de la mañana, ya
00:16:13sea extraer métricas de las redes sociales, ya sea esta sección de investigación, todo esto son solo resultados y
00:16:18datos de automatizaciones, eso es todo lo que es. Ahora, el tuyo se va a ver diferente y eso es algo bueno, por eso
00:16:24pienso que el sistema es genial porque es totalmente personalizable; lo que sea que quieras ver
00:16:30debería ser el resultado de una habilidad y luego lo arrojamos aquí y ¡bum!, es tuyo. Ahora hablemos de
00:16:36la parte de la memoria y lo que Obsidian aporta realmente en términos de, entre comillas,
00:16:40mejorar la memoria de Claude. Este es el tuit de Karpathy que hizo que todos perdieran la cabeza
00:16:45por Obsidian y esa especie de conexión con Claude Code; esto salió en abril, casi 22 millones de vistas,
00:16:51y el sistema que presentó es relativamente sencillo y se ve así: nuestro centro de comandos de Obsidian,
00:16:56nuestro Claude OS, vive principalmente en una carpeta conocida como la bóveda (vault), no tiene que
00:17:02llamarse literalmente la bóveda, pero esa es una especie de convención de nombres que usa Obsidian, es solo una
00:17:06carpeta en tu computadora. Dentro de esa carpeta tenemos tres subcarpetas: tenemos raw (crudos), tenemos wiki y tenemos output (resultados).
00:17:15Así que quiero que imagines que tenemos a Claude abierto en esta carpeta de la bóveda y decimos: quiero que hagas algo
00:17:23de investigación sobre sistemas RAG. Así que sale y encuentra un montón de datos, un montón de fuentes, un montón de información
00:17:31sin procesar sobre agentes de IA; todos esos datos sin procesar se colocan esencialmente dentro de la carpeta raw, vive aquí,
00:17:37¿verdad? Tenemos un artículo sobre RAG. Ahora digamos que quieres ir un paso más allá y quieres tomar toda
00:17:44esa información sin procesar y quieres convertirla en un artículo al estilo de Wikipedia, bueno, eso va a
00:17:49la sección wiki y puedes ver aquí que tenemos una subcarpeta en la sección wiki para sistemas RAG, así que todo
00:17:56eso datos se convierte en un nuevo artículo sobre bases de datos vectoriales y tenemos un segundo artículo que tiene
00:18:02que ver con las estrategias de fragmentación (chunking), ¿verdad? Estamos sintetizando esencialmente toda esa información sin procesar que encontramos.
00:18:07Ahora digamos que queremos convertir eso en una presentación de diapositivas, quiero una presentación que hable sobre sistemas RAG,
00:18:12bueno, entonces esa presentación se colocará en la carpeta output, ¿verdad? La estamos convirtiendo en un entregable
00:18:17entregable y ahora es una presentación; así que la idea simple es que tenemos una sección para información sin procesar
00:18:24tenemos una sección para datos sintetizados y luego los entregables que creamos
00:18:28a partir de esos datos. Ahora, lo importante aquí no es solo tener ese tipo de
00:18:34desglose, sino que le da a la IA un camino claro para encontrar información, y la forma en que lo hace no es
00:18:41solo porque tengamos las carpetas, sino porque en cada paso del camino tenemos esencialmente un índice principal
00:18:48o un archivo index.markdown que actúa como una tabla de contenido que dice: oye, una vez que entras a la carpeta wiki
00:18:53puedes leer este archivo markdown que indica las tres subcarpetas que tenemos aquí:
00:18:59agentes de IA, sistemas RAG y creación de contenido. ¿Necesita la IA un índice principal o tabla de
00:19:04contenidos cuando tienes tres subcarpetas? Por supuesto que no, ¿pero qué pasa si tienes tres mil, qué pasa si
00:19:08tienes treinta mil, qué pasa si tienes tres millones? Se vuelve un poco más fácil para todos
00:19:12los involucrados si hay una tabla de contenido, y esa idea se repite a medida que avanzamos un nivel más profundo;
00:19:18fui a wiki, vi el índice principal, quería aprender sobre sistemas RAG, así que voy a la sección
00:19:23de sistemas RAG. ¿Qué quiero aprender sobre los sistemas RAG? Pues adivina qué, hay otro archivo de índice
00:19:27aquí que dice: bases de datos vectoriales, estrategias de fragmentación, etc., y todo el punto de esto
00:19:33es que realmente hay dos puntos: uno, para ti, si como humano quieres poder encontrar cosas, es
00:19:38bastante fácil; dos, hay un camino claro, le damos a Claude Code un mapa para encontrar las cosas, y como tiene ese mapa,
00:19:44nos da respuestas más rápido y va a gastar menos tokens al hacerlo. Así que ese es el propósito
00:19:48de la memoria de Obsidian, no es realmente darle más memoria, es darle un mapa. Ahora, en términos de
00:19:52aplicación práctica, ¿tienes que configurarlo exactamente de esta manera con raw, wiki y output? ¡Claro que
00:19:57no! No tienes que hacerlo, pero necesitas configurar algo que tenga sentido para ti. Puedes ver aquí a la izquierda que tengo
00:20:03una carpeta para contenido, notas diarias, bandeja de entrada, operaciones, sistemas de proyectos y wiki; así que es un poco diferente
00:20:09y ligeramente más enrevesado. Si creas algo que sea un poco más enrevesado, ¿cómo
00:20:14obtenemos aún los beneficios de un mapa entre comillas? Bueno, puedes simplemente explicárselo a Claude, y eso es
00:20:18lo que hago dentro de mi claude.md. Lo más importante que vas a hacer dentro de tu claude.md que
00:20:22vive en tu bóveda es detallar la estructura de la misma y cómo necesita navegar por las cosas, porque
00:20:27con un patrón de navegación y una estructura de bóveda, le he dado un mapa y las instrucciones de cómo leerlo;
00:20:32eso es todo lo que tienes que hacer. Y adivina qué, si estás confundido con todo eso, ¿sabes lo que puedes hacer?
00:20:36Puedes literalmente señalar a Claude hacia tu bóveda, puedes copiar este tuit entero de Karpathy y puedes
00:20:41decir: oye, ¿puedes configurar esto de acuerdo con los principios expuestos aquí? Ahora hablemos de
00:20:45cómo unes todo esto y construyes realmente este tipo de interfaz, de nuevo, completamente personalizada, y es
00:20:49literalmente un complemento que el propio Claude Code crea y se instala en Obsidian por sí mismo, y
00:20:54puedes ver eso aquí bajo los complementos de la comunidad: tengo el centro de comandos Chase. Otro complemento de la
00:21:00comunidad que definitivamente querrás tener habilitado cuando hagas todo esto es el complemento Hot Reload,
00:21:05que no podrás encontrar, al menos no has podido encontrarlo a través de la interfaz de
00:21:09usuario de los complementos de la comunidad oficial de Obsidian, pero puedes encontrarlo en GitHub; solo
00:21:14busca Hot Reload y está justo aquí, indícale a Claude Code que lo instale en Obsidian
00:21:19por ti. Así que todo lo que tienes que hacer es tener una conversación con Claude Code y decirle que quieres construir un
00:21:23complemento personalizado de Obsidian que actúe como un centro de mando, y luego simplemente especificarás lo que
00:21:29quieres que luzca realmente. Una excelente manera de hacer esto es usar Claude Design y hacer que se le ocurra
00:21:35un montón de maquetas visuales diferentes para ti. Puedes ver aquí cuántas iteraciones diferentes
00:21:40llegué a probar, así que le daba algo de inspiración: puedes ir literalmente a
00:21:46algún sitio como Pinterest y buscar algo como tablero o centro de mando para empezar,
00:21:52soltar esas capturas de pantalla aquí y luego decir: oye, estoy intentando crear una maqueta
00:21:57para un complemento de Obsidian, quiero que incluya ciertas métricas —esas métricas dependerán
00:22:02de lo que realmente quieras ver—, quiero que muestre mi calendario, quiero que muestre estas habilidades, quiero que
00:22:07muestre mi consumo de tokens, lo que sea que desees, y luego vas a decir: quiero que crees cinco
00:22:12variaciones muy distintas de esto. Y si haces eso dentro de Claude Design, las pondrá todas en la
00:22:17misma página como esta, todas probablemente van a ser relativamente diferentes, y luego, cuando encuentres una
00:22:22que te guste, te sugiero que profundices en ella y hagas que cree múltiples variaciones de ese centro
00:22:28de mando. Así que al principio elegí algo como este estilo arcilloso, luego encontré este fondo genial
00:22:33y pensé: oye, ¿y si ponemos un fondo dentro de esto y lo ponemos en capas encima? Así que comencé
00:22:38a hacer variaciones de eso hasta que finalmente aterricé en este, donde tenemos ese efecto de diseño de vidrio esmerilado
00:22:43para que puedas ver las nubes asomándose por la parte de atrás, y si miras de cerca, hice que
00:22:49también agregara casi un efecto de parpadeo de estrellas, es bastante sutil porque no quería
00:22:55que fuera abrumador, pero eso fue lo que hice, añadí un poco de movimiento para que al hacer clic en la vista general
00:23:00puedas ver cómo avanza. Pero de nuevo, puedes hacer lo que quieras, puedes hacer esto tan genial, aburrido
00:23:06o soso como quieras que sea, depende totalmente de ti. Pero si estás haciendo esto dentro de Claude Design, una vez
00:23:12que te decidas por un tipo de diseño con el que quieras avanzar, simplemente se lo dices y va
00:23:17a tomar todo el código que creó para estas maquetas, lo va a poner en un archivo zip y luego puedes
00:23:22simplemente tomar ese archivo zip como ves aquí, soltarlo dentro de Claude Code y decir: oye, construye el complemento
00:23:28basado en esto; lo va a construir, se instalará y luego podrás verlo dentro de
00:23:32Obsidian. Si quieres ir un paso más allá, puedes habilitar el uso de computadora dentro de
00:23:37Claude Code y hacer que realice todas las iteraciones de diseño mientras toma capturas de pantalla
00:23:42de sí mismo, por lo que es bastante autónomo. Pero ese es esencialmente el proceso que seguí
00:23:47para crear el mío, y ese es el flujo de trabajo para crear tu propio centro de mando de Obsidian y Claude OS
00:23:51con cierta capacidad de voz. Como dije, necesitas personalizar esto para aprovecharlo al máximo,
00:23:56pero si quieres mi configuración exacta, incluyendo todo lo de la voz y lo demás, lo tengo dentro
00:24:01de Chase A Plus y puedes encontrarlo en el comentario fijado. Así que, como siempre, dime qué te pareció,
00:24:06me encantaría saber qué tipo de configuraciones de centro de mando has podido crear y qué
00:24:11hiciste para personalizar el tuyo, porque puedes volverte bastante loco con esto; pero aparte de eso, ¡nos vemos!

핵심 요약

La integración de Claude Code con Obsidian y un motor de voz local impulsado por Faster Whisper, Haiku y Kokoro transforma un editor de Markdown en un sistema operativo agéntico totalmente personalizable.

하이라이트

  • Obsidian funciona como un centro de comandos en la nube para Claude Code mediante una capa visual personalizable, un sistema de habilidades y una arquitectura de memoria basada en carpetas.

  • El sistema de voz local utiliza Faster Whisper para la transcripción, Haiku 4.5 para el enrutamiento de comandos y Kokoro para la síntesis de voz.

  • La configuración divide las tareas en tres niveles: ejecución de habilidades, extracción rápida de datos en informes existentes y procesamiento desatendido con instancias de Claude.

  • La estructura de memoria de la bóveda de Obsidian se divide en carpetas de datos sin procesar, artículos sintetizados tipo wiki y entregables finales para guiar a la IA con menor uso de tokens.

  • Los complementos de Obsidian se crean mediante maquetas visuales generadas en Claude Design a partir de capturas de pantalla o tableros de inspiración.

  • El complemento Hot Reload permite actualizar y probar complementos personalizados directamente dentro de la interfaz de Obsidian.

타임라인

Arquitectura general del centro de comandos en Obsidian

  • Obsidian actúa como un sistema operativo agéntico que integra habilidades, automatizaciones y una capa de memoria visual.
  • El sistema incluye un módulo de voz local inspirado en el modo de voz de ChatGPT que funciona incluso al cambiar de pestaña.
  • La interfaz visual muestra métricas personalizadas, calendarios, horarios y resúmenes matutinos extraídos de diversos informes.

La configuración agéntica supera las limitaciones de la terminal tradicional o la aplicación de escritorio al proporcionar un panel visual interactivo. Las capacidades de voz permiten invocar comandos, abrir la terminal y consultar informes ya ejecutados sin necesidad de realizar nuevas búsquedas en la web. El sistema también permite ejecutar tareas profundas en segundo plano de manera desatendida mientras se trabaja en otras ventanas.

Columna vertebral de habilidades, automatizaciones y configuración de voz

  • Las tareas diarias y semanales se codifican primero como habilidades deterministas antes de convertirse en automatizaciones.
  • El pipeline de voz procesa el audio mediante Faster Whisper, enruta la solicitud con Haiku 4.5 y genera la respuesta hablada usando Kokoro.
  • El enrutamiento de voz opera en tres niveles distintos según se trate de ejecutar habilidades directas, extraer métricas o iniciar tareas complejas en segundo plano.

La base operativa del sistema se construye convirtiendo flujos de trabajo repetitivos en habilidades estructuradas. El sistema de voz traduce la entrada de audio a texto, el cual es analizado por el modelo Haiku para determinar si debe activar una habilidad simple, consultar un informe existente o desplegar una instancia de procesamiento profundo. El uso de herramientas de código abierto como Faster Whisper y Kokoro permite mantener toda la infraestructura de voz de forma local en la GPU.

Capa de memoria de Obsidian y creación de complementos personalizados

  • La estructura de carpetas de la bóveda organiza la información en archivos sin procesar, notas sintetizadas tipo wiki y entregables finales.
  • Los archivos de índice con tablas de contenido facilitan la navegación de Claude Code para reducir el consumo de tokens y acelerar las respuestas.
  • Los complementos visuales de Obsidian se diseñan mediante iteraciones en Claude Design y se instalan a través de archivos comprimidos.

La organización de la bóveda de Obsidian sigue principios de navegación estructurada con archivos de índice para guiar de manera eficiente a los modelos de lenguaje. Para la interfaz gráfica, se utilizan maquetas visuales generadas a partir de referencias estéticas, las cuales se convierten en código de complementos ejecutables dentro de Obsidian. El uso del complemento Hot Reload simplifica el desarrollo y las pruebas continuas de estas interfaces personalizadas.

커뮤니티 글

아직 글이 없습니다. 이 영상에 대한 첫 번째 글을 작성해 보세요!

이 영상에 대해 글쓰기