Utilice OpenClaw para crear un asistente personal de IA

convertirse en un conocido sistema de código abierto para ejecutar Claude Code. OpenClaw es esencialmente un sistema que ejecuta Claude Code indefinidamente, lo que le permite configurarlo como su asistente personal de IA.

Puede configurar OpenClaw para que realice todo tipo de tareas por usted, como por ejemplo:

Revisar solicitudes de extracción de GitHub Analizar correos electrónicos Navegar por Internet.

Pasé la última semana configurando muchos sistemas OpenClaw diferentes para que actuaran como mis bots, especializados en diferentes áreas de aplicación. En este artículo, le explicaré cómo configuré OpenClaw en mi propio sistema, garantizando que la implementación sea segura y me haga más eficaz como ingeniero.

Cubriré los detalles de dónde debe configurar OpenClaw, cómo puede configurarlo, la forma recomendada de ejecutar sus instancias de OpenClaw y cómo aprovechar OpenClaw al máximo.

Esta infografía destaca los contenidos principales de este artículo. Explicaré exactamente cómo configuro OpenClaw para convertirme en mi asistente personal, ahorrándome una gran cantidad de tiempo. Imagen de Géminis

¿Por qué configurar un Asistente OpenClaw?

La razón número uno por la que deberías configurar OpenCline en tu computadora es simplemente porque te hace más efectivo. Puedes configurar OpenClaw para automatizar todo tipo de tareas diferentes y ayudarte a organizar todo tu trabajo.

Por ejemplo, en lugar de revisar manualmente sus correos electrónicos en busca de correos electrónicos relevantes y encontrar respuestas, simplemente puede decirle a OpenClo que analice todos sus correos electrónicos diariamente, enséñele qué correos electrónicos cree que son relevantes y cuáles no, y haga que le proporcione respuestas de ejemplo que pueda permitirle enviar.

También puedes darle acceso a OpenClaw a tu perfil de GitHub y hacer que te notifique cada vez que te etiqueten en una solicitud de extracción relevante. Analice la solicitud de extracción como si fuera usted y sugiera un comentario de revisión de extracción.

La mejor parte de OpenClaw es que se puede personalizar:

Puedes decirle exactamente cómo comportarse y puedes enseñarle con el tiempo para que sea cada vez mejor. Esto es exactamente lo que necesitas en un asistente personal. Es muy capaz desde el principio y se vuelve aún más capaz cuanto más le enseñas.

Cómo implementar OpenClaw

En esta sección, explicaré cómo implementé OpenClaw. Hay muchas formas diferentes de hacerlo y muchas aplicaciones diferentes que puedes configurar. Para que sea simple y específico, te diré cómo lo hice específicamente y a qué aplicaciones lo conecté, para inspirarte sobre cómo hacerlo tú mismo. Sin embargo, no existe una única manera verdadera de hacer esto y la forma óptima para usted depende de su flujo de trabajo.

Acceso al Código Claude

Lo primero que necesitas es acceso a Claude Code. Claude Code ofrece tres niveles de suscripción diferentes, que le brindan una cantidad determinada de uso por mes. Esto equivale, respectivamente, a $20, $100 y $200 por mes.

También utilizo Claude Code para mi otra programación y tengo la suscripción máxima. Luego puedo usar esta misma suscripción para mi asistencia de OpenClaude y aún estar dentro de mis limitaciones de uso por mes.

También puede realizar el pago por uso a través de un precio de API, aunque no lo recomiendo porque rápidamente se volverá más costoso que el uso equivalente que podría obtener a través de una de las suscripciones que describí en la sección anterior.

Una vez que tenga acceso a Claude Code, puede ejecutar el siguiente comando para configurar un token, que puede proporcionar para abrir Claude al configurarlo. Recuerde no compartir este token con nadie, ya que le da acceso a su suscripción a Claude Code.

token de configuración de claude

Imágenes de Docker en una computadora separada

Puedes instalar OpenClaw a través de este enlace. Exactamente cómo lo instale dependerá de su sistema operativo, por lo que evitaré proporcionar comandos específicos aquí. Sin embargo, otra forma de configurarlo, que podría ser la más sencilla, es simplemente decirle a Claude Code que lo configure por usted. Proporcione a Claude Code el token que describimos anteriormente y podrá configurar su asistente por usted. He hecho esto tres veces diferentes y siempre ha funcionado para configurar completamente mi asistente exactamente como lo quiero.

Cuando configure su asistente, le recomiendo decirle a Claude Code que lo configure como diferentes imágenes de Docker en su computadora. Esto tiene múltiples ventajas.

El agente se ejecutará en un entorno aislado y no tendrá acceso a cosas a las que no debería tener acceso. Esto es muy importante por motivos de seguridad. Ejecutarlo como una imagen de Docker facilita mover y crear copias de seguridad de su agente. Simplemente puede descargar la imagen de Docker y usarla en una computadora diferente, y almacenar la imagen en Docker Hub para tener una copia de seguridad de su agente.

Simplemente puede decirle a Claude Code que configure todo en Docker y él lo hará por usted. No tienes que hacer nada tú mismo allí.

Personalizando OpenClaw

Una vez que hayas configurado OpenClaw con Claude Code, debes personalizarlo. Dígale a Claude Code que abra el panel de OpenClaw en el navegador web que desee y comience a chatear con su agente. Te preguntará… El agente te preguntará tu nombre y cómo debe llamarse, y podrás darle una personalidad.

He configurado varios bots diferentes. Por ejemplo, configuro un asistente personal que tiene mi personalidad y trata de ser súper racional y solo me brinda resúmenes concisos de todo lo que necesito hacer y las cosas de las que debo estar consciente.

También configuré un robot de ventas que tiene una actitud un poco diferente, de mentalidad muy positiva y al que le he dado acceso a material de ventas relevante, etc.

En general, puedes simplemente charlar con tu agente y decirle que recuerde cosas. Open Claw luego procederá a almacenar información importante en la memoria y la recordará para más adelante.

Acceso

Una vez que hayas configurado OpenClaw con su personalidad, deberías empezar dándole acceso a las cosas. Al otorgar acceso a sus agentes, debe seguir el principio de otorgar la menor cantidad de acceso necesaria para realizar acciones. Para mi bot personal, le he dado el siguiente acceso.

Slack (donde nos comunicamos) Mis correos electrónicos y calendario para que pueda leer correos electrónicos y reservar reuniones Lineal, para que pueda consultar las diferentes tareas que tengo que hacer. GitHub, para que pueda realizar acciones en mi nombre en GitHub.

También configuré un agente diferente que actúa como un robot de ventas. A este bot se le ha dado acceso al sistema CRM, donde podrá obtener todo su material relevante en materia de ventas. También le he dado acceso a Slack donde nos comunicamos.

En general, el acceso que le dé a su agente es crucial para lo que puede hacer. Si desea realizar una acción, debe otorgarle acceso y permisos para hacerlo. Sin embargo, también debes tener cuidado con el acceso que le das, ya que tu agente actuará de forma totalmente autónoma dentro de estos sistemas.

Habilidades

Otra parte increíblemente importante de la configuración de OpenClaw son las habilidades que proporcionaste. Si desea que OpenClaw recuerde cosas para más adelante o actúe de una manera específica, debe proporcionarle habilidades. Para proporcionar la habilidad OpenClaw, simplemente puede decirle “almacenar esto como una habilidad” después de proporcionar cierta información.

Daré algunos ejemplos de las habilidades que he creado:

Habilidad de GitHub: esto le dice al agente cómo debe actuar en GitHub en mi nombre. Por ejemplo, le dice cómo hago las revisiones de solicitudes (hice que mi agente mirara todas mis diferentes revisiones anteriores para analizar mis preferencias). Habilidad de Gmail: le dice al agente qué correos electrónicos debe configurar en rojo automáticamente, cuáles no me interesan y sobre qué correos electrónicos debe informarme en mi informe diario. Habilidad de Slack: le dice al agente cómo interactuar en Slack, por ejemplo, responder siempre en hilos y no como mensajes nuevos. Habilidad de calendario: le dice al agente exactamente cómo leer mi calendario, me informa sobre reuniones, cómo reservar reuniones con otras personas y cómo interactuar con la API de Google para Google Calendar.

En general, intento dotar al agente de una habilidad relevante cada vez que quiero que realice una acción.

Luego, la habilidad se cargará dinámicamente cada vez que se le pida al agente que haga algo relacionado con una habilidad determinada. Por ejemplo, si se le pide que lea Gmail o correos electrónicos, leerá la habilidad de Gmail.

Lo que no funciona con OpenClaw

Experimenté mucho con OpenClaw durante la última semana. He notado situaciones en las que funciona increíblemente bien desde el primer momento, y también he notado escenarios en los que no funciona tan bien. Hay dos cosas principales que debes tener en cuenta y que no funcionan muy bien.

Ser vago Simplemente decirle al agente que recuerde cosas para más tarde.

Ser vago no funciona porque OpenClaw no planifica de la misma manera que tú y no tiene acceso a todos los contactos que necesita. Por lo tanto, debes asegurarte de tener un plan muy específico y evitar la ambigüedad al configurar cosas para OpenClaw.

Para lograr esto, recomiendo hablar con un LLM de antemano antes de intentar implementar algo y luego ser muy específico una vez que intentes implementarlo. No es un problema cambiar su plan más adelante ya que OpenClaw se adaptará; si proporciona un plan muy vago, OpenClaw tendrá muchas dificultades y probablemente no podrá implementar lo que pretende hacer.

Además, simplemente decirle al agente que recuerde cosas para más tarde no funciona tan bien. En general, debes asegurarte de almacenar toda la información importante en las habilidades. Siempre que le enseñe algo específico al agente, dígale que lo agregue a una habilidad relevante creada previamente o que cree una nueva habilidad con la información. Estas habilidades se cargarán cada vez que el agente realice acciones.

Por ejemplo, si le proporciona al agente una habilidad de lectura de correo electrónico, esta habilidad se cargará cada vez que el agente interactúe con los correos electrónicos. Entonces, si desea que el agente se desempeñe de una manera específica al leer o enviar correos electrónicos, debe almacenarlo en una habilidad separada.

Por lo tanto, recomiendo encarecidamente asegurarse de que el agente almacene toda la información relevante en habilidades explícitas y que usted realice un seguimiento de estas habilidades y las actualice continuamente a medida que obtenga más y más información.

Conclusión

En este artículo, he explicado cómo configurar OpenClaw. Simplemente puede configurar OpenClaw de forma gratuita, siempre que ya tenga una suscripción a Claude Code. Al configurar OpenClaw, debe configurarlo en un contenedor Docker separado, aislando cada entorno y asegurándose de que los diferentes agentes no tengan acceso a la información y las claves de los demás. Crear una asistencia OpenClaw ha sido increíblemente poderosa para mí y, en menos de una semana después de configurarla, ya noté enormes ganancias en eficiencia. Sin embargo, también notaré escenarios en los que el agente no funciona tan bien, lo cual debes tener en cuenta al configurar tu asistencia. Sin embargo, la clave general es ser lo más específico posible y hacer que el agente almacene todo lo relevante como habilidades que se puedan cargar dinámicamente según demanda.

👉 Mi libro electrónico y seminario web gratuitos:

🚀 10 veces su ingeniería con LLM (curso gratuito por correo electrónico de 3 días)

📚 Obtenga mi libro electrónico gratuito sobre Modelos de lenguaje de visión

💻 Mi seminario web sobre modelos de lenguaje de visión

👉 Encuéntrame en las redes sociales:

💌 Subpila

🔗 LinkedIn

🐦X/Twitter

You missed

Cohere lanza Parse 5 (parse-v5.0): un modelo de lenguaje de visión de 2.300 millones que convierte documentos empresariales en rebajas[0]Cohere ha lanzado Parse (parse-v5.0), un modelo de análisis de documentos destinado a la ingesta empresarial de gran volumen. Es un modelo de lenguaje de visión de 2,300 millones de parámetros con una ventana de contexto de 8192 tokens y un espacio de ~4,6 GB, construido sobre la arquitectura North-Micro-Vision-Instruct de Cohere Labs. Parse toma una página PDF, PPT o JPEG como un URI de datos codificados en base64 y devuelve Markdown que contiene texto en orden de lectura, tablas representadas como HTML, listas, pares clave-valor, descripciones de imágenes y coordenadas del cuadro delimitador. No hay una etapa de OCR separada frente a él. Cohere fija el precio de la API de Parse a 1,50 dólares por cada 1.000 páginas y posiciona el modelo según la relación precio-rendimiento en lugar de la máxima precisión, una afirmación que la empresa respalda con una puntuación ParseBench autoinformada de 79,2 que, como detallamos a continuación, mide tres de las cinco dimensiones de ese punto de referencia. ¿Es desplegable? Sí, en producción. Parse generalmente está disponible a través de Cohere Parse API, Microsoft Foundry, AWS SageMaker y Model Vault de un solo inquilino. No hay lista de espera ni licencia de investigación. Qué empresas: Los equipos del mercado medio que ya ejecutan una pila RAG pueden comenzar con llamadas API medidas con una clave de prueba gratuita. Las grandes empresas con requisitos de residencia o de espacio aéreo van directamente a Model Vault o a una implementación privada. Las nuevas empresas en etapa inicial pueden usarlo, pero la economía solo comienza a importar a partir de aproximadamente 100.000 páginas al mes. Qué industrias: Cohere apunta a servicios financieros, seguros, atención médica y ciencias de la vida, sector público, telecomunicaciones, energía y manufactura: las verticales con gran cantidad de documentos donde los formularios escaneados y las tablas densas son la norma. Aplicaciones: ingesta de RAG, procesamiento inteligente de documentos, procesamiento de reclamaciones y facturas, búsqueda de contratos y presentaciones, y brindar contexto de documentos a los agentes. ¿Qué es el análisis? Parse es un modelo de lenguaje de visión de 2,300 millones de parámetros construido sobre la arquitectura North-Micro-Vision-Instruct de Cohere Labs, con una ventana de contexto de 8192 tokens y una huella de ~4,6 GB. Acepta páginas PDF, PPT y JPEG como URI de datos codificados en base64 y devuelve Markdown que contiene texto del documento, listas, tablas representadas como HTML, coordenadas del cuadro delimitador y descripciones de imágenes. No hay una etapa de OCR separada frente a él. El modelo recupera el texto y el orden de lectura, tablas, listas, formularios y pares clave-valor, imágenes y leyendas, y la ubicación de los límites de las páginas y los elementos visuales en una sola pasada. Nueve idiomas figuran como estables (árabe, inglés, francés, alemán, italiano, japonés, coreano, portugués y español) con soporte de disparo cero en otros lugares con menor precisión. En la práctica, dos modos de salida importan. El valor predeterminado devuelve una cadena Markdown por página. Configurar output_format=”blocks” devuelve bloques escritos, donde un bloque de tabla lleva su HTML, su cuadro delimitador y una descripción. Ese segundo modo es lo que hace posible la trazabilidad a nivel de cita. ‘+d