Hermes Desktop App: 24 horas con la nueva GUI
La aplicación de escritorio de Hermes llegó en el peor momento posible para mí. Estaba metido tres commits en un proyecto paralelo de Godot, mi agente Hermes vigilaba dos cron jobs en un Mac Mini en la habitación de al lado, y lo último que quería era un nuevo software que aprender. Entonces la nota de lanzamiento apareció en mi feed el 3 de junio: Nous Research lanza Hermes Desktop — un front-end nativo multiplataforma para Hermes Agent. Licencia MIT. Mac, Windows, Linux. El mismo núcleo de agente que la CLI.
Mi primera reacción fue un cansado "ya lo veré la semana que viene." Mi segunda reacción, unos noventa segundos después, fue cerrar mi editor y ejecutar hermes desktop.
Esta es la razón por la que cedí. Durante meses había estado manejando Hermes de la misma forma que la mayoría de la gente — a través de Telegram en mi teléfono, a través de un canal de Discord para las cosas de build y deploy, y a través de una terminal cuando necesitaba ver realmente qué estaba haciendo el agente. Tres superficies. Tres modelos mentales. Un constante impuesto de bajo nivel de "espera, ¿en qué ventana le dije eso?" El presentador cuya demostración me convenció hizo una afirmación audaz después de su primer día con la app: que hace que Telegram, Discord, la CLI y OpenClaw sean obsoletos para uso de escritorio. Esa es su formulación, no la mía — pero después de mis propias 24 horas dentro, entiendo exactamente por qué lo dijo.
Esta es mi primera impresión de la aplicación de escritorio Hermes: qué cambia realmente, las cuatro cosas que genuinamente me sorprendieron, la única configuración que tienes que arreglar el primer día, y la respuesta honesta a si reemplaza todo lo que el hype dice. Separaré las afirmaciones del presentador de lo que yo mismo verifiqué, y marcaré cada lugar donde todavía me baso en 24 horas de datos en vez de 24 días.
Qué es realmente la aplicación de escritorio Hermes (y qué no es)
Permítanme desmontar primero el mayor malentendido, porque cambia cómo deberías pensar sobre todo el asunto. La aplicación de escritorio Hermes no es un producto nuevo — es una ventana nativa sobre exactamente el mismo agente Hermes que ya ejecutas desde la terminal. El mismo archivo de configuración. Las mismas claves API. Las mismas sesiones. Las mismas habilidades. La misma memoria. Según la documentación oficial: "si has usado Hermes en una terminal, todo lo que configuraste allí ya está aquí, y todo lo que hagas aquí aparece allí." Comparten estado. Puedes iniciar una sesión en la CLI y retomarla en la ventana de escritorio, o al revés.
Esa única decisión de diseño es la razón por la que este lanzamiento importa más de lo que parece. No es un wrapper de Electron atornillado a una API de chat. Es una GUI que controla el mismo núcleo de Hermes Agent — versión 0.15.2 en este lanzamiento, construido por Nous Research, el mismo linaje que desglosé cuando integré Hermes en Claude Code como un sistema operativo de IA con memoria compartida. Nada bajo el capó cambió. Lo que cambió es la superficie a través de la cual lo manejas.
Así que cuando la gente dice "la era de la terminal ha terminado," esa es la cabecera de prensa. La versión precisa es más estrecha y más útil: la terminal ya no es la única forma de alta fidelidad de operar el agente. Todavía tienes la CLI. Todavía tienes las pasarelas de mensajería. Ahora también tienes una verdadera UI de escritorio que expone las partes de Hermes que antes vivían en archivos de configuración y en la salida de --help.
La app se lanzó en vista previa pública el 3 de junio de 2026, descargable como instalador o ejecutable directamente desde la CLI con hermes desktop — que por defecto instala las dependencias de Node del workspace, construye una app Electron desempaquetada para tu sistema operativo y la lanza. La primera ejecución funcionó en mi Mac sin problemas. Si ya tienes Hermes configurado, la app de escritorio encuentra tu configuración existente y estarás hablando con tu agente en menos de un minuto.
Ese es el fundamento. Ahora viene lo que me sorprendió una vez que estuve dentro.
Sesiones a la izquierda, y por qué mis hilos de Telegram de repente se sintieron primitivos
Lo primero que hace la app es reformular cómo piensas sobre una conversación. Cada interacción es una sesión, y todas viven en una lista en el lado izquierdo — nombradas, persistentes, clicables. Eso suena mundano hasta que lo comparas con cómo estaba trabajando realmente antes.
En Telegram, todo lo que Hermes y yo habíamos discutido era un scroll infinito. Ideas de contenido, una consulta de precio de acciones, un hilo de debugging, un plan de negocios a medio terminar — todo untado en una sola línea temporal por la que tenía que hacer arqueología cada vez que quería retomar algo. Discord al menos me daba canales, pero los canales son pesados. No abres un canal para una pregunta de cuarenta minutos.
El modelo de sesiones de la app de escritorio resuelve esto sin hacerte pensar en ello. Ahora tengo una sesión para trabajo de contenido, una para el juego de Godot que estoy construyendo, una para seguimiento de inversiones, y una para programación general. Cada una mantiene su propio hilo. Puedo renombrarlas. Puedo agruparlas en carpetas. Y — esta es la parte que justifica su existencia — puedo fijar las que uso constantemente en la parte superior.
Fijar suena trivial. No lo es, y aquí está la razón específica: Hermes crea sesiones automáticamente cuando se ejecutan cron jobs. Cada tarea programada que se ejecuta en una "sesión de agente completamente nueva," según la documentación, se convierte en una nueva entrada en tu lista. Deja unos cuantos cron jobs ejecutándose durante un día y tu barra lateral se llena de sesiones generadas por la máquina que no abriste manualmente. Fijar las tres o cuatro sesiones que realmente controlas evita que se ahoguen. Después de un solo día de pruebas ya tenía una docena de sesiones generadas por cron apiladas. La función de fijar pasó de "bonita" a "requerida" en unas seis horas.
¿Es esto suficiente para retirar Telegram en el escritorio? Para mí, sí — en el escritorio. Cuando estoy en mi Mac, la lista de sesiones supera al threading en cualquier app de mensajería que haya usado con un agente. En mi teléfono, Telegram todavía gana porque aún no hay una app móvil de Hermes, y la pantalla de un teléfono de todos modos no tiene espacio para una barra lateral de sesiones. El presentador dijo lo mismo, y creo que es la opinión honesta: el escritorio migra a la app, el móvil se queda en Telegram hasta que Nous lance un cliente para teléfono.
Pero la lista de sesiones no es la función que me hizo prestar atención. Esa fue la siguiente.
La función de "segundo cerebro" que no sabía que necesitaba
Escondida en la app hay una sección de Artifacts, y resolvió silenciosamente un problema que había dejado de notar porque llevaba tanto tiempo viviendo con él.
Cada enlace, archivo e imagen que envías a Hermes a través de cualquier sesión se recopila en un solo lugar. No por conversación. Globalmente. Envía al agente una URL de YouTube para transcribir en tu sesión de contenido, suelta un PDF en tu sesión de investigación, pega una captura de pantalla en tu hilo de programación — todo aterriza en Artifacts, accesible después independientemente de la sesión de la que vino.
Había estado usando una maraña de marcadores del navegador, una app de Notas, y el ocasional "déjame pegar esto en Telegram para no perderlo" para exactamente esto. El panel de Artifacts colapsa todo eso dentro del propio agente. Es un hub de memoria persistente para las cosas que le entregas al agente, que es algo diferente y más práctico que la propia memoria conversacional del agente.
Así es como cambió concretamente mi día. Le envío a Hermes muchos videos para transcribir. Antes de la app, el enlace fuente desaparecía en cuanto el chat se desplazaba — si quería el original dos días después, estaba excavando en mi historial del navegador. Ahora el video está en Artifacts junto al transcrito que produjo el agente. Lo mismo aplica para PDFs que quiero resumir y presentaciones a las que quiero que el agente haga referencia. Nada se evapora mientras la conversación avanza.
El presentador lo llamó un segundo cerebro. Yo lo pondría más simple: es la gestión de archivos y enlaces que un agente de IA debería haber tenido desde el principio, y es la primera vez que lo veo integrado en el agente en lugar de pegado encima a través de una herramienta de notas separada. Si has leído mi artículo sobre construir un segundo cerebro persistente con Claude Code y Obsidian, este es el mismo instinto — mantener el material crudo unido a la inteligencia que trabaja con él — excepto que Hermes lo hace nativamente, sin vault necesario.
Esa es la función que me convenció de la app en sí. Las dos siguientes son las que arreglaron cosas con las que silenciosamente me había resignado.
Cron jobs que por fin puedes ver, probar y confiar
Si has ejecutado Hermes durante algún tiempo, conoces el dolor del cron. Configuras un job para que se ejecute cada mañana. Se ejecuta una vez. O se ejecuta a la hora equivocada. O se detiene silenciosamente y no te das cuenta durante tres días porque nada te dice que murió. Perdí un chequeo diario de acciones de esta forma y no me di cuenta hasta que fui a buscar una salida que nunca se generó.
La app de escritorio pone el cron detrás de una interfaz real. Puedes ver cada job programado, establecer su horario con un formulario real en lugar de una expresión cron cruda que tenías ligeramente mal, pausar jobs que no quieres que se ejecuten ahora mismo, y — la parte que más me importa — probar un job para confirmar que realmente hace lo que pretendías antes de confiar en que se ejecute desatendido a las 3 de la mañana.
Hay un detalle mecánico importante sobre el que la documentación es explícita, y te ahorrará una hora de confusión: un cron job de Hermes se ejecuta en una sesión de agente completamente nueva. No hereda contexto de tu historial de chat. El prompt debe contener todo lo que el agente necesita que no esté ya suministrado por una habilidad adjunta — y sí, un cron job puede cargar una o más habilidades antes de ejecutarse. Por eso un job que "funciona cuando lo pido en el chat" puede fallar en un horario programado: en el chat, el agente tenía contexto que la ejecución del cron no tiene. El botón de prueba de la app de escritorio es la forma más rápida de detectar esa brecha, porque ejecutas el job en sus condiciones reales de sesión nueva y observas lo que hace.
Para cualquiera que ejecute automatizaciones programadas — el chequeo matutino de acciones, el build nocturno, el scraping diario de competidores — esta es la diferencia entre esperar que un job se haya ejecutado y saber que lo hizo. Pondría el gestor de cron en segundo lugar solo después de Artifacts en cuanto a funciones que cambiaron mi forma de trabajar esta semana. Es el mismo problema de fiabilidad que seguía encontrando cuando programaba automatizaciones tipo Hermes desde un VPS controlado por Discord, excepto que ahora puedo validar el horario visualmente en vez de seguir logs y rezar.
Una advertencia justa sobre 24 horas de datos: he probado la interfaz de cron, he pausado jobs y he visto ejecuciones de prueba. Todavía no he ejecutado una ventana completa de 30 días para confirmar que el programador gestionado por la app sobrevive a un modo de suspensión del Mac, una caída de red o un reinicio del agente con la misma tenacidad que una entrada cron de Linux en un VPS. Mi recomendación de trabajo refleja lo que le digo a la gente sobre cualquier nuevo programador: configura los jobs en la app para claridad y pruebas, pero duplica los de misión crítica en cron puro en un VPS hasta que hayas visto que la app aguanta bajo carga real.
Perfiles, modelos y las configuraciones que silenciosamente controlan el coste
Tres piezas más importan, y son las que separan a alguien que ejecuta un agente de alguien que gestiona una flota.
Perfiles te permiten ejecutar múltiples agentes Hermes distintos, cada uno con configuración, habilidades y sesiones aisladas. Esto no es lo mismo que sub-agentes, y vale la pena entender la distinción correctamente. Un sub-agente es una copia de tu agente principal — mismas memorias, mismas habilidades, despachado para paralelizar una tarea. Un perfil es un agente completamente diferente: su propia memoria, su propia personalidad, su propio conjunto de habilidades y herramientas. El presentador ejecuta siete de ellos a través de un DGX Spark, un par de Mac Minis y un Mac Studio, cada uno con un trabajo diferente. Yo ejecuto menos, pero el principio se mantiene — mi agente de contenido y mi agente de código no deberían compartir cerebro, igual que mi diseñador y mi contable no deberían. Crear y configurar un perfil, editar su personalidad y elegir su modelo ahora sucede todo dentro de la app, sin cirugía de archivos de configuración.
Selección de modelo es un dropdown. Eso suena poco notable hasta que recuerdas el antiguo modo de fallo: cambiar de modelo a mitad de stream podía romper o hacer crashear al agente. La app de escritorio maneja el cambio limpiamente a través del Nous Portal, que expone más de 300 modelos a través de planes gratuitos y de pago. Yo ejecuto Claude Opus 4.8 como mi modelo principal de chat — es en lo que confío para el trabajo de razonamiento pesado — pero el dropdown hace trivial bajar a un modelo más barato para una sesión donde no necesito el peso pesado. Lo que me lleva a las dos configuraciones que silenciosamente deciden tu factura y tu tranquilidad.
Habilidades y conjuntos de herramientas son gestionables desde la UI, y aquí es donde vive el coste de tokens. Hermes viene con habilidades por defecto — acceso a iMessage, Recordatorios de Apple, Find My, y otras — que quizás nunca uses. Cada habilidad cargada es contexto que el agente lleva consigo, y contexto es dinero, especialmente en un modelo de clase Opus donde las tareas auxiliares se acumulan rápidamente. Desactivar las habilidades que no necesitas es la optimización más barata de la app. Desactivé tres habilidades por defecto en la primera hora y vi caer mi huella de tokens por sesión. Las habilidades en Hermes también son auto-mejorables — evolucionan basándose en el uso — y la app te permite realmente ver tus habilidades personalizadas, incluyendo una que había estado cultivando mientras construía ese juego de Godot sin darme cuenta de cuánto había madurado. Los conjuntos de herramientas son grupos de herramientas que trabajan juntas, como automatización del navegador, expuestas para que puedas entender y extender lo que el agente realmente puede hacer.
Si quieres el modelo mental más profundo de por qué desactivar capacidades no utilizadas importa tanto en plataformas de agentes, profundicé exactamente en esta dinámica en mi guía de optimización de costes de agentes IA — la versión corta es que el token más barato es el que nunca cargas.
Esta es la sección donde, si estás configurando la app tú mismo, haría una pausa y realmente haría el trabajo: audita tus habilidades por defecto, elige tu modelo principal deliberadamente y divide tus agentes en perfiles por función. Veinte minutos aquí te ahorran semanas de sesiones confusas y caras después. Y si prefieres que alguien arquitecte un setup multi-agente de Hermes para ti de principio a fin — perfiles, habilidades, cron, las barreras de coste — ese es exactamente el tipo de trabajo que acepto a través de mis ofertas en Fiverr.
Hay una configuración más que no es opcional. Es la corrección que decide si la app es genuinamente usable.
La única configuración que debes cambiar el primer día
Las versiones anteriores de Hermes tenían un problema de memoria: en sesiones largas, el agente perdía contexto — olvidaba lo que habías establecido cuarenta mensajes atrás, se repetía, divagaba. Si probaste Hermes una versión o dos atrás y lo abandonaste por esta razón, esta es tu razón para volver.
La solución es un valor de configuración, y la recomendación del propio equipo de Hermes es la que seguí: establece el umbral de compresión en 0,5. El umbral de compresión por defecto de Hermes es 0,50 (50% del límite de contexto), y ese es el valor que quieres — activa la compresión con más frecuencia pero más ligeramente, de modo que el agente comprime en pasadas más pequeñas y suaves en lugar de esperar hasta que la ventana de contexto esté casi llena y luego aplastarlo todo en un solo bloque con pérdidas. Compresión más frecuente y ligera significa menos pérdida catastrófica de memoria a lo largo de una sesión larga.
En términos prácticos: con el umbral correctamente configurado, mis sesiones mantuvieron su hilo mucho más tiempo que las compilaciones anteriores de Hermes que había abandonado. El agente recordaba decisiones que había tomado al principio de una sesión que versiones anteriores habrían aplanado. Esta es la diferencia entre un agente con el que puedes tener una verdadera sesión de trabajo y uno al que tienes que seguir informando de nuevo. Configúralo el primer día. Es el ajuste de mayor apalancamiento en toda la app, y te cuesta un cambio de configuración.
Mientras estás en configuraciones, hay dos más que vale la pena conocer. La primera es puramente cosmética — una gama de temas de apariencia incluyendo claro y oscuro. Yo uso el tema claro con un sutil tono azul helado; es la única elección puramente estética en este artículo y no voy a pretender que cambia tu output. La segunda no es cosmética en absoluto.
Claves API, por fin fuera del cuadro de chat
Aquí hay un hábito de seguridad que la app corrige del que estoy un poco avergonzado de haber tenido. La antigua forma de meter una clave API en Hermes para ciertos flujos de trabajo era pegarla en un mensaje de chat. Piensa en lo que eso significa: tus credenciales en texto plano dentro de un registro conversacional, a una compartición de pantalla o una copia de seguridad sincronizada de quedar expuestas.
La app de escritorio tiene un menú dedicado de Claves API. Añades y gestionas claves ahí, separadas de cualquier conversación. Las credenciales viven en su propio almacén, completamente fuera del historial de chat. Este es el tipo de corrección poco glamurosa que no llega al titular de lanzamiento pero absolutamente debería, porque el modo de fallo que previene — una clave filtrada en un log que alguien más puede leer — es uno de los errores más comunes y costosos que la gente comete con plataformas de agentes. Si te importa hacer esto correctamente, es el mismo principio que recorro en mi guía de incorporación segura de agentes IA: las credenciales pertenecen a una bóveda, nunca al contexto conversacional.
Mueve cada clave del chat al menú de claves. Toma dos minutos y cierra un agujero real.
Entonces, ¿a qué suma todo esto después de un día?
¿Realmente reemplaza Telegram, Discord, la CLI y OpenClaw?
Esta es la afirmación que me atrajo, así que déjenme responderla honestamente, pieza por pieza, después de 24 horas.
Telegram y Discord, en el escritorio: sí, mayormente. El modelo de sesiones genuinamente supera al threading en una app de mensajería, y Artifacts supera el hábito de "pégalo para no perderlo" que esas apps fomentan. Cuando estoy en mi Mac, no tengo razón para manejar Hermes a través de Telegram. En mi teléfono, Telegram todavía gana por defecto — no hay app móvil de Hermes aún, y espero que Nous lance una antes de que esta afirmación se vuelva completamente verdadera.
La CLI: reemplazada para la mayoría de tareas, no retirada. La app de escritorio expone cosas que la terminal te hacía excavar — cron, perfiles, habilidades, claves — de una manera que es más rápida para la operación diaria. Pero como la app y la CLI comparten el mismo estado, la terminal sigue ahí cuando quiero control directo o estoy conectado por SSH a una máquina sin interfaz gráfica. No es "la terminal está muerta." Es "ya no tienes que vivir en la terminal."
OpenClaw: esta es la picante, y tendría cuidado con ella. Hermes Desktop es una razón fuerte para elegir Hermes sobre OpenClaw si estás eligiendo una plataforma de agente personal hoy desde cero. Pero "obsoleto" es exagerar. OpenClaw tiene su propio ecosistema y su propia GUI comunitaria — reseñé ClawX, la app de escritorio para agentes OpenClaw, que resuelve el mismo problema de superficie en la otra plataforma. La lectura correcta es presión competitiva, no extinción. El propio presentador espera que OpenClaw imite esta UI rápidamente, y estoy de acuerdo — cuando una plataforma entrega la GUI que todos querían, las demás la copian en un ciclo de lanzamiento.
Mi única vacilación honesta sobre todo el asunto: 24 horas es una primera mirada, no un veredicto. Todo lo que he descrito, lo toqué y verifiqué. Lo que no he hecho es ejecutarlo como mi única superficie de Hermes durante un mes, a través de actualizaciones del SO, ciclos de suspensión y la lenta acumulación de cron jobs que revela si una herramienta es realmente duradera o solo bonita para demos. Las funciones son reales. La longevidad aún está en periodo de prueba. Sabré más en treinta días de lo que sé hoy, y lo diré cuando lo sepa.
Sin embargo, hay una pregunta que vale la pena considerar esta noche. Durante dos años, el precio de admisión a agentes de IA serios fue la comodidad con una terminal — y ese único requisito silenciosamente mantuvo las herramientas más poderosas fuera del alcance de las personas que más se habrían beneficiado. La app de escritorio Hermes no simplifica al agente. Hace las mismas cosas poderosas; simplemente deja de exigirte que demuestres que puedes usar una línea de comandos. Así que aquí está la verdadera pregunta que plantea este lanzamiento: cuando la GUI es finalmente así de buena, ¿qué queda para justificar mantener al agente en la terminal — y a quién estábamos dejando fuera al dejarlo ahí?
Preguntas Frecuentes
¿Qué es la aplicación de escritorio Hermes?
La aplicación de escritorio Hermes es una GUI nativa multiplataforma para Hermes Agent, lanzada por Nous Research el 3 de junio de 2026. Funciona en macOS, Windows y Linux, tiene licencia MIT y controla el mismo núcleo de Hermes Agent (v0.15.2) que la CLI — compartiendo configuración, claves API, sesiones, habilidades y memoria. Para el desglose completo, consulta "Qué es realmente la aplicación de escritorio Hermes" arriba.
¿Cómo instalo la aplicación de escritorio Hermes?
Descarga el instalador del sitio de Nous Research, o ejecuta hermes desktop desde la CLI si Hermes ya está instalado. El comando CLI instala las dependencias de Node del workspace, construye una app Electron desempaquetada para tu sistema operativo y la lanza. Si ya tienes Hermes configurado, la app encuentra tu configuración existente automáticamente.
¿La aplicación de escritorio Hermes reemplaza Telegram y la terminal?
En el escritorio, reemplaza en gran medida Telegram y Discord para operar el agente, gracias a su lista de sesiones y el hub de Artifacts. No retira la CLI — ambas comparten estado, así que la terminal permanece disponible para control directo y servidores sin interfaz gráfica. El móvil sigue favoreciendo Telegram hasta que aparezca una app para teléfono.
¿Qué umbral de compresión debo configurar en Hermes?
Establece el umbral de compresión en 0,5, que es el valor por defecto de Hermes (50% del límite de contexto). Esto activa una compresión más frecuente pero más ligera, reduciendo la pérdida de memoria que afectaba a sesiones largas anteriores. Es la configuración más importante del primer día en la app — consulta "La única configuración que debes cambiar el primer día" arriba.
¿Es gratuita la aplicación de escritorio Hermes?
Sí, la aplicación de escritorio Hermes es de código abierto y tiene licencia MIT. El acceso a modelos funciona a través del Nous Portal, que ofrece planes tanto gratuitos como de pago con más de 300 modelos de IA, así que tu único coste real es la inferencia que elijas ejecutar en modelos de pago como Claude Opus 4.8.
Trabajemos Juntos
¿Quieres construir sistemas de IA, automatizar flujos de trabajo o escalar tu infraestructura tecnológica? Me encantaría ayudar.
- Fiverr (soluciones personalizadas e integraciones): fiverr.com/s/EgxYmWD
- Portfolio: mejba.me
- Ramlit Limited (soluciones empresariales): ramlit.com
- ColorPark (diseño y branding): colorpark.io
- xCyberSecurity (servicios de seguridad): xcybersecurity.io