Qué es Grok Bot y cómo evaluarlo con un piloto controlado
En este artículo
Grok Bot es un producto beta de SpaceXAI para delegar tareas persistentes a agentes que trabajan en una computadora administrada en la nube. No es un modelo de Grok: es un entorno de ejecución con memoria, herramientas y permisos.
La pregunta útil no es si la demostración impresiona. Es si un proceso concreto puede probarse con accesos mínimos, una frontera de aprobación y métricas de resultado.
SpaceXAI presentó Grok Bot el 11 de agosto de 2026. El acceso se amplió a más planes el 21 de agosto, mientras el producto seguía en beta.
No he probado Grok Bot. Este análisis se basa en documentación oficial consultada el 25 de agosto de 2026 y separa las capacidades documentadas de los ejemplos comerciales y de la evidencia todavía ausente.
Qué es Grok Bot y cómo funciona
En la terminología oficial, un Bot es un agente persistente con nombre, trabajo, conversación y contexto. Recibe un resultado, fuentes, restricciones y acceso a las herramientas necesarias.
El Bot puede ejecutar una tarea de varios pasos, informar sus acciones y detenerse ante una aprobación. La guía de inicio recomienda definir también el entregable y el punto de revisión.
| Capa | Qué aporta | Límite relevante |
|---|---|---|
| Computadora en la nube | Navegador, archivos y terminal persistentes | Se asigna al usuario y la comparten todos sus Bots |
| Integraciones | Conectores y MCP; navegador cuando no existe una integración | Un sitio puede bloquear la automatización, pedir un nuevo acceso o mostrar un CAPTCHA |
| Memoria y estado | Preferencias, contexto del rol, archivos y sesiones entre tareas | La memoria puede quedar desactualizada y no sustituye a la fuente vigente |
| Coordinación | Mensajes, grupos y traspasos entre Bots | Cada etapa necesita responsable, contexto y verificación |
| Skills y rutinas | Instrucciones reutilizables y ejecuciones programadas o por eventos | Una prueba de rutina hace trabajo real |
| Aprobaciones | Pausas antes de acciones sensibles | Aprobar o denegar no revierte acciones anteriores |
Este conjunto es el harness: la capa operativa que envuelve al modelo y decide contexto, herramientas, permisos, estado, ejecución y revisión.
Cuando existe una integración estructurada, suele ser más predecible que navegar una interfaz. Esta guía de MCP explica qué aporta esa capa y qué permisos abre.
Por qué Grok Bot no es un modelo de Grok
Separar producto y modelo evita trasladar un benchmark de Grok a la calidad de Grok Bot.
La página de modelos de xAI enumera, entre otros, Grok 4.6, grok-build-0.1 y grok-4.20-multi-agent-0309. Grok Bot se documenta aparte como una aplicación con computadora y herramientas.
La documentación para equipos afirma que Grok Bot no ofrece selector de modelo.
Cada solicitud se enruta dentro de un conjunto fijo y puede cambiar de proveedor o modelo mediante conmutación automática.
Los administradores pueden ver en analíticas qué modelo atendió cada solicitud. No pueden elegirlo de antemano para un usuario, un equipo o una tarea.
Por eso, un benchmark de Grok 4.6 o del modelo multiagente de la API no prueba que Grok Bot complete un proceso real con la misma calidad. Cambian el harness, las herramientas, los permisos, el entorno y la revisión.
Qué cambia frente a un chatbot convencional
Un chatbot responde dentro de una conversación. Grok Bot intenta conservar la responsabilidad sobre un resultado mientras actúa en sistemas externos.
| Dimensión | Chatbot convencional | Grok Bot |
|---|---|---|
| Unidad de trabajo | Pregunta y respuesta | Resultado delegado a un Bot con rol persistente |
| Entorno | Principalmente la conversación | Computadora en la nube con navegador, archivos y terminal |
| Estado | Historial o contexto del producto | Conversación, memoria, archivos, sesiones y preferencias |
| Duración | El usuario suele conducir cada turno | Puede continuar en segundo plano o ejecutar una rutina |
| Herramientas | Dependen de la aplicación | Conectores, MCP, navegador y, con permiso, computadora local |
| Coordinación | El usuario mueve el contexto | Los Bots pueden enviarse trabajo y compartir contexto |
| Riesgo | Calidad de la respuesta | También acciones, credenciales, permisos y cambios reales |
La documentación de la computadora confirma que cerrar la aplicación o el equipo local no detiene el trabajo en la nube. Las rutinas también pueden ejecutarse con el equipo apagado.
“Siempre activo” no significa infalible. Una sesión vencida, un CAPTCHA, una aprobación, un límite de uso o un sitio que bloquea direcciones de centros de datos puede detener el flujo.
Qué existía antes y qué empaqueta Grok Bot
Grok Bot no inventó la ejecución de agentes en la nube, el trabajo en paralelo, el control de una computadora ni los disparadores programados.
Cursor ya documentaba Cloud Agents en octubre de 2025: agentes en la nube que trabajaban en paralelo sin mantener el equipo local conectado.
En febrero de 2026, Cursor describió agentes con máquinas virtuales aisladas y control remoto.
En marzo presentó Automations, con ejecuciones por horario o eventos.
La documentación vigente de Automations confirma que esas ejecuciones crean Cloud Agents y pueden usar MCP, memoria y computer use.
Los productos no son equivalentes. Cursor Cloud Agents se orienta al desarrollo de software y asigna una máquina aislada por agente. Grok Bot empaqueta Bots con nombre para trabajo general y comparte una computadora por usuario.
La novedad defendible está en ese empaquetado: conversación continua entre escritorio e iPhone, roles persistentes, coordinación visible, aprendizaje de skills y rutinas dentro de una misma experiencia.
Coordinar más agentes no elimina la orquestación. Mi retrospectiva de un sistema multiagente que terminé eliminando muestra cuándo esa complejidad deja de justificarse.
Qué comparten los Bots de un usuario
La documentación técnica es explícita: todos los Bots de un usuario usan una sola computadora persistente.
Comparten archivos, cookies, sesiones del navegador, inicios de sesión y credenciales de línea de comandos. Los conectores instalados también son de alcance de cuenta, no de un Bot individual.
Cada Bot tiene una pantalla para trabajar en paralelo. Esas pantallas son superficies separadas de trabajo, no fronteras de seguridad.
Crear un Bot de Finanzas y otro de Marketing no aísla secretos. Si una credencial está disponible en la computadora compartida, debe tratarse como accesible para todos los Bots de ese usuario.
Esta arquitectura facilita los traspasos, pero concentra permisos. “Un Bot por proceso” sirve para delimitar responsabilidad y evaluación; no crea aislamiento técnico.
Cómo funcionan skills, rutinas y aprobaciones
Una skill describe cómo realizar una tarea. Una rutina asigna ese flujo a un Bot y define cuándo ejecutarlo: por horario o, donde esté disponible, por evento.
La guía oficial recomienda probar primero una tarea puntual, guardar después el método como skill y automatizar solo cuando el proceso sea estable.
“Teach a task” puede convertir una demostración del navegador en una skill. Su despliegue es gradual, la grabación se limita a diez minutos y el resultado es un borrador que todavía necesita reglas y manejo de fallos.
Una prueba de rutina no es una simulación. Puede navegar, modificar archivos y llamar herramientas reales, por lo que debe usar datos seguros y mantener las escrituras detrás de una aprobación.
La guía de seguridad propone detener mensajes, publicaciones, compras, transferencias, eliminaciones, cambios de permisos, producción y términos legales.
Auto Review también usa modelos. Sus reglas complementan el mínimo privilegio; no garantizan que toda acción peligrosa sea detectada.
Contraseñas, passkeys, códigos de dos factores, CAPTCHAs y confirmaciones de pago requieren una toma de control humana. No deben enviarse en el chat normal.
La computadora local es un permiso separado. El valor predeterminado es solicitar aprobación en cada ejecución y puede cambiarse a “siempre” o “nunca”. En un piloto, “nunca” es el punto de partida más prudente.
Qué límites de privacidad y gobierno tiene hoy
Grok Bot requiere almacenamiento en la nube y no funciona con Legacy Privacy Mode. Las demás opciones siguen la configuración aplicable de Cursor.
Con Privacy Mode, Cursor declara que no usa los datos del cliente para entrenamiento y que mantiene acuerdos de retención cero con sus proveedores.
La misma página documenta una excepción: los proveedores pueden ejecutar clasificadores de riesgo y conservar temporalmente contenido que active detectores de abuso. Los servicios conectados mantienen además sus propios términos.
Para equipos, Grok Bot hereda SSO, privacidad, reglas del equipo y políticas de MCP. Los administradores pueden activar o desactivar el producto y controlar servidores mediante listas de autorización o bloqueo.
El panel muestra consumo por producto y el modelo que atendió cada solicitud. Sin embargo, al 25 de agosto de 2026 persisten tres huecos de gobierno:
- la vista de auditoría de acciones de los Bots figura como próxima;
- no existe un límite de gasto específico para Grok Bot, aunque se aplican controles generales de consumo bajo demanda;
- el techo de ejecución local administrado por el equipo también figura como próximo.
Una organización con restricciones de proveedores debe revisar la conmutación automática antes de usar datos sensibles. Ni usuarios ni administradores pueden fijar el modelo de una solicitud.
Qué planes incluyen Grok Bot y cuánto cuestan
Grok Bot no tiene una suscripción independiente. El centro de ayuda de Cursor documenta estas vías de acceso:
- Cursor Pro+ y Ultra;
- Cursor Teams Standard y Premium para todos los miembros;
- una cuenta individual SuperGrok Plus o Heavy vinculada a Cursor;
- Enterprise durante su despliegue, mediante el equipo de cuenta;
- una prueba individual cuando esté disponible.
Cursor Pro y SuperGrok básico no lo incluyen. Las cuentas SuperGrok Team o Enterprise tampoco pueden otorgar acceso mediante vinculación.
La vinculación con SuperGrok es un permiso de uso, no un cambio de plan. La ayuda oficial advierte que no puede desvincularse ni trasladarse a otra cuenta de Cursor.
| Plan de Cursor con acceso | Precio mensual publicado |
|---|---|
| Pro+ | US$60 |
| Ultra | US$200 |
| Teams Standard | US$40 por usuario |
| Teams Premium | US$120 por usuario |
Fuente: precios oficiales de Cursor, consultados el 25 de agosto de 2026. Son precios de los planes, sin impuestos aplicables, no una tarifa exclusiva de Grok Bot.
Los planes elegibles incluyen uso semanal. Si se habilita, el consumo adicional utiliza el gasto bajo demanda de la cuenta. No se publica un costo fijo por Bot ni por tarea.
La prueba se mide como crédito de uso y también tiene una ventana de siete días. Una tarea larga puede consumirla sin que exista una cantidad fija de mensajes.
Las aplicaciones compatibles son macOS, Windows e iPhone con iOS 18 o posterior. No hay aplicación de escritorio para Linux ni soporte inicial para Android o iPad.
Qué proceso conviene probar primero
La biblioteca oficial de casos propone trabajos de ventas, finanzas, producto, soporte y operaciones. Son ejemplos del proveedor, no resultados independientes.
| Proceso | Primer piloto controlado | Acción que queda detrás de aprobación |
|---|---|---|
| Investigación comercial | Analizar cuentas y preparar borradores con fuentes | Enviar mensajes o inscribir contactos |
| Conciliación de gastos | Cruzar recibos con una política y marcar excepciones | Modificar reembolsos o contactar responsables |
| Rendimiento de producto | Reunir paneles, trazas y capturas en una hipótesis | Cambiar alertas o configuración de producción |
| Reproducción de errores | Reproducir un reporte en staging y entregar evidencias | Usar datos de clientes o modificar producción |
| Resumen ejecutivo | Preparar un digest con enlaces desde fuentes aprobadas | Enviar mensajes o cambiar reuniones |
El mejor primer caso termina en un artefacto revisable. Leer, conciliar, investigar o preparar permite medir utilidad antes de autorizar acciones externas.
Pagos, datos regulados, decisiones legales, publicaciones, mensajes a clientes y cambios en producción requieren controles adicionales. Que el producto pueda hacer clic no significa que deba recibir ese permiso.
Qué no está demostrado y qué exige el retiro de acceso
El anuncio incluye usos internos y testimonios de acceso temprano. Demuestra que SpaceXAI construyó y utilizó el producto, pero no establece una tasa de éxito, ahorro generalizable ni retorno de inversión.
En el corpus revisado no encontré una evaluación independiente y reproducible de tareas completas. Tampoco una métrica estándar de correcciones, fallos, recuperación, costo por resultado o propagación de errores.
La documentación sí reconoce límites concretos:
- sitios que bloquean automatizaciones o direcciones de centros de datos;
- sesiones vencidas, CAPTCHAs y verificaciones humanas;
- memoria desactualizada que debe contrastarse con la fuente;
- pruebas de rutinas que ejecutan acciones reales;
- cambios de modelo por enrutamiento o conmutación automática;
- archivos y credenciales compartidos entre Bots del mismo usuario.
Eliminar un Bot borra su perfil activo, conversación y rutinas. Puede dejar archivos e inicios de sesión en la computadora compartida.
Ocultar un Bot tampoco pausa sus rutinas. En una organización, solo un administrador de organización puede usar Kill: elimina la máquina virtual en ejecución, pero conserva el almacenamiento durable.
Un retiro de acceso completo debe pausar rutinas, cerrar sesiones, revocar conectores en el servicio de origen y eliminar archivos sensibles. La eliminación de la cuenta de Cursor es un proceso separado.
Cómo evaluar un piloto de Grok Bot
1. Elegir un resultado verificable
Comenzar con una tarea repetitiva de lectura y preparación. Por ejemplo: producir un informe semanal desde fuentes conocidas, sin enviar mensajes ni modificar datos.
2. Limitar datos y accesos
Usar cuentas de prueba, permisos de solo lectura y el mínimo de conectores. No conectar correo, CRM, finanzas y producción al mismo tiempo para explorar capacidades.
3. Definir el punto de detención
La instrucción debe declarar qué puede completar, qué debe devolver y qué requiere aprobación. Las reglas de Auto Review deben nombrar acciones y destinos concretos.
4. Exigir evidencia y registro
Cada resultado importante debe incluir fuentes, supuestos, acciones completadas, acciones pendientes y aquello que no pudo verificarse. La guía de resultados propone esa separación.
5. Probar antes de automatizar
Primero se ejecuta una tarea puntual. Luego se guarda el método como skill, se prueba con otra entrada y recién entonces se crea una rutina con fallos y reintentos definidos.
6. Medir supervisión y costo
Registrar tareas completadas, correcciones, intervención humana, aprobaciones, consumo, capacidad de reconstrucción y recuperación después de un fallo.
Si el proceso necesita tanta supervisión como antes, sumar Bots no resuelve el problema. Solo distribuye la complejidad.
Veredicto: un Bot, un proceso y una frontera
Grok Bot merece atención por cómo reúne computadora, estado, herramientas, memoria, coordinación y rutinas. Su aporte más claro está en el harness y la experiencia de delegación, no en probar la superioridad de un modelo.
Lo evaluaría solo con un proceso repetitivo, revisable y de bajo impacto que pueda comenzar con permisos de lectura.
No lo usaría todavía como operador desatendido de pagos, producción, asuntos legales, datos sensibles o comunicación externa.
La computadora compartida, la auditoría incompleta, el enrutamiento administrado y la evidencia independiente limitada elevan el costo de confiar demasiado pronto.
La regla de adopción es simple: un Bot, un proceso, una frontera de aprobación y una medida de éxito. Solo después de comprobar ese circuito tiene sentido agregar rutinas o más Bots.
Si una organización necesita definir ese primer proceso y sus límites antes de conectar herramientas reales, puede iniciar una conversación.
Preguntas frecuentes
¿Qué es Grok Bot?
Grok Bot es un producto beta de SpaceXAI para crear agentes persistentes con nombre. Trabajan en una computadora en la nube, usan aplicaciones y herramientas, conservan estado y pueden ejecutar tareas o rutinas en segundo plano.
¿Grok Bot es un modelo de IA o es lo mismo que Grok Build?
No. Grok Bot es un producto y un entorno de ejecución que combina modelos, memoria, herramientas, permisos y una computadora en la nube. Grok Build y los modelos de la API de Grok son productos o componentes distintos.
¿Grok Bot sigue trabajando cuando se cierra la computadora?
Sí. El trabajo se ejecuta en la computadora de Grok Bot en la nube, por lo que una tarea en segundo plano o una rutina puede continuar con el equipo local apagado. Esto no garantiza exactitud, acceso permanente ni autonomía sin límites.
¿Cada Bot tiene una computadora aislada?
No. Todos los Bots de un mismo usuario comparten una computadora, incluidos sus archivos, sesiones del navegador e inicios de sesión. Cada Bot tiene una pantalla para trabajar en paralelo, pero esa pantalla no es una barrera de seguridad.
¿Cuánto cuesta Grok Bot?
No existe una suscripción independiente. El acceso se incluye en planes de SuperGrok y Cursor, con uso semanal y posible consumo bajo demanda. En Cursor, Pro+ cuesta US$60 al mes y Teams Standard US$40 por usuario al mes.
Fuentes consultadas
SpaceXAI
Fuentes primarias de SpaceXAI, consultadas el 25 de agosto de 2026:
Cursor
Fuentes primarias de Cursor, consultadas el 25 de agosto de 2026:
Nicolas Farchica
Especialista en Agentes de IA · Copenhague
Diseño e implemento agentes IA, MCP servers y harnesses en producción: el loop, las herramientas y el contexto que hacen que un modelo pase de contestar a trabajar. Todo lo que ves en este sitio está construido así.
Artículos relacionados
Codex en Claude Code: la guía del plugin oficial de OpenAI
OpenAI publicó un plugin para correr Codex dentro de Claude Code: review adversarial, delegación de tareas y un review gate opcional que puede bloquear el cierre del turno.
Gemini 3.7 Flash: análisis, precio y mi veredicto
Analizo Gemini 3.7 Flash, su precio, velocidad y límites, y explico por qué no sería mi primera opción para trabajar con IA.
Inteligencia Artificial para PyMEs: Por Dónde Empezar en 2026 (Guía Práctica)
IA para PyMEs: por dónde empezar, qué herramientas usar, cuánto cuesta y qué esperar. Sin tecnicismos. Con plan de acción de 30 días.