← Todas las noticias

Grok y agentes: dónde está de verdad SpaceXAI en el mapa de 2026

Hay tres cosas llamadas Grok y ocupan esquinas opuestas del mapa de agentes. El bot de X tiene alcance y ninguna autonomía. Grok Build tiene subagentes, modo plan y verificación adversarial — y corre en una terminal. Una lectura honesta, con fuentes.

Leonardo Dias grokagentesdev

Cada semana alguien me pregunta si “Grok ya es un agente”. No hay una respuesta única, porque existen tres cosas distintas llamadas Grok — y ocupan esquinas casi opuestas del mapa de agentes.

Conviene empezar por el detalle que confunde incluso a quien sigue el tema de cerca: xAI ya no existe como empresa independiente. Fue absorbida por SpaceX y rebautizada SpaceXAI. No es chisme de timeline: la documentación oficial y el README del CLI ya firman así. El producto sigue llamándose Grok.

Tres Groks, tres niveles de autonomía

El bot @grok en X. Su system prompt es público, en el repositorio xai-org/grok-prompts. Vale la pena leer el archivo entero. El bot tiene búsqueda en tiempo real, herramientas de X para tomar el contexto del hilo y una instrucción explícita de abrir las páginas para verificar cada dato — “you must use the browse page to verify all points of information”. También tiene un techo: la respuesta final debe quedar por debajo de 550 caracteres, sin markdown y sin etiquetar a quien preguntó.

Eso es uso de herramientas con verificación, y está bien hecho. No es un agente. No hay objetivo que sobreviva a la respuesta, no hay estado entre ejecuciones, no hay efecto en el mundo más allá de un post. Es un investigador de un solo turno con límite de caracteres.

Detalle honesto: ese repositorio no recibe un commit desde noviembre de 2025, y el prompt publicado todavía se describe como “a version of Grok 4 built by xAI”. La transparencia es real, pero está atrasada.

La Agent Tools API. Es la capa de servidor. La documentación lista cinco herramientas nativas que corren en la infraestructura de xAI: Web Search, X Search, Code Interpreter (Python en sandbox), Image Generation y Collections Search sobre tus documentos — más conexión con servidores MCP remotos. La distinción que hacen es la correcta: la herramienta nativa se ejecuta en su servidor; el function calling, en el tuyo.

Grok Build. El CLI. Es la pieza más seria y la menos comentada.

Mapa de dos ejes. En el eje vertical, distribución; en el horizontal, profundidad agéntica. El bot de X aparece arriba a la izquierda: mucho alcance, poca autonomía. La Agent Tools API queda en el medio. Grok Build aparece abajo a la derecha, en el mismo grupo que Claude Code y Codex: mucha autonomía, poco alcance. DISTRIBUCIÓN ↑ PROFUNDIDAD AGÉNTICA → miles de millones 1 dev superficial autónomo @grok en X busca, cita, para en 550 caracteres Agent Tools API sandbox Python, X Search, MCP asistentes personales OpenClaw y similares Grok Build · Claude Code · Codex subagentes, plan, /goal, ACP ✓ lo que tiene alcance no tiene profundidad — y viceversa

El activo único de Grok es la distribución dentro de X. Su profundidad agéntica vive en una terminal, lejos de ese alcance.

Lo que Grok Build tiene de agente de verdad

El código está abierto: xai-org/grok-build, Apache 2.0, escrito en Rust, publicado en julio de 2026. Pasó las 24 mil estrellas. Las contribuciones externas no se aceptan — es código abierto para leer, no para construir juntos.

Leyendo la guía de usuario que viene en el repositorio, esto es lo que existe de verdad:

Subagentes. El agente principal llama a spawn_subagent y abre una sesión hija con su propia ventana de contexto, que devuelve un resumen al terminar. Es aislamiento real, no una línea en el prompt.

Modo plan. Una fase de planificación en la que todo es de solo lectura, excepto el archivo plan.md. Y la restricción vale en todos los modos de permiso, incluido always-approve. Eso es diseño de gente que ya se quemó.

Tareas en background. wait_commands_or_subagents con modo wait_any o wait_all sobre hasta veinte tareas. Fan-out y barrera, se llame como se llame.

/goal. Un objetivo autónomo con --budget en tokens, que solo se marca como completo tras una revisión de evidencia independiente. Si esa revisión no reproduce el resultado, el objetivo sigue activo o se pausa señalando las brechas concretas.

/loop. Recurrencia por intervalo, mínimo sesenta segundos, con expiración a los siete días.

Memoria entre sesiones. Existe, es experimental y viene desactivada.

Para quien lee este blog, esto debería sonar familiar. Escribí que un loop sin criterio de parada y sin presupuesto quema dinero, y que la verificación adversarial es un nodo del grafo, no un adjetivo del prompt. /goal es exactamente eso implementado: presupuesto en tokens más un revisor independiente con poder de rechazar la conclusión. xAI no copió mi blog — el problema converge en la misma respuesta para todos los que lo toman en serio.

La convergencia que nadie anuncia en un keynote

Este es el hecho más interesante y el menos difundido.

Grok Build descubre skills en ~/.claude/skills/, ./.claude/skills/ y ~/.cursor/skills/. Sus modos de permiso se llaman acceptEdits y bypassPermissions, y el modo plan está documentado como aceptado “for compatibility” con “Claude-compatible settings”. El aviso de terceros del crate de herramientas declara, como exige la licencia Apache, que apply_patch, grep_files, list_dir y read_file fueron portados de openai/codex, y que bash, edit, glob, grep, read, skill, todowrite y write vinieron de sst/opencode.

Y xAI mantiene un plugin oficial de Claude Code — xai-org/grok-build-plugin-cc — para delegar revisiones y tareas de rescate de Claude Code a Grok.

Léelo de nuevo: la empresa de Musk publica un plugin para el agente de Anthropic. Eso no es debilidad. Es la admisión pública de que la capa de harness se volvió commodity y de que la disputa se mudó al modelo, al precio y a la integración.

La parte que no se puede saltar

Un análisis honesto incluye lo que salió mal. En enero de 2026 la Comisión Europea abrió un procedimiento formal contra X bajo el Digital Services Act por la integración de Grok y la generación de deepfakes sexualizados; Ofcom abrió una investigación bajo el Online Safety Act días antes, y reguladores de varios otros países actuaron en la misma ventana, Brasil incluido.

Esto importa técnicamente, no solo moralmente. La distribución dentro de una red social es la mayor ventaja de Grok y es justamente el vector que convierte un error de modelo en un incidente regulatorio. Un agente con alcance de miles de millones de timelines tiene un radio de explosión distinto al de un agente que corre en la terminal de un desarrollador.

La lectura Arvor

En Arvor la regla es multimodelo: el agente correcto para el trabajo correcto, sin contrato de matrimonio con un proveedor.

Grok tiene una ventaja que no se compra con GPUs: acceso nativo y legítimo al flujo de X en tiempo real, expuesto como herramienta de servidor. Para un nodo de investigación sobre lo que pasa ahora mismo, es difícil de superar.

Para nodos de código en producción, Grok Build todavía es joven — memoria experimental, herramientas portadas de los competidores, un ecosistema de plugins que se mide en semanas. El precio de API es agresivo, y eso cambia la cuenta de los nodos baratos y paralelos.

Lo que no haría es tratarlo como una elección binaria. El grafo define el mapa, el loop define el motor, y el modelo es apenas el obrero dentro de cada nodo — reemplazable por definición. Quien diseña así usa Grok donde gana y no pierde nada cuando llegue el próximo modelo.

Si querés dejar de elegir proveedores y empezar a diseñar arquitectura, mirá nuestra consultoría agéntica.

Un árbol no crece en línea recta. Crece en ramas — y cada rama sabe de dónde vino.