← Todas as notícias

Grok e agentes: onde a SpaceXAI está de verdade no mapa de 2026

Existem três coisas chamadas Grok, e elas ocupam pontos opostos do mapa de agentes. O bot do X tem alcance e nenhuma autonomia. O Grok Build tem subagentes, plano e verificação adversarial — e roda num terminal. Uma leitura honesta, com fontes.

Leonardo Dias grokagentesdev

Toda semana alguém me pergunta se “o Grok já virou agente”. A pergunta não tem resposta única, porque existem três coisas diferentes chamadas Grok — e elas ocupam pontos praticamente opostos do mapa de agentes.

Vale começar pelo detalhe que confunde até quem acompanha de perto: a xAI não existe mais como empresa independente. Foi absorvida pela SpaceX e rebatizada SpaceXAI. Não é boato de timeline: a documentação oficial e o README do CLI já assinam assim. O produto continua se chamando Grok.

Três Groks, três níveis de autonomia

O bot @grok no X. O system prompt dele é público, no repositório xai-org/grok-prompts. Vale ler o arquivo inteiro. O bot tem busca em tempo real, ferramentas de X para pegar o contexto da thread, e uma instrução explícita de abrir as páginas para conferir cada informação — “you must use the browse page to verify all points of information”. Tem também um teto: a resposta final precisa ficar abaixo de 550 caracteres, sem markdown, sem marcar quem perguntou.

Isso é uso de ferramenta com verificação, e é competente. Mas não é agente. Não há objetivo que sobreviva à resposta, não há estado entre execuções, não há efeito no mundo além de um post. É um pesquisador de um turno só com limite de caracteres.

Detalhe honesto: aquele repositório não recebe commit desde novembro de 2025, e o prompt publicado ainda se descreve como “a version of Grok 4 built by xAI”. A transparência é real, mas está atrasada.

A Agent Tools API. É a camada de servidor. A documentação lista cinco ferramentas nativas que rodam na infra da xAI: Web Search, X Search, Code Interpreter (Python em sandbox), Image Generation e Collections Search sobre documentos que você subiu — mais conexão com servidores MCP remotos. A distinção que eles fazem é a certa: ferramenta nativa executa no servidor deles; function calling executa no seu.

Grok Build. O CLI. É o pedaço mais sério, e o menos comentado.

Mapa de dois eixos. No eixo vertical, distribuição; no horizontal, profundidade agêntica. O bot do X aparece no alto à esquerda: muito alcance, pouca autonomia. A Agent Tools API fica no meio. Grok Build aparece embaixo à direita, no mesmo agrupamento de Claude Code e Codex: muita autonomia, pouco alcance. DISTRIBUIÇÃO ↑ PROFUNDIDADE AGÊNTICA → bilhões 1 dev raso autônomo @grok no X busca, cita, para em 550 caracteres Agent Tools API sandbox Python, X Search, MCP assistentes pessoais OpenClaw e afins Grok Build · Claude Code · Codex subagentes, plano, /goal, ACP ✓ o que tem alcance não tem profundidade — e vice-versa

O ativo único do Grok é a distribuição dentro do X. A profundidade agêntica dele mora num terminal, longe desse alcance.

O que o Grok Build tem de agente de verdade

O código está aberto: xai-org/grok-build, Apache 2.0, escrito em Rust, publicado em julho de 2026. Passou de 24 mil estrelas. Contribuições externas não são aceitas — é código aberto para ler, não para construir junto.

Lendo o guia do usuário que vem no repositório, o que existe de verdade:

Subagentes. O agente principal chama spawn_subagent e abre uma sessão-filha com janela de contexto própria, que devolve um resumo ao terminar. É isolamento real, não instrução de prompt.

Plan mode. Fase de planejamento em que tudo é somente leitura, exceto o arquivo plan.md. E a restrição vale em todos os modos de permissão, inclusive no always-approve. Isso é design de gente que já se queimou.

Tarefas em background. wait_commands_or_subagents com modo wait_any ou wait_all sobre até vinte tarefas. Fan-out e barreira, com esses nomes ou não.

/goal. Objetivo autônomo com --budget em tokens, que só é marcado como concluído depois de uma revisão de evidência independente. Se a revisão não reproduz o resultado, o goal continua ativo ou pausa apontando as lacunas.

/loop. Recorrência com intervalo, mínimo de 60 segundos, expirando em sete dias.

Memória entre sessões. Existe, é experimental e vem desligada.

Para quem lê este blog, isso deve soar familiar. Escrevi que loop sem critério de parada e sem orçamento queima dinheiro, e que verificação adversarial é um nó do grafo, não um adjetivo no prompt. O /goal é exatamente isso implementado: orçamento em tokens mais um revisor independente com poder de recusar a conclusão. Não é a xAI copiando meu blog — é o problema convergindo para a mesma solução em todo mundo que leva a sério.

A convergência que ninguém anuncia em keynote

Este é o fato mais interessante e o menos divulgado.

Grok Build descobre skills em ~/.claude/skills/, ./.claude/skills/ e ~/.cursor/skills/. Os modos de permissão se chamam acceptEdits e bypassPermissions, e o modo plan está documentado como aceito “for compatibility” com “Claude-compatible settings”. O arquivo de terceiros do crate de ferramentas declara, como a licença Apache exige, que apply_patch, grep_files, list_dir e read_file foram portados do openai/codex, e que bash, edit, glob, grep, read, skill, todowrite e write vieram do sst/opencode.

E a xAI mantém um plugin oficial do Claude Code — xai-org/grok-build-plugin-cc — para delegar review e tarefas de resgate do Claude Code para o Grok.

Leia de novo: a empresa do Musk publica um plugin para o agente da Anthropic. Isso não é fraqueza. É a admissão pública de que a camada de harness virou commodity, e que a disputa migrou para o modelo, para o preço e para a integração.

A parte que não dá para ignorar

Análise honesta inclui o que deu errado. Em janeiro de 2026, a Comissão Europeia abriu procedimento formal contra o X sob o Digital Services Act por causa da integração do Grok e da geração de deepfakes sexualizados; o Ofcom abriu investigação sob o Online Safety Act dias antes, e reguladores de vários outros países agiram na mesma janela, inclusive no Brasil.

Isso importa tecnicamente, não só moralmente. Distribuição dentro de uma rede social é a maior vantagem do Grok e é exatamente o vetor que transforma erro de modelo em incidente regulatório. Agente com alcance de bilhões de timelines tem raio de explosão diferente de agente que roda no terminal de um desenvolvedor.

A leitura Arvor

Na Arvor a regra é multi-modelo: o agente certo para o trabalho certo, sem contrato de casamento com fornecedor.

O Grok tem uma vantagem que ninguém compra com GPU: acesso nativo e legítimo ao fluxo do X em tempo real, como ferramenta de servidor. Para um nó de pesquisa sobre o que está acontecendo agora, é difícil de bater.

Para nós de código em produção, o Grok Build ainda é jovem — memória experimental, ferramentas portadas dos concorrentes, ecossistema de plugins de semanas de idade. O preço de API é agressivo, e isso muda a conta de nós baratos e paralelos, onde volume pesa mais que o último ponto de benchmark.

O que eu não faria é a escolha binária. Grafo define o mapa, loop define o motor, e o modelo é só o operário de cada nó — trocável por definição. Quem desenha assim usa o Grok onde ele ganha e não perde nada quando chegar o próximo modelo.

Se você quer parar de escolher fornecedor e começar a desenhar arquitetura, conheça nossa consultoria agêntica.

Árvore não cresce em linha reta. Cresce em galho — e cada galho sabe de onde veio.