Durante meses, Claude Code tem sido o agente de codificação de terminal para desenvolvedores. Então o Grok Construct chegou em beta em 14 de maio de 2026, dando aos desenvolvedores uma segunda opção séria e levantando uma nova questão: qual deles realmente tem melhor desempenho?
Testei ambos os agentes nas mesmas tarefas de codificação do mundo actual usando prompts idênticos para comparar seus pontos fortes, fracos e fluxo de trabalho geral. Como o Grok Construct ainda está em fase beta inicial, são esperadas melhorias rápidas. Neste artigo, compararemos as duas ferramentas, analisaremos os resultados do benchmark e mostraremos prompts que você pode executar em sua própria base de código.
Ambas as ferramentas ficam em seu terminal e fazem a mesma coisa: você descreve o que deseja em inglês simples e o agente lê sua base de código, planeja as alterações, edita arquivos, executa comandos e itera até que o trabalho seja concluído. Essa semelhança superficial esconde uma diferença arquitetônica bastante acentuada.
Código Claude
Claude Code é o agente de codificação nativo de terminal da Anthropic, construído sobre as variantes dos modelos Opus e Sonnet. Ele usa uma passagem de raciocínio única e profunda. Um agente, com até 1 milhão de tokens de contexto, planeja o planejamento antes que qualquer arquivo seja tocado. Ele mostra seu plano e aguarda sua aprovação. Você permanece no controle sem microgerenciar cada etapa.
Está em produção desde o início de 2025, o que significa que as ferramentas, os recursos da comunidade e os padrões de integração (VS Code, CI, PCM) são maduros.
Grok Construct CLI
Grok Construct é a aposta da xAI no paralelismo em vez da profundidade. Enquanto Claude Code usa um agente com uma janela de contexto de token de 1 milhão para raciocínio profundo, o Grok Construct gira até oito subagentes trabalhando simultaneamente. O principal recurso é o Modo Enviornment: vários agentes correm para resolver a mesma tarefa de forma independente e você escolhe o melhor resultado. É uma filosofia fundamentalmente diferente de como os agentes de IA devem trabalhar no código.
O modelo subjacente, grok-build-0.1, foi desenvolvido especificamente para esta CLI, substituindo o modelo anterior grok-code-fast-1 em 20 de maio de 2026. Ele tem uma janela de contexto de 256K, suporta entrada de texto e imagem e custa US$ 1,00 por milhão de tokens de entrada e US$ 2,00 por milhão de tokens de saída por meio da API xAI. O acesso requer uma assinatura SuperGrok (US$ 299/mês) ou X Premium Plus.
Como o Grok Construct realmente funciona
Cada tarefa passa por três etapas. Primeiro, um agente coordenador lê sua base de código e divide a tarefa em um plano numerado, a mesma porta de aprovação que você vê no Claude Code. Você o revisa e aprova antes que qualquer coisa seja escrita. Segundo, o trabalho é distribuído entre subagentes paralelos. Em uma tarefa grande, como adicionar autenticação a um aplicativo Specific, um agente pode lidar com a camada de rota, outro com a lógica do token e um terceiro com a cobertura de teste, todos executados simultaneamente. Terceiro, os resultados retornam como diferenças revisáveis antes que qualquer coisa seja confirmada, para que você mantenha o controle do que acontece.
Modo Enviornment na prática
O Modo Enviornment é o que torna o Grok Construct genuinamente diferente de qualquer outra coisa no terminal atualmente. Em vez de confiar no resultado de um agente, você obtém soluções concorrentes e seleciona o vencedor. Isso é mais útil quando a tarefa tem múltiplas abordagens válidas, como refatorar um módulo onde tipagem estrita, desempenho ou cobertura de teste podem ser a prioridade. Você escolhe qual implementação se adapta às suas restrições reais, em vez de esperar que o modelo adivinhe corretamente. Desligue-o para edições de rotina. A sobrecarga de avaliar três resultados concorrentes não vale a pena para uma simples correção de bug.
Habilidades groques
Grok Construct também vem com Expertise: pacotes de instruções nomeados e versionados invocados por meio de comandos de barra dentro de qualquer sessão. Você dá um nome, uma descrição e uma especificação comportamental completa a uma habilidade e, a partir de então, aciona todo o fluxo de trabalho com um único comando de barra. As habilidades acompanham seu repositório por meio de pull requests e revisões de código. xAI enviou um conjunto integrado cobrindo fluxos de trabalho de documentos e dados (geração de Phrase, Excel com fórmulas, operações de PDF) em maio de 2026, e você pode escrever outros personalizados para suas próprias tarefas repetidas.
Instalando Grok Construct CLI
A configuração do Claude Code é abordada em nosso Primeiros passos com o código Claude artigo. Esta é a aparência de colocar o Grok Construct em execução:


Configuração de compilação Grok
# One-line set up
curl -fsSL https://x.ai/cli/set up.sh | bash
# Authenticate along with your xAI/X account
grok auth login
grokGrok Construct indexa o diretório do seu projeto na inicialização. A instalação leva menos de um minuto. O controle é a assinatura, não a configuração técnica.
Como realmente testá-los você mesmo
Os benchmarks são um contexto útil, mas a única comparação que importa é o desempenho deles em tarefas reais. Comece com o Immediate 1 abaixo, ele funciona sem um projeto existente, então você pode experimentar as duas ferramentas em menos de cinco minutos. Os prompts 2 a 5 são para testes em sua própria base de código.
Immediate 1: O teste rápido (nenhum projeto existente é necessário)
Este é o único immediate a ser tentado se você nunca usou nenhuma das ferramentas antes. Crie uma pasta vazia, abra-a no seu terminal e execute a mesma instrução em ambos:
Construct a working REST API in Python with two endpoints: GET /well being returns {"standing": "okay"} and POST /echo returns no matter JSON physique you ship it. Use FastAPI. Add a README.

O que procurar: Claude Code mostrará um plano passo a passo e pedirá sua aprovação antes de escrever um único arquivo. Grok Construct gerará vários agentes e, opcionalmente, fornecerá implementações concorrentes no modo Enviornment. Execute ambos e você entenderá a diferença basic entre como as duas ferramentas pensam sobre uma tarefa, imediatamente, sem precisar de uma base de código existente.
Immediate 2: Refatoração (testa a qualidade do raciocínio)
Refactor auth.js to make use of async/await all through.
Add JSDoc feedback to each perform.
Don't change any habits, solely the syntax and documentation.
O que procurar: Claude Code mostrará um plano numerado e pedirá aprovação antes de tocar em qualquer coisa. Grok Construct no modo Enviornment gerará vários agentes, cada um com uma interpretação ligeiramente diferente, e permitirá que você escolha. A abordagem de Claude é mais previsível. A saída da Enviornment de Grok oferece opções, mas exige que você as avalie, o que aumenta o tempo.
Immediate 3: recurso de vários arquivos (testa a manipulação de contexto)
Add price limiting to each API route within the routes/ folder.
Use express-rate-limit.
Add a check for the speed limiting habits in every route's check file.
Este enfatiza a janela de contexto. Suas rotas e arquivos de teste juntos podem representar dezenas de milhares de tokens. A janela de token de 1 milhão do Claude Code lida com isso confortavelmente em grandes bases de código. O limite de 256K do Grok Construct pode se tornar uma restrição actual aqui. Fique atento para Grok perder um arquivo de rota ou truncar a cobertura de teste quando a base de código ficar grande.
Immediate 4: Depuração (testa o diagnóstico de erros)
The consumer login endpoint returns 500 intermittently in manufacturing.
Test the auth move, database connection dealing with, and error boundaries.
Establish the almost certainly trigger and suggest a repair with a check to catch it.
As tarefas de diagnóstico favorecem o raciocínio profundo em vez da amplitude paralela. Claude Code tende a produzir análises de causa raiz mais completas aqui. Os agentes paralelos do Grok Construct podem gerar hipóteses concorrentes, o que às vezes é útil, mas para um único bug bem definido, a saída additional geralmente apenas adiciona ruído para avaliação.
Immediate 5: Novo recurso do zero (testa autonomia)
Add a password reset move.It wants an endpoint to request a reset hyperlink, an endpoint to validate the token and settle for a brand new password, and emails through the prevailing mailer setup. Comply with the patterns already on this codebase.
É aqui que os subagentes paralelos do Grok Construct mais brilham. Criar agentes separados para o endpoint, a lógica do token e a integração de e-mail em paralelo pode ser genuinamente mais rápido do que uma passagem sequencial de agente único. Se você estiver trabalhando com recursos greenfield, é aqui que a arquitetura do Grok Construct compensa mais claramente.
Os números: o que os benchmarks realmente dizem a você
SWE-bench Verified é o principal ponto de referência que as pessoas usam para comparações de agentes de codificação. É aqui que ambas as ferramentas estão em meados de 2026, com base em pontuações relatadas pelo fornecedor e verificadas de forma independente.
| Métrica | Código Claude | Grok Construct CLI |
|---|---|---|
| Banco SWE verificado | 87,6% (Opus 4.7) | 70,8% (grok-code-fast-1, beta) |
| Janela de contexto | 1 milhão de tokens | 256 mil tokens |
| Arquitetura | Agente profundo único | Até 8 subagentes paralelos |
| Modo Enviornment | Não | Sim |
| Suporte MCP | Sim | Sim (beta) |
| Nível gratuito | Sim (uso limitado) | Não |
| Ponto de entrada pago | Plano profissional | SuperGrok $ 299 / mês |
Duas coisas dignas de nota sobre esses números. Primeiro, o valor do banco SWE de 70,8% para Grok Construct foi medido em grok-code-fast-1que foi descontinuado em 15 de maio de 2026. A CLI de produção agora é executada em grok-build-0.1e o xAI ainda não publicou uma pontuação de benchmark atualizada para ele. A lacuna pode ser mais estreita ou mais larga. Em segundo lugar, o Grok Construct é uma versão beta inicial. xAI envia atualizações semanalmente. A lacuna diminuirá com o tempo.
A liderança do SWE-bench de Claude Code é actual, mas os benchmarks medem o desempenho em problemas de codificação padronizados, não em sua base de código específica. É por isso que as instruções do teste prático acima são mais importantes do que esses números para a maioria das equipes.
Quem deve usar qual
Use o Código Claude se:
- Você está trabalhando com uma grande base de código existente. A janela de contexto do token 1M é genuinamente útil quando você precisa analisar dezenas de arquivos ao mesmo tempo.
- Você precisa de estabilidade nas ferramentas de produção. Um ano de uso pela comunidade significa que bugs, casos extremos e padrões de integração de CI estão bem documentados.
- Você não está no SuperGrok. A barreira de custo do Grok Construct é actual. O nível gratuito e os preços do plano Professional do Claude Code são mais acessíveis para desenvolvedores individuais.
- Suas tarefas são problemas de raciocínio complexos e de várias etapas, em que uma única passagem profunda supera várias passagens superficiais.
Use Grok Construct se:
- Você já está no SuperGrok ou X Premium Plus e deseja usar o que está pagando.
- Você faz muitos trabalhos de recursos greenfield, onde agentes paralelos exploram diferentes implementações simultaneamente, economizando tempo actual.
- O Modo Enviornment agrada a você. Fazer com que o agente gere três versões concorrentes da mesma função e escolha a melhor é um fluxo de trabalho genuinamente diferente da abordagem de passagem única de Claude Code.
- Você deseja avaliá-lo agora, antes que sua equipe padronize uma ferramenta. É cedo o suficiente para que se familiarizar com ele enquanto o xAI itera seja uma aposta razoável.
Veredicto
A maioria dos desenvolvedores seniores com quem conversei não escolhe um e abandona o outro. Eles executam um primário (geralmente Claude Code para qualquer coisa crítica à produção) e mantêm o segundo para trabalhos específicos. Essa é provavelmente a abordagem certa agora.
Coisas a observar:
- Grok Construct – teto de contexto: 256K preenche rapidamente em um monorepo de tamanho médio. Exceda-o e o agente trabalhará silenciosamente em um subconjunto de seus arquivos. A janela maior de Claude Code é importante aqui na prática, não apenas no papel.
- Grok Construct – Modo Enviornment tem um custo: Três implementações candidatas significam três coisas a serem avaliadas, e você precisa entender as diferenças bem o suficiente para escolher corretamente. Exagero para tarefas simples; útil para chamadas arquitetônicas genuinamente ambíguas.
- Código Claude – verifique seus preços antes do uso intenso: Seu rascunho cita uma mudança em 15 de junho de 2026 para créditos medidos. Verifique o uso e as taxas atuais antes de se comprometer com cargas de trabalho longas, especialmente no Professional ou em um plano legado.
- Ambos — configure o MCP primeiro: conectores de sistema de arquivos e GitHub no mínimo. Testar qualquer uma das ferramentas sem o MCP significa que você não está avaliando o que ela realmente faz em um fluxo de trabalho actual.
Perguntas frequentes
O acesso requer uma assinatura SuperGrok (US$ 299/mês) ou X Premium Plus. Não há nível gratuito. Claude Code tem um nível de uso gratuito com limites diários.
O Modo Enviornment gera vários agentes, cada um resolvendo a mesma tarefa de forma independente. Você analisa os resultados concorrentes e escolhe o melhor. É mais útil quando você deseja explorar diferentes abordagens de implementação em vez de se comprometer com uma única solução.
Sim. Eles operam de forma independente em seu terminal e leem seus arquivos locais. Muitos desenvolvedores usam uma como ferramenta principal e recorrem à outra para tipos de tarefas específicas.
Sim, o suporte MCP está incluído no Grok Construct beta. A configuração segue um padrão semelhante à configuração do MCP de Claude Code.
Claude Code pontua 87,6% no SWE-bench verificado com Opus 4.7. O número publicado do Grok Construct de 70,8% vem de seu modelo anterior grok-code-fast-1, que foi descontinuado em maio de 2026. Uma pontuação atualizada para o modelo grok-build-0.1 atual ainda não foi publicada.
Faça login para continuar lendo e desfrutar de conteúdo com curadoria de especialistas.