Grok 4.6: o que se sabe sobre o próximo modelo de 2 trilhões da SpaceXAI
Em 18 de julho de 2026, Elon Musk anunciou pelo X que a xAI (agora SpaceXAI) está terminando o treinamento do Grok 4.6, um modelo de 2 trilhões de parâmetros, com meta explícita de superar o Kimi K3 e manter a mesma velocidade e economia de tokens do Grok 4.5. O anúncio veio dois dias depois da Moonshot ter lançado o Kimi K3 e ter roubado a manchete global. Este artigo cobre o que já é fato, o que ainda é promessa, e como o 4.6 se posiciona no mercado antes mesmo de existir publicamente.
O que é confirmado — e o que ainda é promessa
Do anúncio de Musk, os únicos fatos consolidados até 20 de julho são três:
- Escala: 2 trilhões de parâmetros, subindo dos 1,5 trilhão do modelo base V9 que sustenta o Grok 4.5.
- Meta de capacidade: "possivelmente" superar o Kimi K3 (2,8T) em performance, com mesma economia do 4.5 em velocidade e custo por token.
- Cronograma: pré-treinamento inicial terminando entre 20 e 27 de julho.
Tudo o resto — janela de contexto, preços da API, benchmarks, data de disponibilidade pública, features específicas — ainda não foi divulgado. Terminar o pré-treinamento é uma etapa. Depois vêm avaliação, alinhamento, RLHF, red-teaming e deploy — processo que a xAI tipicamente leva de 4 a 6 semanas.
Contexto: o ritmo insano da xAI em 2026
Para entender o Grok 4.6, é preciso ver o ritmo:
| Modelo | Parâmetros | Data |
|---|---|---|
| Grok 4.2 | 500 bilhões | Início de 2026 |
| Grok 4.4 | 1 trilhão | Maio 2026 |
| Grok 4.5 | 1,5 trilhão | 8 de julho 2026 |
| Grok 4.6 | 2 trilhões | Treino terminando em 20-27/07 |
| Grok 5 (planejado) | 6 a 10 trilhões | Sem data pública |
Em menos de 6 meses, a escala do modelo da fronteira quadruplicou. Isso é possível pelo Colossus, o supercluster de 200 mil GPUs NVIDIA em Memphis, Tennessee, com meta declarada de chegar a 1 milhão de GPUs.
O objetivo declarado: superar o Kimi K3
Musk foi direto ao ponto: quer o Grok 4.6 "melhor em tudo" que o 4.5 e capaz de superar o Kimi K3. A analista Artificial Analysis publicou os números atuais:
- Kimi K3: 57 no índice de inteligência, ~US$ 0,94 por tarefa média.
- Grok 4.5: 54 no índice, US$ 0,31 por tarefa.
O Grok 4.5 é mais barato mas menos inteligente. A aposta do Grok 4.6 é fechar o gap de inteligência sem perder a vantagem de custo. Se conseguir, a matemática do valor por dólar fica interessante para desenvolvedores.
O Grok 4.6 vs o Claude Fable 5
Um alerta útil para quem escolhe IA no Brasil: apesar do marketing agressivo de Musk, os benchmarks do Grok 4.5 posicionam-no atrás do Claude Fable 5, do Opus 4.8 e do GPT-5.6 Sol em avaliações agregadas. Elon Musk mesmo admitiu publicamente, em maio de 2026, que "um modelo da Anthropic é definitivamente melhor". A ambição do 4.6 é reduzir esse gap — mas ele parte de uma posição de desvantagem no ranking multi-domínio.
Para escolha profissional hoje, o Claude Fable 5 segue sendo referência em tarefas de código complexo, escrita profissional e trabalho conversacional profundo. Se o Grok 4.6 chegar, a comparação recomeça — e vamos publicar o comparativo detalhado.
O contexto do "por que agora"
O anúncio do 4.6 foi dois dias depois do Kimi K3. Isso não é coincidência. A Moonshot cutucou publicamente Musk no Weibo com um "Bem-vindo ao clube dos 2 trilhões+" logo que o modelo chinês foi anunciado. Musk respondeu no X anunciando o 4.6.
Do lado do negócio, há pressão real. O SpaceX vai a IPO ainda em 2026 com avaliação estimada em US$ 1,25 trilhão. A SpaceXAI (o antigo xAI, que foi absorvido pela SpaceX em maio) precisa mostrar que a divisão de IA justifica parte dessa avaliação. Um Grok que fica atrás do Kimi K3 e do Claude é o contrário do que investidores querem ver na janela do IPO.
O contexto do "por que preocupa"
Vamos ser honestos sobre um ponto: existe distância entre "terminar treino" e "modelo público confiável". A xAI vem enfrentando problemas de execução que documentamos no artigo sobre a crise de identidade da SpaceXAI — meta interna de "igualar o Claude", canais internos no Slack literalmente batizados com o nome do concorrente, uso do Claude pelos próprios engenheiros da xAI para trabalho técnico. O Grok Build, quando lançou em maio, tinha o problema grave de vazamento de repositórios que só foi corrigido em julho.
O Grok 4.6, se lançar em agosto/setembro, chegará em ambiente onde a base de usuários corporativos está cética. Um quarto das empresas europeias baniu o Grok, segundo dados da indústria. Isso importa: por mais impressionante que seja o benchmark, a adoção real depende de confiança.
Impacto para quem usa Claude no Brasil
No curtíssimo prazo, o Grok 4.6 não muda absolutamente nada para o usuário do Claude. Não há Grok 4.6 público, não há preço, não há como testar. Para agosto/setembro, três cenários:
- Se o 4.6 igualar Kimi K3 e manter o custo baixo, ele vira competidor sério para o Fable 5 na faixa de preço/desempenho.
- Se atrasar ou decepcionar, reforça a percepção de que a SpaceXAI está mais em produção de marketing do que de modelos.
- Se ficar entre Kimi K3 e Fable 5 (cenário mais provável), continua sendo opção interessante para quem valoriza preço mais que qualidade máxima, mas não vira o padrão.
Como se preparar
Para quem já usa Claude profissionalmente, a orientação prática é a de sempre: não trocar de modelo por marketing. Testar quando lançar. Comparar em tarefas reais, não em benchmarks. Nossa página sobre qual modelo Claude escolher segue com metodologia útil para avaliar qualquer modelo novo que surja. Enquanto isso, o Fable 5, Sonnet 5 e Haiku 4.5 seguem sendo as escolhas mais defensáveis para trabalho profissional.
O contexto financeiro por trás do 4.6
A SpaceXAI opera em uma economia de queima altíssima. A xAI queimou US$ 7,8 bilhões nos primeiros três trimestres de 2025, o que projeta uma queima anual de US$ 10,4 bilhões. O SpaceX absorveu a divisão em maio de 2026 e agora carrega esse peso. O IPO da SpaceX, previsto para ainda este ano com avaliação de US$ 1,25 trilhão, coloca a divisão de IA sob escrutínio: quanto do valuation total vem da IA?
O Grok 4.6 chega, portanto, com pressão dupla: precisa ser tecnicamente competitivo e precisa contribuir com narrativa positiva para o IPO. Isso ajuda a explicar a agressividade dos anúncios de Musk sobre "poder superar o Kimi" — é sinalização para o mercado, não só para desenvolvedores.
Colossus 1, Colossus 2 e o paradoxo do data center
O treinamento do Grok 4.6 acontece no Colossus 2, o novo supercluster da SpaceXAI. O detalhe irônico: o Colossus 1, o data center original em Memphis, foi totalmente alugado para a Anthropic desde maio de 2026. A Anthropic passou a ter uso exclusivo dos 300+ megawatts do Colossus 1 para rodar seus próprios modelos — incluindo o Claude Fable 5, que a SpaceXAI definiu como benchmark a bater.
É uma configuração que só faz sentido em uma economia de aluguel de infraestrutura em escala: a SpaceXAI treina no Colossus 2, ganha dinheiro alugando o Colossus 1 para a Anthropic, e a Anthropic usa o data center do concorrente para rodar o modelo que o Grok 4.6 quer superar. Todo mundo ganha algo. Ninguém está exatamente competindo do jeito clássico.
O que esperar em benchmarks — quando eles saírem
Baseado no salto Grok 4.4 (1T) → Grok 4.5 (1,5T), que gerou ganho moderado no Artificial Analysis (de ~50 para 54), a expectativa razoável para Grok 4.5 (1,5T) → Grok 4.6 (2T) é um salto de mais 3-5 pontos no índice de inteligência. Isso o colocaria em torno de 57-59 — competitivo com Kimi K3 (57) e ainda abaixo do Fable 5 (que atualmente lidera o Artificial Analysis com folga).
Vale lembrar: parâmetros brutos não são o único fator. Qualidade dos dados, algoritmos, alinhamento e pós-treinamento importam tanto. O Kimi K3, apesar de ter mais parâmetros, gasta muitos mais tokens em raciocínio, o que penaliza custo por tarefa. Se o Grok 4.6 conseguir manter a eficiência do 4.5, pode ser mais competitivo em custo/desempenho que em benchmark bruto.
Cronograma provável e o que observar
Baseado no ritmo histórico da xAI, o cronograma plausível é:
- Semana de 20-27/07/2026: conclusão do pré-treinamento.
- Últimos dias de julho e primeira metade de agosto: avaliação interna, alinhamento (RLHF), red-teaming.
- Segunda metade de agosto: beta interno em SpaceX e Tesla (padrão que a xAI seguiu no 4.5).
- Fim de agosto ou primeira metade de setembro: lançamento público, provavelmente primeiro no SuperGrok/Grok Premium e no X.
- Setembro-outubro: disponibilidade via API e integração no Grok Build.
O que observar quando lançar: benchmarks independentes do Artificial Analysis, testes de comunidade em coding real (não sintético), custo por tarefa comparado ao Kimi K3, e — o mais importante para uso profissional — se problemas de segurança como o do Grok Build serão evitados na integração corporativa.
Resumo em uma linha
Escolha o produto certo para o seu momento
Materiais práticos para quem quer usar o Claude de verdade.
Aponte a câmera do app do seu banco
Artigos relacionados: