A empresa de inteligência artificial SpaceX AI, de Elon Musk, lançou recentemente o novo modelo de ponta Grok 4.6, que é principalmente direcionado a agentes inteligentes que operam por longos períodos, programação e cenários de trabalho de conhecimento, adotando uma estratégia de preços mais competitiva para reduzir os custos operacionais dessas cargas de trabalho. No índice de inteligência da entidade de avaliação independente Artificial Analysis, o Grok 4.6 obteve uma pontuação de 61, superando o modelo de código aberto Kimi K3 e igualando-se ao GPT-5.6 Sol Max da OpenAI, com um aumento de 5 pontos em relação à versão anterior, Grok 4.5.
Atualmente, os dois primeiros lugares da lista são ocupados pelo Claude Opus 5 e Claude Fable 5 da Anthropic, com o Grok 4.6 e o GPT-5.6 Sol Max empatados em terceiro lugar global.
A capacidade de programação e de agentes inteligentes é o foco da atualização do Grok 4.6. Nos testes de benchmark DeepSWE v1.1, a sua pontuação subiu de 54% para 65.9%; o benchmark de agentes APEX-Agents aumentou de 47.1% para 57.5%, uma melhoria de 10.4 pontos percentuais, ligeiramente acima dos 56.7% do GPT-5.6 Sol Max; a pontuação do Terminal-Bench v3.0 também aumentou de 15.7% para 26%. No entanto, nos dois últimos testes, o Claude Fable 5 Max ainda mantém a liderança, o que indica que, embora o Grok 4.6 tenha feito progressos significativos, ainda não conseguiu dominar completamente os concorrentes.
Grok 4.6 demonstra competitividade em preços e desempenho
No que diz respeito aos preços, o preço inicial da API do Grok 4.6 é de US$2 por milhão de tokens de entrada (cerca de HK$16) e US$6 por milhão de tokens de saída (cerca de HK$47), situando-se na faixa média dos modelos de ponta, a menos de metade do preço do modo padrão do GPT-5.6 Sol. Este modelo suporta uma janela de contexto de 500 mil tokens, cobrando os preços mencionados quando o número de tokens de prompt é inferior a 200 mil; após atingir 200 mil tokens, a taxa será ajustada. De acordo com a SpaceX AI, o Grok 4.6 já está disponível no Grok Build a partir de hoje e também foi lançado na empresa de programação de IA Cursor, que foi adquirida, com parceiros como OpenRouter,
Vercel e Cloudflare, entre outros.
No nível de treinamento, a SpaceX AI afirmou que, em comparação com o Grok 4.5, o Grok 4.6 passou por um treinamento mais prolongado e reforçou o aprendizado por reforço em ambientes de agentes inteligentes, como programação geral, trabalho de conhecimento, otimização de núcleo, desenvolvimento web e design assistido por computador. Nos testes, o Grok 4.6 demonstrou uma capacidade mais forte de auto-teste e verificação em tarefas de sequência longa. Em termos de eficiência de custos, os dados da Artificial Analysis mostram que o Grok 4.6 conclui a carga de trabalho AA-Briefcase em média com apenas cerca de 53 interações e 500 milhões de tokens de entrada, enquanto o Claude Opus 5 Max requer cerca de 103 interações e 20
mil milhões de tokens, evidenciando uma vantagem de eficiência bastante clara.

