Elon Musk definiu o início de agosto como meta para o Grok 4.6 e revelou planos para um modelo maior, o Grok 4.7, enquanto a SpaceXAI intensifica sua competição com OpenAI, Anthropic e a chinesa Moonshot AI.
Resumo
- Grok 4.6 está programado para por volta de 7 de agosto, de acordo com Musk.
- O próximo modelo terá 1,5 trilhão de parâmetros e pós-treinamento aprimorado.
- Grok 4.7 pode chegar algumas semanas depois com 2,1 trilhões de parâmetros.
- Grok 4.5 ficou em primeiro lugar em custo-benefício para segurança cibernética em uma avaliação da Vercel.
Grok 4.6 tem como alvo o lançamento em 7 de agosto
Musk divulgou o cronograma em uma postagem no X em 28 de julho, dizendo que o Grok 4.6 seria lançado "por volta de 7 de agosto". Ele o descreveu como um modelo de 1,5 trilhão de parâmetros com ajuste fino supervisionado e aprendizado por reforço mais fortes.
O ajuste fino supervisionado treina um modelo em exemplos selecionados para melhorar a qualidade de suas respostas. O aprendizado por reforço usa feedback e sinais de recompensa para refinar como um modelo lida com tarefas e segue instruções.
Musk também disse que o Grok 4.7 viria "algumas semanas depois" como um modelo de 2,1 trilhões de parâmetros. No entanto, ele não forneceu uma data exata de lançamento nem divulgou detalhes de preço e disponibilidade para nenhum dos lançamentos.
"Este será melhor que o 4.6 em todos os aspectos, exceto por ser um pouco mais lento para servir, embora com eficiência de token ainda melhor", disse Musk sobre o Grok 4.7.
Ambas as datas permanecem como metas, não compromissos de lançamento confirmados. Os cronogramas de desenvolvimento de modelos podem mudar durante treinamento, testes e implantação.
Grok 4.5 estabelece a linha de base para as atualizações
A SpaceXAI apresentou o Grok 4.5 no início de julho como um modelo projetado para codificação, tarefas baseadas em agentes e trabalho de conhecimento. A empresa atualmente cobra US$ 2 por milhão de tokens de entrada e US$ 6 por milhão de tokens de saída.
Musk anunciou os próximos dois modelos em resposta a uma avaliação do CEO da Vercel, Guillermo Rauch, que descreveu o Grok 4.5 como o modelo de segurança cibernética com melhor desempenho em relação ao seu preço nos testes mais recentes da Vercel.
De acordo com a postagem de Rauch, o Grok 4.5 era 10 vezes mais barato que o GPT-5.6 Sol da OpenAI, 5,7 vezes mais barato que o Opus 5 da Anthropic e 2,2 vezes mais barato que o Kimi K3 da Moonshot, ao mesmo tempo em que entregava desempenho próximo ao do Kimi.
Rauch ainda classificou o Sol como o principal modelo de fronteira, à frente do Opus 5. Suas descobertas refletem os métodos de teste da Vercel e não estabelecem uma classificação universal em todas as cargas de trabalho de IA.
A SpaceXAI não disse se o Grok 4.6 e o Grok 4.7 manterão o preço do Grok 4.5. A velocidade do serviço, o uso de tokens e os custos de API determinarão se os modelos mais novos manterão a mesma vantagem de custo-benefício.
Empresas de IA dos EUA enfrentam pressão do Kimi K3 da China
As atualizações planejadas do Grok chegam enquanto desenvolvedores chineses reduzem a diferença para as principais empresas de IA dos EUA. A Moonshot AI lançou os pesos completos do Kimi K3 em 27 de julho, permitindo que desenvolvedores baixem, modifiquem e operem o modelo em sua própria infraestrutura.
O Kimi K3 tem 2,8 trilhões de parâmetros, capacidades visuais nativas e uma janela de contexto de um milhão de tokens. Sua escala e estrutura de pesos abertos aumentaram a pressão sobre empresas dos EUA que distribuem principalmente seus modelos mais avançados por meio de plataformas fechadas e APIs pagas.
SpaceXAI, OpenAI e Anthropic também estão competindo em codificação, segurança cibernética, raciocínio e no custo necessário para concluir cada tarefa. A arquitetura maior do Grok 4.7 pode melhorar suas capacidades, mas Musk reconheceu que ele seria mais lento para servir do que o Grok 4.6.
A contagem de parâmetros por si só não determina a qualidade do modelo. Dados de treinamento, arquitetura, métodos de pós-treinamento, sistemas de inferência e eficiência de tokens podem afetar o desempenho.
Empresas de IA dos EUA divididas sobre supervisão federal
OpenAI e Anthropic já concordaram em fornecer aos funcionários dos EUA acesso antecipado a modelos de fronteira não lançados para testes de segurança. Esses acordos formaram a base para um quadro mais amplo de revisão federal voluntária que agora cobre outros grandes desenvolvedores, incluindo SpaceXAI, Google DeepMind e Microsoft.
O presidente Donald Trump formalizou o quadro por meio de uma ordem executiva de junho. As empresas participantes podem fornecer modelos cobertos ao governo federal por até 30 dias antes de liberá-los para parceiros confiáveis. A ordem afirma que as revisões não criam um sistema obrigatório de licenciamento ou pré-aprovação.
No entanto, a indústria permanece dividida sobre como Washington deve lidar com modelos de peso aberto. Nvidia, Microsoft, Meta, OpenAI, Palantir e outras organizações alertaram os formuladores de políticas dos EUA contra restrições amplas em uma carta aberta de 24 de julho. Eles argumentaram que modelos abertos apoiam a concorrência, reduzem os custos de implantação e permitem que os desenvolvedores executem e modifiquem sistemas de IA em sua própria infraestrutura.
O debate se intensificou após o lançamento do Kimi K3 de 2,8 trilhões de parâmetros pela Moonshot AI. Funcionários da administração Trump acusaram a Moonshot de usar saídas do modelo Fable da Anthropic para treinar o Kimi K3 por meio de destilação em larga escala. O conselheiro de tecnologia da Casa Branca, Michael Kratsios, descreveu a suposta prática como uma tentativa de obter tecnologia proprietária dos EUA, enquanto o secretário do Tesouro, Scott Bessent, disse que a administração estava considerando sanções e colocar a Moonshot em uma lista negra comercial.
A Moonshot não aceitou publicamente essas alegações. A disputa, no entanto, colocou o Kimi K3 no centro de uma disputa política mais ampla sobre se Washington deve atingir riscos específicos de segurança e propriedade intelectual ou restringir mais amplamente o acesso a modelos chineses de peso aberto. Grok 4.6 e Grok 4.7 entrarão nesse mercado enquanto os desenvolvedores dos EUA enfrentam pressão para melhorar o desempenho e atender às novas expectativas federais de segurança.






