Esta semana, a SpaceXAI lançou o Grok 4.7, uma versão desenhada especificamente para potenciar a escrita de código e o trabalho de conhecimento profissional. O modelo utiliza uma base substancialmente maior do que a geração anterior. A empresa submeteu o sistema a um período extenso de aprendizagem por reforço, a focar a atenção em tarefas complexas que podem demorar algumas horas a concluir.
A arquitectura foi desenhada para melhorar a forma como a inteligência artificial verifica o seu próprio raciocínio. O sistema consegue agora gerir contextos longos e resolver problemas de múltiplos passos com enorme facilidade. A integração nativa permite ainda compreender perfeitamente a estrutura de suporte do robô conversacional da marca. A mais recente iteração do modelo está disponível através de várias plataformas, incluindo o agente de programação Grok Build, que facilita o trabalho de desenvolvimento e a gestão de repositórios.
Desempenho reforçado na programação
Os ganhos de desempenho são evidentes nos ensaios oficiais partilhados pela tecnológica. No CursorBench 4.0, a nova versão obteve 46.3%, uma subida clara face aos 40.4% registados anteriormente. O resultado no Terminal-Bench 4.0 quase duplicou para 38%, a estabelecer uma margem confortável contra a marca prévia. O cenário positivo repete-se noutras avaliações técnicas exigentes. O sistema atingiu os 71% no DeepSWE v1.1 com um nível de esforço elevado e alcançou 64% no EEBench.
Apesar destes avanços notáveis, a vitória não é absoluta em todas as frentes. A própria SpaceXAI reconhece que o modelo Fable 5.1 Max continua a liderar em alguns exames específicos. A nova aposta também fica atrás de plataformas concorrentes em determinados testes clínicos e de conhecimento profissional. O verdadeiro calcanhar de Aquiles reside na previsibilidade dos resultados, que variam consoante a metodologia aplicada e as ferramentas utilizadas durante as sessões de programação.
O dilema dos custos e do consumo
O preço base de entrada mantém-se inalterado, o que representa um forte atractivo para os programadores com grandes volumes de trabalho. O acesso custa dois dólares por cada um milhão de tokens de entrada e seis dólares para a mesma quantidade na saída. Existe ainda uma versão mais rápida que exige um investimento de quatro dólares para as entradas e 12 dólares para as saídas. Esta estrutura de custos parece ideal para fluxos de trabalho onde os modelos operam durante longos períodos em vez de responderem a pedidos isolados.
Contudo, a factura final pode esconder surpresas desagradáveis devido ao apetite voraz do sistema. Testes independentes revelaram que, na configuração de raciocínio mais elevada, a ferramenta consumiu cerca de 81000 tokens por tarefa. Este volume expressivo significa que um custo unitário mais baixo não garante automaticamente uma poupança real. As empresas precisam de calcular o valor por trabalho bem-sucedido, a incluir as tentativas falhadas e a latência, para perceberem se a actualização compensa os recursos investidos.
Segurança e disponibilidade no mercado
A protecção contra ameaças informáticas recebeu uma atenção especial nesta actualização de outono. A arquitectura introduz novas salvaguardas desenhadas para resistir a tentativas de manipulação do sistema, a limitar simultaneamente as recusas desnecessárias que frustram os utilizadores. No exigente teste de biossegurança LatchBio, a ferramenta marcou 62.4%. Paralelamente, o sistema bloqueou quase todas as ameaças no HackerBench v0.3, a permitir apenas a passagem de 3.3% das instruções de risco.
Vários parceiros de cibersegurança seleccionados já receberam convites exclusivos para testar as vulnerabilidades da plataforma de forma intensiva. Os profissionais podem tirar partido deste foco em documentos e apresentações complexas, algo que ganha especial relevância numa altura em que o Grok começa a integrar ferramentas de produtividade como o Office. O sucesso desta versão dependerá agora das avaliações independentes e dos resultados práticos em ambiente de produção, que ditarão se as promessas teóricas se traduzem em vantagens competitivas reais.
