Elon Musk anunciou em 28 de junho o Grok 4.5, construído sobre um modelo base de 1,5 trilhão de parâmetros, em beta privado nas empresas do próprio grupo. Avaliações iniciais divulgadas indicavam desempenho próximo ou superior ao de modelos concorrentes de topo.
Testar primeiro dentro de casa, em empresas com operação real, é um método com vantagem clara sobre avaliação em bancada: os problemas aparecem em uso, com dado verdadeiro e consequência de verdade.
A mesma escolha tem um limite que vale registrar. Empresas do mesmo grupo compartilham cultura, infraestrutura e tipo de problema, o que produz um retrato favorável e pouco representativo do que acontece quando o modelo encontra o restante do mundo.
Números de avaliação divulgados por quem lança modelo devem ser lidos com a reserva habitual: a medição é escolhida por quem publica, e a comparação com concorrente raramente usa a mesma configuração.
O dado de contexto é a escala. Modelo base de 1,5 trilhão de parâmetros exige infraestrutura de treinamento que poucas organizações no mundo conseguem montar, o que reforça a concentração que atravessa todo o setor.
