
ByteDance treina modelo de IA com até 10 trilhões de parâmetros
Dona do TikTok está em pré-treinamento de um modelo de linguagem que pode chegar a 10 trilhões de parâmetros, mais que o triplo do Kimi K3 e próximo das estimativas para o Mythos 5, da Anthropic, segundo o Financial Times.
Por Redação tech & talk · Curadoria assistida por IA, revisão humana
ByteDance mira modelo gigante para disputar liderança em IA
A ByteDance, controladora do TikTok, está treinando um modelo de linguagem que pode chegar a 10 trilhões de parâmetros, segundo reportagem do Financial Times replicada por veículos internacionais nesta semana. O projeto ainda está em estágio de pré-treinamento, fase que costuma durar de três a seis meses antes de avançar para ajuste fino e, eventualmente, lançamento público.
Se confirmado no tamanho projetado, o modelo seria mais de três vezes maior que o Kimi K3, da chinesa Moonshot AI, treinado com 2,8 trilhões de parâmetros e considerado até então o maior modelo já lançado no país. O número final de parâmetros, no entanto, ainda não está definido e pode mudar até a conclusão do treinamento.
Comparação com a Anthropic
A movimentação da ByteDance é lida pelo mercado como uma tentativa de aproximar a empresa da fronteira tecnológica ocupada por companhias como a Anthropic. Estimativas de mercado citadas nas reportagens apontam que o Mythos 5, modelo mais avançado da Anthropic, teria cerca de 8 trilhões de parâmetros, enquanto o Fable 5 giraria em torno de 5 trilhões. Nem Anthropic nem OpenAI, porém, divulgam oficialmente o número de parâmetros de seus modelos mais recentes, o que torna qualquer comparação direta imprecisa.
Apesar da escala anunciada, especialistas ouvidos pela imprensa internacional ressaltam que um número maior de parâmetros não garante, por si só, desempenho superior. Fatores como qualidade dos dados de treinamento, arquitetura do modelo e técnicas de otimização continuam sendo determinantes para a capacidade final do sistema.
Corrida chinesa por modelos maiores
A iniciativa da ByteDance ocorre em meio à aceleração do ciclo de lançamentos de modelos por empresas chinesas de tecnologia, que buscam acompanhar o ritmo de rivais americanas em uma corrida cada vez mais cara pela construção de modelos maiores e mais capazes. Diferentemente de concorrentes locais, a companhia tem mantido a maior parte de seus modelos fechada, sem divulgação pública ampla, mesmo enquanto avança silenciosamente em pesquisa de ponta.
As reportagens não identificam um nome oficial para o novo modelo de 10 trilhões de parâmetros — a ByteDance mantém as famílias Doubao e Seed como suas principais linhas de produtos de IA, mas não há confirmação de qual delas receberá o novo sistema em treinamento. A empresa não comentou publicamente os detalhes revelados pelo Financial Times.