NOTÍCIA

NVIDIA ainda treina a IA chinesa: o custo real de abandonar o CUDA

NVIDIA segue como base do treino dos maiores modelos chineses. Entenda o custo de migrar de CUDA para CANN e o que isso ensina sobre acoplamento.

NVIDIA ainda treina a IA chinesa: o custo real de abandonar o CUDA
Imagem: Redação iMasters

NVIDIA continua sustentando o treinamento dos modelos de linguagem mais avançados da China. A apuração é do South China Morning Post, publicada em 10 de agosto de 2026, com fontes ligadas a desenvolvedores de LLMs. Pequim pressiona pela adoção de semicondutores nacionais há anos. Ainda assim, os fluxos de treino seguem rodando em hardware estrangeiro. Portanto, o caso diz respeito a quem escreve código, tanto quanto a quem assina a ordem de compra.

NVIDIA: O gargalo mora na camada de software

O ponto crítico aparece no CUDA. Afinal, a plataforma virou padrão de fato para aplicações de IA. Bibliotecas, kernels otimizados, profilers, drivers e toda a cultura de debugging foram construídos em cima dela. Assim, o acoplamento se acumulou em camadas, ano após ano.

A Huawei oferece a CANN como caminho alternativo para os chips Ascend. Contudo, a troca exige reescrever e otimizar volumes altos de código. Um pesquisador baseado em Xangai resumiu o problema de forma direta ao jornal. Segundo ele, o código escrito para CUDA não roda no Ascend sem reescrita extensa.

Trocar de fornecedor, nesse cenário, significa refazer parte da engenharia. Ou seja, a decisão sai do orçamento de hardware e cai no backlog do time.

Reescrever sai mais caro do que comprar a placa

O mesmo pesquisador estimou o impacto em números. Na avaliação dele, migrar os sistemas atuais para o Ascend elevaria tempo e custo de trabalho da equipe em pelo menos 50%. Esse percentual não cobre apenas a portabilidade inicial. Além disso, existe o retrabalho de tuning, validação numérica e ajuste de performance.

Na prática, o time paga duas vezes. Primeiro, para fazer o código rodar. Depois, para fazer o código rodar rápido.

Código aberto reduz o tamanho da conta

O esforço varia conforme o modelo. Para sistemas abertos, como o DeepSeek e seus derivados, a estimativa de um engenheiro envolvido na migração ficou em dois ou três profissionais por cerca de um mês adicional. A razão é simples. Com acesso total ao código, a equipe consegue mapear dependências e substituir chamadas com previsibilidade.

Inclusive, o ecossistema em volta ajuda. Modelos populares acumulam issues, forks e relatos de quem já tentou o mesmo caminho.

Código fechado multiplica o prazo

O quadro muda quando o código não está disponível. No caso do Kimi K3, da Moonshot AI, a estimativa citada foi de cerca de dez engenheiros por mais de seis meses de trabalho extra. A diferença aparece no nível de acesso e na maturidade das ferramentas ao redor de cada arquitetura.

Logo, a licença do modelo funciona como variável de infraestrutura. Quem escolhe um modelo fechado também escolhe, em silêncio, uma dependência de plataforma.

LongCat 2.0 mostra que a virada é possível

A situação já registra exceções relevantes. Em junho, a Meituan lançou o LongCat 2.0, com 1,6 trilhão de parâmetros. A empresa afirma que o treinamento inteiro ocorreu em um cluster doméstico com 50 mil placas. O fornecedor dos componentes não foi divulgado.

Portanto, a barreira técnica cede quando existe volume de engenharia disponível. Empresas com times grandes conseguem absorver a reescrita. Startups enxutas dificilmente conseguem.

NVIDIA: O que isso ensina sobre o seu stack

A lição escapa da geopolítica e chega no cotidiano de qualquer time de dados. NVIDIA aparece aqui como exemplo de um padrão maior. Toda escolha de plataforma cria um custo de saída, e esse custo raramente aparece no diagrama de arquitetura.

Vale medir esse custo antes de precisar dele. Enquanto o projeto é pequeno, a troca custa dias. Depois de dezoito meses de kernels custom, a troca custa trimestres.

Alguns hábitos reduzem a exposição:

  • Isole o código específico de fornecedor em módulos próprios, longe da lógica de treino.
  • Prefira abstrações de alto nível sempre que a perda de performance for aceitável.
  • Documente cada kernel escrito à mão, com o motivo da otimização registrado.
  • Rode um teste de portabilidade periódico, mesmo que apenas em escala reduzida.
  • Trate a licença do modelo como decisão de infraestrutura, e não apenas como questão jurídica.
  • Mantenha um número estimado de horas para migração no seu registro de riscos.

O ponto que fica: NVIDIA

O hardware chinês avançou de forma consistente nos últimos anos. Mesmo assim, a NVIDIA segue no centro do treinamento por causa do software construído em volta dela. Ecossistemas se acumulam devagar e se substituem ainda mais devagar.

Para quem desenvolve, o recado cabe em uma frase. Escolher uma plataforma é escolher o preço de sair dela depois.

Acompanhe nosso perfil no Instagram!

Matérias especiais e reportagens conduzidas internamente pela Redação iMasters. Acompanhe no Twitter @imasters e no Instagram/Threads @portalimasters

Ver perfil