A mais recente análise da empresa de pesquisa de mercado Counterpoint indica que o foco da competição dos grandes modelos de IA da China no mercado global não é necessariamente superar completamente modelos de ponta como o Claude dos EUA, mas sim tornar-se a “segunda escolha padrão” após os desenvolvedores ponderarem entre custo, abertura e flexibilidade. O relatório afirma que o Lado Escuro da Lua Kimi, o Alibaba Qwen, o DeepSeek e o Zhipu GLM já passaram da fase de “substitutos de baixo custo” para “soluções alternativas confiáveis”, capazes de lidar com mais programação, agentes inteligentes e tarefas de longo contexto.
A análise aponta que a variável chave na competição entre modelos da China e dos EUA está a mudar de testes de referência para os caminhos de chamada reais dos desenvolvedores. Quando os modelos de ponta proprietários têm preços elevados, são mais fechados ou têm capacidades que excedem as necessidades específicas da tarefa, os desenvolvedores tendem a optar por modelos alternativos que são mais baratos e mais flexíveis para implementar. A “segunda escolha padrão” referida aqui não é o modelo classificado em segundo lugar globalmente, mas sim a alternativa que os desenvolvedores mais frequentemente consideram prioritariamente em negócios reais.
Modelos chineses começam a entrar na pilha técnica dos desenvolvedores globais
Casos relevantes mostram que essa mudança já se reflete no comportamento de uso real. Até o início de junho de 2026, a quota de tokens do DeepSeek na OpenRouter atingiu 18%; a Lindy.ai viu uma redução de cerca de 90% nos custos de inferência após transferir parte do tráfego de agentes inteligentes do Claude; e a Harvey baseou-se no Kimi K3 do Lado Escuro da Lua para realizar um treinamento posterior, criando seu próprio modelo jurídico. O relatório acredita que esses fenômenos demonstram que os modelos chineses começaram a entrar na pilha técnica dos desenvolvedores globais e a assumir cargas de trabalho reais em alguns cenários.
Ao mesmo tempo, a forma de medir a competição no setor também está a mudar. Com a popularização das aplicações de agentes inteligentes, uma única instrução muitas vezes desencadeia dezenas de chamadas de modelo, e as empresas estão mais preocupadas com o “custo aceitável de conclusão por tarefa”, em vez do preço de um único token ou da classificação de uma única capacidade. Dentro dessa lógica, a cascata de múltiplos modelos e o desvio de tarefas tornar-se-ão mais comuns, e os fornecedores ocidentais poderão manter a entrada dos clientes, mas parte do volume de chamadas poderá fluir para outros fornecedores de modelos.
Segmentos de valor acrescentado mudam para roteamento, hospedagem e camada de aplicação
O relatório aponta ainda que, à medida que as capacidades dos modelos se tornam cada vez mais substituíveis, os segmentos verdadeiramente valorizados irão mais para roteamento, hospedagem, orquestração e camada de aplicação. Os modelos de pesos de código aberto da China estão a pressionar os preços de raciocínio geral, mas a principal restrição à sua expansão internacional pode não ser mais a capacidade em si, mas sim a confiança e fatores geopolíticos.

