- O modelo mais barato entre os gigantes da IA
- Preço por token não conta toda a história
- Desempenho continua atrás dos líderes
- Um modelo pensado para operar em grande escala
- DeepSeek aposta em infraestrutura própria
- O V4-Pro já está no horizonte
- A guerra dos modelos chineses acelera
- A próxima disputa será pelo menor custo
Principais destaques
- O DeepSeek V4-Flash foi classificado como o modelo de IA mais barato entre os principais concorrentes globais.
- Embora não lidere os rankings de desempenho, seu custo extremamente reduzido pode acelerar a adoção da IA por empresas de todos os portes.
- O lançamento intensifica a disputa entre gigantes como OpenAI, Google, Anthropic, Alibaba, Meta e Moonshot AI, que agora competem não apenas por qualidade, mas também por eficiência econômica.
A corrida pela inteligência artificial acaba de entrar em uma nova fase. Depois de meses em que a disputa girava principalmente em torno de quem entregava o modelo mais inteligente, as empresas agora travam uma verdadeira batalha pelos menores custos de operação. Nesse cenário, a chinesa DeepSeek acaba de assumir o protagonismo.
A empresa lançou oficialmente o DeepSeek V4-Flash, modelo que, segundo levantamento da consultoria especializada Artificial Analysis, apresenta atualmente o menor custo operacional entre os grandes modelos comerciais disponíveis no mercado.
A novidade representa mais um passo da estratégia da companhia de transformar modelos de linguagem avançados em uma tecnologia acessível para aplicações de grande escala.
A mudança acontece em um momento decisivo para o setor. A demanda por inteligência artificial cresce rapidamente, mas muitas empresas ainda enfrentam um obstáculo importante: o custo para executar milhões ou até bilhões de solicitações diariamente. É justamente nesse ponto que a DeepSeek acredita ter encontrado sua principal vantagem competitiva.
O modelo mais barato entre os gigantes da IA
De acordo com a Artificial Analysis, executar seu conjunto padronizado de testes custa aproximadamente US$ 0,03 utilizando o V4-Flash.
O contraste com os principais concorrentes chama atenção. O mesmo processo custa cerca de:
- US$ 0,86 no Kimi K3, da Moonshot AI;
- US$ 1,86 no GPT-5.6 da OpenAI;
- US$ 3,15 no Claude Fable 5, da Anthropic.
A própria DeepSeek informa que sua API cobra US$ 0,14 por milhão de tokens de entrada e US$ 0,28 por milhão de tokens de saída, valores muito abaixo dos praticados pelos modelos de ponta do mercado. A empresa também oferece um custo ainda menor quando há reutilização de cache, reduzindo significativamente as despesas em aplicações repetitivas.
À primeira vista, esses números podem parecer apenas uma redução de preço. Na prática, eles podem representar milhões de dólares economizados para empresas que operam chatbots, assistentes virtuais, plataformas de atendimento, agentes de programação ou sistemas internos baseados em IA.
Preço por token não conta toda a história
Embora o preço por milhão de tokens seja uma referência comum no mercado, especialistas afirmam que essa métrica isoladamente não representa o custo real de utilização.
Isso ocorre porque alguns modelos precisam realizar mais etapas de raciocínio para chegar à resposta correta. Quanto maior o número de interações internas, maior tende a ser o consumo de tokens e, consequentemente, a conta final.
Por esse motivo, a Artificial Analysis utiliza uma métrica chamada custo por benchmark, que mede quanto cada modelo gasta para resolver um conjunto padronizado de tarefas envolvendo programação, raciocínio lógico e problemas corporativos.
Segundo a consultoria, essa metodologia oferece uma visão muito mais próxima do impacto financeiro enfrentado pelas empresas no uso cotidiano da inteligência artificial.
Desempenho continua atrás dos líderes
Ser o modelo mais barato não significa ser o mais inteligente.
No índice de inteligência da Artificial Analysis, composto por nove avaliações independentes, o DeepSeek V4-Flash recebeu 50 pontos em uma escala de 100.
O resultado o coloca no mesmo nível do Gemini 3.6 Flash, do Google, apenas um ponto abaixo do Muse Spark 1.1, da Meta, e do GLM-5.2, da Z.AI.
No entanto, ainda existe uma diferença considerável para os líderes do setor.
O Kimi K3, da Moonshot AI, alcançou 57 pontos, enquanto Claude Opus 5, Claude Fable 5 e GPT-5.6 continuam ocupando as posições mais altas do ranking.
Em outras palavras, quem busca a melhor capacidade de raciocínio ainda encontrará alternativas superiores. Já empresas preocupadas principalmente com custos podem considerar que a pequena perda de desempenho é compensada pela enorme economia financeira.
Um modelo pensado para operar em grande escala
O foco do V4-Flash não é substituir os modelos mais sofisticados em tarefas extremamente complexas.
Sua proposta é diferente.
Ele foi desenvolvido para ambientes onde milhões de solicitações são processadas diariamente, como:
- atendimento automatizado ao cliente;
- geração de conteúdo;
- ferramentas para desenvolvedores;
- automação de processos administrativos;
- agentes corporativos;
- fluxos internos de empresas.
Nesses cenários, uma economia de poucos centavos por milhão de tokens pode representar uma redução significativa nos custos anuais de operação.
DeepSeek aposta em infraestrutura própria
Outro diferencial importante está na infraestrutura utilizada.
Os modelos V4 foram desenvolvidos para funcionar tanto em GPUs da Nvidia quanto nos aceleradores Huawei Ascend, reduzindo a dependência da tecnologia norte-americana e fortalecendo o ecossistema chinês de inteligência artificial.
Nos últimos meses, a procura pelos chips Ascend cresceu significativamente após o lançamento da família V4, refletindo a estratégia da China de fortalecer sua cadeia doméstica de hardware para IA diante das restrições impostas pelos Estados Unidos.
O V4-Pro já está no horizonte
Além do V4-Flash, a DeepSeek prepara o lançamento oficial do V4-Pro, uma versão voltada para tarefas de raciocínio mais sofisticadas.
A empresa ainda não confirmou quando o modelo será disponibilizado, mas já havia reduzido permanentemente em 75% o preço previsto para sua utilização, numa tentativa clara de acelerar sua adoção pelo mercado.
Essa estratégia mostra que a DeepSeek pretende competir em duas frentes: oferecer um modelo extremamente barato para aplicações em massa e outro mais poderoso para clientes que precisam de maior capacidade de raciocínio.
A guerra dos modelos chineses acelera
A DeepSeek já não está sozinha.
Depois do enorme impacto causado pelo modelo R1 no início de 2025, praticamente todas as grandes empresas chinesas intensificaram seus investimentos em inteligência artificial.
Moonshot AI, MiniMax, ByteDance, Alibaba e Z.AI passaram a lançar modelos em ritmo acelerado, tornando o mercado muito mais competitivo.
Nesta mesma semana, por exemplo, a Alibaba apresentou oficialmente o Qwen3.8-Max, descrito como seu maior e mais poderoso modelo até agora.
O novo sistema possui cerca de 2,4 trilhões de parâmetros, suporte multimodal para texto, imagens e vídeos, janela de contexto de até um milhão de tokens e arquitetura do tipo Mixture of Experts, ativando apenas parte dos parâmetros durante a execução para reduzir custos computacionais.
A próxima disputa será pelo menor custo
Nos últimos dois anos, a indústria da inteligência artificial concentrou esforços para criar modelos cada vez mais inteligentes.
Agora, o foco começa a mudar.
Empresas querem soluções capazes de entregar qualidade suficiente, mas consumindo muito menos infraestrutura. Isso reduz custos, amplia margens e torna economicamente viável incorporar IA em praticamente qualquer serviço digital.
Esse movimento já produz efeitos em todo o setor. A OpenAI reduziu os preços do GPT-5.6 diante da pressão competitiva, enquanto outras empresas revisam suas estratégias comerciais para evitar perder espaço em um mercado que cresce rapidamente.
Especialistas acreditam que essa tendência deve continuar ao longo dos próximos meses. Em vez de existir apenas um modelo dominante, o mercado tende a se dividir entre sistemas de altíssimo desempenho, voltados para tarefas complexas, e modelos extremamente baratos, destinados ao uso em larga escala. Nesse cenário, a DeepSeek aposta que o custo será tão importante quanto a inteligência para conquistar empresas ao redor do mundo.
