DeepSeek apresenta modelo V4 e busca investimento bilionário

Renê Fraga
6 min de leitura

Principais destaques

  • DeepSeek lança modelos V4 com janela de contexto de 1 milhão de tokens e arquitetura avançada
  • Versões Pro e Flash combinam escala massiva com redução significativa de custo e uso de memória
  • Nova geração open-source rivaliza com líderes como o Gemini e pressiona o mercado

A DeepSeek deu um passo decisivo na corrida global por inteligência artificial ao lançar, em versão de pré-visualização, seus modelos V4 com código aberto.

O anúncio não apenas reforça o momento de forte valorização da empresa, que negocia uma rodada bilionária de investimento, como também reposiciona o papel do open-source em um mercado dominado por sistemas fechados.

Disponibilizados publicamente com pesos e relatório técnico, os novos modelos representam a aposta mais ambiciosa da empresa desde o impacto causado pelo R1 em 2025. Agora, o foco vai além de desempenho bruto: eficiência, custo e escalabilidade entram no centro da estratégia.

Arquitetura avançada e salto para 1 milhão de tokens

O V4 chega em duas variantes principais, cada uma com objetivos distintos, mas baseadas na mesma filosofia técnica. O DeepSeek-V4-Pro é o modelo mais robusto, com impressionantes 1,6 trilhão de parâmetros totais, dos quais cerca de 49 bilhões são ativados por token. Já o DeepSeek-V4-Flash, mais leve, trabalha com 284 bilhões de parâmetros totais e 13 bilhões ativos.

Ambos utilizam a arquitetura Mixture-of-Experts, um modelo que ativa apenas partes específicas da rede neural por vez, reduzindo drasticamente o custo computacional sem comprometer a qualidade. Esse design é essencial para viabilizar sistemas dessa escala.

O grande destaque, porém, está na janela de contexto de 1 milhão de tokens. Na prática, isso permite que o modelo processe volumes gigantescos de informação em uma única interação, como bases inteiras de código, documentos extensos ou múltiplos arquivos simultaneamente. É uma das maiores capacidades já vistas no setor.

Para sustentar esse avanço, a DeepSeek implementou um mecanismo de atenção híbrido que combina técnicas como Compressed Sparse Attention e Heavily Compressed Attention. O resultado é expressivo: o V4-Pro utiliza apenas cerca de 27% do processamento de inferência e 10% da memória cache exigidos por seu antecessor em contextos longos.

Benchmarks colocam V4 entre os mais competitivos do mundo

Nos testes divulgados pela própria empresa, o desempenho do V4-Pro chama atenção. Em tarefas de programação, o modelo alcançou 93,5 no LiveCodeBench e uma pontuação de 3.206 no Codeforces, superando sistemas avançados como o Gemini-3.1-Pro.

No benchmark SWE-bench Verified, amplamente utilizado para medir desempenho em engenharia de software real, o modelo atingiu 80,6%, ficando praticamente empatado com o líder do mercado.

Esses resultados indicam que modelos open-source começam a reduzir significativamente a distância para soluções proprietárias. Ainda assim, a DeepSeek reconhece que há lacunas em áreas como conhecimento geral e execução de agentes complexos, onde sistemas fechados ainda mantêm vantagem.

Preço agressivo pode redefinir o mercado

Se os benchmarks impressionam, os preços podem ser ainda mais disruptivos. O V4-Flash foi lançado com valores extremamente baixos por milhão de tokens, enquanto o V4-Pro também apresenta custos significativamente inferiores aos concorrentes diretos.

Essa estratégia posiciona a DeepSeek como uma alternativa altamente competitiva para empresas e desenvolvedores que precisam de escala sem custos proibitivos. Na prática, isso pode acelerar a adoção de IA avançada em aplicações comerciais e industriais.

A combinação de alto desempenho com baixo custo reforça uma tendência crescente: a democratização da inteligência artificial por meio de modelos abertos e economicamente viáveis.

Infraestrutura, chips e estratégia nacional

O desenvolvimento do V4 não foi simples. O projeto enfrentou atrasos, em parte devido a desafios com chips chineses, especialmente da linha Ascend. Ainda assim, a DeepSeek conseguiu otimizar seus modelos para rodar em infraestrutura doméstica, um movimento estratégico relevante.

Essa compatibilidade reduz a dependência de tecnologias estrangeiras e se alinha aos esforços da China para fortalecer sua soberania tecnológica. Grandes empresas como Alibaba, Tencent e ByteDance já se preparam para integrar o V4 em suas plataformas, com investimentos massivos em hardware.

Além disso, os modelos foram disponibilizados com licença aberta, permitindo download gratuito e uso amplo, enquanto APIs comerciais oferecem acesso escalável.

DeepSeek entre inovação técnica e disputa bilionária

O lançamento do V4 acontece em paralelo à tentativa da DeepSeek de captar recursos no mercado, com valuation que já ultrapassa US$ 20 bilhões. Esse contexto reforça como avanços técnicos e interesse financeiro caminham juntos no setor de IA.

Ao combinar inovação em arquitetura, eficiência operacional e estratégia de mercado agressiva, a DeepSeek se posiciona como uma das principais forças emergentes da inteligência artificial global.

Mais do que competir com gigantes estabelecidas como o Google, a empresa sinaliza uma mudança estrutural no setor: modelos abertos, poderosos e acessíveis podem redefinir quem lidera a próxima geração da IA.

Apoie o Eurisko
Este conteúdo é independente, sem anúncios e feito por pessoas.
A inteligência artificial e as mudanças recentes do Google reduziram significativamente o alcance dos sites independentes. Se este conteúdo foi útil para você, considere apoiar o Eurisko e todo o ecossistema de projetos com qualquer valor.
Quero apoiar
Seguir
Renê Fraga é fundador e editor-chefe do Eurisko, ecossistema editorial independente dedicado à inteligência artificial, código aberto, tecnologia e cultura digital. Atuando com projetos online desde 1996, escreve há mais de 20 anos sobre tecnologia e inovação, acompanhando a evolução da internet e o impacto das novas tecnologias na forma como vivemos, trabalhamos e pensamos.
Nenhum comentário