O DeepSeek V4, versão recém revelada pela startup chinesa, chega um ano após o alvoroço do mercado com o R1. A empresa apresenta uma prévia oficial do novo modelo de linguagem, mantendo a proposta de código aberto. O lançamento visa competir com incumbentes dos EUA, como Google, OpenAI e Anthropic. A DeepSeek afirma que o V4 pode igualar ou superar líderes em testes de desempenho.
O foco técnico do V4 é a melhoria na codificação. Segundo o documento técnico publicado, destacam-se refinamentos na arquitetura que permitem resolver lógicas de programação mais complexas com menor consumo de poder computacional. A versão analisada na fonte é o *V4 Pro*, com avanços para uso corporativo.
Além da arquitetura, a DeepSeek mantém o software aberto, buscando atrair desenvolvedores que busquem alternativas às APIs pagas do Vale do Silício. A organização também ressalta compatibilidade nativa com chips da Huawei, ampliando a infraestrutura possível fora de fornecedoras americanas.
A empresa aponta que o treinamento exige dados massivos, mas não divulgou valores de custo na fase de treinamento do V4. A informação foi apresentada sem números oficiais, seguindo a prática de não detalhar custos de desenvolvimento.
O histórico da DeepSeek envolve o R1, lançado há um ano, que mostrou possível treinar modelos avançados com recursos menores. O lançamento gerou debates sobre financiamento e velocidade de crescimento da empresa frente aos rivais.
Entre as controvérsias, autoridades dos EUA acusaram a DeepSeek de contornar sanções ao supostamente usar chips proibidos para treinar modelos anteriores. Além disso, a Anthropic alega uso de dados sintéticos gerados a partir de seus modelos Claude para aperfeiçoar os produtos da DeepSeek.
Entre na conversa da comunidade