DeepSeek lança modelos V4 e desafia líderes em IA
DeepSeek lança modelos V4-Pro e V4-Flash, com até 1,6 trilhão de parâmetros e janela de 1M tokens. Prometem alta eficiência, desempenho robusto e custos reduzidos.
A DeepSeek lançou sua série V4 de modelos de IA open-source, apresentando duas variantes: V4-Pro, com cerca de 1,6 trilhão de parâmetros, e V4-Flash, com 284 bilhões de parâmetros. Ambos suportam uma janela de contexto de 1 milhão de tokens, equiparando-se a modelos líderes como o Gemini do Google. O V4-Pro oferece desempenho comparável aos principais sistemas proprietários, destacando-se em tarefas de raciocínio, programação e STEM. Já o V4-Flash é uma alternativa eficiente e econômica, com significativa redução nos requisitos computacionais e de memória em relação aos concorrentes. Os modelos estão disponíveis sob licença MIT, com pesos acessíveis no Hugging Face e ModelScope. O lançamento ocorre enquanto grandes empresas chinesas consideram investir na DeepSeek, avaliando-a acima de US$ 20 bilhões. Atualmente, os modelos V4 são apenas para texto, mas há planos de expansão, e sua implementação em chips Huawei pode impulsionar o ecossistema de IA da China.