O novo modelo chinês foi apresentado como uma alternativa mais rápida e eficiente para agentes e chatbots de inteligência artificial, com capacidades multimodais e desempenho superior ao de concorrentes em testes seleccionados.
O DeepSeek-V4.1 Flash foi lançado na quarta-feira, 9 de Setembro, como a opção mais pequena da nova geração de modelos da DeepSeek. O grande modelo de linguagem (LLM) é multimodal, permitindo compreender imagens, e foi desenvolvido para oferecer maior velocidade de inferência e rendimento, mantendo um desempenho próximo do modelo topo de linha DeepSeek V4 Pro.
Segundo a desenvolvedora, o V4.1 Flash possui até 552 mil milhões de parâmetros sob uma arquitectura Mixture of Experts (MoE). O modelo utiliza ainda uma arquitectura Causal Encoder-Decoder, capaz de activar 16 mil milhões de parâmetros a partir de oito mil milhões de parâmetros na entrada.
Nos testes apresentados pela DeepSeek, o novo modelo foi comparado com sistemas como Kimi-K3, GLM-5.3, Claude Opus 5 e GPT-5.6-Sol. A empresa destacou os resultados obtidos nos benchmarks Terminal-Bench 3.0, DeepSWE v1.1, CyberGym e Automation-Bench.
De acordo com os resultados divulgados pela desenvolvedora, o V4.1 Flash superou os modelos concorrentes nos quatro testes seleccionados, reforçando a estratégia da DeepSeek de disputar o segmento de modelos avançados com uma arquitectura orientada para maior eficiência e utilização em aplicações de IA generativa.


A carregar a conversa…