TECNOLOGIA

DeepSeek lança nova IA mais rápida e com custo reduzido

Tudo sobre Inteligência Artificial

A DeepSeek lançou o V4.1-Flash, novo modelo de IA da empresa chinesa. A tecnologia foi apresentada como a menor da nova família de modelos da startup e promete respostas mais rápidas, maior capacidade de processamento e custos menores.Continua após a publicidadeO lançamento acontece enquanto a DeepSeek começa a se preparar para uma oferta pública inicial de ações no mercado STAR, em Xangai, segundo a Reuters. A empresa também está substituindo modelos anteriores pelo V4.1-Flash.
O novo modelo utiliza um quarto da memória HBM necessária pela geração anterior, segundo a DeepSeek. – Imagem: mundissima/ShutterstockModelo quer fazer mais gastando menosEmbora seja considerado o menor modelo da nova família, o V4.1-Flash reúne 552 bilhões de parâmetros, que são elementos usados pela inteligência artificial para processar informações e produzir respostas.A tecnologia consegue usar apenas uma parte desses recursos durante cada tarefa. São 8 bilhões de parâmetros ativos para receber informações e 16 bilhões para gerar as respostas.Para o usuário, a ideia é fazer o modelo funcionar com mais velocidade e atender um volume maior de solicitações sem exigir tantos recursos. A DeepSeek também afirma que o sistema foi preparado para facilitar a criação de modelos maiores no futuro.“Apresentamos o menor modelo da nossa nova família de arquitetura, com compreensão visual nativa.”O V4.1-Flash também consegue interpretar informações visuais, como imagens. Segundo a DeepSeek, testes feitos por diferentes partes colocaram o novo modelo à frente do V4-Pro em desempenho, custo, velocidade e tempo total de execução.Menos espaço para guardar informaçõesOutra mudança importante está na forma como o modelo guarda informações durante uma tarefa. Isso pode pesar nos custos de serviços que utilizam inteligência artificial por longos períodos.Na comparação com a geração anterior, a DeepSeek afirma que o V4.1-Flash precisa de:
um quarto da memória HBM;

um oitavo do espaço de armazenamento SSD;

menos espaço para manter informações das interações;

menos recursos para lidar com esses dados.
A empresa diz que essa redução pode diminuir significativamente os custos, especialmente em agentes de inteligência artificial, sistemas capazes de realizar tarefas com menor intervenção humana.

Segundo a DeepSeek, testes colocaram o V4.1-Flash à frente do V4-Pro em desempenho, custo e velocidade. – Imagem: Robert Way/iStockModelos antigos serão substituídosO V4.1-Flash já está disponível na API da DeepSeek, serviço que permite que outras aplicações utilizem o modelo. Os modelos V4-Flash e V4-Flash-Vision-Exp foram retirados e, temporariamente, suas solicitações serão encaminhadas para o novo sistema.Leia mais:O V4-Pro também será retirado gradualmente. A partir de 14 de setembro de 2026, as solicitações feitas para ele serão direcionadas ao V4.1-Flash e terão a cobrança correspondente ao novo modelo. Isso continuará até o lançamento do V4.1-Pro.Continua após a publicidadePreços também mudamOs novos preços da API entram em vigor em 10 de setembro. A DeepSeek mantém valores diferentes para períodos de maior e menor demanda. Fora do horário de pico, o preço será equivalente à metade da tarifa de pico.“V4.1-Flash permite atender mais usuários a um custo menor. Estamos repassando essa economia para você.”A DeepSeek também pretende trabalhar com a comunidade de código aberto para ampliar o suporte ao modelo e estudar outras formas de implantação.

Valdir Antonelli

Valdir Antonelli é jornalista com especialização em marketing digital e consumo.

Ver todos os artigos →


Deixe um comentário

O seu endereço de email não será publicado. Campos obrigatórios marcados com *

Botão Voltar ao Topo

Adblock Detectado

Para continuar no site, por favor, desative o Adblock.