A DeepSeek lançou o V4. 1-Flash, novo modelo de IA da empresa chinesa. A tecnologia foi apresentada como a menor da nova família de modelos da startup e promete respostas mais rápidas, maior capacidade de processamento e custos menores.
- um oitavo do espaço de armazenamento SSD.
- menos espaço para manter informações das interações.
- menos recursos para lidar com esses dados.
- EUA acusam empresas chinesas de IA de copiar modelos avançados para reduzir custos.
- DeepSeek lança IA que entende imagens e executa tarefas sozinha.
- DeepSeek amplia corrida por IA com data center bilionário na China.
O lançamento acontece enquanto a DeepSeek começa a se preparar para uma oferta pública inicial de ações no mercado STAR, em Xangai, segundo a Reuters. A empresa também está substituindo modelos anteriores pelo V4.
Modelo quer fazer mais gastando menos.
Embora seja considerado o menor modelo da nova família, o V4. 1-Flash reúne 552 bilhões de parâmetros, que são elementos usados pela inteligência artificial para processar informações e produzir respostas.
A tecnologia consegue usar apenas uma parte desses recursos durante cada tarefa. São 8 bilhões de parâmetros ativos para receber informações e 16 bilhões para gerar as respostas.
Para o usuário, a ideia é fazer o modelo funcionar com mais velocidade e atender um volume maior de solicitações sem exigir tantos recursos. A DeepSeek também afirma que o sistema foi preparado para facilitar a criação de modelos maiores no futuro.
O V4. 1-Flash também consegue interpretar informações visuais, como imagens. Segundo a DeepSeek, testes feitos por diferentes partes colocaram o novo modelo à frente do V4-Pro em desempenho, custo, velocidade e tempo total de execução.
Menos espaço para guardar informações.
Outra mudança importante está na forma como o modelo guarda informações durante uma tarefa. Isso pode pesar nos custos de serviços que utilizam inteligência artificial por longos períodos.
Na comparação com a geração anterior, a DeepSeek afirma que o V4. 1-Flash precisa de.
A empresa diz que essa redução pode diminuir significativamente os custos, especialmente em agentes de inteligência artificial, sistemas capazes de realizar tarefas com menor intervenção humana.
O V4. 1-Flash já está disponível na API da DeepSeek, serviço que permite que outras aplicações utilizem o modelo. Os modelos V4-Flash e V4-Flash-Vision-Exp foram retirados e, temporariamente, suas solicitações serão encaminhadas para o novo sistema.
O V4-Pro também será retirado gradualmente. A partir de 14 de setembro de 2026, as solicitações feitas para ele serão direcionadas ao V4. 1-Flash e terão a cobrança correspondente ao novo modelo.
Isso continuará até o lançamento do V4. 1-Pro.
Os novos preços da API entram em vigor em 10 de setembro. A DeepSeek mantém valores diferentes para períodos de maior e menor demanda. Fora do horário de pico, o preço será equivalente à metade da tarifa de pico.
A DeepSeek também pretende trabalhar com a comunidade de código aberto para ampliar o suporte ao modelo e estudar outras formas de implantação.
Valdir Antonelli é jornalista com especialização em marketing digital e consumo.
Em números
- 1-Flash reúne 552 bilhões de parâmetros, que são elementos usados pela inte
- São 8 bilhões de parâmetros ativos para receber informações e 16 bilhões para gerar as respostas
Comentários
Participe da conversa. Comentários passam por moderação antes de aparecer.
Carregando comentários…