DeepSeek lança versão oficial e eleva preços da API em até 1.100 por cento

Redação Rádio Plug
7 min. de leitura
Lançamento oficial do DeepSeek-V4-Pro enfatiza ...

A startup chinesa de inteligência artificial DeepSeek apresentou oficialmente na quinta-feira (13.ago.2026) a versão definitiva de seu principal modelo de linguagem, o DeepSeek-V4-Pro. Junto com a novidade, a companhia promoveu um reajuste expressivo nas tarifas de sua API (interface de programação de aplicações), com altas que chegam a 1.100% em determinadas modalidades de serviço.

Essa alteração nos custos marca uma clara mudança de rumo em relação à agressiva guerra de preços entre as desenvolvedoras de IA da China. O movimento ocorre no momento em que a DeepSeek passa a lidar com uma concorrência cada vez mais acirrada no mercado doméstico, além da pressão exercida por concorrentes internacionais, a exemplo da OpenAI, que recentemente reduziu suas tarifas para tentar enfraquecer o domínio das companhias chinesas do setor.

Como parte da nova estratégia comercial, a empresa implementou uma diferenciação de valores baseada em horários de pico e de menor movimento. Durante o período de pico — estabelecido das 9h ao meio-midi e das 14h às 18h no horário de Pequim —, a cobrança por milhão de tokens passou para 0,3 yuan (aproximadamente US$ 0,04) para entradas em cache, 9 yuans para entradas sem cache e 27 yuans para a geração de saídas. Anteriormente, os custos eram fixos e bem mais baixos, situados em 0,025 yuan, 3 yuans e 6 yuans, respectivamente. Nos horários fora de pico, os valores caem pela metade em relação à tabela principal.

A versão mais leve e otimizada da tecnologia, batizada de DeepSeek-V4-Flash, também sofreu impactos financeiros. O custo para processamento de entrada em cache nos horários de maior tráfego registrou um salto de 400%, alcançando 0,1 yuan por milhão de tokens. Já as tarifas para entradas sem cache e saídas subiram para 3 yuans e 9 yuans, respectivamente, superando os patamares anteriores de 1 yuan e 2 yuans.

Com a nova tabela de pico, o DeepSeek-V4-Pro emparelha-se em termos de custos com o modelo GLM-5.2, desenvolvido pela Zhipu AI, que comercializa seus serviços cobrando 2 yuans pela entrada em cache, 8 yuans pela entrada sem cache e 28 yuans pela saída por milhão de tokens. Análises de mercado apontam que o concorrente tem conseguido ditar preços graças à robustez de suas funções. Apesar do encarecimento, a DeepSeek mantém tarifas inferiores às do Kimi K3, da Moonshot AI, preservando vantagens competitivas na retenção de clientes locais sensíveis a custos operacionais.

Por outro lado, o reajuste coloca o modelo DeepSeek-V4-Flash acima do GPT-5.6 Luna, criado pela OpenAI, quando considerados os valores de pico. Após cortes recentes promovidos no final de julho, a empresa norteamericana passou a cobrar US$ 0,2 por entrada e US$ 1,2 por saída, tornando o produto mais acessível do que diversas opções de ponta vindas da China, como o próprio GLM-5.2, o MiniMax-M3 e o Qwen3.8-Max, da gigante Alibaba.

Evolução técnica e desempenho operacional

No que diz respeito às capacidades técnicas, o lançamento comercial do DeepSeek-V4-Pro destaca uma autonomia aprimorada na execução de tarefas complexas por agentes inteligentes. A desenvolvedora sustenta que o sistema supera o GLM-5.2 em múltiplos testes comparativos de agentes e bate o Claude Opus 4.8, da Anthropic, em avaliações específicas, embora ainda fique atrás do Kimi K3 e do Claude Fable 5 na média geral dos benchmarks.

Em plataformas independentes de monitoramento, como o Artificial Analysis, o DeepSeek-V4-Pro registrou 53 pontos, empatando diretamente com o rival da Zhipu AI. O resultado o posiciona abaixo de soluções concorrentes consolidadas, mas garante uma margem de apenas um ponto de vantagem sobre a versão intermediária V4-Flash.

A família de modelos DeepSeek-V4 foi apresentada inicialmente em abril, trazendo uma ampla janela de contexto de 1 milhão de tokens. A edição Pro conta com 1,6 trilhão de parâmetros totais — incluindo 49 bilhões de parâmetros ativos —, consolidando-se como um dos maiores projetos de pesos abertos de seu período de lançamento. Em contrapartida, a variação Flash disponibiliza 284 bilhões de parâmetros gerais e 13 bilhões ativos, funcionando como uma alternativa voltada para aplicações que exigem respostas rápidas e custos operacionais reduzidos.

A chegada oficial do V4-Pro aconteceu com quase um mês de defasagem em relação ao cronograma inicial, que previa sua liberação para meados de julho. A empresa havia disponibilizado a versão definitiva do Flash em 31 de julho, momento em que relatou ganhos expressivos na performance de agentes autônomos, gerando grande expectativa no ecossistema tecnológico para a chegada da edição Pro.

O atraso no lançamento gerou repercussões e especulações no mercado. Pouco antes do anúncio oficial, alterações na documentação técnica da API haviam indicado brevemente a disponibilidade da nova ferramenta, mas o conteúdo foi retirado do ar minutos depois. O episódio, somado à percepção de alguns programadores de que os ganhos de performance poderiam ser modestos, alimentou boatos de que a companhia teria hesitado em colocar o produto no mercado.

Paralelamente às novidades comerciais, a companhia iniciou os testes globais de uma versão preliminar voltada para desenvolvedores do DeepSeek Harness, um framework operacional disponibilizado sob a licença MIT. A estrutura utiliza uma arquitetura modular baseada em plugins voltados para a integração de modelos, ferramentas computacionais e interfaces dedicadas a agentes.

As iniciativas de expansão ocorrem logo após a conclusão da primeira rodada de captação de recursos externos realizada pela startup. O processo injetou aproximadamente 50 bilhões de yuans na companhia, elevando sua avaliação de mercado para patamares superiores a 350 bilhões de yuans com o apoio de doze instituições financeiras e tecnológicas, entre elas Tencent, JD.com, NetEase e CATL.

Fonte:: poder360.com.br

Anúncios
Compartilhe este artigo