DeepSeek revela IA mais barata para competir com o Claude Opus

Resumo
- A startup chinesa DeepSeek revelou um novo modelo de IA de baixo custo com capacidade de processamento visual.
- A novidade supera o Opus 4.8 da Anthropic em alguns testes, mas ainda fica atrás em avaliações para o meio corporativo.
- O principal atrativo, no entanto, é a eficiência de custos: a IA gasta menos de US$ 1 para processar um milhão de palavras.
A startup chinesa DeepSeek revelou nesta sexta-feira (21/08) o DeepSeek-V4-Flash-Vision-Exp. O modelo experimental de baixo custo recebeu a capacidade de processamento visual e melhorias em agentes autônomos — sistemas de IA capazes de agir e tomar decisões sem supervisão humana.
O grande atrativo do modelo é a eficiência de custos. A IA consegue processar um milhão de palavras por aproximadamente US$ 0,87 (cerca de R$ 4,50). Em contrapartida, as alternativas equivalentes no mercado norte-americano chegam a custar perto de US$ 50 pelo mesmo volume de processamento, quase R$ 260 em conversão direta.
Com a atualização, a empresa sediada em Hangzhou espera competir com soluções corporativas de rivais como a Anthropic. A novidade já está disponível na plataforma de API da desenvolvedora.
Quem vence a disputa nos benchmarks?
Para medir a capacidade das ferramentas, a indústria utiliza benchmarks, testes padronizados que avaliam o desempenho da IA em desafios específicos, como interpretação de gráficos, resolução de problemas matemáticos ou uso de ferramentas externas.
Segundo os dados divulgados pela própria DeepSeek, o V4-Flash-Vision-Exp supera o modelo Opus 4.8 da Anthropic em três de onze testes aplicados.
Em outros oito, no entanto, o modelo chinês ficou atrás do concorrente. As maiores desvantagens ocorreram em avaliações relevantes para o setor corporativo, como o NL2Repo, um teste voltado para a manipulação de grandes repositórios de código, no qual a DeepSeek marcou 57,7 contra 69,7 pontos da Anthropic.
No exame de raciocínio DSBench-Hard, o placar foi de 63,6 contra 71,7 pontos. Já em avaliações de uso de ferramentas, como o Toolathlon-Verified, houve empate técnico (75,9 contra 76,2).
A adição do processamento de imagens melhorou a capacidade da IA de interpretar textos. O modelo multimodal superou a versão anterior em seis dos sete testes diretos, registrando avanços notáveis.
Vale ressaltar que a comparação é baseada no Opus 4.8, lançado em maio deste ano e com suporte garantido pela Anthropic até maio de 2027. O comparativo evitou menções ao Claude Opus 5, apresentado no final de julho.
DeepSeek revela IA mais barata para competir com o Claude Opus

Major Agent upgrades with strong production gains!