HP.
← Todas as notícias

Inteligência Artificial

DeepSeek V4 Pro: 80,6% do topo por 37x menos

O melhor open-weight para código marca 80,6% no SWE-bench Verified por ~US$ 0,27/US$ 1,10 — contra US$ 10/US$ 50 do Claude Fable 5. Licença MIT.

14 de ago. de 20263 minFonte: Requesty
Código open-source em terminal com texto verde e mãos no teclado

O DeepSeek V4 Pro virou a resposta padrão para quem quer modelo de código open-weight sem amarras: 80,6% no SWE-bench Verified por cerca de US$ 0,27 de entrada e US$ 1,10 de saída por milhão de tokens. O Claude Fable 5 lidera com 95%, mas cobra US$ 10/US$ 50 — ~37x mais caro na entrada.

A comparação ganha força com a licença MIT: o modelo pode ser self-hosted sem restrição de uso, o que muda completamente a conta para quem tem volume ou requisito de privacidade.

Onde o DeepSeek V4 Pro se encaixa

  • Open-weight com licença MIT: self-host sem lock-in de provedor nem cláusula de uso restritiva.
  • 80,6% no SWE-bench Verified: empata com o Gemini 3.1 Pro e fica a 14 pontos do topo absoluto — diferença que só pesa em tarefas de raciocínio profundo.
  • Custo de produção viável: para volume alto de código, o preço por token permite escala que os modelos premium inviabilizam.

O Terminal-Bench (67,9%) fica abaixo dos líderes — ou seja, em loop agente autônomo ele perde para GPT-5.5 e Opus 4.8. Mas para o fluxo típico de desenvolvimento assistido, a relação qualidade-preço é difícil de bater.

Na prática, a regra que venho aplicando: DeepSeek para o grosso do código e agentes de automação; modelos premium reservados para as tarefas que exigem o raciocínio mais fino. Montar essa arquitetura mista é parte do que faço na consultoria de IA — e a matemática de custo muda o ROI de qualquer pipeline.

Fonte: Requesty — análise de benchmarks e custo 2026.

Compartilhe

Achou útil? Mande pra quem precisa ver.

Quer aplicar isso no seu negócio?

Agende um diagnóstico de 30 minutos. Sem pitch, sem proposta empurrada — só entender se faz sentido continuar.