DeepSeek V4.1 Flash testado — Modelo de IA open-source colocado à prova
DeepSeek V4.1, modelo de IA open-source, passa por teste de velocidade Flash revelando desempenho surpreendente.
Conteudo
TLDR;
O DeepSeek V4.1 Flash gera entre 260 e 287 tokens por segundo e obtém 74,2 no benchmark Deep‑E‑Suite, superando o Opus 5, porém o tempo total de resposta pode ser longo, como 18 minutos em um teste, ficando ligeiramente atrás do Gemini Flash em alguns casos. O custo da API fora de pico é de US$ 0,0015 por milhão de tokens de entrada e US$ 0,006 por milhão de tokens de saída, com preços ainda menores para entradas em cache. O modelo é totalmente open‑source, está disponível no Hugging Face e pode ser executado localmente em hardware compatível usando Node.js e um único comando NPX que abre a interface web.
Resumo
A equipe da DeepSeek lançou o modelo V4.1 Flash, prometendo mais inteligência, velocidade e eficiência. No benchmark Deep E‑Suite, ele marcou 74,2, acima do Opus 5, o que motivou o autor a testá‑lo. A API, fora de pico, custa US$0,15 por milhão de tokens na entrada e US$0,60 na saída, com cache ainda mais barato; o modelo está disponível como código aberto no Hugging Face, permitindo execução sem custos. Para os testes usou‑se o DeepSeek Harness, um agente baseado em plugins que roda com Node.js e um comando NPX, abrindo uma interface web. O primeiro teste gerou um organizador semanal de comprimidos em 3 js; a geração atingiu 260