38:15
youtube.com 14/08/2026 SRT AI Coder TODAY

Qwen3.8 27B Is INSANE – This Is the BEST Local AI Model Yet!

Qwen3.8 27B revoluciona a inteligência artificial local, suplantando todos os modelos anteriores.

Tecnologia Coding Qwen Local AI

Conteudo

TLDR;

Porque é um modelo 27B otimizado para uso local que apresenta um salto grande em desempenho de codificação nos benchmarks, contexto muito longo e licença Apache 2.0, entregando capacidade de modelos de ponta sem depender de subscrições. Ele pode rodar em uma única GPU, mas a quantização Q8 usada pelo autor não cabe em uma placa de 24 GB, então foi testado numa RTX Pro 6000 com VRAM suficiente. Suporta multimodalidade (imagens e vídeos, inclusive vídeos longos), tem contexto de 262k extensível até 1 milhão via Qwen Cloud e permite escolhas de quantização para balancear desempenho e uso de memória.

Resumo

Neste vídeo o autor apresenta o lançamento do modelo Qwen 3.827B, comemorando como um avanço importante para IA local graças à sua flexibilidade de hardware e ao fato de poder rodar sem necessidade de grandes investimentos em computação. O modelo traz 262 mil tokens de contexto, extensíveis até um milhão, e hospedagem na nuvem com contexto de 1M por padrão. Em benchmarks de coding mostrou um salto notável nos scores DeepSWE, passando de ~13,3 para ~42,2, aproximando‑se do desempenho de variantes maiores como Qwen 3.7 Plus e concorrentes como o Opus 4.6. Licenciado sob Apache 2.0, é multimodal e aceita imagens e vídeos longos. Para testar, o autor usou quantização Q8 do Unsloth em uma GPU RTX Pro 6000 para alcançar desempenho elevado, admitindo que não cabe em uma placa de 24 GB. Também avaliou a nova Browser OS v2.7 com papeis de parede procedurais, cliente de email e apps simulados; porém encontrou bugs e limitações, como um app de notas sem salvar, respostas estranhas do assistente chamado "Pulse" e problemas no clone de jogo tipo GTA. O balanço final foi de entusiasmo técnico misturado com frustrações práticas durante os testes. O autor recomenda acompanhamento próximo das próximas atualizações imediatas.