How To Run Insanely Good Uncensored AI Coding Models on ANY PC
Essas técnicas revolucionárias permitem rodar modelos de IA de codificação sem censura em qualquer PC.
Conteudo
TLDR;
Para configurar os modelos basta baixar o Ollama no site ollama.com, instalar o VS Code e o plugin Continue, depois selecionar Ollama como provedor de API.. O modelo Qwen 3.8 27B é recomendado para placas com 24 a 36 GB de VRAM e pode ser baixado com o comando pull qwen3:8 27b.. O Qwen 3.8 27B supera o Opus 4.6 Max em benchmarks de codificação agentic, marcando 61.7 contra 53.4 no SWE-Bench Pro.
Resumo
Neste vídeo, é demonstrado como configurar um modelo de IA de codificação local em um computador gamer doméstico, superando o desempenho do Opus 4.6 Max. O processo é simples, gratuito, sem censura e totalmente privado. Comece instalando o Ollama pelo site oficial e o VS Code. Em seguida, adicione a extensão Continue (transcrito como Klein) no VS Code, configure o provedor de API para Ollama e ajuste o tamanho da janela de contexto, como 64K. Para escolher o modelo ideal, acesse o site canirun.ai e selecione conforme a VRAM disponível: Ornith 1.5B para placas com 8 a 12 GB ou Qwen 3 8.27B para 24 a 36 GB. Baixe o modelo via comando no terminal, como “ollama pull qwen2.5-coder:32b”. Depois, abra sua pasta de projeto no VS Code, confie na pasta se necessário e utilize o Continue para interagir com o modelo em tarefas de codificação. O Qwen 3 8.27B alcança pontuação superior em benchmarks como o SWE-Bench, oferecendo uma solução poderosa e local para desenvolvimento.