22:20
youtube.com ha 6 dias SRT AI Coder TODAY

Claude Mythos 6 = Modelo 2! VAZAMENTOS GIGANTESCOS, DeepSeek v4 Pro, Gemini 3.7 Flash, Codex 2.0 ...

Vazamentos gigantescos: Claude Mythos 6 é equivalente ao Modelo 2!

Benchmark Tecnologia AI Anthropic

Conteudo

TLDR;

Enthropic revelou em um relatório interno detalhes sobre um "Model 2" que muita gente especula ser a base do Mythos 6, mas a empresa indica que ele é interno e não confirmado como lançamento público. O "vazamento" refere‑se principalmente à divulgação discreta do desempenho e de políticas internas (como marca d'água em texto gerado) no relatório de risco da Enthropic, além de informações e controvérsias sobre outras atualizações de modelos. Nos testes internos Cobbench v2, o Model 2 alcançou 62,8% contra 50,3% do Mythos 5 (12,5 pontos percentuais a mais), ficando ainda cerca de 22 pontos abaixo do estimado 85% que poderia automatizar tarefas de P&D.

Resumo

Na última semana houve uma enxurrada de novidades em IA: a Enthropic revelou informações sobre um modelo interno chamado Model 2 (possivelmente Mythos 6) que superou Mythos 5 em 12,5 pontos no benchmark interno Cobbench v2, alcançando 62,8% — e, embora ainda esteja longe dos ~85% estimados para automatizar grande parte do trabalho de pesquisa, a trajetória preocupa e entusiasma; a empresa também se envolveu em polêmica ao anunciar watermarking invisível em textos de seus modelos em nuvem para cumprir o AI Act europeu, gerando debates; a OpenAI está implantando resets pagos no Codex e promete um upgrade significativo que pode transformar a ferramenta em um potente agente de codificação; o Google lançou o Gemini 3.7 Flash com melhorias notáveis para programação e desenvolvimento web; o Deep Seek v4 Pro ficou disponível, mas decepcionou algumas expectativas e causou insatisfação com mudanças de precificação; provedores como Berta/Verda oferecem acesso em escala ao hardware mais recente da Nvidia, computação confidencial e preços agressivos para workloads de IA; por fim, limitações de computação e decisões estratégicas podem explicar por que modelos internos ainda não foram liberados ao público, tornando o cenário de IA desta semana ao mesmo tempo acelerado, cauteloso e muito imprevisível.