29:20
youtube.com 03/07/2026 SRT AI Coder TODAY

Notícias de IA: Fable está de volta, mas este novo modelo é melhor?

Fable está de volta, mas será que este novo modelo supera o original?

Benchmark Fable 5 Tecnologia IA

Conteudo

TLDR;

A versão reimplantada do Fable 5 inclui guardrails extras e um classificador que tende a sinalizar mais requisições benignas, redirecionando muitas ao modelo Opus. Benchmarks iniciais apontam quedas grandes em tarefas como debugging e refactoring (ex.: 86.2→25.9 e 73.6→38.4), embora quando o modelo conclui uma tarefa ele funcione como antes e alguns usuários reportem experiência similar. Continua muito útil para criar jogos, dashboards e gerar scripts/B‑roll para vídeos, mas você pode enfrentar mais bloqueios em tarefas rotineiras de codificação e depuração por causa das novas salvaguardas.

Resumo

Esta semana voltou o Fable 5, lançado originalmente em 9 de junho de 2026 e retirado do ar em 12 de junho após o governo dos EUA, acionado por vulnerabilidades relatadas por empregados da Amazon, considerar o modelo perigoso; em 1º de julho foi redeployado com proteções extras que incluem um classificador de segurança que passa a sinalizar e redirecionar mais solicitações benignas aos modelos Opus, tornando‑o aparentemente mais restrito. Benchmarks divulgados (Bridgemind) indicaram queda significativa em tarefas como debugging e refactoring, embora muitos usuários — incluindo o autor — reportem experiência funcionalmente semelhante nas interações cotidianas. Com a nova versão o autor desenvolveu várias aplicações: um jogo (Cube Basher) com gráficos e controles excelentes; um painel para gerar vídeos curtos que automatiza roteiro, checagem de fatos, teleprompter e B‑roll via Remotion, permitindo exportar e auditar custos; e uma ferramenta que transforma partes de artigos em B‑roll animado destacando trechos e imagens. Como destaque final, o autor apresentou o Beautybench, um benchmark que avalia a evolução dos modelos em gerar imagens SVG codificadas (Gary Buucy), mostrando progressos notáveis em modelos até Gemini 3.1. O debate segue entre segurança, utilidade e limitações, enquanto desenvolvedores testam novas estratégias e ajustes constantes também.