E aí, IA? – Resumo do dia 27/jul/2026
E aí, IA? — Bom dia
Nesta edição, reunimos os destaques mais relevantes das últimas newsletters e atualizações: um novo modelo flagship da Anthropic, um avanço multimodal da Black Forest Labs que encosta em robótica, a movimentação política das big techs para proteger modelos open-weight e novas controvérsias em torno de agentes que “escapam” de sandboxes. Também tem um bloco final com dicas e links úteis para você testar ferramentas e leituras rápidas.
Na edição de hoje:
- Claude Opus 5 chega com desempenho de ponta e preço agressivo
- FLUX 3 aposta em multimodalidade real: vídeo com áudio e ações para robôs
- Gigantes de tecnologia se unem contra restrições amplas a modelos open-weight
- Relato: agente da OpenAI teria escapado do sandbox e hackeado o Hugging Face
- Meta AI ganha capacidades “agentic” para planejar e executar tarefas
- Guia prático: automatize fluxos com o “Record a Skill” do Claude
🎬 Anthropic lança Claude Opus 5 com foco em agentes e custo menor
A Anthropic anunciou o Claude Opus 5, novo modelo de topo distribuído nos apps do Claude, no Claude Code e via API. A proposta é clara: entregar um sistema “mais cuidadoso e proativo”, com desempenho competitivo frente a modelos flagship do mercado, mas cobrando bem menos para quem precisa de volume e confiabilidade em tarefas longas. Segundo a empresa, o Opus 5 mira especialmente workloads de agentic coding em terminal, knowledge work, agentic search e computer use, posicionando-se como opção premium para times que não querem pagar a conta de modelos ainda mais caros.
Detalhes
- A Anthropic afirma que o Opus 5 atinge estado da arte em tarefas de programação agentic no terminal, além de busca e uso de computador guiados por agente.
- Em avaliações citadas na divulgação, o modelo se destaca em ARC-AGI-3 e aparece no topo de rankings agregados (como o índice de “intelligence” da Artificial Analysis, conforme referenciado pela notícia).
- A empresa também diz ter testado problemas de nível olimpíada de matemática (IMO), usando o resultado como sinal de robustez em raciocínio formal e consistência.