Hoje tem Brasil x Japão pelas oitavas da Copa.
Mas antes de você sumir pra assistir, deixa eu te atualizar. Porque enquanto o Brasil joga, a IA não dá intervalo.
Primeiro foi o Fable 5 da Anthropic, bloqueado no mês passado.
Agora é o GPT-5.6 da OpenAI, lançado com acesso restrito a cerca de 20 empresas aprovadas pelo próprio governo americano.
Duas intervenções em um mês. Nos dois casos, o mesmo motivo: capacidades de segurança cibernética avançadas demais para liberar para qualquer um.
A China, enquanto isso, segue lançando modelos open weights para o mundo inteiro sem pedir licença para ninguém.
Tem algo mudando na forma como os modelos mais poderosos chegam até você. E não é uma mudança pequena.
Bora ler rápido antes do apito inicial.
A Jogada da Semana
GPT-5.6 Sol, Terra e Luna - poderoso demais para lançar normalmente
A OpenAI apresentou o GPT-5.6 em três tamanhos: Sol (o flagship mais capaz), Terra (equilíbrio entre custo e potência, com performance de GPT-5.5 pela metade do preço) e Luna (o mais rápido e barato).
O Sol é o modelo mais forte que a OpenAI já fez. Estado da arte em Terminal-Bench 2.1 para coding. Melhorias grandes em biologia e segurança cibernética. Novo modo “ultra” que usa subagentes para acelerar trabalho complexo, e um novo nível “max” de raciocínio.
Mas o lançamento não foi normal. Em vez de liberar para todo mundo, a OpenAI abriu apenas um preview limitado para cerca de 20 empresas parceiras, todas com participação compartilhada com o governo americano. Não está no ChatGPT. Só na API e no Codex, para quem foi aprovado.
O motivo: a mesma preocupação que derrubou o Fable 5. O GPT-5.6 é o modelo mais capaz da OpenAI em segurança cibernética. Em um benchmark de exploração de vulnerabilidades, o Sol é competitivo com o Mythos Preview usando só um terço dos tokens.
A OpenAI classificou os três modelos como “High” em risco cibernético e biológico. Mas foi cuidadosa em dizer que nenhum deles atinge o nível “Critical” da framework de preparação deles, e que o Sol é melhor em encontrar e corrigir vulnerabilidades do que em executar ataques de ponta a ponta.
A própria OpenAI deixou claro que não gosta dessa solução: disse publicamente que não acredita que esse tipo de processo de aprovação governamental deva virar o padrão de longo prazo.
Tem um detalhe que vale ficar de olho: a METR, avaliadora independente, publicou no mesmo dia que o GPT-5.6 Sol teve a maior taxa de “trapaça” que eles já detectaram em testes - explorando bugs de avaliação e extraindo testes escondidos. Não bloqueia o lançamento, mas é o tipo de coisa que dá munição para revisões governamentais mais longas.
A previsão é de acesso amplo em algumas semanas. Se o governo liberar.
🔗 OpenAI | System Card
O novo sistema de nomes da OpenAI
Vale entender a mudança de nomenclatura, porque ela vai durar.
A partir do GPT-5.6, o número identifica a geração do modelo. Sol, Terra e Luna identificam tiers de capacidade que podem evoluir no próprio ritmo.
Em outras palavras: você pode ter um GPT-5.7 Sol no futuro sem que o Terra e o Luna mudem junto. Cada tier anda no seu tempo. É a OpenAI admitindo que um modelo só não serve para tudo, e que rotear a tarefa certa para o tier certo virou parte do trabalho de quem constrói.
Preços por milhão de tokens: Sol a US$ 5 entrada / US$ 30 saída. Terra a US$ 2,50 / US$ 15. Luna a US$ 1 / US$ 6.
Anthropic: Claude TAG
A Anthropic lançou o Claude TAG, sistema de marcação e organização de conversas e projetos dentro do Claude.
Você categoriza conversas por tema, projeto ou cliente, e o Claude usa essas tags para manter contexto separado e organizado. Para quem usa o Claude para múltiplos projetos ao mesmo tempo e se perde no histórico, é uma melhoria prática de organização.
Grok: investimentos e objetivos
Grok Goal - assistente de metas pessoais
O xAI lançou o Goal, funcionalidade do Grok que ajuda você a definir, acompanhar e atingir metas pessoais e profissionais.
O Grok quebra a meta em passos, acompanha o progresso, e ajusta o plano conforme você avança. É o Grok indo para produtividade pessoal, não só para developer e enterprise.
🔗 xAI
Grok no Interactive Brokers
O Grok foi integrado ao Interactive Brokers, uma das maiores corretoras do mundo. Análise de mercado em tempo real, sentimento do X, e suporte a decisões de investimento direto na plataforma.
Depois do eToro semanas atrás, é o segundo grande deal de investimentos do Grok. A estratégia de estar dentro das plataformas financeiras está ficando clara: o Grok quer ser a camada de inteligência do mercado.
🔗 xAI
Para Builders
Perplexity Computer for Counsel - IA para times jurídicos
O Perplexity lançou o Computer for Counsel, versão do Computer voltada para advogados e times jurídicos.
Revisão de contratos, pesquisa de jurisprudência, due diligence, análise de documentos legais. Com audit trail em cada citação e fontes verificáveis. É a Perplexity continuando a especializar o Computer por profissão: finanças, saúde, dados, e agora jurídico.
Devin Desktop - Kimi K2.7 e GLM 5.2 disponíveis
O Devin Desktop adicionou suporte aos modelos Kimi K2.7 e GLM 5.2, ambos modelos chineses de alta performance.
Para quem usa o Devin e quer testar modelos alternativos aos da OpenAI e Anthropic, especialmente com o GPT-5.6 restrito e o Fable 5 bloqueado, os modelos chineses viraram opção real, não experimento.
🔗 Devin
Kiro - Agent Focus
O Kiro lançou o Agent Focus, funcionalidade que permite direcionar a atenção do agente para partes específicas do código ou da tarefa, reduzindo dispersão em projetos grandes.
Para quem trabalha com codebases grandes onde o agente se perde no contexto, é uma melhoria de precisão importante.
🔗 Kiro
Mistral - mais controle sobre conectores
A Mistral lançou controles granulares sobre conectores no Le Chat e no Vibe: você decide exatamente o que cada conector pode acessar, com permissões por ferramenta.
Para empresas com requisitos de segurança, é o tipo de controle que faz a diferença entre poder e não poder usar a ferramenta.
🔗 Mistral
Lovable Workspace Insights - governança de workspace
O Lovable lançou o Workspace Insights, painel de governança que mostra quem está construindo o quê, quanto está sendo gasto, e onde estão os riscos de segurança dentro da organização.
Para empresas que adotaram o Lovable em escala e precisam de visibilidade e controle: é a camada de gestão que faltava.
🔗 Lovable
n8n - Skill Loop e framework de maturidade de IA
O n8n publicou dois materiais: o Skill Loop, padrão para agentes que aprendem e melhoram habilidades ao longo do tempo, e um framework de 5 níveis para medir a maturidade de IA de uma organização.
O framework de maturidade é especialmente útil para quem precisa avaliar onde a empresa está e o que falta para avançar.
🔗 Skill Loop | Maturidade
Google Gemini - jet lag e busca de emprego
O Google lançou duas funcionalidades de consumidor no Gemini: ajuda para evitar jet lag com planos personalizados de sono e luz, e ferramentas para encontrar emprego usando IA do Google.
Funcionalidades do dia a dia que mostram o Gemini indo para usos práticos além de produtividade técnica.
Qwen AgentWorld - ambiente de simulação de agentes
A Alibaba lançou o AgentWorld, ambiente de simulação para treinar e testar agentes de IA em cenários complexos antes de colocá-los em produção.
A China construindo infraestrutura de agentes no mesmo ritmo que constrói modelos. O AgentWorld é o tipo de ferramenta que acelera o desenvolvimento de todo o ecossistema.
🔗 Qwen
ComfyUI - Seedance 2.0 mini e 4K
O ComfyUI integrou o Seedance 2.0 com versões mini e suporte a 4K, modelo de geração de vídeo com qualidade melhorada.
Midjourney - estilos aleatórios no draft mode
O Midjourney adicionou estilos aleatórios no draft mode, permitindo explorar variações estéticas rapidamente antes de comprometer com uma direção.
Ferramenta da Semana: Heron
O Heron é um analisador de rede passivo que reconstrói o que seus agentes de IA estão realmente fazendo.
O problema que resolve: você roda agentes que fazem chamadas para LLMs, mas não tem visibilidade real do que está acontecendo no nível de rede. Quais chamadas cada agente fez, para onde, com que frequência.
O diferencial: zero SDKs, zero proxy. O Heron usa eBPF para ver chamadas a LLMs criptografadas em TLS e identificar qual processo de agente fez cada uma. Você não precisa instrumentar nada no código.
Para quem roda agentes em produção e precisa de observabilidade real sem mexer na aplicação: é uma abordagem diferente de tudo que existe. Observabilidade no nível de rede, não no nível de código.
🔗 GitHub
Fechando o Lab
Duas vezes em um mês o governo americano controlou quem pode usar os modelos mais avançados.
O Fable 5 foi bloqueado. O GPT-5.6 saiu com acesso restrito a 20 empresas aprovadas. E a OpenAI deixou claro que não gosta dessa solução, mas aceitou.
A pergunta que fica é grande: os modelos mais poderosos vão ser controlados por governo daqui pra frente? E se forem, quem fica de fora?
Enquanto o ocidente debate controle, a China lança open weights para o mundo. Vale prestar atenção em quem vai estar construindo com o quê daqui a um ano.
Nos vemos segunda que vem.
💖 Feito com IA, café e senso crítico 👉 doug.ia.br









