Essa semana teve lançamento de modelo novo quase todo dia, mas o que mais me chamou atenção não foi nenhum benchmark. Foi um case simples de como um produto B2B trocou tela complexa por conversa. Fica registrado abaixo, junto com o resto do que filtrei hoje.

Toda vez que participo de uma discussão sobre relatório e dashboard num produto B2B, chega o momento em que alguém pergunta: por que o usuário ainda precisa aprender a navegar em quinze telas para achar uma resposta que ele poderia simplesmente perguntar? Essa semana o Google deu uma resposta prática pra isso.

Lançaram o Ask Ad Manager, um agente construído com Gemini dentro do Google Ad Manager. A ideia é direta: o publisher escreve o que quer saber, em linguagem natural, e o agente vai lá, cruza os dados da conta, monta o relatório, e ainda ajuda a navegar na própria plataforma. Nada de aprender filtro, nada de decorar caminho de menu.

O que me chama atenção não é o produto de anúncios em si, é o padrão por trás dele. Pegar um sistema B2B cheio de relatório manual e tela complexa, e trocar isso por um agente que responde perguntas usando os dados do próprio cliente. Isso é replicável em qualquer vertical que tenha operação densa de dados, e crédito estruturado é uma delas.

Do lado de produto em crédito, vejo bastante gente ainda tratando “gerar relatório de carteira” ou “explicar uma métrica de recebíveis” como tarefa que exige treinar o usuário na ferramenta. O caminho que o Ask Ad Manager mostra é outro: o sistema entende a pergunta, busca o dado certo e devolve a resposta, sem exigir que a pessoa vire especialista na interface.

Isso não substitui quem entende do negócio. Pelo contrário, libera essa pessoa da parte operacional de garimpar dado e deixa mais tempo pra interpretar o resultado e decidir o próximo passo. É a IA fazendo o trabalho chato pra que o time possa fazer o trabalho que importa.

Acho que esse tipo de case vale mais que qualquer benchmark de modelo novo, porque mostra IA resolvendo um problema real de produto, dentro de um fluxo que já existia e que só ficou mais simples.

Para quem quiser ver os detalhes do lançamento, deixo o link aqui: Ler mais

O resto do radar

GPT-5.6, a nova geração de modelos da OpenAI — Redefine o benchmark de custo-benefício para features com IA e libera o modo “ultra” (agentes em paralelo) como novo padrão de produto. Ler mais

Meta lança Muse Spark 1.1, modelo agentic multimodal — Abre API pública para um modelo forte em uso de computador e orquestração multiagente, ampliando as opções de fornecedor além de OpenAI, Anthropic e Google. Ler mais

OpenAI lança GPT-Live-1, voz full-duplex para o ChatGPT — Sinaliza a aposta da OpenAI em voz como interface primária para trabalho agentic de longa duração, relevante para quem tem voz no roadmap. Ler mais

Estudo sobre adoção do Claude Code e do Copilot CLI na Microsoft — Dados reais de adoção interna de coding agents em larga escala, úteis para calibrar expectativas de rollout e métricas de sucesso. Ler mais

Benchmark de maturidade de agentes de IA para times de engenharia — Framework rápido para avaliar o quanto o time está preparado para adotar agentes no fluxo de desenvolvimento. Ler mais

Sx 2.0: compartilhando skills de IA por uma pasta do Dropbox — Reduz a fricção para distribuir prompts e capacidades padronizadas no time, sem precisar de infraestrutura dedicada. Ler mais

Clawk: VMs Linux descartáveis para agentes de coding — Infraestrutura de isolamento que vira peça-chave de segurança e confiabilidade ao dar mais autonomia a coding agents em produção. Ler mais

“O que vai sobrar para nós trabalharmos?” — Ensaio sobre como a automação por IA redesenha papéis de trabalho, com implicações diretas para o posicionamento de produtos de IA. Ler mais


É isso que separei hoje. Amanhã tem mais.