Hoje teve modelo novo praticamente a cada notícia, mas o que mais me chamou atenção foi o menor de todos. Um modelo que roda direto no bolso, sem depender de nuvem. Deixo essa análise como destaque e o resto do que filtrei logo abaixo.
Toda vez que discuto com o time onde rodar um modelo de IA, a pergunta que mais aparece é: o dado do cliente precisa sair da máquina dele?
Essa semana essa pergunta ficou mais fácil de responder.
A PrismML lançou o Bonsai 27B, um modelo de 27 bilhões de parâmetros que roda direto num iPhone, mantendo cerca de 90% da qualidade do modelo original. Sem mandar nada para a nuvem.
Isso muda o cálculo de quem trabalha com produto em crédito e finanças.
No meu dia a dia com produtos de crédito, dado sensível é a regra, não a exceção. Recebível, faturamento, comportamento de pagamento. Cada chamada para um modelo na nuvem é mais um ponto para pensar em segurança, custo e conformidade.
Com o modelo rodando local, esse cálculo muda. Custo marginal zero por interação. Funciona offline. O dado nunca sai do aparelho.
Não acho que tudo vai virar on-device amanhã. Mas para funções sensíveis, como triagem de documento ou apoio a decisão em campo, ter essa opção na mesa já é diferente de não ter.
Produto bom, cada vez mais, também é escolher onde a inteligência roda.
Para quem ficou curioso, deixo o link da notícia aqui: Ler mais
O resto do radar
GPT-5.6, a nova geração de modelos da OpenAI — Redefine o benchmark de custo-benefício em coding e trabalho de conhecimento, pressionando roadmaps que competem com Claude e Gemini. Ler mais
Muse Spark 1.1, modelo agentic multimodal da Meta — Meta entra forte em modelos agentic com API pública, ampliando as opções de fornecedor para features de agentes e uso de computador. Ler mais
Novos modelos de voz da OpenAI para conversas em tempo real — Voz bidirecional abre caminho para tradução ao vivo, assistentes e atendimento conversacional mais naturais. Ler mais
Agnost AI (YC S26): extrair feedback de conversas de agentes — Transforma conversas reais de agentes de IA em sinais de bug, pedido de feature e risco de churn, quase um substituto para evals que não capturam falhas reais. Ler mais
Codex passa a criptografar prompts entre agentes — Mudança de segurança em ferramenta de coding agent amplamente adotada pode afetar debugging e observabilidade de quem constrói sobre ela. Ler mais
Zero-day no Cursor divulgado por falta de resposta do fornecedor — Vulnerabilidade em uma das principais IDEs com IA é risco de segurança a monitorar para quem integra ou recomenda a ferramenta. Ler mais
Ask Ad Manager: agente de IA do Google dentro do Ad Manager — Case concreto de agente embutido em produto B2B para acelerar insight e decisão, padrão replicável em outros verticais. Ler mais
Guia de MCP para gestores — Explica o protocolo e como avaliar governança, segurança e adoção ao integrar agentes de IA a sistemas corporativos. Ler mais
Microsoft restringe acesso a dados que alimentam agentes de terceiros — Sinaliza risco de lock-in para quem depende de integrações com grandes plataformas e reforça a necessidade de plano de contingência. Ler mais
Fico por aqui. O radar de amanhã já está em curadoria.