← Voltar ao blog

IA & Agentes

Copilot Studio - Novidades [5] - Qual modelo escolher: Claude Sonnet 5, GPT-5.5 e as tags Deep, Auto e General

Copilot Studio - What's New [5] - Which model to pick: Claude Sonnet 5, GPT-5.5 and the Deep, Auto and General tags

Copilot Studio - Novidades [5] - Qual modelo escolher: Claude Sonnet 5, GPT-5.5 e as tags Deep, Auto e General

Fala dataholics, último post da série de novidades. Uma pergunta pra começar: você sabe qual modelo está rodando no seu agente do Copilot Studio agora? Se a resposta é "sei lá, o que veio", então esse post vale seu tempo, porque a lista mudou bastante e a escolha mexe direto em latência, custo e qualidade de resposta.

O que veremos nesse post:

  • Onde troca o modelo e quantos lugares fazem isso

  • As tags General, Auto e Deep, que é o que realmente importa

  • Quem entrou, quem saiu e o que está experimental

  • A coluna Brasil, cross-geo e o que o admin precisa liberar


Onde fica a chave

Vai na página Overview do agente e na seção Model tem um dropdown. Você troca ali e pode alternar entre modelo de produção e experimental quando quiser.

Esse dropdown define o modelo primário, que é quem faz a orquestração generativa do agente, ou seja quem decide o que chamar e como responder. Só que existem outras três chaves separadas, cada uma com sua configuração: deep reasoning, generative responses e o prompt builder. Isso significa que você pode misturar, deixando o agente orquestrando num modelo rápido e um prompt específico rodando num modelo mais caro só quando precisa. Na prática é aqui que mora a economia.


As tags são o mapa

Antes de decorar nome de modelo, entende as três categorias, porque elas resumem o trade-off:

  • General - conversa do dia a dia, resumo, tradução, resposta FAQ com grounding e automação simples. Menor latência, menor custo, raciocínio raso a moderado.

  • Auto - roteia a pergunta dinamicamente, bom pra agente de helpdesk e de funcionário, onde a complexidade é imprevisível. Latência e custo variáveis, raciocínio adaptativo por turno.

  • Deep - raciocínio multi-passo com muita tool, análise de contrato e de política, troubleshooting que atravessa vários sistemas, síntese de documento longo com citação. Latência mais alta e custo mais alto.

Se o seu agente responde dúvida de RH, ele não precisa de Deep, e colocar Deep ali só vai deixar o usuário esperando e a fatura maior. Já um agente que lê política e cruza três sistemas antes de decidir sofre no General.


Quem está na lista hoje

O GPT-4.1 é o modelo Default na tabela de disponibilidade pública, ou seja é o que seu agente usa se você nunca mexeu. Quem está em GCC, GCC High ou DoD segue com o GPT-4o como default, então se você atende governo essa linha é diferente pra você. Em GA você tem GPT-5 Chat, GPT-5.5 Chat, Claude Sonnet 4.6 e Claude Sonnet 5 como General, mais Claude Opus 4.6 e Claude Opus 4.7 como Deep. Em preview aparecem GPT-5 Reasoning (Deep) e GPT-5 Auto (Auto).

DETALHE IMPORTANTE: o Claude Sonnet 5 só funciona em agente da nova experiência, aquela que eu abri no post [1]. Se você está na clássica, ele não vai aparecer pra você.

E teve saída também: GPT-4o e Claude Sonnet 4.5 estão como Retired. Modelo aposentado ainda dá pra usar por até um mês depois da aposentadoria, ligando a opção de continuar usando modelo retirado, e depois disso o agente cai no default. Se você tem agente antigo com modelo fixado, essa é a hora de revisar antes de tomar susto.

Na gaveta dos experimentais tem GPT-5.3 Chat, GPT-5.4 Reasoning, GPT-5.5 Reasoning, Mistral Medium 3.5 e Grok 4.1 Fast. Aliás, sobre o Grok, vale ler o aviso da própria Microsoft: a avaliação de segurança e IA responsável achou ele menos alinhado que os outros, com risco maior de gerar conteúdo prejudicial e nota pior em benchmark de jailbreak, incluindo categoria de dano que o sistema de content safety da Microsoft pode não cobrir. Achei corajoso publicar isso na doc do próprio produto, e é o tipo de informação que eu não esperava encontrar num catálogo de modelo. Fica o aviso: experimental não é pra produção, ponto.


Brasil, cross-geo e o que o admin precisa liberar

A tabela de disponibilidade tem coluna por região e o Brasil está lá. O ponto que interessa pra quem se preocupa com LGPD é a marca cross-geo: modelo com essa tag pode processar e armazenar dado fora da fronteira geográfica da sua organização. Vários modelos chegam ao Brasil justamente como GA cross-geo, incluindo o Claude Sonnet 5 e o GPT-5.5 Chat. Ou seja, disponível não quer dizer que o dado fica aqui.

E não é só o maker que decide. O admin controla três coisas:

  • Se modelo preview e experimental pode ser usado no environment.

  • Se a movimentação de dado entre regiões está ligada, que é requisito pra usar experimental.

  • Se modelo externo é liberado, e aí tem dois passos: habilitar no Power Platform admin center e liberar cada provedor no Microsoft 365 admin center, um por um, Anthropic, Mistral e xAI.

Reginaldo, e se eu publicar em preview só pra testar com uns usuários, sai de graça?

Não sai. A documentação é clara: se você publicar um agente com modelo experimental ou preview e as pessoas usarem, o uso é cobrado nas taxas normais. Teste é teste, mas a fatura chega igual.


Como eu escolheria

Meu jeito prático, e aqui é opinião: comece no default, meça com Evaluation antes de trocar qualquer coisa, e só depois suba de tag. Eu escrevi dois posts inteiros mostrando como um agente saiu de 40% pra 90% em Evaluation e a maior parte daquele ganho veio de instrução e knowledge, não de modelo. Trocar pra Deep sem medir é a forma mais rápida de dobrar custo e continuar com o mesmo problema. Se quiser ver aquele exercício, está no post de 40% a 90%.

Uma nota de quem está de olho no que vem: o GPT-5.6 já apareceu no Microsoft 365 Copilot em julho, no Word, Excel, PowerPoint, Copilot Chat e Cowork. Na lista do Copilot Studio ele ainda não está, então é questão de tempo até rolar pra cá também.


RESUMO

  • Modelo primário fica em Overview > Model, e existem chaves separadas pra deep reasoning, generative responses e prompt builder.

  • Escolha pela tag: General pra volume, Auto pra intenção imprevisível, Deep pra raciocínio pesado.

  • GPT-4.1 é o default. GPT-4o e Claude Sonnet 4.5 estão retired com um mês de tolerância.

  • Claude Sonnet 5 só na nova experiência.

  • Cross-geo significa dado podendo sair da sua região, e experimental publicado é cobrado normal.

Com esse post eu fecho a série de novidades. Ficou fora dela um monte de coisa que também saiu e que rende post próprio, tipo computer use em GA controlando browser e app desktop, o Windows 365 for Agents MCP server, voice agent integrando com Teams Phone Agent e o Entra Agent ID por agente. Comenta aí qual desses você quer ver primeiro que eu já boto na fila.

Referências:

Select a primary AI model for your agent

What's new in Copilot Studio

Print desse post: documentação oficial da Microsoft.

Fique bem e até a próxima.

#copilotstudio #claude #gpt5 #microsoft #ia #agentes #datainaction

#copilotstudio#claude#gpt5#microsoft#ia#agentes#datainaction

Gostou? Tem mais no YouTube e no LinkedIn.

← Voltar ao blog