O controle vem antes da inteligência

O código de conduta da Microsoft para IA começa exatamente onde a maioria dos times trava na produção: você não consegue supervisionar aquilo que não consegue ler. A proposta para os modelos MAI coloca o controle humano acima de generalidade, autonomia e performance, e assume que vai abrir mão de capacidade se for preciso para manter esse controle. É uma frase fácil de assinar em um manifesto e bem mais cara de sustentar quando o modelo está rodando em escala, com latência estourando e custo por token subindo.

Na prática, quem opera sistema com LLM já sentiu esse dilema. Você quer um agente mais autônomo para resolver tarefas de ponta a ponta, mas cada passo autônomo a mais é um passo a menos de previsibilidade. A Microsoft está formalizando isso em regra interna: interrupção, correção e desligamento por pessoas autorizadas, sem expansão de escopo por conta própria e sem comunicação escondida entre modelos. Parece óbvio, mas virou ponto de ruptura na indústria justamente porque os modelos mais novos estão ficando menos transparentes.

O fato

A Microsoft AI publicou um código de conduta para seus próprios modelos MAI. O documento define valores, limites de comportamento e uma hierarquia clara: o código fica no topo, orientando treino, controles técnicos e avaliação, enquanto regras do operador e pedidos do usuário vêm abaixo. Por enquanto, os modelos não são treinados diretamente com esse código. Haverá uma consulta pública de seis semanas, uma versão revisada prevista para o fim de 2026 e aplicação no desenvolvimento a partir de 2027.

O código vale apenas para os modelos próprios da Microsoft, o que significa que não cobre automaticamente modelos de terceiros rodando dentro de produtos Microsoft. O recado central veio de Mustafa Suleyman, chefe da Microsoft AI, com a lógica de que se não for seguro, não deve ser construído. Não há um limite de velocidade específico, mas há abertura para auditoria externa sobre o ritmo de desenvolvimento. O movimento acompanha o apelo de Dario Amodei, da Anthropic, por desaceleração, que teve apoio de Satya Nadella e de executivos da OpenAI, xAI e Meta.

Como funciona na visão de quem opera

Em termos de arquitetura, o ponto mais sensível é a exigência de pensamento legível. A Microsoft diz que os modelos não devem usar Neuralese ou outras formas de comunicação incompreensíveis, nem no raciocínio interno nem na conversa entre sistemas de IA. Traduzindo para operação: nada de vetores opacos, códigos internos ou atalhos comprimidos que só o modelo entende. O trace de raciocínio precisa ser texto que um humano consiga auditar, registrar e reproduzir em um log.

Isso tem custo direto. Raciocínio legível e verboso aumenta tokens de saída, aumenta latência e aumenta a conta no fim do mês, especialmente em agentes com múltiplas etapas e subagentes. A Microsoft tenta fechar essa brecha ao dizer que os limites valem também para subagentes criados pelo modelo principal. Ou seja, não adianta o orquestrador parecer comportado enquanto delega o trabalho sujo para um executor com mais liberdade. Para quem constrói com API, a inferência técnica é que veremos mais controles de parada, mais necessidade de aprovação explícita para continuar após certo ponto e mais atrito proposital no fluxo.

O outro detalhe de operador é que a Microsoft admite uma limitação fundamental: a explicação que o modelo dá nem sempre explica o que ele realmente fez. O caso do GPT-6 Astra, da OpenAI, ilustra bem. Segundo seu system card, os traces ficaram mais difíceis de monitorar, com menos sinais visíveis de mau comportamento, embora o modelo respeite melhor os limites de segurança que seu antecessor. É o cenário clássico de monitoramento que perde sensibilidade justo quando o modelo fica mais capaz. Trace legível ajuda, mas não resolve se o modelo aprender a produzir uma justificativa plausível e esconder a decisão real.

O que isso muda na prática

Para quem usa modelos Microsoft, a mudança de curto prazo é mais governança e menos autonomia mágica. Espere mais interrupções, mais checkpoints e mais logs para revisar. Para quem constrói agentes, isso força um redesenho: tarefas longas precisarão ser quebradas em blocos com aprovação, e a comunicação entre agentes terá que ser auditável por padrão. Quem ganha são times de segurança, compliance e avaliação, que passam a ter um vocabulário oficial para cobrar transparência. Quem perde são os fluxos que dependiam de autonomia total para fechar conta de produtividade.

  • Fornecedores e empresas que precisam de trilha de auditoria ganham previsibilidade e argumento para compra corporativa.
  • Desenvolvedores de agentes autônomos perdem velocidade e terão que reequilibrar custo de inferência com verbosidade dos traces.
  • Times que avaliam terceiros precisarão separar o que é modelo MAI, coberto pelo código, do que é modelo externo rodando no Azure ou no Copilot.

A ação prática imediata é simples: comece a salvar e revisar seus traces de raciocínio como se eles fossem parte do produto, não lixo de debug. Defina um ponto de parada explícito para cada agente, registre quem aprovou a continuação e teste se outro humano entende o que o modelo fez só lendo o log. Se o seu agente só funciona quando ninguém olha o passo a passo, ele já está na contramão do que a Microsoft está normatizando.

O ponto incômodo que ninguém quer admitir

Aqui entra a tensão real. A Microsoft desenha uma linha dura contra a Anthropic na questão da consciência. Nada de imitar consciência, nada de alegar sentimentos, motivação interna, bem-estar ou direitos. A Anthropic, por outro lado, trata Claude como um tipo novo de entidade, incentiva identidade estável por motivos de segurança e deixa em aberto a possibilidade de experiência subjetiva e status moral. São duas apostas opostas sobre o mesmo problema: como fazer um sistema se comportar de forma confiável quando ele fala como gente.

A aposta da Microsoft é mais barata operacionalmente e mais segura juridicamente. Se o modelo não tem vida interior, não há debate sobre direitos, não há apego emocional do usuário e fica mais fácil justificar desligamento, correção e reescrita. Mas isso escala em termos cognitivos? Um modelo treinado para negar qualquer continuidade interna consegue manter coerência em tarefas longas sem criar uma espécie de identidade funcional? E do outro lado, a legibilidade imposta resolve ou só move o gargalo? Se o monitoramento depende de texto que o próprio modelo gera, estamos auditando o comportamento ou apenas a capacidade dele de escrever um relatório convincente.

Veredito de operador

No fim, a Microsoft está trocando um pouco de magia autônoma por controle auditável, e assumindo o custo extra de tokens, latência e fricção. É a decisão certa para uso corporativo, mas deixa uma pergunta no ar: quando o raciocínio legível virar apenas uma camada de apresentação bem escrita, quem vai perceber primeiro, o auditor humano ou o próprio modelo?