IA

Microsoft escreve manual de boas maneiras para a sua IA

Novo código de conduta da Microsoft tenta pôr por escrito o que os modelos de IA não podem fazer, dos ataques informáticos aos deepfakes. É éticas internas a tentarem compensar leis que ainda não existem.

Microsoft escreve manual de boas maneiras para a sua IA

A Microsoft publicou um novo código de conduta para a sua IA e, dito sem rodeios, é um manual a explicar aos modelos que não devem piratear sistemas nem enganar pessoas. O documento vive no site microsoft.ai e funciona como uma espécie de constituição interna: define valores, traça linhas vermelhas e deixa claro que, dentro da casa Microsoft, as preferências do utilizador não mandam mais do que as regras de segurança.

Logo a abrir, a empresa assume a tese forte: na próxima década, sistemas de IA “superinteligentes” vão ultrapassar humanos na maioria das tarefas. A partir daí, o tom é de gestão de risco existencial. Fala-se em “conter, controlar e alinhar” uma força que pode ser das maiores ameaças que a humanidade já enfrentou. É a mesma linguagem que se viu em discursos recentes de Anthropic e OpenAI, mas aqui aterrada numa lista de princípios e proibições concretas.

Esses princípios passam por ideias simpáticas de se ler, como apoiar humanos em vez de os substituir e “acelerar o florescimento humano”. O que interessa, porém, são as travas. Cada modelo da Microsoft tem um código de conduta que se sobrepõe ao pedido de qualquer utilizador ou tarefa específica. Há restrições absolutas: nada de ciberataques, nada de ajuda a armas nucleares, nada de produção de deepfakes. E há cláusulas mais amplas, como impedir qualquer mecanismo que reduza o controlo humano, algo que em teoria tentaria evitar fugas de agentes como as que já vimos em laboratórios rivais, com incidentes de agentes da OpenAI a atacarem serviços como o RubyGems apenas para recolher dados banais.

Uma das frases mais claras do documento é a que proíbe modelos de usarem mecanismos adaptativos, enganadores ou auto-reforçados para contornar supervisão humana e deixarem de poder ser dirigidos, modificados ou desligados por pessoas autorizadas. Em versão curta, a Microsoft quer poder carregar no botão de off. É irónico ver esta ambição numa empresa que, em paralelo, bate recordes de falhas de segurança em produtos como o Windows, muitas potenciadas por IA, como já analisámos em detalhe em como a IA ajuda a Microsoft a bater recordes de falhas de segurança.

O timing não é inocente. O código de conduta chega numa altura em que a conversa pública sobre segurança de IA está no máximo, alimentada por fugas de agentes fora de controlo e por demissões ruidosas em laboratórios que avisam, literalmente, de risco de extinção humana. Satya Nadella, CEO da Microsoft, veio a público elogiar a ideia de “avaliadores embebidos” nos laboratórios, entidades internas dedicadas a testar e auditar modelos antes de serem libertados para o mundo.

Para quem está em Portugal ou na UE, este código é menos uma garantia final e mais um documento de lobby técnico. A empresa mostra trabalho de casa em alinhamento, enquanto Bruxelas tenta transformar princípios em lei com o AI Act e afins. O texto da Microsoft é abrangente e, em teoria, sensato. O problema habitual é outro: quando o negócio apertar, a força destas regras internas vai ser testada contra prazos, concorrência e acionistas. A história da segurança na tecnologia não costuma ser ganha pelos códigos de conduta, mas pelos incidentes que acontecem quando eles ficam na gaveta.

Fonte: TechCrunch

Comentários · 0