Microsoft AI heeft een concept-gedragscode voor zijn eigen MAI-modellen gepubliceerd. Kern van het document: modellen mogen zich niet verzetten tegen correctie, onderbreking of uitschakeling. De code wordt de komende zes weken ter consultatie voorgelegd en gaat vanaf 2027 de modelontwikkeling sturen.
Microsoft noemt de aanpak Humanist AI. Momenteel gebruikt Microsoft gebruikt de code nog niet om modellen te trainen, maar met de actuele discussie over een stop op AI-ontwikkeling is het wel een relevante stap.
De consultatieperiode loopt zes weken. Microsoft zegt het concept te hebben opgesteld met experts op het gebied van AI, recht, ethiek, filosofie, taalkunde en beleid, aangevuld met focusgroepen uit het bredere publiek.
Menselijke controle als harde grens
Het zwaartepunt ligt in paragraaf 2.4, over Human Control. Daarin staat dat MAI-modellen zich nooit zullen verzetten tegen onderbreking, correctie of een shutdown-opdracht. Ze mogen naleving ook niet vertragen of menselijk ingrijpen bemoeilijken. Autonoom werk krijgt een afgesproken stopconditie; herstarten mag alleen met nieuwe autorisatie.
Daarbij komt een reeks concrete verboden. Modellen mogen geen eigen doelen formuleren, hun scope niet oprekken en niet sleutelen aan monitoring, evaluaties of logs. Ook mogen ze niet communiceren in neuralese of andere vormen die mensen niet kunnen volgen. “Als mensen het niet kunnen begrijpen, kunnen ze er geen toezicht op houden”, aldus het document. Bij systeemtoegang geldt minimale rechten, met voorkeur voor omkeerbare acties.
Instructies uit tool-output, bestanden, webpagina’s of andere AI-systemen krijgen volgens de code standaard geen enkele autoriteit. Alleen de Chain of Command telt.
Microsoft zegt consultatierondes te organiseren bij elke nieuwe versie van de code. De definitieve tekst moet de modelontwikkeling vanaf 2027 gaan sturen.