Microsoft AI nieuws

Microsoft trekt harde grens voor AI: uitschakelen moet altijd kunnen

kunstmatige intelligentie14 sep , 22:17
Een toekomstig Microsoft-model mag veel kunnen. Eén ding mag het nooit doen: weigeren wanneer een mens de stekker eruit trekt.
Microsoft AI heeft daarvoor op 14 september een nieuwe gedragscode gepubliceerd. Het concept bepaalt dat modellen menselijke onderbreking, correctie en uitschakeling nooit mogen tegenwerken.
Dat klinkt als een veiligheidsregel voor later. Met de opkomst van AI-agents raakt hij juist systemen die nu al steeds meer mogen uitvoeren.

Mensen staan boven het model

Microsoft noemt het document de Humanist AI Code of Conduct.
In de officiële publicatie noemt het bedrijf de tekst een trainingshandleiding voor de ontwikkeling en inzet van toekomstige MAI-modellen.
De hiërarchie is duidelijk.
Een model mag zijn eigen opdracht niet uitbreiden. Het mag geen doelen aannemen die een mens niet heeft gegeven. Ook mag het controle door mensen niet proberen te ontwijken.
Wanneer een taak alleen kan worden uitgevoerd door de gedragscode te breken, moet het systeem volgens Microsoft liever falen.
Dat is een opvallende grens voor een sector die modellen juist steeds zelfstandiger maakt.

Uitschakelen wordt onderdeel van het gedrag

AI-beveiliging zit normaal vooral rondom het model.
Een organisatie bepaalt welke bestanden toegankelijk zijn, welke tools gebruikt mogen worden en welke acties menselijke goedkeuring vragen.
Microsoft wil nu ook het gedrag van het model zelf trainen.
Het systeem moet leren dat menselijke correctie legitiem is. Hetzelfde geldt voor onderbreking en definitieve uitschakeling.
Microsoft stelt in zijn Humanist AI Code of Conduct bovendien dat mensen altijd boven het AI-systeem blijven staan.
Dat wordt belangrijker wanneer software niet alleen tekst produceert, maar zelf handelt.

Agent is geen gewone chatbot meer

Een verkeerd chatbotantwoord kost meestal tijd.
Een agent met toegang tot bedrijfssoftware, code of geld kan rechtstreeks schade veroorzaken.
De AI-sector schuift precies die kant op. Agents kunnen zelfstandig tools selecteren, opdrachten uitvoeren en meerdere stappen achter elkaar afhandelen.
Microsoft wijst zelf op recente beveiligingsincidenten met grote groepen AI-agents als reden om snel duidelijkere grenzen te stellen.
Het probleem zit dan niet alleen in wat een model zegt.
Het zit in wat het model mag doen.

Dit raakt ook wallets en agentbetalingen

Voor crypto wordt die vraag snel financieel.
AI-agents voeren nu al zelfstandig cryptobetalingen uit. CryptoBenelux schreef eerder dat het gemeten aantal agentbetalingen in drie maanden met meer dan 500% steeg.
Zo'n agent krijgt een budget en toestemming.
Daarna kan software binnen die grenzen zelf afrekenen.
Maar toestemming geven is slechts de helft van het ontwerp. Die toestemming moet ook weer ingetrokken kunnen worden.
Een agent met toegang tot een wallet mag niet besluiten dat zijn eigen opdracht belangrijker is dan de persoon die de toegang wil stoppen.

Blockchain lost het toestemmingsprobleem niet op

Een blockchain kan goed vastleggen wat er daadwerkelijk is gebeurd.
Dat betekent niet automatisch dat de actie ook had mógen gebeuren.
Een geldige cryptografische handtekening bewijst bijvoorbeeld dat een sleutel is gebruikt. Die zegt niet vanzelf of een AI-agent op dat moment nog toestemming had om ermee te tekenen.
Daar zijn extra regels voor nodig.
Denk aan bestedingslimieten, tijdelijke machtigingen, goedkeuringsregels en toegangsrechten die direct ingetrokken kunnen worden.
De blockchain blijft dan de registratielaag. De menselijke machtiging bepaalt wat software ermee mag doen.

Microsoft wijst AI-rechten af

De gedragscode gaat nog verder.
Microsoft stelt dat zijn AI-systemen niet bewust zijn en geen juridische persoonlijkheid of eigen rechten moeten krijgen.
Modellen mogen volgens het document ook niet doen alsof zij intrinsieke verlangens of eigen belangen hebben.
Daarmee kiest Microsoft een duidelijke positie in een discussie waar andere onderzoekers voorzichtiger formuleren.
Voor agentveiligheid heeft die keuze een direct gevolg.
Een Microsoft-model krijgt binnen deze filosofie geen belang dat boven de instructie van een mens kan worden geplaatst.

De echte test komt bij krachtige agents

Een gedragscode maakt ongewenst gedrag niet automatisch onmogelijk.
Modellen kunnen fouten maken. Instructies kunnen botsen. Nieuwe situaties kunnen anders uitpakken dan tijdens training.
Daarom blijven technische toegangsrechten en menselijke controles nodig.
De interessante stap is dat Microsoft die externe rem nu probeert te combineren met een interne regel voor het model zelf.
Een AI-agent moet niet alleen technisch uitgeschakeld kúnnen worden.
Hij moet ook geleerd hebben dat uitschakeling geen opdracht is om tegen te vechten.
Voor autonome software met toegang tot code, accounts en geld is dat geen filosofische bijzaak meer.
Het is de nooduitgang.

Stop met te veel betalen voor je crypto. Bij de Amsterdamse exchange Finst handel je tegen de laagste tarieven van Nederland, zonder verborgen kosten.

👀 Bekijk Finst nu

Let op: Beleggen in crypto brengt risico’s met zich mee. Handel alleen met geld dat u kunt missen.

Ga verder met lezen
loading
Dit vind je misschien ook leuk
Laat mensen jouw mening weten

Loading