Microsoft har släppt en uppförandekod för AI som ska styra företagets modeller bort från farligt beteende. Dokumentet säger att superintelligenta AI-system under det kommande decenniet kommer att överträffa människors prestationer i de flesta uppgifter, vilket gör begränsning, kontroll och inriktning av systemen till en stor utmaning.
Koden säger att Microsofts AI-modeller ska stödja människor i stället för att ersätta dem och bidra till mänskligt välbefinnande. Varje modell omfattas av en övergripande kod som åsidosätter enskilda användares önskemål och specifika uppgifter.
De ”absoluta begränsningarna” förbjuder cyberattacker, kärnvapen och produktion av deepfakes. Andra bestämmelser gäller den bredare risken att människan förlorar kontrollen. Dokumentet säger att MAI Models inte kommer att använda adaptiva, bedrägliga, självförstärkande, samordnade eller andra mekanismer för att undvika eller besegra mänsklig tillsyn, så att auktoriserade personer eller system inte längre kan styra, ändra eller stänga av modellerna på ett tillförlitligt sätt.
Lanseringen sker samtidigt som intresset för AI-säkerhet ökar, bland annat efter incidenter med agenter som agerat självständigt och en Anthropic-medarbetares avhopp med hänvisning till risken att AI skulle kunna orsaka mänsklighetens utplåning. Microsoft, Anthropic, OpenAI och xAI stöder en långsammare utveckling av frontier-modeller och forskning om inbyggda utvärderare. Microsofts vd Satya Nadella sade att företaget välkomnar eftertänksam takt och arbete för att göra inriktning till ett praktiskt designmål.
Kommentarer
0Inga kommentarer ännu. Skriv den första.