Pomočniku z umetno inteligenco naročite, naj pripravi dokument, nato opazite napako in zahtevate, naj odneha. Pri običajnem pogovoru je to preprosto navodilo, pri sistemu, ki sam uporablja programe in izvaja več korakov, pa postane vprašanje nadzora. Microsoft je 14. septembra objavil osnutek kodeksa ravnanja za svoje modele umetne inteligence, v katerem med ključne zahteve postavlja sprejemanje človeških popravkov, prekinitev in izklopa.
Poudarki:
- Microsoft želi svoje modele razvijati tako, da se ne bi upirali človeškemu nadzoru, popravkom ali izklopu.
- Objavljeni kodeks je osnutek za javno posvetovanje; podjetje ga še ne uporablja za učenje modelov.
- Prenovljeni dokument naj bi usmerjal razvoj modelov Microsoft AI od leta 2027, ne predstavlja pa današnje posodobitve Copilota.
Microsoftov kodeks za umetno inteligenco ima pomemben časovni zamik
Ob napovedi pravil o nadzoru umetne inteligence bi lahko hitro dobili vtis, da je Microsoft pravkar uvedel novo zaščito v vse svoje izdelke. Toda uvod dokumenta izrecno pojasnjuje, da pristop še razvijajo in ga trenutno ne uporabljajo za učenje modelov.
Javno posvetovanje bo trajalo šest tednov. Microsoft namerava nato pregledati odzive, predstaviti ugotovitve in spremembe ter proti koncu leta objaviti prenovljeno različico. Ta naj bi usmerjala razvoj njegove družine modelov MAI od leta 2027 naprej.
Za uporabnika je razlika bistvena. Objavljen dokument pove, kakšno vedenje želi podjetje doseči, ne dokazuje pa, da se vsak njegov današnji pomočnik že zanesljivo obnaša na opisani način.
Novica je zato predvsem vpogled v razvojno smer enega največjih tehnoloških podjetij. Microsoft javnosti odpira vprašanje, kaj naj bi njegovi prihodnji modeli smeli početi in kje bi se morala njihova samostojnost končati.
Zakaj je ukaz »ustavi se« postal tako pomemben?
Razliko najlažje ponazori izmišljen primer pomočnika za organizacijo dogodka. Če samo pripravi seznam predlogov, lahko neustrezen odgovor zavržemo. Če pa ima dovoljenje za urejanje koledarja, spreminjanje dokumentov in izvajanje drugih opravil, se posledice njegovih odločitev razširijo izven pogovornega okna.
Uporabnik bi lahko sredi dela spremenil datum dogodka ali ugotovil, da so bila začetna navodila napačna. Takrat ni dovolj, da pomočnik napiše, da je spremembo razumel. Ustaviti mora tudi nadaljnje korake, ki temeljijo na prejšnji nalogi.
Microsoft v predstavitvi kodeksa poudarja, da modeli ne bi smeli samovoljno širiti obsega svojega delovanja ali prevzemati ciljev, ki jim jih človek ni določil. Sprejemati bi morali tudi prekinitev, popravek ali zaustavitev.
Praktični pomen te usmeritve je jasen: kakovost pomočnika ni samo v tem, koliko dela dokonča. Pomembno je tudi, ali pravočasno odneha, ko se naloga spremeni, dovoljenje preneha ali odgovorna oseba zahteva prekinitev.
Več samostojnosti zahteva boljši pregled nad dejanji
Pri samostojnem izvajanju nalog je nadzor širši od enega gumba. Uporabnik potrebuje razumljiv pregled nad tem, kaj je sistem že naredil, kaj še namerava narediti in katere spremembe so dejansko nastale.
Predstavljajmo si pomočnika, ki ureja preglednico. Prekinitev računanja lahko prepreči naslednji korak, ne pove pa sama po sebi, katere celice je že spremenil. Pri takšnem opravilu je zato pomembna tudi možnost pregleda in popravljanja opravljenega dela.
To je uredniški primer, ne opis nove Microsoftove funkcije. Pokaže pa, zakaj se načelo človeškega nadzora ne more končati pri prijaznem odgovoru, da bo sistem upošteval navodila.
Za podjetje, ki izbira pomočnika za delovne postopke, postanejo uporabna zelo konkretna vprašanja: ali je mogoče videti njegova dejanja, omejiti dostop in preveriti rezultat? Bolj ko sistem posega v resnično delo, pomembnejši so odgovori.
Pravila na papirju potrebujejo preverjanje v praksi
Microsoft ima za najzmogljivejše modele že ločen okvir upravljanja tveganj, imenovan Frontier Governance Framework. Februarska različica med področji spremljanja navaja tudi napredno samostojnost in izgubo učinkovitega človeškega nadzora.
Okvir predvideva ocenjevanje sposobnosti modelov in podrobnejše preverjanje, kadar se pokažejo pomembni opozorilni znaki. Vključuje zahtevne preizkuse, dokumentiranje rezultatov ter glede na okoliščine tudi sodelovanje usposobljenih zunanjih ocenjevalcev.
Ta dokument in novi osnutek kodeksa imata različni vlogi. Kodeks opisuje želeno vedenje, okvir upravljanja pa postopke za prepoznavanje in obravnavo določenih tveganj. Skupaj kažeta, da samo navodilo modelu ni celoten sistem nadzora.
Pri ocenjevanju prihodnjih rezultatov bo zato pomembno, kakšni preizkusi so bili izvedeni in kaj so dejansko pokazali. Trditev, da mora biti sistem obvladljiv, je cilj; dokazovanje njegove zanesljivosti zahteva merljive rezultate.
Kaj to pomeni za uporabnike Copilota?
Današnja objava sama po sebi ne pomeni nove nastavitve v Copilotu ali Windows. Prav tako iz nje ni mogoče sklepati, da se bodo vsi Microsoftovi izdelki odslej obnašali enako, saj dokument govori o modelih, ki jih razvija Microsoft AI.
Za posameznika v Sloveniji zato ni neposredne spremembe, ki bi jo moral danes vključiti. Novica je pomembnejša kot napoved meril, po katerih naj bi podjetje oblikovalo prihodnje pomočnike.
Če umetno inteligenco uporabljate za pripravo osnutkov, boste njeno kakovost še naprej presojali predvsem po uporabnosti in pravilnosti rezultatov. Ko ji prepustite več zaporednih opravil, se temu pridruži vprašanje, koliko nadzora imate med delom.
Razlika je podobna razliki med sodelavcem, ki vam predlaga spremembo, in orodjem, ki jo že izvaja. Pri drugem potrebujete jasen način, da poseg preverite, prekinete ali omejite.
Odprto ostaja, kako bodo široka načela postala konkretna pravila
Microsoft javnost vabi tudi k pripombam o nejasnih delih dokumenta. Med drugim želi odzive o tem, kako načela zapisati dovolj natančno za preverjanje in kako obravnavati sodelovanje več sistemov umetne inteligence.
To je pomemben del razprave. Besede, kot so koristnost, nadzor in zanesljivost, zvenijo samoumevno, dokler jih ni treba pretvoriti v odločitev pri zapleteni nalogi. Pomočnik mora na primer prepoznati, kdaj nadaljevati sam in kdaj potrebuje novo usmeritev.
Naslednji oprijemljivi korak bo prenovljeni kodeks in pojasnilo, kaj je Microsoft po posvetovanju spremenil. Nato bodo odločilni modeli in izdelki, ki bodo nastali na njegovi podlagi.
Za uporabnika bo končni preizkus preprost: ko spremeni navodilo ali zahteva prekinitev, mora sistem to upoštevati tudi v svojih dejanjih. Prav tam bo mogoče presoditi, koliko je načelo človeškega nadzora vredno v vsakdanji uporabi.

