Juhtimine · Juhtimine
Human-in-the-loop: inimkontroll AI-töövoos
Mis on human-in-the-loop?
Inimene saab AI-ga samas ahelas osaleda kolmes põhirollis:
| Inimese roll | Mida inimene teeb | Praktiline näide |
|---|---|---|
| Õpetaja | märgendab või parandab treeningandmeid | märgib, milline kliendipäring kuulub arvelduse alla |
| Hindaja | kontrollib mudeli väljundit ja annab tagasisidet | võrdleb AI kokkuvõtet algdokumendiga |
| Otsustaja | kinnitab, muudab või peatab tegevuse | kinnitab tagasimakse enne raha liikumist |
Generatiivse AI ja agentide puhul on kõige nähtavam kolmas roll: AI valmistab otsuse või tegevuse ette, kuid määratud lävel töö peatub. Inimene vaatab üle sisendi, kasutatud allikad, väljundi ja võimaliku mõju ning alles siis lubab töövoole järgmise sammu.
Euroopa Liidu tehisintellekti määruse artikkel 14 käsitleb inimjärelevalvet kõrge riskiga AI-süsteemides. Selline süsteem peab olema kavandatud nii, et füüsiline isik saaks seda kasutamise ajal tõhusalt jälgida. Järelevalvet tegev inimene peab muu hulgas suutma mõista süsteemi võimeid ja piiranguid, vältida automaatse väljundi pimesi usaldamist, väljundit eirata või ümber pöörata ning vajadusel süsteemi peatada.
Human-in-the-loop töövoog viie sammuga
- AI valmistab tegevuse ette. Süsteem kogub lubatud sisendi, kasutab kinnitatud allikaid ja koostab väljundi või tegevusettepaneku.
- Reegel hindab mõju. Kontrollpunkt käivitub summa, andmeklassi, adressaadi, ebakindluse või muu eelnevalt määratud läve alusel.
- Töö peatub enne mõju. Kinnitus peab toimuma enne kirja saatmist, makset, avaldamist või andmete jagamist.
- Inimene teeb sisulise otsuse. Valikud on kinnita, paranda, lükka tagasi või anna juhtum edasi pädevamale inimesele.
- Otsus läheb logisse ja testidesse. Tagasilükkamise põhjus aitab parandada reeglit, prompti, teadmusbaasi või hindamist.
Generatiivse AI väljundi täpsust, kvaliteeti, töökindlust ja autentsust tuleb hinnata nii inimjärelevalve kui ka automatiseeritud kontrollidega. HITL ei asenda teste: inimese kontroll ja tehniline mõõtmine täiendavad teineteist.
Millal peab inimene otsustama?
1. Raha ja siduv kohustus
Makse, tagasimakse, ost, hinnalubadus või lepingu kinnitamine vajab vähemalt määratud piiri ületades inimotsust. OpenAI agentide juhend toob kõrge riskiga tegevuste näidetena välja maksed, suuremad tagasimaksed ja tellimuste tühistamise.
Kontrollpunkt: näita summa, alus, saaja, kasutatud allikad ja erand reeglist. Luba kinnitada, parandada või tagasi lükata.
2. Inimese õigusi või võimalusi mõjutav otsus
Värbamine, krediit, kindlustus, haridus, tervishoid ja töötaja hindamine võivad mõjutada inimese õigusi või võimalusi. Enne kasutuselevõttu tuleb hinnata mõju inimeste õigustele, kallutatust ja ebaõiglasi tulemusi ning tagada sekkumisvõimalus.
Kontrollpunkt: inimene hindab nii algandmeid, mudeli põhjendust kui ka võimalikku ebavõrdset mõju. Pelgalt lõpptulemuse näitamisest ei piisa.
3. Avalik või kliendile suunatud sõnum
Avaldamine võib tekitada maine-, lepingu- või andmekaitseriski. Esimeses versioonis peaks agent valmistama ette mustandi, mitte seda iseseisvalt saatma.
Kontrollpunkt: kinnitaja näeb adressaati, täielikku sõnumit, allikaid ja manuseid samas vaates, kus ta otsustab.
4. Tundlike andmete kasutamine või jagamine
Inimkinnitus ei muuda keelatud või aluseta andmetöötlust lubatuks. Kontrollpunkt peab kinnitama, et kasutuseesmärk, andmete ulatus, ligipääs ja edastus on heaks kiidetud.
Kontrollpunkt: kui andmeklass või adressaat ei vasta reeglile, peab süsteem tegevuse blokeerima, mitte lihtsalt hoiatama.
5. Erand, mida süsteem pole varem näinud
Agent võib anda enesekindla vastuse ka ebapiisava info korral. Anna juhtum inimesele üle, kui allikas puudub, väljundid lähevad vastuollu või lubatud tõrgete ja katsete piir saab täis.
Kontrollpunkt: eskaleeri, kui allikas puudub, väljundid on vastuolus, kindluslävi jääb täitmata või lubatud katsete arv saab täis.
Hea kontrollpunkti neli tingimust
- kontrollijal on otsustamiseks vajalik kontekst;
- valikud ei piirdu formaalse kinnitamisega;
- otsus ja selle alus logitakse;
- tagasilükatud juhtum muutub testjuhtumiks või paranduseks.
Kontrollpunkt võib parandada kriitiliste otsuste ohutust ja töökindlust, kuid lisab töövoole tehnilist ning korralduslikku keerukust. Vali kontrollpunktid võimaliku mõju, mitte mugavuse järgi.
Näide: klienditeeninduse tagasimakse
Kujuta ette e-poe klienditeeninduse agenti, mis loeb kliendi pöördumist, kontrollib tellimuse olekut ja koostab lahenduse. Kõiki juhtumeid ei ole mõistlik inimesele saata.
| Juhtum | AI tegevus | Inimkontroll |
|---|---|---|
| Tarneaja küsimus, vastus kinnitatud teadmusbaasis | koostab ja saadab vastuse | pole vajalik, kui allikas on värske |
| Tagasimakse kuni 30 eurot, tingimused üheselt täidetud | valmistab tagasimakse ette | pisteline järelkontroll |
| Tagasimakse üle 30 euro või erand reeglist | peatab töö ja näitab otsuse alust | teenindaja kinnitab või lükkab tagasi |
| Vastuolulised andmed või võimalik pettus | ei tee tagasimakset | eskaleerib vastutavale rollile |
Kinnitaja peab samas vaates nägema tellimust, kliendi sõnumit, tagasimakse põhjust, summat, rakendatud reeglit ja AI tehtud muudatusi. Kui inimene ei vasta, jääb raha liigutamata. Selline vaikeolek piirab mõju ka siis, kui töövoos või teavituses tekib tõrge.
Inimkontroll üksi ei tee agenti ohutuks
Liiga palju kinnitusi tekitab kinnitamisväsimuse: inimene harjub nupule vajutama ega hinda enam iga juhtumit sisuliselt. Anthropic kirjeldab oma agentide turvapraktikas sama probleemi ning rõhutab lisaks inimjärelevalvele ka agendi võimalike tegevuste tehnilist piiramist.
Seetõttu vajab hea lahendus korraga kolme kaitsekihti:
- õiguste piir: agent pääseb ligi ainult tööks vajalikele andmetele ja tegevustele;
- automaatne kontroll: testid, reeglid ja läved püüavad tavapärased vead kinni;
- inimkontroll: inimene otsustab erandi või suure mõjuga tegevuse üle.
Kui tegevus on keelatud, ei tohi süsteem seda pelgalt kinnitusküsimuseks muuta. Kui tegevus on madala riskiga ja kergesti tagasipööratav, ei ole iga juhtumi käsitsi kinnitamine samuti mõistlik.
Kopeeri ja kasuta: kontrollpunkti kaart
Tegevus, mida AI tahab teha: [tegevus] Võimalik mõju: [raha, inimene, andmed, maine, leping] Otsuse lävi: [millal kinnitust nõutakse] Kinnitaja roll: [roll, mitte ainult nimi] Kinnitajale nähtav info: [sisend, allikad, väljund, muudatus] Valikud: kinnita / paranda / lükka tagasi / anna edasi Peatumise vaikeolek: [mis juhtub vastuse puudumisel] Logitav info: [otsus, aeg, põhjus, versioon] Tagasiside kasutus: [millisesse testi või reeglisse juhtum jõuab]
Kontrollpunkti test
Anna kinnitajale kolm juhtumit: üks selgelt lubatud, üks selgelt keelatud ja üks ebaselge. Kontrollpunkt töötab ainult siis, kui ta eristab neid järjepidevalt ning ebaselge juhtum liigub õige inimese juurde.
Mõõda lisaks vähemalt kinnitamise aega, tagasilükkamiste osakaalu, valepositiivseid eskalatsioone ja juhtumeid, kus inimene muutis AI ettepanekut. Kui peaaegu kõik kinnitatakse muutmata, võib kontrollpunkt olla vales kohas või kinnitajal puududa otsustamiseks vajalik kontekst.
Levinud vead
- kinnitus küsitakse pärast tegevuse toimumist;
- kinnitaja näeb ainult AI soovitust, mitte algandmeid ja allikaid;
- vastamata kinnitus loetakse vaikimisi heakskiiduks;
- tagasilükkamised ei jõua testidesse ega tööjuhendi parandusse.
Allikad
- EUR-Lex: määrus (EL) 2024/1689, artikkel 14
- Google Cloud: What is human-in-the-loop?
- Google Cloud: Human-in-the-loop agentic design pattern
- NIST: Generative Artificial Intelligence Profile
- Anthropic: How we contain Claude across products
- OpenAI: A practical guide to building agents
- Andmekaitse Inspektsioon: tehisaru kasutusele võtjale