← Kõik juhendid

Juhtimine · Juhtimine

Human-in-the-loop: inimkontroll AI-töövoos

Human-in-the-loop ehk HITL on töökorraldus, kus inimene osaleb AI-süsteemi õpetamises, hindamises või igapäevases töös. Nii saab ühendada inimese teadmised mudeli kiiruse ja skaleeritavusega ning parandada süsteemi täpsust, töökindlust ja kohanemisvõimet. AI-töövoos ei tähenda inimkontroll seda, et töötaja vajutab iga sammu järel „kinnita”. Hea kontrollpunkt asub kohas, kus vea võimalik mõju ületab automatiseerimise kasu. Inimesel peab olema otsustamiseks vajalik info, piisav pädevus, päriselt aega süveneda ja õigus tegevus peatada.

Mis on human-in-the-loop?

Inimene saab AI-ga samas ahelas osaleda kolmes põhirollis:

Inimese rollMida inimene teebPraktiline näide
Õpetajamärgendab või parandab treeningandmeidmärgib, milline kliendipäring kuulub arvelduse alla
Hindajakontrollib mudeli väljundit ja annab tagasisidetvõrdleb AI kokkuvõtet algdokumendiga
Otsustajakinnitab, muudab või peatab tegevusekinnitab tagasimakse enne raha liikumist

Generatiivse AI ja agentide puhul on kõige nähtavam kolmas roll: AI valmistab otsuse või tegevuse ette, kuid määratud lävel töö peatub. Inimene vaatab üle sisendi, kasutatud allikad, väljundi ja võimaliku mõju ning alles siis lubab töövoole järgmise sammu.

Euroopa Liidu tehisintellekti määruse artikkel 14 käsitleb inimjärelevalvet kõrge riskiga AI-süsteemides. Selline süsteem peab olema kavandatud nii, et füüsiline isik saaks seda kasutamise ajal tõhusalt jälgida. Järelevalvet tegev inimene peab muu hulgas suutma mõista süsteemi võimeid ja piiranguid, vältida automaatse väljundi pimesi usaldamist, väljundit eirata või ümber pöörata ning vajadusel süsteemi peatada.

Human-in-the-loop töövoog viie sammuga

  1. AI valmistab tegevuse ette. Süsteem kogub lubatud sisendi, kasutab kinnitatud allikaid ja koostab väljundi või tegevusettepaneku.
  2. Reegel hindab mõju. Kontrollpunkt käivitub summa, andmeklassi, adressaadi, ebakindluse või muu eelnevalt määratud läve alusel.
  3. Töö peatub enne mõju. Kinnitus peab toimuma enne kirja saatmist, makset, avaldamist või andmete jagamist.
  4. Inimene teeb sisulise otsuse. Valikud on kinnita, paranda, lükka tagasi või anna juhtum edasi pädevamale inimesele.
  5. Otsus läheb logisse ja testidesse. Tagasilükkamise põhjus aitab parandada reeglit, prompti, teadmusbaasi või hindamist.

Generatiivse AI väljundi täpsust, kvaliteeti, töökindlust ja autentsust tuleb hinnata nii inimjärelevalve kui ka automatiseeritud kontrollidega. HITL ei asenda teste: inimese kontroll ja tehniline mõõtmine täiendavad teineteist.

Millal peab inimene otsustama?

1. Raha ja siduv kohustus

Makse, tagasimakse, ost, hinnalubadus või lepingu kinnitamine vajab vähemalt määratud piiri ületades inimotsust. OpenAI agentide juhend toob kõrge riskiga tegevuste näidetena välja maksed, suuremad tagasimaksed ja tellimuste tühistamise.

Kontrollpunkt: näita summa, alus, saaja, kasutatud allikad ja erand reeglist. Luba kinnitada, parandada või tagasi lükata.

2. Inimese õigusi või võimalusi mõjutav otsus

Värbamine, krediit, kindlustus, haridus, tervishoid ja töötaja hindamine võivad mõjutada inimese õigusi või võimalusi. Enne kasutuselevõttu tuleb hinnata mõju inimeste õigustele, kallutatust ja ebaõiglasi tulemusi ning tagada sekkumisvõimalus.

Kontrollpunkt: inimene hindab nii algandmeid, mudeli põhjendust kui ka võimalikku ebavõrdset mõju. Pelgalt lõpptulemuse näitamisest ei piisa.

3. Avalik või kliendile suunatud sõnum

Avaldamine võib tekitada maine-, lepingu- või andmekaitseriski. Esimeses versioonis peaks agent valmistama ette mustandi, mitte seda iseseisvalt saatma.

Kontrollpunkt: kinnitaja näeb adressaati, täielikku sõnumit, allikaid ja manuseid samas vaates, kus ta otsustab.

4. Tundlike andmete kasutamine või jagamine

Inimkinnitus ei muuda keelatud või aluseta andmetöötlust lubatuks. Kontrollpunkt peab kinnitama, et kasutuseesmärk, andmete ulatus, ligipääs ja edastus on heaks kiidetud.

Kontrollpunkt: kui andmeklass või adressaat ei vasta reeglile, peab süsteem tegevuse blokeerima, mitte lihtsalt hoiatama.

5. Erand, mida süsteem pole varem näinud

Agent võib anda enesekindla vastuse ka ebapiisava info korral. Anna juhtum inimesele üle, kui allikas puudub, väljundid lähevad vastuollu või lubatud tõrgete ja katsete piir saab täis.

Kontrollpunkt: eskaleeri, kui allikas puudub, väljundid on vastuolus, kindluslävi jääb täitmata või lubatud katsete arv saab täis.

Hea kontrollpunkti neli tingimust

  1. kontrollijal on otsustamiseks vajalik kontekst;
  2. valikud ei piirdu formaalse kinnitamisega;
  3. otsus ja selle alus logitakse;
  4. tagasilükatud juhtum muutub testjuhtumiks või paranduseks.

Kontrollpunkt võib parandada kriitiliste otsuste ohutust ja töökindlust, kuid lisab töövoole tehnilist ning korralduslikku keerukust. Vali kontrollpunktid võimaliku mõju, mitte mugavuse järgi.

Näide: klienditeeninduse tagasimakse

Kujuta ette e-poe klienditeeninduse agenti, mis loeb kliendi pöördumist, kontrollib tellimuse olekut ja koostab lahenduse. Kõiki juhtumeid ei ole mõistlik inimesele saata.

JuhtumAI tegevusInimkontroll
Tarneaja küsimus, vastus kinnitatud teadmusbaasiskoostab ja saadab vastusepole vajalik, kui allikas on värske
Tagasimakse kuni 30 eurot, tingimused üheselt täidetudvalmistab tagasimakse ettepisteline järelkontroll
Tagasimakse üle 30 euro või erand reeglistpeatab töö ja näitab otsuse alustteenindaja kinnitab või lükkab tagasi
Vastuolulised andmed või võimalik pettusei tee tagasimakseteskaleerib vastutavale rollile

Kinnitaja peab samas vaates nägema tellimust, kliendi sõnumit, tagasimakse põhjust, summat, rakendatud reeglit ja AI tehtud muudatusi. Kui inimene ei vasta, jääb raha liigutamata. Selline vaikeolek piirab mõju ka siis, kui töövoos või teavituses tekib tõrge.

Inimkontroll üksi ei tee agenti ohutuks

Liiga palju kinnitusi tekitab kinnitamisväsimuse: inimene harjub nupule vajutama ega hinda enam iga juhtumit sisuliselt. Anthropic kirjeldab oma agentide turvapraktikas sama probleemi ning rõhutab lisaks inimjärelevalvele ka agendi võimalike tegevuste tehnilist piiramist.

Seetõttu vajab hea lahendus korraga kolme kaitsekihti:

  • õiguste piir: agent pääseb ligi ainult tööks vajalikele andmetele ja tegevustele;
  • automaatne kontroll: testid, reeglid ja läved püüavad tavapärased vead kinni;
  • inimkontroll: inimene otsustab erandi või suure mõjuga tegevuse üle.

Kui tegevus on keelatud, ei tohi süsteem seda pelgalt kinnitusküsimuseks muuta. Kui tegevus on madala riskiga ja kergesti tagasipööratav, ei ole iga juhtumi käsitsi kinnitamine samuti mõistlik.

Kopeeri ja kasuta: kontrollpunkti kaart

Prompt
Tegevus, mida AI tahab teha: [tegevus]
Võimalik mõju: [raha, inimene, andmed, maine, leping]
Otsuse lävi: [millal kinnitust nõutakse]
Kinnitaja roll: [roll, mitte ainult nimi]
Kinnitajale nähtav info: [sisend, allikad, väljund, muudatus]
Valikud: kinnita / paranda / lükka tagasi / anna edasi
Peatumise vaikeolek: [mis juhtub vastuse puudumisel]
Logitav info: [otsus, aeg, põhjus, versioon]
Tagasiside kasutus: [millisesse testi või reeglisse juhtum jõuab]

Kontrollpunkti test

Anna kinnitajale kolm juhtumit: üks selgelt lubatud, üks selgelt keelatud ja üks ebaselge. Kontrollpunkt töötab ainult siis, kui ta eristab neid järjepidevalt ning ebaselge juhtum liigub õige inimese juurde.

Mõõda lisaks vähemalt kinnitamise aega, tagasilükkamiste osakaalu, valepositiivseid eskalatsioone ja juhtumeid, kus inimene muutis AI ettepanekut. Kui peaaegu kõik kinnitatakse muutmata, võib kontrollpunkt olla vales kohas või kinnitajal puududa otsustamiseks vajalik kontekst.

Levinud vead

  • kinnitus küsitakse pärast tegevuse toimumist;
  • kinnitaja näeb ainult AI soovitust, mitte algandmeid ja allikaid;
  • vastamata kinnitus loetakse vaikimisi heakskiiduks;
  • tagasilükkamised ei jõua testidesse ega tööjuhendi parandusse.

Allikad

  1. EUR-Lex: määrus (EL) 2024/1689, artikkel 14
  2. Google Cloud: What is human-in-the-loop?
  3. Google Cloud: Human-in-the-loop agentic design pattern
  4. NIST: Generative Artificial Intelligence Profile
  5. Anthropic: How we contain Claude across products
  6. OpenAI: A practical guide to building agents
  7. Andmekaitse Inspektsioon: tehisaru kasutusele võtjale

Seotud juhendid

Koolitus tiimile

Teeme kaardistuse koos ära. Ühe päevaga.

Tuleme teie kontorisse, viime töötoa läbi tiimiga ja ehitame kolm töövoogu teie päris protsesside peale. Lahkume nii, et need jäävad kasutusse.
Vaata koolitusi