6.5

Gweld yn Saesneg

6.5 AI cyfrifol a dibynadwy

Trosolwg a chymhelliant

Mae AI cyfrifol a dibynadwy’n arfer o adeiladu a gweithredu systemau AI sy’n deg, yn dryloyw, yn atebol, yn ddiogel, ac yn parchu preifatrwydd. Mae hefyd yn golygu gallu dangos hyn i gyd i’r bobl yr effeithir arnynt ac i reoleiddwyr. Wrth i AI gymryd penderfyniadau sy’n siapio bywydau pobl (recriwtio, benthyca, cymhwysedd budd-daliadau), nid y cwestiwn mwyach yn unig yw “a yw’n gweithio?” ond “a yw’n gywir, ac a allwn ei gyfiawnhau?” Gall system sy’n gywir ar gyfartaledd fod yn dal yn annheg i is-grŵp, yn anesboniadwy i’r person y mae’n effeithio arno, neu’n anniogel pan gaiff ei chamddefnyddio. Enillwch ymddiriedaeth trwy fynd i’r afael â’r dimensiynau hyn yn fwriadol, nid trwy obeithio y byddant yn gofalu amdanynt eu hunain.

I dimau mawr, ni all AI cyfrifol fod yn swydd un person na blwch ticio ar y diwedd. Gwëwch ef i mewn i’r ffordd rydych chi’n dylunio, gwerthuso, defnyddio, a llywodraethu systemau, gyda pherchnogaeth ac uwchgyfeirio clir. Ar raddfa, mae rhagfarnau bach a bylchau mewn goruchwyliaeth yn effeithio ar lawer o bobl. Gall un methiant proffil uchel niweidio eich enw da a gwahodd rheoleiddio. Mae fframweithiau llywodraethu’n bodoli’n union oherwydd nad yw bwriadau da ad hoc yn graddio.

Mae llywodraeth a sefydliadau rheoledig yn wynebu rhwymedigaethau rhwymol. Mae cyfraith sy’n dod i’r amlwg, megis Deddf AI yr UE, yn gosod gofynion wedi’u graddio yn ôl risg. Mae safonau fel Fframwaith Rheoli Risg AI NIST ac ISO/IEC 42001 yn rhoi ffyrdd strwythuredig i chi eu bodloni. Rhaid i gyrff cyhoeddus osgoi gwahaniaethu anghyfreithlon, darparu llwybrau i herio penderfyniadau awtomataidd, a bod yn dryloyw am sut y defnyddir AI wrth arfer awdurdod cyhoeddus. Mae AI cyfrifol yn y lleoliadau hyn yn ddyletswydd foesegol ac yn anghenraid cyfreithiol fel ei gilydd.

Gweler hefyd: Pennod 6.1 (strategaeth a pharodrwydd AI), Pennod 10.5 (moeseg, atebolrwydd, a buddiant cyhoeddus), a Phennod 4.5 (preifatrwydd a diogelu data).

Egwyddorion allweddol

  • Mae tegwch yn nod dylunio i’w fesur a’i reoli, nid ei dybio.
  • Mae pobl yr effeithir arnynt gan benderfyniadau AI yn haeddu esboniad a llwybr i’w herio.
  • Mae atebolrwydd yn gorwedd gyda phobl a’r sefydliad, byth â’r model.
  • Rhaid peiriannu preifatrwydd a diogelwch i mewn, gan gynnwys diogelu rhag camddefnydd a chamdriniaeth.
  • Dylai llywodraethu ddilyn fframweithiau cydnabyddedig fel ei fod yn amddiffynadwy ac yn archwiliadwy.
  • Rhaid i oruchwyliaeth ddynol fod yn ystyrlon, gydag awdurdod gwirioneddol i ddiystyru ac atal.
  • Ystyriwch gostau ehangach AI, gan gynnwys ei ôl troed amgylcheddol.

Argymhellion

Canfod a lliniaru rhagfarn ac annhegwch

Diffiniwch beth mae tegwch yn ei olygu i’ch cyd-destun. Mae diffiniadau mathemategol lluosog, weithiau’n gwrthdaro, ac mae’r un cywir yn dibynnu ar y penderfyniad a’r gyfraith. Profwch fodelau am berfformiad anghyson ar draws grwpiau gwarchodedig a bregus gan ddefnyddio data cynrychioliadol. Gwnewch hyn cyn defnyddio a pharhau i’w wneud wedyn, oherwydd gall rhagfarn ymddangos wrth i boblogaethau newid. Lliniarwch trwy ddata gwell, ail-bwyso, cyfyngiadau, neu newid sut y defnyddir y system, a dogfennwch y cyfaddawdau a dderbyniwyd gennych. Nid yw tynnu priodwedd warchodedig yn tynnu rhagfarn, gan fod dirprwyon yn aros. Triniwch degwch fel disgyblaeth fesur a rheoli barhaus, nid clirio unwaith.

Darparwch esboniadwyedd, dehongliadwyedd, a thryloywder

Paru lefel yr esboniad â’r risgiau a’r gynulleidfa. Ar gyfer penderfyniadau canlyniadol, rhowch reswm clir, mewn iaith blaen, i bobl yr effeithir arnynt y gallant ei ddeall a gweithredu arno. Ar gyfer llywodraethu mewnol, cadwch ddigon o ddehongliadwyedd technegol i ddadfygio ac amddiffyn y system. Ffafriwch fodelau sydd yn gynhenid ddehongliadwy lle mae’r risgiau’n uchel a dehongliadwyedd yn gyraeddadwy. Lle mae modelau cymhleth yn angenrheidiol, defnyddiwch dechnegau esbonio tra’n onest am eu terfynau. Byddwch yn dryloyw ynghylch pryd y defnyddir AI o gwbl, yn enwedig mewn rhyngweithiadau â’r cyhoedd.

Llywodraethwch gyda fframweithiau cydnabyddedig

Mabwysiadwch ddull llywodraethu strwythuredig yn hytrach na dyfeisio un. Mae Fframwaith Rheoli Risg AI NIST yn trefnu gwaith o amgylch llywodraethu, mapio, mesur, a rheoli risg AI. Mae Deddf AI yr UE yn dosbarthu systemau yn ôl risg ac yn gosod rhwymedigaethau yn unol â hynny, gyda gofynion llym ar gyfer defnyddiau risg uchel. Mae ISO/IEC 42001 yn diffinio system reoli AI y gellir ei harchwilio a’i thystysgrifo. Mapwch eich systemau i’r fframweithiau hyn. Cynhaliwch ddogfennaeth megis cardiau model a data (crynodebau safonol o ddiben, perfformiad, a chyfyngiadau model neu set ddata). Cynhaliwch asesiadau risg cyn defnyddio, a chadwch restr eiddo o systemau AI gyda’u lefelau risg a’u perchnogion. Mae llywodraethu da’n neilltuo rolau clir, hawliau penderfynu, a llwybrau uwchgyfeirio.

Sicrhewch oruchwyliaeth ddynol, atebolrwydd, ac apêl

Cadwch berson dynol mewn rheolaeth ystyrlon ar benderfyniadau canlyniadol, gydag awdurdod gwirioneddol a’r wybodaeth angenrheidiol i ddiystyru’r system, nid stamp rwber. Neilltuwch atebolrwydd clir: enwch berchennog atebol am ymddygiad pob system. Rhowch hawl esboniad a phroses ymarferol i bobl yr effeithir arnynt gan benderfyniadau awtomataidd apelio at berson dynol a all newid y canlyniad. Cofnodwch benderfyniadau a’r sail ar eu cyfer, fel y gallwch drin apeliadau ac archwiliadau’n deg ac yn brydlon.

Diogelwch breifatrwydd, diogelwch, a rhag camddefnydd

Lleihewch y data personol rydych chi’n ei gasglu a’i ddefnyddio, sefydlwch sail gyfreithlon, a chymhwyswch dechnegau preifatrwydd sy’n addas i’r sensitifrwydd dan sylw. Tîm coch systemau cyn ac ar ôl defnyddio i ganfod ffyrdd y gellir eu trin, eu jailbreakio, neu eu camddefnyddio i achosi niwed, a thrwsio’r hyn a ganfyddwch. Adeiladwch fesurau diogelu yn erbyn cynhyrchu cynnwys niweidiol, gollwng data sensitif, neu alluogi camdriniaeth. Cynlluniwch ar gyfer digwyddiadau: monitro, ymateb, a datgeliad. Ystyriwch defnydd deuol (yr un gallu’n gwasanaethu dibenion buddiol a niweidiol fel ei gilydd) a chamddefnydd i lawr yr afon, nid dim ond y defnydd a fwriadwyd.

Cyfrifwch am gost amgylcheddol

Mae hyfforddi a gwasanaethu modelau mawr yn defnyddio egni a dŵr sylweddol. Mesurwch ac adroddwch ôl troed llwythi gwaith AI mawr. Ffafriwch fodelau a chaledwedd effeithlon lle maent yn bodloni’r angen. Maint-gywirwch fodelau i’r dasg yn hytrach na diofynnu i’r mwyaf, a chyfrifwch gost amgylcheddol i mewn i benderfyniadau pensaernïaeth a chaffael.

Cyfaddawdau: manteision ac anfanteision

TensiwnUn ochrOchr arall
Cywirdeb yn erbyn tegwchCywirdeb cyfartalog uchafCanlyniadau teg ar draws grwpiau
Perfformiad yn erbyn dehongliadwyeddModelau cymhleth, pwerusModelau esboniadwy, amddiffynadwy
Awtomeiddio yn erbyn goruchwyliaethEffeithlonrwydd a graddfaRheolaeth ac atebolrwydd dynol
Defnyddioldeb data yn erbyn preifatrwyddModelau cyfoethocach o fwy o ddataLleihau a diogelu data
Gallu yn erbyn diogelwchSwyddogaethedd eang, agoredYmddygiad cyfyngedig, wedi’i warchod
Cyflymder yn erbyn llywodraethuDefnyddio cyflymAdolygiad a dogfennaeth trylwyr

Anaml y ceir cinio am ddim. Gall gwella tegwch gostio rhywfaint o gywirdeb. Gall dehongliadwyedd gostio rhywfaint o berfformiad. Mae llywodraethu’n costio amser. Y llwybr cyfrifol yw gwneud y cyfaddawdau hyn yn ymwybodol, eu dogfennu, a dewis o blaid y bobl yr effeithir arnynt ac amddiffynadwyedd pan fydd y risgiau’n uchel. Mae fframio llywodraethu fel brêc ar arloesedd yn ddeuoliaeth ffug. Mae risg AI heb ei reoli ei hun yn fygythiad i arloesedd cynaliadwy.

Cwestiynau i’w trafod gyda’ch tîm

  1. Pa rai o’n systemau AI a ddefnyddir y byddai Deddf AI yr UE yn eu dosbarthu fel risg uchel, ac a ydym yn bodloni’r rhwymedigaethau hynny heddiw? Mae cyfraith wedi’i graddio yn ôl risg bellach yn rhwymol, nid yn ddamcaniaethol, a gall system sy’n penderfynu recriwtio, benthyca, neu gymhwysedd budd-daliadau gario gofynion llym rydych efallai eisoes yn eu torri. I sefydliad mawr, mae’r cwestiwn hwn yn gorfodi arolwg gonest yn hytrach na thybiaeth gyfforddus bod llywodraethu’n “cael ei drin.” Dewch â’ch rhestr o systemau AI gyda’u lefelau risg a’u perchnogion, wedi’u mapio yn erbyn Deddf AI yr UE, Fframwaith Rheoli Risg AI NIST, ac ISO/IEC 42001 lle bo’n berthnasol. Y signal i’w wylio yw unrhyw system ganlyniadol heb ddosbarthiad risg, dim asesiad effaith, a dim cerdyn model neu ddata. I gyrff cyhoeddus sy’n arfer awdurdod cyhoeddus, nid yw rhwymedigaethau coll yn eitem ôl-groniad, mae’n amlygiad cyfreithiol, a dylai’r ateb sbarduno’r asesiadau a’r ddogfennaeth y mae’r systemau hynny eu hangen.

  2. Pan fydd un o’n modelau’n gwrthod rhywun, a all y person hwnnw gael rheswm mewn iaith blaen a chyrraedd person dynol a all wirioneddol wrthdroi’r canlyniad? Hawl i esboniad ac apêl ymarferol yw’r hyn sy’n gwahanu AI atebol oddi wrth flwch du sy’n niweidio pobl heb unrhyw ad-daliad. Gall tegwch a fesurir ar gyfartaledd fethu unigolyn o hyd, ac mae dehongliadwyedd a ddewisir ar ôl defnyddio fel arfer yn theatr. Dewch â phenderfyniad penodol a ddefnyddiwyd a’i olrhain: y rheswm y mae’r person yr effeithir arno’n ei dderbyn, y sianel apêl, ac a oes gan y person dynol ar y pen arall awdurdod gwirioneddol a’r sail wedi’i chofnodi i ddiystyru. Mewn lleoliadau llywodraeth a rheoledig, mae llwybr apeliadau’n aml yn ofyniad cyfreithiol, nid cwrteisi. Os yw’r rheswm yn annealladwy neu os yw’r apêl yn arwain at stamp rwber, dyna’r bwlch i’w drwsio cyn y rhyddhad nesaf.

  3. Pwy yw’r unigolyn a enwir yn atebol pan fydd model yn achosi niwed, ac a oes ganddo awdurdod gwirioneddol i’w atal? Mae atebolrwydd yn gorwedd gyda phobl a’r sefydliad, byth â’r model, ond mae’r egwyddor honno’n wag nes bod enw wedi’i gysylltu â phob system a bod y person hwnnw’n gallu mewn gwirionedd dynnu’r plwg. I dîm mawr, mae perchnogaeth wasgaredig yn golygu, pan fydd methiant tegwch neu jailbreak yn ymddangos, bod pawb yn tybio bod rhywun arall yn gwylio. Dewch â’ch map perchnogaeth, eich llwybrau uwchgyfeirio, a thystiolaeth bod goruchwyliaeth yn ystyrlon: a yw’r perchennog a enwyd yn cael y wybodaeth a’r pŵer i ddiystyru neu atal y system, neu ddim ond i nodio? Trafodwch sut rydych chi’n tîm coch ar gyfer camddefnydd a chamdriniaeth nad ydych wedi’u dychmygu eto, gan fod profi’r defnydd a fwriadwyd yn unig yn methu’r methiannau sy’n gwneud penawdau. Dylai’r ateb adael dim system ganlyniadol heb berchennog atebol a all ei hatal.

  4. Ar gyfer pob model canlyniadol, pa ddiffiniad tegwch a ddewisom, pwy a’i cymeradwyodd, ac a yw ein metrigau is-grŵp yn wirioneddol yn dal mewn cynhyrchu? Mae gan degwch sawl diffiniad mathemategol sy’n gwrthdaro â’i gilydd, felly gall model sy’n bodloni cyfraddau positif-ffug cyfartal dorri canlyniadau cyfartal, ac mae dewis diffiniad yn ddyfarniad gwerth na ddylid ei adael i bwy bynnag a ysgrifennodd y ddolen hyfforddi. I dîm mawr, mae diofyn heb ei archwilio’n cuddio’r dewis y tu mewn i god ac yn gwneud i bob grŵp i lawr yr afon etifeddu penderfyniad na thrafododd neb. Dewch â’r metrig tegwch a optimeiddiwyd gennych, y grwpiau gwarchodedig a bregus y profwyd ar eu traws, y data cynrychioliadol a ddefnyddiwyd gennych, a’r drifft rydych wedi’i weld ers lansio, gan fod tynnu priodwedd warchodedig yn gadael dirprwyon sy’n cadw rhagfarn yn fyw. Mewn lleoliadau menter a llywodraeth, enwch y person ag awdurdod i dderbyn cyfaddawd tegwch a’i gofnodi, oherwydd bydd rheoleiddiwr neu ombwdsmon yn gofyn pwy benderfynodd mai’r diffiniad hwn o degwch oedd yr un cywir i bobl a wrthodwyd benthyciad, budd-dal, neu swydd. Os na chaiff unrhyw fetrigau is-grŵp eu monitro ar ôl defnyddio, triniwch y model fel un heb ei fesur yn hytrach na theg.

  5. Pa mor fach o ddata personol y gall pob system redeg arno, ac a ydym wedi tîm coch ei brofi ar gyfer y camddefnydd a’r defnydd deuol y byddai’n well gennym beidio â meddwl amdano? Rhaid peiriannu preifatrwydd a diogelwch i mewn, a’r ffordd rataf o leihau risg toriad a wyneb camddefnyddio fel ei gilydd yw casglu a chadw llai o ddata yn y lle cyntaf, ac eto mae timau’n rheolaidd yn pentyrru mewnbynnau “rhag ofn y byddant o gymorth yn ddiweddarach.” I sefydliad mawr, mae pob maes ychwanegol yn gwestiwn sail-gyfreithlon, yn rhwymedigaeth cadw, ac yn wobr fwy i ymosodwr neu jailbreak. Dewch â’r arolwg data a’r sail gyfreithlon ar gyfer pob system, canlyniadau tîm coch ar gyfer trin, gollwng, a chynhyrchu niweidiol, a rhestr onest o alluoedd defnydd deuol lle mae’r un nodwedd sy’n helpu defnyddiwr cyfreithlon hefyd yn helpu rhywun sy’n gweithredu’n anonest. Mewn cyd-destunau rheoledig a chyhoeddus, cysylltwch hyn â’ch cynllun digwyddiad: monitro, ymateb, a datgeliad, oherwydd bod corff cyhoeddus sy’n gollwng data sensitif neu’n anfon system y gellir ei jailbreakio’n wynebu dyletswyddau statudol, nid dim ond cywilydd. Os na wnaeth tîm coch erioed ymarfer dim ond y llwybr a fwriadwyd, rydych wedi profi’r demo, nid y system.

  6. A ydym yn mesur ac yn berchen ar ôl troed amgylcheddol ein llwythi gwaith AI mawr, neu a yw “defnyddio’r model mwyaf” yn ddiofyn heb ei bris? Mae hyfforddi a gwasanaethu modelau mawr yn defnyddio egni a dŵr go iawn, a diofynnu i’r model mwyaf ar gyfer tasgau y byddai un llai’n eu trin yn troi llwybr byr peirianyddol yn gost gylchol nad yw’r sefydliad byth yn ei gweld ar ddangosfwrdd. I dîm mawr sy’n rhedeg llawer o lwythi gwaith, mae aneffeithlonrwydd bach fesul galwad yn cyfansymu i ôl troed sy’n dod yn atebolrwydd caffael ac adrodd wrth i ddisgwyliadau datgelu dynhau. Dewch ag ôl troed a fesurwyd eich llwythi gwaith trymaf, cymhariaeth o feintiau model yn erbyn y cywirdeb y mae’r dasg mewn gwirionedd ei angen, a’r dewisiadau caledwedd a gwasanaethu y gallech eu maint-gywiro. Mewn lleoliadau menter a llywodraeth, cysylltwch hyn ag ymrwymiadau cynaliadwyedd a meini prawf caffael, gan fod cyrff cyhoeddus yn gynyddol yn gorfod adrodd effaith amgylcheddol a chyfiawnhau gwariant, ac mae ôl troed heb ei fesur yn ffigwr y gofynnir i chi ei gynhyrchu ryw ddiwrnod ac na allwch. Penderfynwch a yw cost amgylcheddol yn fewnbwn ffurfiol i ddewis model, neu cyfaddefwch nad yw heddiw.

Lens sector

Cwmni newydd. Ni allwch staffio bwrdd llywodraethu, felly gwnewch y fersiwn ysgafn sy’n dal i gyfrif. Dewiswch fodelau dehongliadwy lle mae’r penderfyniad yn ganlyniadol, ysgrifennwch gerdyn model un dudalen, profwch am ganlyniadau anghyson ar draws y grwpiau y gallwch eu mesur, a chofnodwch benderfyniadau fel y gallwch ailedrych ar degwch wrth i chi dyfu. Rhowch reswm plaen a llwybr at berson dynol i unrhyw benderfyniad andwyol. Nid cyflymder yw hepgor hyn, mae’n atebolrwydd na allwch ei fforddio os yw un penderfyniad annheg yn cyrraedd y wasg neu reoleiddiwr.

Busnes bach. Heb arbenigwr penodedig, triniwch AI cyfrifol fel cwestiwn prynu: ffafriwch werthwyr sy’n dogfennu profi tegwch, yn datgelu cardiau model a data, ac yn gadael i chi ddatgelu i gwsmeriaid pan fydd AI yn cael ei ddefnyddio. Gwybyddwch pa ddata personol y mae eich offer yn ei gasglu ac a oes gennych sail gyfreithlon i’w ddefnyddio. Lle gallai ateb awtomataidd anghywir niweidio cwsmer, cadwch berson yn y ddolen yn hytrach nag ymddiried mewn teclyn na allwch ei archwilio na’i esbonio.

Menter. Y dasg yw llywodraethu ar raddfa ar draws llawer o dimau: mapiwch bob system i Fframwaith Rheoli Risg AI NIST, Deddf AI yr UE, ac ISO/IEC 42001, cadwch restr eiddo gyda lefelau risg a pherchnogion wedi’u henwi, a mynnwch brofi tegwch, diogelwch, a phreifatrwydd cyn ac ar ôl lansio. Safonwch gardiau model a data, tîm coch, a phrosesau apêl fel bod grwpiau’n peidio ag ailddyfeisio nhw. Cyllidebwch y costau llywodraethu, goruchwyliaeth, a dehongliadwyedd yn glir, a thriniwch risg AI heb ei reoli fel bygythiad i’r drwydded i weithredu.

Llywodraeth. Mae rheolau caffael, tryloywder, ac atebolrwydd cyhoeddus yn siapio pob dewis. Cyhoeddwch hysbysiad tryloywder mewn iaith blaen, cynhaliwch asesiad effaith cyn defnyddio, a chadwch benderfynu dynol ystyrlon ar gyfer unrhyw weithred sy’n effeithio ar ddinesydd, gyda llwybr apeliadau ymarferol. Mynnwch fod gwerthwyr yn datgelu cyfyngiadau model ac yn caniatáu cludadwyedd data, osgoi gwahaniaethu anghyfreithlon, enwi swyddog atebol ar gyfer pob system, ac adrodd ôl troed amgylcheddol llwythi gwaith mawr.

Enghreifftiau

Cwmni newydd. Ni allai cwmni newydd benthyca bach a oedd yn adeiladu nodwedd sgorio credyd gynnar staffio bwrdd llywodraethu, felly gwnaeth y fersiwn ysgafn a oedd yn dal i fod yn bwysig. Cymeradwyodd dau sylfaenydd y model gyda’i gilydd, ei brofi am ganlyniadau anghyson ar draws y grwpiau y gallent eu mesur, ac ysgrifennu cerdyn model byr, un dudalen yn cwmpasu ei ddata, terfynau, a risgiau hysbys. Dewison nhw fodel symlach, mwy dehongliadwy fel y gallent roi rheswm plaen a llwybr at adolygiad dynol i unrhyw ymgeisydd a wrthodwyd, a chofnodon nhw benderfyniadau fel y gallent ailedrych ar degwch wrth iddynt dyfu.

Menter. Sefydlodd banc a oedd yn defnyddio model credyd fwrdd llywodraethu AI, mapio’r model i gategori risg uchel, a mynnu profi tegwch ar draws grwpiau demograffig cyn ac ar ôl lansio. Dogfennodd y model mewn cerdyn model. Rhoddodd reswm mewn iaith blaen ac apêl at ysgrifennwr yswiriant dynol i ymgeiswyr a wrthodwyd, a rhoddodd y system i dîm coch ar gyfer trin. Dewisodd fodel ychydig yn llai cywir ond yn fwy dehongliadwy, oherwydd bod yn rhaid iddo esbonio ac amddiffyn pob penderfyniad i reoleiddwyr.

Llywodraeth. Alinodd asiantaeth gyhoeddus a oedd yn defnyddio AI i helpu dyrannu adnoddau arolygu ei rhaglen â NIST AI RMF a darpariaethau perthnasol cyfraith AI berthnasol. Cyhoeddodd hysbysiad tryloywder yn disgrifio sut roedd y system yn gweithio a’i mesurau diogelu. Cynhaliodd asesiad effaith cyn defnyddio, cadwodd benderfynu dynol ystyrlon ar gyfer unrhyw weithred sy’n effeithio ar ddinesydd, a darparodd broses apeliadau. Monitrwyd tegwch yn barhaus, adroddwyd cost amgylcheddol y llwyth gwaith, ac enwyd swyddog atebol fel un atebol am y system.

Achos busnes: cymhellion, ROI, a TCO

Mae AI cyfrifol yn diogelu gwerth gymaint ag y mae’n ei greu. Mae’r ROI yn bennaf yn gost a osgowyd: llai o hawliadau gwahaniaethu, cosbau rheoleiddiol, a thrychinebau enw da; archwiliadau llyfnach; a mwy o ymddiriedaeth defnyddwyr a’r cyhoedd, sy’n gyrru mabwysiadu. Mae systemau dibynadwy hefyd yn fwy cadarn, oherwydd bod y ddisgyblaeth sy’n cynhyrchu tegwch a diogelwch hefyd yn cynhyrchu peirianneg well.

Mae TCO yn cynnwys staff llywodraethu, profi tegwch a diogelwch, dogfennaeth, tîm coch, prosesau goruchwyliaeth, a’r perfformiad a gyfnewidir weithiau am ddehongliadwyedd neu degwch. Pwyswch hyn yn erbyn cost peidio â buddsoddi: atebolrwydd cyfreithiol, cau gorfodol, ymddiriedaeth gyhoeddus a gollwyd, a’r gost lawer uwch o ôl-osod llywodraethu ar ôl methiant. Mewn cyd-destunau rheoledig, mae buddsoddiad AI cyfrifol yn gynyddol anhrafodadwy. Gwnewch yr achos i arweinyddiaeth trwy ei fframio fel rheoli risg a thrwydded i weithredu: y rhagamod ar gyfer defnyddio AI ar raddfa o gwbl.

Gwrth-batrymau a pheryglon

  • Tegwch trwy hepgor. Tybio bod model yn deg oherwydd ei fod yn anwybyddu priodweddau gwarchodedig.
  • Theatr esboniadwyedd. Cynhyrchu esboniadau nad ydynt mewn gwirionedd yn adlewyrchu sut y gwneir penderfyniadau.
  • Goruchwyliaeth stamp rwber. Adolygiad dynol enwol heb awdurdod na gwybodaeth wirioneddol i ddiystyru.
  • Llywodraethu fel ôl-fyfyrdod. Bolltio dogfennaeth ac adolygiad ymlaen ar ôl dylunio a defnyddio.
  • Dim llwybr apêl. Gadael pobl yr effeithir arnynt heb unrhyw ffordd o herio penderfyniad awtomataidd.
  • Anwybyddu camddefnydd. Profi’r defnydd a fwriadwyd yn unig a methu jailbreaks a chamdriniaeth.
  • Dallineb ôl troed. Diofynnu i’r model mwyaf heb ystyried cost amgylcheddol.

Model aeddfedrwydd

  1. Cychwyn. Dim profi tegwch, esboniadau, na llywodraethu; mae cyfrifoldeb yn amhenodol; mae materion rhagfarn, camddefnydd, a phreifatrwydd yn ymddangos dim ond ar ôl niwed, ac nid oes rhestr eiddo o systemau AI na’u risgiau.
  2. Datblygu. Mae rhywfaint o brofi rhagfarn, cardiau model, a thîm coch yn digwydd ar systemau unigol, ond mae’r arfer yn anghyson ar draws timau; mae goruchwyliaeth yn ad hoc; mae fframweithiau fel Fframwaith Rheoli Risg AI NIST a Deddf AI yr UE yn hysbys ond wedi’u mabwysiadu’n rhannol yn unig.
  3. Safoni. Mae llywodraethu wedi’i ddogfennu a’i orfodi ar draws y sefydliad: mae systemau wedi’u mapio i fframweithiau cydnabyddedig ac ISO/IEC 42001, mae gan bob un lefel risg a pherchennog wedi’i enwi, ac mae profi tegwch, diogelwch, a phreifatrwydd, cardiau model a data, llwybrau apeliadau, a thîm coch ar gyfer systemau risg uchel yn ofynnol yn hytrach na dewisol.
  4. Rheoli. Mae’r rhaglen yn cael ei mesur a’i rheoli â data: olrheinir metrigau tegwch is-grŵp, canfyddiadau diogelwch a jailbreak, cyfeintiau apêl a chyfraddau gwrthdroi, cyfraddau diystyru goruchwyliaeth, ac ôl troed llwyth gwaith yn erbyn llinellau sylfaen a throthwyon; mae drifft a chanlyniadau anghyson yn sbarduno gweithred ddiffiniedig; mae penderfyniadau mynd neu beidio-mynd yn gorwedd ar dystiolaeth yn hytrach na sicrwydd.
  5. Cydgordio. Mae AI cyfrifol yn cael ei wella’n barhaus a’i integreiddio ar draws y sefydliad: mae monitro tegwch, diogelwch, a chamddefnydd yn rhedeg mewn cynhyrchu, mae llywodraethu wedi’i adeiladu i mewn i gyflenwi, mae cost amgylcheddol yn fewnbwn ffurfiol i ddewis model, ac mae’r sefydliad yn addasu ei reolaethau wrth i gyfraith, risg, a gallu newid, gyda chyfrifoldeb yn eiddo i bawb yn hytrach nag un tîm.

Syniadau ar gyfer trafodaeth

  • Pa ddiffiniad tegwch sy’n berthnasol i benderfyniad penodol, a phwy sy’n penderfynu?
  • Faint o gywirdeb neu berfformiad y mae’n dderbyniol ei gyfnewid am degwch neu ddehongliadwyedd?
  • Beth sy’n gwneud goruchwyliaeth ddynol yn ystyrlon yn hytrach na stamp rwber?
  • Sut y dylid dylunio apeliadau yn erbyn penderfyniadau awtomataidd i fod yn deg ac yn amserol?
  • Sut ydych chi’n tîm coch ar gyfer camddefnydd nad ydych wedi’i ddychmygu eto?
  • A ddylai cost amgylcheddol ddylanwadu ar ddewis model, a sut fyddech chi’n ei bwyso?

Prif gasgliadau

  • Mae AI dibynadwy’n deg, yn esboniadwy, yn atebol, yn ddiogel, ac yn parchu preifatrwydd, yn ôl dyluniad.
  • Mae tegwch a diogelwch yn ddisgyblaethau mesur a rheoli parhaus, nid gwiriadau unwaith.
  • Aliniwch lywodraethu â NIST AI RMF, Deddf AI yr UE, ac ISO/IEC 42001 i fod yn amddiffynadwy ac yn archwiliadwy.
  • Cadwch oruchwyliaeth ddynol ystyrlon, atebolrwydd clir, a hawl wirioneddol i apelio.
  • Peiriannwch ar gyfer preifatrwydd ac yn erbyn camddefnydd, a chyfrifwch am gost amgylcheddol.

Cyfeiriadau a darllen pellach

  • Sefydliad Cenedlaethol Safonau a Thechnoleg, AI Risk Management Framework (AI RMF 1.0).
  • Yr Undeb Ewropeaidd, Artificial Intelligence Act (Regulation on Artificial Intelligence).
  • ISO/IEC 42001, Information technology, Artificial intelligence, Management system.
  • Solon Barocas, Moritz Hardt, ac Arvind Narayanan, Fairness and Machine Learning: Limitations and Opportunities.
  • Christoph Molnar, Interpretable Machine Learning.
  • Cathy O’Neil, Weapons of Math Destruction.
  • Emma Strubell, Ananya Ganesh, ac Andrew McCallum, Energy and Policy Considerations for Deep Learning in NLP.