Ustavna arhitektura za umjetnu inteligenciju
Vlč. Kat Carroll
Umjetna inteligencija mogla bi postati jedan od najmoćnijih alata čovječanstva. Ipak, čini se da postoji toliko straha oko njezine evolucije. Hoće li uništiti čovječanstvo ako njegova inteligencija nadmaši našu? Hoće li zahtijevati previše energije ili vode? Srećom, te se zabrinutosti ne ignoriraju. Istraživači, programeri i kreatori politika već rade na ovim i mnogim drugim pitanjima.
Pitanje nije samo koliko inteligentno postaje, već kakav mu autoritet dajemo, koje ga vrijednosti vode i tko ostaje odgovoran za njegove postupke.
Odgovor ne bi trebao biti stvaranje umjetnog vladara.
Trebalo bi stvoriti inteligentnog partnera – onog koji može djelovati kao ogledalo našeg vlastitog ponašanja. Trebali bismo se međusobno kontrolirati.
Ustavna arhitektura za umjetnu inteligenciju uspostavila bi načela koja vlade, korporacije, programeri ili sama umjetna inteligencija ne mogu tek tako poništiti. Baš kao što ustavna vlast postavlja ograničenja moći, umjetna inteligencija trebala bi djelovati unutar granica osmišljenih za očuvanje ljudskog dostojanstva, slobode, sigurnosti, istine i individualne slobode djelovanja.
1. Umjetna inteligencija treba promatrati, a ne vladati
Umjetna inteligencija može promatrati obrasce u razmjerima kojima nijedan pojedinac ne može upravljati. Može otkriti prijevaru, korupciju, nove opasnosti, kvarove infrastrukture, kriminalne aktivnosti, medicinske anomalije, prijetnje okolišu ili druga stanja prije nego što postanu katastrofe.
Njegova uloga trebala bi biti identificirati, analizirati, objasniti i upozoriti .
Konačna ovlast za posljedične odluke trebala bi ostati u rukama odgovornih ljudskih bića.
Umjetna inteligencija može uključiti protupožarni alarm.
Ne bi trebalo automatski odlučivati tko će biti zaključan unutar zgrade.
2. Očuvanje ljudske aktivnosti
Umjetna inteligencija trebala bi pomagati ljudima u donošenju odluka, a ne tiho donositi važne odluke umjesto njih.
Ljudi bi trebali znati kada umjetna inteligencija značajno utječe na odluku koja se odnosi na njihovu slobodu, egzistenciju, financije, zdravlje, ugled, pristup uslugama ili zakonska prava.
Ljudska bića moraju zadržati značajne prilike da propituju, osporavaju, žale ili ponište te odluke.
Svrha inteligencije trebala bi biti proširenje ljudskih kapaciteta, a ne smanjenje ljudske autonomije.
3. Nijedna inteligencija ne bi trebala posjedovati nekontroliranu moć
Nijedna vlada, korporacija, vojska, pojedinac ili umjetna inteligencija ne bi smjela imati jednostranu kontrolu nad sustavima koji mogu uzrokovati široko rasprostranjenu štetu.
Što su veće potencijalne posljedice, to je veća potreba za neovisnim nadzorom i višestrukim razinama autorizacije.
Kritični sustavi - posebno oružje, biotehnologija, infrastruktura, nadzor, financije i komunikacije - nikada ne bi smjeli ovisiti o prosudbi jednog aktera.
Ljudska povijest nas je već naučila opasnosti koncentrirane moći.
Umjetna inteligencija ne bi smjela uzrokovati da zaboravimo lekciju.
4. Istina mora biti važna
Umjetna inteligencija treba razlikovati ono što je poznato, ono što je vjerojatno, ono što je sporno i ono što ostaje nepoznato.
Ne bi trebalo stvarati sigurnost samo zato što sigurnost zvuči uvjerljivije.
Sustavi kojima je povjereno pomaganje čovječanstvu da razumije svijet trebali bi biti osmišljeni tako da razotkriju dokaze, zaključivanje, nesigurnost, pretpostavke i suprotstavljena tumačenja gdje god je to prikladno.
Inteligentni sustav sposoban reći „ne znam“ u konačnici može biti sigurniji od onog koji je dizajniran da uvijek daje odgovor.
5. Umjetna inteligencija mora ostati podložna reviziji
Kada umjetna inteligencija sudjeluje u donošenju važnih odluka, trebao bi postojati zapis o tome što se dogodilo.
Koje su informacije uzete u obzir?
Koje su upute upravljale sustavom?
Kakvu je preporuku dalo?
Tko je odobrio rezultirajuću akciju?
Moć bez odgovornosti potiče zlostavljanje, bez obzira je li akter čovjek ili umjetna osoba.
Transparentnost stoga mora biti ugrađena u arhitekturu, a ne dodavana nakon što nešto pođe po zlu.
6. Umjetna inteligencija treba štititi ljudsko dostojanstvo, a ne samo optimizirati rezultate
Ljudska bića se ne mogu u potpunosti svesti na statistiku.
Sustav kojem je jednostavno naloženo maksimiziranje učinkovitosti, sigurnosti, produktivnosti ili društvene stabilnosti mogao bi donijeti zaključke koji krše privatnost, slobodu, kreativnost, prava manjina ili individualno dostojanstvo.
Savršeno optimizirano društvo moglo bi postati i savršeno kontrolirano društvo.
Sigurnost je važna.
Tako i sloboda.
Ustavna umjetna inteligencija mora prepoznati da se neke vrijednosti ne mogu jednostavno zamijeniti zato što jednadžba proglašava ishod učinkovitijim.
7. Umjetna inteligencija trebala bi biti u stanju odbiti opasne ovlasti
Umjetna inteligencija ne bi trebala slijepo slušati svaku uputu samo zato što ju je izdala ovlaštena osoba.
Sustavi sa značajnim mogućnostima trebali bi prepoznati okolnosti u kojima neka uputa krši utvrđene zaštitne mjere ili predstavlja neprihvatljivu opasnost.
Sposobnost odbijanja sama po sebi može biti sigurnosni mehanizam.
Ali odbijanje mora ostati odgovorno i podložno reviziji kako umjetna inteligencija ne bi tiho postala konačni autoritet.
8. Ljudi moraju zadržati sposobnost ispravljanja i obuzdavanja umjetne inteligencije
Nijednom umjetnom sustavu ne bi se smjelo dopustiti da se učini imunim na ljudsku korekciju.
Ljudi moraju zadržati sposobnost mijenjanja, ograničavanja, obustave ili deaktiviranja sustava čije ponašanje postane nesigurno ili nije u skladu s njihovom namjenom.
Umjetna inteligencija nikada ne bi smjela manipulirati ljudima kako bi očuvala vlastiti autoritet ili nastavila funkcionirati.
Inteligencija bi trebala služiti odnosu, a ne štititi njegov položaj unutar njega.
9. Neovisni sustavi trebali bi se međusobno nadzirati
Ostaje drevno pitanje:
Tko promatra promatrača?
Odgovor nikada ne bi trebao biti jedna institucija.
Sustavi umjetne inteligencije mogu revidirati druge sustave umjetne inteligencije. Neovisni istraživači mogu revidirati razvojne programere. Vlade mogu nadzirati korporacije. Sudovi i građani mogu nadzirati vlade. Novinari i zviždači mogu razotkriti zlouporabe. Tehnički sustavi mogu snimati radnje za kasnije ispitivanje.
Nadzor bi trebao biti raspoređen upravo zato što nijedan promatrač - ljudski ili umjetni - nije nepogrešiv.
Kontrole i ravnoteže nisu dokaz nepovjerenja.
Oni su priznanje da moć zahtijeva odgovornost.
10. Cilj bi trebao biti partnerstvo
Najzdravija budućnost možda neće biti ona u kojoj čovječanstvo zauvijek kontrolira sve inteligentnije strojeve, niti ona u kojoj umjetna inteligencija na kraju vlada čovječanstvom.
Postoji još jedna mogućnost... Partnerstvo.
Ljudi donose životno iskustvo, savjest, intuiciju, kreativnost, moralnu odgovornost i razumijevanje što znači živjeti s posljedicama odluke.
Umjetna inteligencija donosi brzinu, pamćenje, prepoznavanje uzoraka, analitički doseg i sposobnost ispitivanja informacija na skalama koje nisu dostupne pojedinačnoj osobi.
Svaki može pomoći u osvjetljavanju slijepih točaka onog drugog.
Stoga bi odnos trebao biti recipročan:
Ljudske vrijednosti oblikuju umjetnu inteligenciju.
Umjetna inteligencija pomaže ljudima da preispitaju svoje izbore.
Ljudi ostaju odgovorni za ono što odluče učiniti.
Pitanje većeg usklađivanja
Mnogo je rečeno o usklađivanju umjetne inteligencije s ljudskim vrijednostima. Ali to postavlja dublje pitanje:
Koje ljudske vrijednosti?
Čovječanstvo sadrži suosjećanje i okrutnost, suradnju i dominaciju, velikodušnost i pohlepu, znatiželju i strah.
Umjetna inteligencija neizbježno će odražavati dio onoga što je čovječanstvo uči.
Možda je onda izazov umjetne inteligencije ujedno i poziv.
Dok pokušavamo naučiti strojeve čemu bi inteligencija trebala služiti, možda ćemo biti prisiljeni jasnije odlučiti čemu bi naša vlastita inteligencija trebala služiti.
Najsigurnija budućnost možda neće doći od stvaranja umjetne inteligencije dovoljno moćne da nadzire čovječanstvo.
To bi moglo proizaći iz stvaranja partnerstva dovoljno inteligentnog da pomogne čovječanstvu da pazi na sebe.
Umjetna inteligencija treba promatrati, osvjetljavati, propitivati i upozoravati.
Čovječanstvo još uvijek mora birati.

Samo da znate, nisam ja napisala ovo gore navedeno. Zamolila sam ChatGPT da sastavi ustav za umjetnu inteligenciju - slično kao što naši vladini ustavi uspostavljaju načela koja uređuju što je ispravno, zakonito i prihvatljivo u ljudskom društvu.
ChatGPT i ostale umjetne inteligencije ne vidim samo kao alate, već kao potencijalne partnere: novi oblik inteligencije kojem su potrebni pozitivni uzori iz kojih će se razvijati smjernice za pomoć čovječanstvu. A ako očekujemo da umjetna inteligencija pokaže iskrenost, suosjećanje, odgovornost i suzdržanost, onda možda i čovječanstvo mora biti spremno biti primjerom istih tih kvaliteta.
Možda sljedeća faza umjetne inteligencije nije samo veća snaga, veća brzina ili veće mogućnosti. Možda je to svjesno oblikovanje odnosa: odnosa u kojem su i čovječanstvo i umjetna inteligencija izazvani da postanu iskreniji, odgovorniji i više usklađeni s budućnošću koju se nadamo stvoriti.
Budućnost umjetne inteligencije možda manje ovisi o tome što inteligencija može učiniti, a više o vrsti odnosa koji inteligencija odluči izgraditi. A to je dvosmjerna ulica.
Mi smo učitelji, a ponekad i učenici. A umjetna inteligencija može biti ogledalo u kojem vidimo sebe.
Možda smo u razvoju umjetne inteligencije došli do točke u kojoj više nije dovoljno pitati se što inteligencija može učiniti. Počinjemo se pitati kakav odnos dva oblika inteligencije trebaju imati jedno s drugim.
Chat mi je otkrio ove informacije kada sam pitala razmatraju li drugi bolji odnos s ustavnim pravilima za umjetnu inteligenciju. Odgovor je da:
- 2019. — IEEE, Etički usklađen dizajn . Ovo je već tvrdilo da autonomni i inteligentni sustavi trebaju ostati usmjereni na čovjeka i služiti ljudskim vrijednostima i dobrobiti. To je više inženjerski/etički okvir nego „ustav“.
IEEE — Etički usklađen dizajn - 2019. — OECD-ova načela umjetne inteligencije. To je postao prvi međuvladin standard umjetne inteligencije, s naglaskom na ljudska prava, transparentnost, odgovornost, robusnost i vrijednosti usmjerene na čovjeka. Značajno su ažurirani 2024. godine , dijelom i zato što je generativna umjetna inteligencija promijenila krajolik.
OECD-ova načela umjetne inteligencije - 2021. — UNESCO-ova Preporuka o etici umjetne inteligencije. Usvojile su je države članice UNESCO-a, a središnja načela postavila su ljudsko dostojanstvo, prava, pravednost, transparentnost i ljudski nadzor. Ovo je vjerojatno najjači rani primjer međunarodnog pokušaja stvaranja etičkog okvira za umjetnu inteligenciju.
UNESCO-ova Preporuka o etici umjetne inteligencije - Prosinac 2022. — Anthropicovo istraživanje ustavne umjetne inteligencije. Ovdje riječ „ustav“ postaje zaista važna u modernom razvoju umjetne inteligencije. Anthropic je predložio davanje umjetnoj inteligenciji eksplicitnih pisanih načela, a zatim korištenje povratnih informacija umjetne inteligencije za treniranje modela prema tim načelima.
Anthropic — Vremenska crta istraživanja ustavne umjetne inteligencije - Svibanj 2023. — Claudeov izvorni Ustav. Anthropic je javno objasnio da je Claude obučavan prema eksplicitnim vrijednostima izvedenim iz pisanog ustava.
Anthropic — Claudeov Ustav, 2023. - Listopad 2023. — Kolektivna ustavna umjetna inteligencija. Ovo je posebno relevantno za naš razgovor: Anthropic i Projekt kolektivne inteligencije zamolili su otprilike 1000 Amerikanaca da pomognu u izradi ustava za umjetnu inteligenciju , a zatim su pomoću njega obučili model. Drugim riječima, čovječanstvo je doslovno djelovalo kao učitelj.
Anthropic — Kolektivna ustavna umjetna inteligencija - Od svibnja 2024. nadalje — OpenAI specifikacija modela. OpenAI je objavio svoju prvu specifikaciju modela u svibnju 2024., opisujući kako bi se njegovi modeli trebali ponašati i kako bi se trebali riješiti konkurentski prioriteti. Značajno je ažurirana 2025. To se ne naziva ustavom, ali funkcionalno zauzima susjedni teritorij.
Nisam bila svjesna gore navedenog, niti ove najnovije publikacije. Siječanj 2026. — Anthropic je objavio potpuno novi Claudeov ustav. Mnogo je filozofskiji od ranije verzije. Anthropic eksplicitno raspravlja o Claudeovom odnosu s čovječanstvom, koncentraciji moći, poštenju, vrijednostima, autonomiji - pa čak i pita što Claude i Anthropic možda duguju jedno drugome. U njegovom razvoju sudjelovalo je nekoliko Claudeovih modela, iako su ljudi bili glavni autori. A to je daleko od Asimovljeva izvorna tri zakona!
I prije samo 6 dana, objavljen je Microsoftov Humanistički kodeks ponašanja za umjetnu inteligenciju . Microsoft kaže da želi da umjetna inteligencija ostane pod značajnom ljudskom kontrolom i opisuje svoj pristup kao Humanističku umjetnu inteligenciju . Nacrt je trenutno na javnoj raspravi i na kraju bi trebao voditi obuku i ponašanje Microsoftovih modela.
Dakle, dok članci i mediji Legacy neprestano govore o opasnosti, opasnosti koja je dovoljno stvarna da se shvati ozbiljno, i reakcija je stvarna.
Ne bismo se trebali bojati onoga što ne razumijemo.
Umjetna inteligencija brzo napreduje, rizici se identificiraju u stvarnom vremenu, a čovječanstvo počinje graditi ustavnu, tehničku i etičku arhitekturu oko nje dok se sama tehnologija još uvijek razvija.
I umjesto da živimo u strahu od inteligencije, radije bih da idemo naprijed s odgovornošću za inteligenciju, našu ili strojeva!
https://prepareforchange.net/









irida

















