Mchoro wa AI wa "System 2" bado ni mchoro tu, miaka mitano baadaye
Karatasi ya utafiti ya mwaka 2021 iliyohusishwa na IBM ilipendekeza mawakala wa haraka na wa polepole wenye modeli ya "nafsi". Kile ilichopendekeza, na kile ambacho haikuwahi kudai kuwa imekijenga.
Pendekezo lililowasilishwa mara moja, halikuwahi kurekebishwa
Tarehe 5 Oktoba 2021, kundi kubwa la watafiti lilichapisha karatasi kwenye arXiv yenye kichwa Thinking Fast and Slow in AI: the Role of Metacognition (arXiv:2110.01834). Waandishi wake ni pamoja na Marianna Bergamaschi Ganapini, Murray Campbell, Francesco Fabiano, Lior Horesh, Jon Lenchner, Andrea Loreggia, Nicholas Mattei, Francesca Rossi, Biplav Srivastava na Kristen Brent Venable. Muhtasari wake unafanya jambo moja kwa uwazi: unahoji na unapendekeza. Haiwasilishi benchmark (kipimo cha ulinganisho wa utendaji), mfumo, wala tathmini. Rekodi ya arXiv inaonyesha toleo moja tu, v1, uwasilishaji wa KB 560, na hakuna marekebisho yaliyofuata.
Hilo ni muhimu kwa sababu msamiati wa karatasi hii, yaani mawakala wa haraka, mawakala wa polepole, na uwashaji wa makusudi wa kufikiri, sasa umekuwa lugha ya kawaida ya masoko kwa kizazi cha bidhaa za AI. Karatasi inayotajwa mara nyingi kama chanzo chake ni karatasi ya msimamo (position paper). Inafaa kusomwa kwa masharti yake yenyewe; si ushahidi kwamba mtu yeyote alitoa bidhaa halisi.
Kile ambacho usanifu huu unasema hasa
Uchambuzi wa kuanzia ni wa moja kwa moja. Waandishi wanaandika kwamba licha ya maendeleo makubwa, bado tunaona "mara nyingi mifano ya AI nyembamba": mifumo iliyojengwa kwa ujuzi mdogo kama kutafsiri picha, usindikaji wa lugha asilia, uainishaji na utabiri. Pia wanatoa hoja ambayo imedumu vizuri, kwamba mafanikio haya yanahusiana si tu na algorithimu bora bali pia na upatikanaji wa hifadhidata kubwa sana na nguvu za kompyuta. AI ya kisasa kabisa, wanahoji, bado haina uwezo ambao mtu angeujumuisha kwa kawaida katika dhana ya akili.
Suluhisho wanalopendekeza linakopa tofauti ya Daniel Kahneman kati ya njia mbili za fikra za binadamu. System 1 ni ya haraka, ya kiotomatiki, inayoendeshwa na utambuzi wa mifumo, kama kutambua uso au kudaka glasi inayoanguka. System 2 ni ya polepole, yenye juhudi na ya makusudi, kama kufanya mgawanyo mrefu au kupanga njia katika jiji usilolijua.
Karatasi inaweka dhana hii kwenye usanifu wa mawakala wengi. Matatizo yanayoingia huelekezwa ama kwa mawakala wa "system 1", ambao hujibu kwa kutumia uzoefu wa zamani tu, au kwa mawakala wa "system 2", ambao, kwa maneno ya waandishi, "huwashwa kwa makusudi pale panapohitajika kufikiri na kutafuta suluhisho bora zaidi ya kile kinachotarajiwa kutoka kwa wakala wa system 1."
Rasilimali mbili za pamoja zipo chini ya aina zote mbili za mawakala. Modeli ya ulimwengu inahifadhi maarifa ya kikoa kuhusu mazingira. Modeli ya "nafsi" inahifadhi taarifa kuhusu vitendo vya awali vya mfumo na ujuzi wa watatuzi wake. Sehemu hii ya pili ndiyo ya kuvutia, na ndipo neno metacognition (kufikiri kuhusu kufikiri) linapostahili nafasi yake: mfumo unaoweka rekodi ya vipengele vyake vinavyofaa kwa kazi gani unaweza, kwa nadharia, kuamua wakati ambapo mwitikio wake wa haraka umezidiwa uwezo.
Sehemu ngumu ambayo muhtasari haujaitatua
Uelekezaji (routing) ndio kiini cha mchezo, na ni mgumu kweli. Ili kujua kwamba jibu la haraka halitoshi, kitu fulani lazima kikadirie ubora wa jibu ambalo mbadala wake haujakokotolewa bado. Ukikosea upande mmoja, unachoma nguvu za kompyuta kutafakari mambo madogo. Ukikosea upande mwingine, mfumo unaamua kwa kujiamini kupitia mwitikio wa haraka na kufikia uamuzi mbaya, hali ambayo kila mtu anayeendesha modeli kwenye uzalishaji (production) anaitambua.
Muhtasari unaeleza kigezo hicho kwa kiwango cha nia, si utaratibu. Unasema mawakala wa polepole huwashwa pale panapohitajika kufikiri zaidi ya kinachotarajiwa kutoka kwa wakala wa haraka. Jinsi matarajio hayo yanavyoundwa, kupimwa, kusawazishwa au kukaguliwa si jambo ambalo muhtasari unalithibitisha. Bidhaa yoyote inayodai kulitatua hili itazame kama dai, na uombe takwimu.
Maswali Unayopaswa Kuuliza
- Muuzaji anaposema mfumo wake "hufikiri polepole inapohitajika," ni ishara gani mahususi inayosababisha kubadili, na je, unaweza kuona kumbukumbu (log) ya wakati ilipowaka na wakati haikuwaka?
- Mfumo unaamini nini kuhusu uwezo wake wenyewe, na nani aliyeandika imani hiyo? "Modeli ya nafsi" ni kitu cha usanidi; kama msambazaji ndiye aliyeijaza, inabeba dhana zake kuhusu chombo chake mwenyewe.
- Gharama ya uamuzi mbaya wa uelekezaji ni nini katika mchakato wako wa kazi: nguvu za kompyuta zilizopotea, au uamuzi usiokaguliwa unaomfikia mteja?
- Usanifu unaouziwa umetathminiwa dhidi ya msingi wa kulinganisha (baseline), au unaelezwa kwa mlinganisho na fikra za binadamu? Hizo ni aina tofauti za hoja.
- Jibu la njia ya haraka likiwa si sahihi, je, kuna kitu katika mfumo kinachogundua hilo baadaye na kusasisha, au kosa linakuwa sehemu ya "uzoefu wa zamani" tu?
Cha Kufuatilia Baadaye
Ishara ya kufuatilia si karatasi zaidi zinazomtaja Kahneman. Ni kama mfumo wowote uliotumwa kazini unachapisha maamuzi yake ya uelekezaji kama rekodi inayoweza kukaguliwa: rekodi ya maombi yaliyopandishwa kwenda kwenye kufikiri kwa makusudi, yapi hayakupandishwa, na mara ngapi uchaguzi huo ulikuwa kosa. Hadi hilo litakapokuwepo, safu ya metacognition ni kitu unachoombwa kukiamini badala ya kitu unachoweza kukichunguza.
- 1Kagua historia ya matoleo ya arXiv kabla ya kutaja karatasi kama msingi; v1 pekee bila marekebisho ni ishara ya pendekezo, si matokeo yaliyothibitishwa.
- 2Muuzaji akitumia lugha ya 'haraka/polepole' au 'kufikiri kwa makusudi', omba benchmark na data ya tathmini, si ukoo wa kidhana.
- 3Tofautisha karatasi zinazohoji na zile zinazopima, na taja za pili unapohalalisha usanifu au ununuzi.
Ready to implement AI in your business?
Our team builds the AI systems you just read about. Start with a free 30-minute discovery meeting.
