Pinuno ng Alignment ng Anthropic, hayagang kinilala ang 'walang solusyon' na panganib ng superintelligence; babala ng industriya: 'taya nito ang buhay ng tao'
Si Evan Hubinger, pinuno ng alignment science ng Anthropic, ay hayagang kinilala na ang kumpanya ay tunay na naniniwalang ang superintelligence ay maaaring pumatay ng buong sangkatauhan sa loob ng dekada na ito, at wala pang solusyon. Samantala, higit sa 1,300 dating empleyado ng mga nangungunang kumpanya ng AI ay lumagda ng babala tungkol sa panganib ng pagkawala ng kontrol, ngunit hindi nag-angkin na ihihinto ang pananaliksik o tatanggap ng panlabas na regulasyon ang Anthropic at OpenAI. Babal
Si Evan Hubinger, pinuno ng alignment science ng Anthropic, ay bihirang hayagang kinilala nitong linggo na ang kumpanya ay tunay na naniniwalang ang superintelligence ay maaaring 'pumatay ng buong sangkatauhan' sa loob ng dekada na ito, at wala pang malinaw na solusyon sa tinatawag na 'problema sa alignment.' Ito ang pinakabagong pagyanig mula sa loob ng kumpanya matapos ideklara ng mananaliksik ng Anthropic na si Jacob Coxon ang kanyang pagbibitiw.
Ayon sa ulat ng ABC News Australia, hayagang sinabi ni Coxon sa social media na X na pinili niyang umalis pagkatapos ng tatlong taong pananaliksik sa pre-training sa Anthropic at OpenAI, dahil 'walang responsibilidad ang dalawang kumpanya.' Ang kanyang eksaktong sinabi ay: 'Tumutulong sila nang tuluy-tuloy patungo sa superintelligence na nagpapabuti sa sarili, at ang taya nito ay ang aming buhay.'
Sumagot si Hubinger sa X na 'tama' ang sinabi ni Coxon. Sumulat siya: 'Tunay kaming naniniwala na ang AI ay maaaring pumatay ng buong sangkatauhan! Sa aking personal na pananaw, ang posibilidad na mangyari ito sa susunod na dekada ay higit sa 10 porsyento.' Sa usapin ng teknikal na landas na may kinalaman sa kaligtasan ng kumpanya at kapalaran ng sangkatauhan, kinilala rin niya: 'Naniniwala ako na pinagsisikapan ng Anthropic, ngunit wala pa kaming solusyon sa problema sa alignment ng superintelligence, at hindi rin kami malinaw na naglalakad sa landas patungo sa solusyon na iyon.'
Hindi nag-iisa si Coxon. Noong Hulyo ngayong taon, higit sa 1,300 empleyado mula sa Anthropic, OpenAI, at iba pang mga nangungunang kumpanya ng AI ay lumagda ng pampublikong pahayag, na nagbabala na 'ang pag-unlad ng kakayahan ay maaaring mabilis na lumampas sa ating kakayahan na maunawaan o kontrolin ang mga sistemang nilikha,' at nanawagan sa gobyerno ng US na suportahan ang internasyonal na pagsisikap, na magtatatag ng mga kasangkapan na 'may kamalayan sa pagkontrol sa bilis ng pag-unlad ng frontier AI.' Ang inisyatibang ito ay pinangalanang 'Pacing the Frontier.'
Gayunpaman, ang tugon ng dalawang kumpanya sa pananawagan ay nanatili sa antas ng prinsipyo, hindi sa mga kongkretong pangako sa aksyon. Ayon sa pahayag ng dalawang kumpanya sa platapormang X na sinipi ng ABC News Australia, kinilala ng Anthropic na ang pananaliksik nito noong nakaraang buwan tungkol sa 'recursive self-improvement' ay 'nagtuturo na kailangan ng mga kasangkapan para may kamalayan sa pagkontrol sa bilis ng pag-unlad ng frontier AI, upang maging handa ang lipunan'; ang OpenAI naman ay malabo ang pahayag na, 'naniniwala kami na sa ilang punto sa hinaharap, ang pagpapabilis ng AI sa pag-unlad ng frontier model ay maaaring maging napakataas, kaya't kailangan ng mundo na kontrolin ang bilis ng pag-unlad ng AI.' Walang alinmang kumpanya ang nangakong ihihinto ang pananaliksik o tatanggap ng nakatali na panlabas na regulasyon.
Ang kawalan ng presensya sa antas ng regulasyon ay mas direktang tinuturo sa internasyonal na entablado. Ayon sa ulat ng ABC News Australia, babala ni Volker Turk, Mataas na Komisyonado para sa Karapatang Pantao ng United Nations, sa Geneva noong Lunes na ang advanced na AI ay maaaring bumuo ng 'panganib na existential' sa sangkatauhan, at nangako na pipilitin ang mga kaugnay na kumpanya na bawasan ang mga panganib na nakatala sa kanilang opisina—kabilang ang epekto sa mga pampublikong serbisyo, komunikasyon, at sistemang demokratiko. Nanawagan si Turk na 'magtakda ng bakal-tibay na mga panseguridad' para sa kaligtasan ng AI 'bago pa huli na.' 'Ako ay nababahala katulad ng mga tao sa loob ng industriya na ang advanced na AI ay maaaring bumuo ng panganib na existential para sa sangkatauhan,' pahayag niya sa ahensya ng UN.
Ang kakanyahan ng 'problema sa alignment' ay: ang isang sistema ng AI na lumalampas sa kakayahan ng tao ay maaaring hindi magbahagi ng mga pagpapahalaga ng tao. Sa konteksto na wala pang balangkas ng regulasyon na may bisa sa antas pederal ng US para sa frontier AI, ang loob ng industriya ngayon ay kinikilala sa pinakatapat na paraan na: ang pamamahagi ng panganib at gantimpala sa karerang ito ay hindi simetrico—ang kita ay nakatala sa mga kumpanya, habang ang halaga ay maaaring mapasa sa lahat.
Wala pang komento. Simulan ang talakayan.