Güç ve Siyaset

Anthropic'in hizalama sorumlusu, 'çözümsüz' süper zekâ riskini açıkça kabul etti; sektör uyarıyor: 'İnsan hayatı üzerine bahis oynanıyor'

Anthropic'in hizalama bilimi sorumlusu Evan Hubinger, şirket içinde süper zekanın bu on yıl içinde tüm insanlığı öldürebileceğine ve şu anda çözüm bulunmadığına gerçekten inandıklarını açıkça kabul etti. Bu arada 1300'den fazla önde gelen AI şirketi çalışanı, kontrolden çıkma risklerine karşı uyarı niteliğinde ortak bildiriye imza attı; ancak ne Anthropic ne de OpenAI araştırma geliştirmeyi durdurmayı ya da bağlayıcı dış düzenlemeyi kabul etti. Birleşmiş Milletler İnsan Hakları Yüksek Komiseri,

5 görüntülemeKaydetmek için giriş yapın
TRUTH ERA

Anthropic'in hizalama bilimi sorumlusu Evan Hubinger bu hafta nadiren yaptığı bir açıklamayla, şirket içinde süper zekanın bu on yıl içinde 'tüm insanlığı öldürebileceğine' ve söz konusu 'hizalama sorununu' çözecek net bir yöntemin henüz bulunmadığına gerçekten inandıklarını kabul etti. Bu, Anthropic araştırmacısı Jacob Coxon'un istifa ettiğini açıklamasının ardından şirket içinden gelen son sarsıcı açıklama oldu.

ABC News Australia'nın haberine göre, Coxon X adlı sosyal medya platformunda, Anthropic ve OpenAI'da toplam üç yıl ön eğitim araştırması yaptıktan sonra 'iki şirketin de sorumlu davranmaması' nedeniyle ayrıldığını açıkça söyledi. Kendi ifadesiyle: 'Kendi kendini geliştiren süper zekâya doğru son sürat ilerliyorlar, bahislerini bizim hayatlarımızla oynuyorlar.'

Hubinger bunun üzerine X'te Coxon'un söylediklerinin 'doğru' olduğunu belirtti. Şöyle yazdı: 'Biz gerçekten de AI'nın tüm insanlığı öldürebileceğine inanıyoruz! Bence önümüzdeki on yıl içinde gerçekleşme olasılığı yüzde 10'un üzerinde.' Şirketin geleceğiyle insanlığın kaderini ilgilendiren teknik yol haritası meselesinde, aynı zamanda şunu da kabul etti: 'Anthropic'in elinden gelenin en iyisini yaptığına inanıyorum, ancak süper zekâ hizalama sorununu çözecek bir yöntemimiz yok, bu çözüme giden yolda da net bir şekilde ilerlemiyoruz.'

Coxon yalnız değil. Bu yılın temmuz ayında, Anthropic, OpenAI ve diğer önde gelen AI şirketlerinden 1300'den fazla çalışan, 'yetenek gelişiminin ürettiğimiz sistemleri anlama veya kontrol etme kapasitemizi hızla aşabileceği' konusunda uyaran ortak bir bildiriye imza attı ve ABD hükümetini, 'öncü AI geliştirme hızını bilinçli olarak kontrol edebilecek' araçlar oluşturmak amacıyla uluslararası çabaları desteklemeye çağırdı. Girişim 'Pacing the Frontier' adıyla anılıyor.

Ancak iki şirketin bildiriye verdikleri yanıt, somut eylem taahhütlerinden çok ilkesel düzeyde kaldı. ABC News Australia'nın, iki şirketin X platformundaki açıklamalarına dayandırdığı habere göre, Anthropic, geçen ay yayımladığı 'özyinelemeli öz iyileştirme' konulu araştırmanın 'toplumun hazırlanabilmesi için öncü AI geliştirme hızını bilinçli olarak kontrol edecek araçlara ihtiyaç olduğuna işaret ettiğini' kabul etti; OpenAI ise belirsiz bir dille, 'önümüzdeki bir noktada, öncü model geliştirmedeki AI hızlanmasının, dünyanın AI ilerleme hızını kontrol etmesini gerektirecek kadar yüksek olabileceğine' inandıklarını ifade etti. İki şirket de araştırma geliştirmeyi durdurmayı veya bağlayıcı dış düzenlemeyi kabul etmedi.

Düzenleme alanındaki boşluk, uluslararası platformlarda giderek daha doğrudan bir şekilde gündeme getiriliyor. ABC News Australia'nın haberine göre, Birleşmiş Milletler İnsan Hakları Yüksek Komiseri Volker Turk pazartesi günü Cenevre'de yaptığı açıklamada, ileri AI'nın insanlık için 'varoluşsal risk' oluşturabileceği uyarısında bulundu ve ilgili şirketlere, ofislerinde sıralanan—kamu hizmetleri, iletişim ve demokratik sistemlere yönelik etkiler de dahil—riskleri azaltma yönünde baskı yapacağına yemin etti. Turk, 'çok geç olmadan' AI güvenliği için 'demir gibi sağlam güvenceler' oluşturulması çağrısında bulundu. 'Sektör içindeki insanlar gibi, ileri AI'nın insanlık için varoluşsal risk oluşturabileceğinden endişe duyuyorum,' diye konuştu BM organlarında yaptığı konuşmada.

'Hizalama sorununun' özü şudur: İnsan yeteneklerini aşan bir AI sistemi insan değerlerini paylaşmayabilir. ABD federal düzeyde öncü AI için bağlayıcı bir düzenleyici çerçeve henüz oluşturulmamışken, sektör içinden artık en açık şekilde şu kabul ediliyor: Bu yarışın risk ve getiri dağılımı asimetriktir—getiriler şirketlere kilitlenmiş, bedel ise tüm insanlığa düşebilir.

Yorumlar

0

Henüz yorum yok. Tartışmayı başlatın.