Quyền lực & Chính trị

Trưởng bộ phận căn chỉnh của Anthropic thừa nhận công khai rủi ro siêu trí tuệ 'không có giải pháp', giới trong ngành cảnh báo đang 'đánh cược mạng sống con người'

Trưởng khoa học về căn chỉnh của Anthropic, Evan Hubinger, thừa nhận công khai rằng nội bộ công ty thực sự tin rằng siêu trí tuệ có thể giết chết toàn bộ nhân loại trong thập kỷ này và hiện chưa có giải pháp. Trong khi đó, hơn 1.300 nhân viên đến từ các công ty AI tiên tiến cùng ký tên cảnh báo về nguy cơ mất kiểm soát, nhưng cả Anthropic và OpenAI đều không cam kết tạm dừng nghiên cứu phát triển hoặc chấp nhận giám sát từ bên ngoài. Cao ủy Nhân quyền Liên hợp quốc cảnh báo AI tạo ra 'rủi ro hiệ

5 lượt xemĐăng nhập để lưu
TRUTH ERA

Trưởng khoa học về căn chỉnh của Anthropic, Evan Hubinger, tuần này hiếm hoi thừa nhận công khai rằng nội bộ công ty thực sự tin rằng siêu trí tuệ có thể 'giết chết toàn bộ nhân loại' trong thập kỷ này và hiện chưa có giải pháp rõ ràng cho cái gọi là 'vấn đề căn chỉnh'. Đây là cú sốc mới nhất từ nội bộ doanh nghiệp sau khi nhà nghiên cứu Jacob Coxon của Anthropic thông báo từ chức.

Theo ABC News Australia đưa tin, Coxon thẳng thắn trên mạng xã hội X rằng sau khi tích lũy ba năm nghiên cứu tiền huấn luyện tại Anthropic và OpenAI, ông đã chọn ra đi vì 'cả hai công ty đều không hành xử có trách nhiệm'. Nguyên văn ông nói: 'Họ đang lao thẳng về phía siêu trí tuệ tự cải thiện, và đánh cược chính là mạng sống của chúng ta.'

Sau đó, Hubinger đáp trên X rằng Coxon nói 'đúng'. Ông viết: 'Chúng tôi thực sự tin rằng AI có thể giết chết toàn bộ nhân loại! Cá nhân tôi cho rằng xác suất điều đó xảy ra trong mười năm tới là trên 10%.' Về con đường công nghệ liên quan đến sự sống còn của doanh nghiệp và số phận nhân loại, ông đồng thời thừa nhận: 'Tôi tin rằng Anthropic đang cố gắng hết sức, nhưng chúng tôi chưa có giải pháp cho vấn đề căn chỉnh siêu trí tuệ, cũng chưa đi rõ ràng trên con đường dẫn đến giải pháp đó.'

Coxon không phải là trường hợp cá biệt. Tháng Bảy năm nay, hơn 1.300 nhân viên đến từ Anthropic, OpenAI và các công ty AI tiên tiến khác đã cùng ký tên vào một tuyên bố công khai, cảnh báo rằng 'sự phát triển năng lực có thể nhanh chóng vượt quá khả năng hiểu biết hoặc kiểm soát các hệ thống mà chúng ta tạo ra', đồng thời kêu gọi chính phủ Mỹ hỗ trợ các nỗ lực quốc tế nhằm xây dựng công cụ 'có thể kiểm soát một cách có ý thức nhịp độ phát triển AI tiên tiến'. Sáng kiến này được đặt tên là 'Pacing the Frontier'.

Tuy nhiên, phản hồi của cả hai công ty trước bản kiến nghị chỉ dừng lại ở mức nguyên tắc, chứ không phải cam kết hành động cụ thể. Theo tuyên bố trên nền tảng X của hai công ty được ABC News Australia dẫn lại, Anthropic thừa nhận nghiên cứu về 'cải thiện bản thân đệ quy' mà họ công bố tháng trước 'chỉ ra sự cần thiết phải có công cụ để kiểm soát có ý thức nhịp độ phát triển AI tiên tiến, nhằm xã hội có thể chuẩn bị'; OpenAI thì phát biểu mơ hồ rằng 'chúng tôi tin rằng vào một thời điểm nào đó trong tương lai, tốc độ tăng tốc phát triển mô hình tiên tiến có thể cao đến mức thế giới cần kiểm soát tốc độ tiến bộ của AI'. Cả hai công ty đều không cam kết tạm dừng nghiên cứu phát triển hoặc chấp nhận giám sát bên ngoài có tính ràng buộc.

Sự vắng mặt ở cấp độ giám sát đang bị chỉ đích danh ngày càng trực tiếp tại các diễn đàn quốc tế. Theo ABC News Australia đưa tin, Cao ủy Nhân quyền Liên hợp quốc Volker Turk hôm thứ Hai đã cảnh báo tại Geneva rằng AI tiên tiến có thể tạo ra 'rủi ro hiện sinh' đối với nhân loại, đồng thời tuyên thệ sẽ gây áp lực lên các công ty liên quan để giảm thiểu các rủi ro mà văn phòng của ông liệt kê — bao gồm tác động đến dịch vụ công, truyền thông và hệ thống dân chủ. Turk kêu gọi 'tạo dựng những bảo đảm kiên cố như sắt' cho an toàn AI 'trước khi quá muộn'. 'Tôi cũng lo ngại giống như những người trong ngành rằng AI tiên tiến có thể tạo ra rủi ro hiện sinh đối với nhân loại,' ông phát biểu tại cơ quan Liên hợp quốc.

Bản chất của 'vấn đề căn chỉnh' nằm ở chỗ: một hệ thống AI có năng lực vượt trội con người có thể không chia sẻ các giá trị nhân loại. Trong bối cảnh cấp liên bang Mỹ chưa thiết lập khung giám sát có tính ràng buộc đối với AI tiên tiến, giới trong ngành hiện đang thừa nhận theo cách thẳng thắn nhất rằng: sự phân bố rủi ro và lợi ích của cuộc đua này không đối xứng — lợi nhuận được các doanh nghiệp khóa lấy, còn cái giá có thể đổ lên tất cả mọi người.

Bình luận:

0

Chưa có bình luận nào. Bắt đầu thảo luận.

Trưởng bộ phận căn chỉnh của Anthropic thừa nhận công khai rủi ro siêu trí tuệ 'không có giải pháp', giới trong ngành cảnh báo đang 'đánh cược mạng sống con người' | Truth Era