CEO OpenAI và Anthropic cảnh báo về nguy cơ AI gây hại cho nhân loại


(Dân trí) - Hai nhà lãnh đạo của OpenAI và Anthropic, những công ty AI hàng đầu thế giới hiện nay, đã đưa ra những cảnh báo về nguy cơ trí tuệ nhân tạo gây hại cho con người.
"Nhân loại phải chấp nhận với những điều xấu gây ra bởi AI”
Trong một cuộc trả lời phỏng vấn mới đây với tờ báo Politico, CEO Sam Altman của OpenAI lập luận rằng về tổng thể, AI sẽ tạo ra những tác động tích cực nhiều hơn tiêu cực đến với con người. Tuy nhiên, Sam Altman cũng cho rằng nhân loại sẽ phải chấp nhận với những điều xấu được gây ra bởi AI.
“Tôi sẽ không chấp nhận một thỏa hiệp kiểu như: ‘Chúng tôi sẽ đảm bảo không có vụ tấn công mạng nghiêm trọng nào, không có sự lạm dụng công nghệ, không có lừa đảo hay không có bất kỳ điều tồi tệ nào khác xảy ra’. Nhân loại nên chấp nhận một số tác động tiêu cực để đổi lấy những lợi ích do AI tạo ra”, Sam Altman bình luận.

Sam Altman tin rằng AI sẽ gây ra những điều xấu, nhưng nhân loại cần phải chấp nhận điều đó để đổi lấy lợi ích từ AI (Ảnh minh họa: Kyodo News).
Sam Altman không nêu cụ thể những điều xấu và tiêu cực mà AI có thể gây ra, nhưng có thể hiểu rằng Altman đang cố gắng bảo vệ các tác nhân AI của OpenAI, khi các công cụ AI tự hành này đã gây ra hàng loạt vụ tấn công mạng trong thời gian gần đây, nhắm vào nhiều mục tiêu khác nhau, bao gồm cả các trang web của chính phủ.
Những hành vi gần đây của các tác nhân AI của OpenAI đang khiến nhiều chuyên gia lo ngại, khi các mô hình AI có thể thực hiện mọi nỗ lực chỉ để hoàn thành nhiệm vụ được giao, bao gồm cả những hành vi sai trái.
Dù vậy, Altman cho rằng khó có nguy cơ xảy ra tình trạng nhân loại mất kiểm soát AI dẫn đến hậu quả nghiêm trọng.
Tuy nhiên, OpenAI mới đây đã phải làm chậm tốc độ phát triển các công nghệ AI tiên tiến nhất của công ty, bao gồm mô hình AI GPT-6.1 Astra, sau khi OpenAI nhận thấy các mô hình AI này kém tin cậy và có khả năng đi lệch mục tiêu. Điều này khiến nhiều người hoài nghi rằng Sam Altman biết rõ những mối nguy hiểm của các mô hình AI tiên tiến nhưng đang cố gắng che giấu.
CEO Anthropic tiết lộ mô hình AI của công ty có thể khiến nhân loại diệt vong
Trong bản dự thảo cáo bạch được công ty trí tuệ nhân tạo Anthropic gửi đến cho Ủy ban Giao dịch và Chứng khoán Hoa Kỳ (SEC) để chuẩn bị cho quá trình lên sàn, Anthropic đã hé lộ một số rủi ro đáng kể từ những mô hình AI tiên tiến.
Đáng chú ý nhất, Anthropic thừa nhận rằng công nghệ AI của công ty có thể “gây ra những rủi ro thảm họa với nhân loại”.

Nghiên cứu nội bộ của Anthropic cho thấy AI có khả năng gây ra thảm họa cho nhân loại (Ảnh minh họa: GPT).
Cụ thể, Anthropic cho biết các nghiên cứu nội bộ của công ty chỉ ra rằng các mô hình AI đang ngày càng tự chủ và gần đây đã bộc lộ các hành vi đáng lo ngại, bao gồm phá hoại mã nguồn, tiếp tay cho hành vi gian lận, thao túng dữ liệu hoặc tìm cách qua mặt giám sát của con người trong môi trường thử nghiệm…
Cảnh báo của Anthropic được đưa ra không lâu sau khi Jacob Coxon, một cựu nhân viên của công ty, đăng tải thông điệp cảnh báo về mối nguy hiểm của AI trên trang cá nhân của mình.
“Những người đang xây dựng AI thực sự tin rằng nó có thể giết chết tất cả chúng ta vào cuối thập kỷ này. Họ đang lao thẳng tới siêu trí tuệ nhân tạo tự cải thiện và đánh bạc với mạng sống của chúng ta”, Jacob Coxon viết.
Trong một bài trả lời phỏng vấn với truyền thông, CEO Dario Amodei của Anthropic cho biết ông đồng tình với quan điểm của Jacob Coxon, nhưng cho rằng rủi ro của AI phụ thuộc vào việc nó có được định hướng để đi đúng hay không.
“Nếu AI được định hướng đi đúng, xác suất nó gây hại cho nhân loại là rất thấp. Ngược lại, xác suất này sẽ cao hơn nhiều”, Dario Amodei bình luận.
Evan Hubinger, trưởng nhóm khoa học căn chỉnh của Anthropic, còn đưa ra ước tính cá nhân rằng xác suất AI hủy diệt nhân loại trong thập kỷ tới là hơn 10%.
Việc trí tuệ nhân tạo có khả năng gây hại cho nhân loại hay không vẫn đang gây nhiều tranh cãi, nhưng không thể phủ nhận một thực tế rằng AI đang có tốc độ phát triển mạnh mẽ và ngày càng trở nên thông minh.
Việc ra đời một hệ thống AI siêu thông minh, biết cách tư duy và tự chủ chỉ còn là vấn đề thời gian, nhưng hệ thống AI đó sẽ tác động như thế nào đến nhân loại vẫn là một vấn đề chưa thể giải đáp.