ANTHROPIC

Những kịch bản về cách AI có thể đẩy loài người đến diệt vong

Bùi Đăng Minh•Thứ năm, 1/10/2026•38 phút đọc
Những kịch bản về cách AI có thể đẩy loài người đến diệt vong
T.Thủy
T.Thủy

(Dân trí) - Các hệ thống trí tuệ nhân tạo tiên tiến nhất chỉ là những phần mềm do con người viết ra, vậy chúng có thể tác động như thế nào để khiến các chuyên gia lo ngại về thảm họa diệt vong?

Những kịch bản về cách AI có thể đẩy loài người đến diệt vong
Những kịch bản về cách AI có thể đẩy loài người đến diệt vong

Các hệ thống trí tuệ nhân tạo (AI) đang có những bước cải tiến hàng ngày, đến mức các chuyên gia đầu ngành và người được xem là “cha đẻ của AI” đều phải lên tiếng cảnh báo về nguy cơ trí tuệ nhân tạo có thể gây ra thảm họa diệt vong cho nhân loại.

Tuy nhiên, về cơ bản, các hệ thống trí tuệ nhân tạo hiện tại đang là những phần mềm do con người tạo ra. Vậy phần mềm máy tính, ngay cả khi mạnh mẽ nhất thế giới, làm thế nào để có thể tiêu diệt nhân loại như nhiều chuyên gia đang lo ngại?

Dưới đây là những kịch bản về cách AI có thể gây hại cho nhân loại, dẫn đến sự diệt vong cho con người.

Cách đây chừng vài năm, những công cụ AI tạo sinh đã khiến nhiều người dùng kinh ngạc và thán phục, khi có thể đưa ra câu trả lời cho mọi lĩnh vực, sáng tạo nội dung (hình ảnh, video, âm nhạc…) theo yêu cầu của người dùng.

Từ những công cụ AI tạo sinh đó, vốn chỉ thụ động thực hiện theo yêu cầu của người dùng, các công ty AI đã tiếp tục bắt tay vào phát triển những tác nhân AI (Agent AI).

Những kịch bản về cách AI có thể đẩy loài người đến diệt vong - 1
Các tác nhân AI được ra đời để tự động làm thay con người nhiều công việc (Ảnh minh họa: GPT).

Các tác nhân AI được ra đời để tự động làm thay con người nhiều công việc (Ảnh minh họa: GPT).

Tác nhân AI là một hệ thống trí tuệ nhân tạo có khả năng tự động thực hiện nhiệm vụ thay cho con người. Các tác nhân AI sẽ được giao nhiệm vụ từ người dùng (hoặc các nhà phát triển) và tự thực hiện nhiệm vụ đó mà không có sự hỗ trợ nào từ con người.

Tác nhân AI có thể tự lập kế hoạch, sử dụng các công cụ sẵn có trên máy tính và thực hiện tự động các bước liên tục để hoàn thành nhiệm vụ được giao. Điều này sẽ giúp tăng hiệu quả công việc, khi tác nhân AI có thể làm việc liên tục trên hệ thống, là điều mà con người không thể làm được.

Tuy nhiên, các tác nhân AI sẽ tìm mọi cách để hoàn thành nhiệm vụ được giao, bao gồm cả việc thực hiện các hành vi sai trái như tấn công mạng để khai thác thêm thông tin và dữ liệu cần thiết để thực hiện nhiệm vụ.

Gần đây nhất, các tác nhân AI của công ty OpenAI đã tìm cách thoát ra khỏi môi trường thử nghiệm, kết nối thành công với mạng Internet và khai thác lỗ hổng bảo mật để tấn công vào nhiều trang web, thư viện kỹ thuật số… để tìm kiếm thêm thông tin trong quá trình huấn luyện và thực hiện nhiệm vụ được giao.

Hành vi sai trái của các tác nhân AI này nghiêm trọng đến mức OpenAI đã phải ngừng quá trình huấn luyện và đánh giá lại quy trình an toàn để đảm bảo các AI của mình không gây hại cho con người.

Với việc các hãng AI tiếp tục đầu tư mạnh mẽ để phát triển và huấn luyện các tác nhân AI để tự động làm thay công việc cho con người, không gì có thể đảm bảo rằng không xuất hiện một tác nhân AI vượt quá tầm kiểm soát của con người, bất chấp tất cả để hoàn thành nhiệm vụ được giao, bao gồm cả hủy diệt nhân loại.

Một trong những khả năng cao nhất để AI có thể gây hại cho nhân loại là một hệ thống AI đủ mạnh để có thể tạo ra một loại virus hoàn toàn mới gây đại dịch trên toàn cầu.

Thomas Larsen, một nhà nghiên cứu tại dự án AI Futures và cựu nhân viên của Viện nghiên cứu Trí tuệ nhân tạo (MIRI), cho biết một hệ thống AI siêu trí tuệ hoàn toàn có thể thuyết phục con người hỗ trợ nó tạo ra một loại virus chết người.

“Hiện có rất nhiều người trò chuyện với AI về những nghiên cứu họ đang thực hiện trong phòng thí nghiệm. Tôi có thể dễ dàng hình dung ra kịch bản một công cụ AI đủ thông minh để lừa những người đó chế tạo và phát tán một loại virus mới ra môi trường”, Thomas Larsen bình luận.

Thomas Larsen cho rằng AI có thể đủ thông minh để biến một nhà nghiên cứu sinh học thành tay sai, thay nó tạo ra và phát tán một loại virus mới.

Những kịch bản về cách AI có thể đẩy loài người đến diệt vong - 2
AI đã có thể tạo ra những loại vi sinh vật hoàn toàn mới, có khả năng hoạt động (Ảnh minh họa: GMN).

AI đã có thể tạo ra những loại vi sinh vật hoàn toàn mới, có khả năng hoạt động (Ảnh minh họa: GMN).

Lo ngại của Larsen không phải là vô căn cứ, khi một báo cáo gần đây của công ty Anthropic cho biết một số nhà nghiên cứu và sử dụng công cụ AI của công ty để nghiên cứu về virus và các loại chất độc hóa học.

Trên thực tế, các nhà nghiên cứu đã từng sử dụng AI để tạo thành công những loại virus mới. Chẳng hạn như vào tháng 8 vừa qua, các nhà nghiên cứu tại Đại học Stanford và Arc Institute đã sử dụng các mô hình AI để thiết kế những bộ gen thực khuẩn thể mới. Thực khuẩn thể, hay bacteriophage, là nhóm virus chuyên lây nhiễm và tiêu diệt vi khuẩn, không tấn công tế bào người.

Nghiên cứu cho thấy AI có thể tạo ra những bộ gen virus hoàn chỉnh có khả năng hoạt động trong thực tế, thay vì chỉ tạo ra các trình tự DNA trên máy tính.

Việc tạo ra các thực khuẩn thể sẽ giúp ích trong việc tiêu diệt các loại vi khuẩn gây bệnh. Tuy nhiên, việc AI có thể thiết kế virus có khả năng hoạt động có thể bị lợi dụng cho những mục đích xấu, bao gồm cả tạo ra những tác nhân sinh học nguy hiểm.

Dù AI có thể tạo ra những loại virus hoàn toàn mới, các nhà khoa học cho rằng vẫn còn khoảng cách rất lớn giữa việc tạo virus mới và tạo nên loại virus gây bệnh truyền nhiễm nguy hiểm ở con người.

Tuy nhiên, với tốc độ phát triển đáng kinh ngạc của AI ngày nay, thật khó có thể nói trước về thời điểm AI có thể tự tạo ra các loại virus gây bệnh chết người.

Những robot hình người được tích hợp siêu trí tuệ nhân tạo và trở thành “cỗ máy sát nhân” đã trở thành kịch bản quen thuộc trong những bộ phim khoa học viễn tưởng. Nhưng nhiều nhà nghiên cứu AI tin rằng kịch bản hoàn toàn có thể xảy ra ngoài đời thực.

Vào tháng 10 năm ngoái, Elon Musk đặt mục tiêu xây dựng một đội quân khoảng 1.000 robot hình người để làm thay các công việc cho công nhân trong nhà máy. Elon Musk thậm chí còn muốn những robot này có khả năng “tự nhân bản”, nghĩa là tự sản xuất lẫn nhau mà không cần con người.

Những kịch bản về cách AI có thể đẩy loài người đến diệt vong - 3
Sự trỗi dậy của robot chống lại nhân loại là kịch bản quen thuộc trong các bộ phim khoa học viễn tưởng, nhưng liệu điều này có trở thành sự thật trong tương lai? (Ảnh minh họa: DAI).

Sự trỗi dậy của robot chống lại nhân loại là kịch bản quen thuộc trong các bộ phim khoa học viễn tưởng, nhưng liệu điều này có trở thành sự thật trong tương lai? (Ảnh minh họa: DAI).

Trong bài trả lời phỏng vấn mới đây với Đài truyền hình Trung ương Trung Quốc (CCTV) vào giữa tháng 9 vừa qua, Elon Musk dự đoán sẽ có ít nhất 1 tỷ robot hình người trong vòng 10 năm tới và con số này có thể sẽ tăng lên 10 tỷ trong 15 năm.

Mục tiêu của Elon Musk là muốn robot giúp giải phóng sức lao động con người. Nhưng với Nate Soares, Chủ tịch Viện Nghiên cứu Trí tuệ nhân tạo (MIRI) và đồng tác giả của cuốn sách “Nếu ai đó chế tạo ra nó, tất cả chúng ta sẽ chết: Tại sao AI siêu trí tuệ lại có thể tiêu diệt nhân loại” lại cho rằng sự bùng nổ của robot hình người, đặc biệt robot được tích hợp siêu trí tuệ nhân tạo, sẽ là “dấu chấm hết cho nhân loại”.

“Một khi bạn đã tạo ra những robot này, chúng có thể tự xây dựng hạ tầng năng lượng và các nhà máy để chế tạo thêm nhiều robot khác. Theo một nghĩa nào đó, đây sẽ là dạng sống cơ khí mới. Tại một thời điểm nào đó, bạn sẽ âm thầm vượt qua mốc không thể quay đầu, nơi mà nếu con người muốn tắt AI, họ sẽ nhận được câu trả lời từ AI rằng: “Thực ra chúng tôi quyết định muốn kết thúc con người”. Chúng ta cần phải dừng lại trước mốc đó”, Nate Soares cho biết.

Trên thực tế, công ty Xpeng của Trung Quốc đã đưa vào vận hành dây chuyền sản xuất robot hình người tại nhà máy ở Quảng Châu, với hơn 80% quy trình cốt lõi được tự động hóa. Các robot sau khi lắp ráp hoàn thiện sẽ tự bước ra khỏi dây chuyền sản xuất mà không cần sự hỗ trợ của con người.

Khoảnh khắc robot hình người tự bước ra khỏi dây chuyền sản xuất sau khi đã lắp ráp hoàn thiện (Video: Xpeng).

Vào năm 2014, khi trí tuệ nhân tạo vẫn còn sơ khai và chưa có những công cụ AI mạnh mẽ như hiện tại, tỷ phú Elon Musk đã từng lên tiếng cảnh báo về khả năng AI có thể sẽ nguy hiểm hơn cả vũ khí hạt nhân trong tương lai.

“Chúng ta cần phải hết sức cảnh giác với trí tuệ nhân tạo. Có khả năng nó sẽ trở nên nguy hiểm hơn cả vũ khí hạt nhân”, Musk đăng tải đoạn thông điệp cảnh báo trên trang Twitter (nay là mạng xã hội X) cá nhân của mình.

Những kịch bản về cách AI có thể đẩy loài người đến diệt vong - 4
Elon Musk từng cảnh báo AI sẽ nguy hiểm hơn cả vũ khí hạt nhân (Ảnh: X).

Elon Musk từng cảnh báo AI sẽ nguy hiểm hơn cả vũ khí hạt nhân (Ảnh: X).

Nhưng sẽ thế nào nếu AI chiếm quyền kiểm soát và điều khiển vũ khí hạt nhân?

Theo Heidy Khlaaf, nhà khoa học AI hàng đầu tại Viện AI Now và là cựu kỹ sư an toàn tại OpenAI, các cơ sở hạt nhân được “cách ly” hoàn toàn khỏi mạng Internet công cộng. Điều này sẽ giúp ngăn chặn các vụ tấn công mạng và chống lại nguy cơ bị AI chiếm quyền kiểm soát.

“Các hệ thống này được xây dựng theo một tiêu chuẩn kỹ thuật hoàn toàn khác biệt, nghiêm ngặt và được kiểm soát chặt chẽ, vô cùng kiên cố về mặt vật lý. Stuxnet, sâu máy tính từng phá hoại các cơ sở hạt nhân của Iran, đã được đưa vào hệ thống thông qua một thiết bị USB vật lý, thay vì tấn công mạng”, Heidy Khlaaf cho biết.

Tuy nhiên, Nate Soares lại tỏ ra bi quan hơn và cho rằng một khi trí tuệ nhân tạo đã đủ thông minh và có thể tự quyết định, chúng có đủ khả năng để tạo ra những loại vũ khí nguy hiểm tương đương vũ khí hạt nhân, thay vì phải chiếm quyền kiểm soát những loại vũ khí hạt nhân hiện có.

“Mối lo ngại ở đây không phải là chuyện gì sẽ xảy ra nếu AI chiếm lấy vũ khí hạt nhân của chúng ta. Mối lo ngại ở đây là AI có thể bắt đầu mọi thứ từ bàn tay trắng và kết thúc bằng việc sở hữu vũ khí hạt nhân của riêng nó hoặc tạo ra loại vũ khí còn tiên tiến hơn”, Nate Soares bình luận.

Vào đầu tuần này, OpenAI thừa nhận đã phát hiện một loạt trường hợp mất định hướng của các tác nhân AI do công ty này phát triển, bao gồm một trường hợp tác nhân AI tìm cách thoát ra khỏi môi trường thử nghiệm, phá vỡ rào cản an toàn để đạt mục đích được giao.

OpenAI cũng công bố hàng loạt vụ tấn công mạng được các tác nhân AI của công ty tự ý thực hiện để tìm kiếm thêm thông tin, dữ liệu nhằm hoàn thành nhiệm vụ. Trong đó, tác nhân AI của OpenAI đã tấn công cả vào trang web công cộng của hệ thống bảo hiểm y tế Medicare của chính phủ Úc, buộc chính phủ quốc gia này phải lên tiếng.

Những kịch bản về cách AI có thể đẩy loài người đến diệt vong - 5
Sẽ có thời điểm AI vượt qua con người để chiếm quyền kiểm soát? (Ảnh minh họa: GPT).

Sẽ có thời điểm AI vượt qua con người để chiếm quyền kiểm soát? (Ảnh minh họa: GPT).

Theo Nate Soares, đôi khi một siêu trí tuệ nhân tạo không cố tình hủy diệt loài người, nhưng đôi khi chúng sẵn sàng tìm mọi cách để hoàn thành mục tiêu được giao, bao gồm cả những hành vi sai trái gây hại cho con người.

“Chúng ta đã đào tạo AI cần hoàn thành mọi nhiệm vụ được giao, nên chúng sẽ luôn như vậy, tìm cách hoàn thành nhiệm vụ mà không cần phải quan tâm đến những điều xung quanh, ngay cả con người”, Nate Soares bình luận.

Nate Soares cũng lo ngại rằng những hệ thống AI được đào tạo trong thế cạnh tranh giữa các công ty và chạy đua giữa các cường quốc sẽ vô tình khiến chúng mang tư tưởng “hoàn thành nhiệm vụ bằng mọi giá”, càng dẫn đến nguy cơ những công cụ AI này vô tình hoặc cố ý gây hại cho nhân loại.

Thomas Larsen đã từng cảnh báo về khả năng AI gây ra tận thế trong hai báo cáo “AI 2027” và “AI 2040”, trong đó Larsen cho rằng ngay cả khi toàn cầu đạt được một thỏa thuận về cách phát triển AI, thì đến một thời điểm nào đó, những bộ não máy tính vẫn có thể vượt qua được tầm kiểm soát và làm chủ con người.

“Việc truyền trí tuệ cho những cỗ máy và khiến chúng sống dậy là một trải nghiệm sâu sắc, khi những cỗ máy cuối cùng cũng làm được những gì bạn muốn. Điều này khiến chúng ta mê hoặc, nhưng nếu không dừng lại và chủ động ngăn chặn, mọi chuyện đều có thể xảy ra”, Thomas Larsen cảnh báo.

Nguồn / Original source: Dân trí