OpenAI ra mắt GPT-6 Astra, mô hình trí tuệ nhân tạo nguy hiểm nhất


(Dân trí) - Sau khi GPT-6 Astra được ra mắt, bản thân OpenAI thừa nhận rằng mô hình AI mới của hãng có thể gây nguy hiểm vì những khả năng mà nó có thể thực hiện.
OpenAI vừa chính thức phát hành GPT-6 Astra, mô hình trí tuệ nhân tạo (AI) mạnh mẽ nhất từ trước đến nay.
Chủ tịch OpenAI Greg Brockman tự tin tuyên bố đây là mô hình AI thông minh nhất thế giới, có thể xem là một phiên bản của trí tuệ nhân tạo tổng quát (AGI), tức là công nghệ AI có khả năng thực hiện các tác vụ đa dạng với hiệu suất ngang bằng con người, như khả năng tự động kiểm soát các hệ thống máy tính và thực hiện các nhiệm vụ thay cho người dùng.
“Chào mừng đến với kỷ nguyên AGI. Astra thực sự có thể làm bất cứ điều gì mà một con người có thể làm được trên máy tính”, đồng sáng lập và Chủ tịch OpenAI Greg Brockman tuyên bố.

Mô hình trí tuệ nhân tạo GPT-6 Astra được đánh giá thông minh như con người, có thể tự làm được nhiều tác vụ (Ảnh minh họa: GPT).
OpenAI cũng nhấn mạnh rằng, mô hình AI này nhanh và hiệu quả hơn nhiều so với phiên bản tiền nhiệm GPT-5.6 Sol trên nhiều loại tác vụ khác nhau.
“Astra là mô hình tiên tiến nhất về sử dụng máy tính, sử dụng trình duyệt, kỹ thuật phần mềm, an ninh mạng, khoa học và công việc chuyên nghiệp”, OpenAI viết trong một blog thông báo.
OpenAI hiện phát hành GPT-6 Astra cho một số người dùng nhất định tại Mỹ để sử dụng thử, trước khi mở rộng ra cho nhiều người dùng hơn.
GPT-6 Astra được ra mắt chỉ vài ngày sau khi đối thủ của OpenAI là Anthropic phát hành các mô hình AI mới nhất mang tên Fable 5.1 và Mythos 5.1.
Cả OpenAI lẫn Anthropic tuyên bố các mô hình của họ là hệ thống AI hàng đầu thế giới. Tuy nhiên, GPT-6 Astra thiên về các tác vụ tổng hợp trên máy tính, trong khi các mô hình AI của Anthropic tập trung khả năng lập trình tự động và hỗ trợ các tác vụ đòi hỏi kỹ thuật cao.
Trong bài viết trên trang blog chính thức, OpenAI cho biết GPT-6 Astra là mô hình AI mạnh nhất mà công ty từng triển khai. Công ty thừa nhận nếu GPT-6 Astra có các quyền truy cập phù hợp, công cụ này có thể tự phát hiện lỗ hổng bảo mật chưa từng biết, xây dựng cách khai thác chúng để tấn công vào các hệ thống được bảo mật tốt mà không cần con người hướng dẫn.
Mô hình AI này cũng có thể tự lập và thực hiện chiến lược tấn công mạng nhằm vào các mục tiêu được bảo vệ, thậm chí leo thang tấn công để xâm nhập sâu hơn vào các hệ thống được nhắm đến.
Đáng chú ý, GPT-6 Astra có khả năng kiểm soát chuỗi suy luận nhằm qua mặt người giám sát, âm thầm thực hiện một số tác vụ phá hoại. Điều này đồng nghĩa với việc con người sẽ khó có thể biết được GPT-6 Astra đang suy luận và mục tiêu thực sự là gì.
Để đối phó với những nguy cơ GPT-6 Astra có thể gây ra, OpenAI đã siết chặt các biện pháp bảo vệ, như cách ly nghiêm ngặt hơn, giám sát toàn bộ chuỗi suy luận, nâng cao quy trình đánh giá để ngăn chặn những hành vi sai trái của GPT-6 Astra trước khi thực hiện…
GPT-6 Astra được phát hành trong bối cảnh những lo ngại ngày càng tăng cao về các mô hình AI tiên phong có khả năng gây nguy hiểm nếu bị sử dụng sai cách. Do vậy, OpenAI phải chứng minh được khả năng kiểm soát công cụ này, nếu không GPT-6 Astra hoàn toàn có thể bị chính phủ nhiều quốc gia cấm triển khai.
AGI - Trí tuệ nhân tạo tổng quát là gì?
Trí tuệ nhân tạo tổng quát (AGI - Artificial General Intelligence) được định nghĩa là một hệ thống siêu trí tuệ nhân tạo có khả năng thực hiện bất kỳ nhiệm vụ trí tuệ nào mà con người có thể làm được. AGI sở hữu khả năng học hỏi, tự suy luận và đưa ra quyết định tương tự con người, với mức độ linh hoạt và tùy biến cực cao.
Khác với các hệ thống trí tuệ nhân tạo hẹp (ANI - Artificial Narrow Intelligence) chỉ chuyên biệt trong một lĩnh vực cụ thể, AGI có dữ liệu chuyên sâu về nhiều lĩnh vực khác nhau và đặc biệt, có khả năng tự học hỏi thêm những kiến thức, vấn đề mới mà không cần sự can thiệp của con người.
AGI được xem là mục tiêu cao nhất trong quá trình phát triển AI. Tuy nhiên, sự ra đời của AGI cũng dấy lên nhiều lo ngại về vấn đề đạo đức và nguy cơ trí tuệ nhân tạo vượt quá tầm kiểm soát của con người.
Trên thực tế, đến hiện tại, chưa có một hệ thống AGI hoàn thiện nào được công bố. Đây chính là lý do thúc đẩy các hãng công nghệ lớn đầu tư những khoản tiền khổng lồ, với hy vọng trở thành đơn vị tiên phong xây dựng thành công một hệ thống AGI.