Giúp xây dựng các tiêu chuẩn chung cho AI tiên tiến

Các mô hình ngày càng có năng lực có thể tăng cường phòng thủ không gian mạng, tăng tốc khám phá khoa học và mở rộng khả năng tiếp cận kiến thức chuyên môn. Nhưng họ cũng có thể tạo ra rủi ro về an toàn và an ninh nếu năng lực của họ bị hiểu sai, biện pháp bảo vệ của họ không đầy đủ hoặc chính phủ thiếu thông tin cần thiết để ứng phó. Để hiện thực hóa các lợi ích một cách an toàn và tự tin, các xã hội sẽ cần các tổ chức có năng lực kỹ thuật và quản trị để đánh giá, bảo mật và quản lý các hệ thống ngày càng có năng lực cao hơn.
Đó là một lý do OpenAI đã giúp thành lập Appia Foundation(opens in a new window), do Linux Foundation tổ chức. Appia sẽ phát triển các thông số kỹ thuật mô-đun mở nhằm mục đích chuyển các tiêu chuẩn quốc tế và các khuôn khổ đã được thiết lập thành các tiêu chí đánh giá thực tế trên chuỗi giá trị AI. Công việc của nó có thể giúp phát triển một lớp tin cậy quan trọng còn thiếu để các bên thứ ba kiểm tra sự phù hợp với các tiêu chuẩn, tạo ra bằng chứng rõ ràng hơn và có thể tái sử dụng nhiều hơn khi các mô hình, cơ sở hạ tầng và ứng dụng được phát triển bởi các tổ chức khác nhau. Khi thực hiện công việc này, Appia sẽ giúp tạo ra một ngôn ngữ kỹ thuật chung cho phép các tổ chức trong nước và quốc tế tin cậy vào công việc của nhau.
Chúng tôi coi nỗ lực này là bước quan trọng tiếp theo trong một loạt công việc rộng lớn hơn nhằm củng cố các thể chế, tiêu chuẩn và phương pháp đánh giá cần thiết cho các hệ thống AI tiên tiến.
Kế hoạch chi tiết gần đây của chúng tôi về quản trị dân chủ đối với AI biên giới đưa ra lộ trình cho công việc đó. Nó kêu gọi một khuôn khổ bền vững của Hoa Kỳ, một Trung tâm Đổi mới và Tiêu chuẩn AI (CAISI) được tăng cường và một chiến lược phục hồi rộng hơn trên toàn chính phủ. Nó cũng thừa nhận rằng rủi ro biên giới có phạm vi quốc tế. Các quốc gia nên làm việc cùng nhau để phát triển các khuôn khổ an toàn tương thích, các kênh đáng tin cậy để chia sẻ các phát hiện rủi ro và phối hợp ứng phó với các sự cố.
Năng lực quốc gia và hợp tác quốc tế cần củng cố lẫn nhau. Các tổ chức mạnh như CAISI có thể phát triển chuyên môn kỹ thuật, đánh giá các hệ thống biên giới và hỗ trợ hệ sinh thái đánh giá độc lập. Sau đó, một mạng lưới các tổ chức quốc gia có năng lực có thể thiết lập các phương pháp chung, công nhận bằng chứng đáng tin cậy và cung cấp cho các chính phủ những hiểu biết kỹ thuật chung cần thiết để cùng nhau hành động.
Các tiêu chuẩn là trọng tâm của nỗ lực đó và chúng phải dựa trên cơ sở thực tiễn đánh giá đáng tin cậy và sự chặt chẽ về mặt kỹ thuật. Trong cẩm nang chia sẻ của chúng tôi về các đánh giá đáng tin cậy của bên thứ ba, chúng tôi đặt ra những gì mà các đánh giá biên giới ngày càng cần tiết lộ: hệ thống được thử nghiệm, khả năng truy cập và khai thác đánh giá công cụ của nó, các phương pháp được sử dụng để khơi gợi các khả năng, nguồn lực sẵn có và các bước kiểm tra được thực hiện để xác thực kết quả. Chúng tôi cũng đã áp dụng những nguyên tắc này vào thực tế thông qua thử nghiệm quan hệ đối tác với CAISI của Hoa Kỳ và AISI của Vương quốc Anh, những tổ chức có công việc đánh giá năng lực biên giới và các biện pháp bảo vệ chống lạm dụng sinh học đã dẫn đến những cải tiến cụ thể trong hệ thống của chúng tôi. Công việc này có chức năng quan trọng là tạo nền tảng cho các phương pháp thực hành có thể được chuẩn hóa để kiểm tra hiệu suất theo cách có thể so sánh được.
Những thực tiễn này bổ sung cho cơ sở hạ tầng an toàn rộng hơn của OpenAI. Khung chuẩn bị của chúng tôi là nền tảng cho cách chúng tôi xác định và vận hành phương pháp quản lý những rủi ro nghiêm trọng nhất từ các hệ thống AI tiên tiến, bao gồm cả các hoạt động nội bộ của chúng tôi. Khung quản trị biên giới của chúng tôi áp dụng các phần liên quan của phương pháp đó vào tài liệu quản trị công tập trung vào các nghĩa vụ pháp lý cụ thể, bao gồm đánh giá rủi ro, báo cáo mô hình, kiểm soát an ninh, ứng phó sự cố và kết hợp ý kiến đóng góp của chuyên gia bên ngoài. Cùng với nhau, những tạo phẩm này giúp chuyển các cam kết rộng rãi thành các hoạt động thực tiễn có thể được xác nhận và cải thiện.
Công việc của Appia hướng tới thách thức tiếp theo: làm cho những hoạt động đó có thể tương tác giữa các tổ chức, khu vực pháp lý và chuỗi cung ứng.
OpenAI đã đóng góp vào một hệ sinh thái tiêu chuẩn và nỗ lực tiền tiêu chuẩn hóa rộng lớn hơn. Chúng tôi tham gia Ủy ban Kỹ thuật chung số 1 của Tổ chức Tiêu chuẩn hóa Quốc tế và Ủy ban Kỹ thuật Điện Quốc tế, Tiểu ban 42 về Trí tuệ Nhân tạo(mở trong một cửa sổ mới) và Hiệp hội Trí tuệ Nhân tạo do Viện Tiêu chuẩn và Công nghệ Quốc gia dẫn đầu(mở trong một cửa sổ mới); đã giúp thành lập Diễn đàn Mô hình Biên giới và Quỹ Trí tuệ Nhân tạo Tác nhân của Quỹ Linux(mở trong một cửa sổ mới); tham gia Liên minh vì trí tuệ nhân tạo an toàn(mở trong một cửa sổ mới); phục vụ trong ban chỉ đạo của Liên minh Xuất xứ và Xác thực Nội dung(mở trong một cửa sổ mới); và tham gia vào các quy trình của Lực lượng Đặc nhiệm Kỹ thuật Internet(opens in a new window) và Fast Identity Online Alliance(opens in a new window) để nâng cao các tiêu chuẩn kỹ thuật có khả năng tương tác.
Trên khắp các diễn đàn này, bao gồm cả thông qua Appia, mục tiêu của chúng tôi là chuyển các bài học từ quá trình phát triển tiên phong thành các thực tiễn mở, có nền tảng kỹ thuật mà các chính phủ, công ty và đánh giá viên độc lập có thể sử dụng trên khắp các khu vực pháp lý.