WASHINGTON—Ngày 1 tháng 7, Nhân loại truy cập toàn cầu được khôi phục sang mô hình Fable 5 của mình, mười chín ngày sau khi Bộ Thương mại Hoa Kỳ ra lệnh đóng cửa. Tình tiết này đã bộc lộ lỗ hổng trong chính sách trí tuệ nhân tạo (AI) của Hoa Kỳ: Hoa Kỳ không có quy trình công khai rõ ràng để hạn chế quyền truy cập vào mô hình AI do tư nhân phát triển. Chính quyền hiện tại có thể và nên bắt đầu nhanh chóng thu hẹp khoảng cách này thông qua hành động hành pháp, nhưng hành động hành pháp có thể bị đảo ngược dễ dàng như khi nó được thực hiện. Giải pháp lâu dài ở đây là giải pháp ràng buộc chính quyền tiếp theo cũng như chính quyền này, thông qua luật pháp của quốc hội. Cho đến khi Quốc hội hành động, bài học dành cho các nhà phát triển AI của Mỹ là các sản phẩm chủ lực của họ có thể bị đình chỉ mà không cần cảnh báo, theo những tiêu chí mà công chúng chưa từng thấy, nhờ một quy trình diễn ra hoàn toàn sau cánh cửa đóng kín.
Câu chuyện đằng sau những hạn chế trên Fable 5
Lệnh đóng cửa Fable 5 của chính quyền đã đi ngược lại với cách tiếp cận đã nêu của chính quyền. Vào ngày 2 tháng 6 sắc lệnhTổng thống Mỹ Donald Trump đã ra lệnh cho các cơ quan phát triển một khuôn khổ trước ngày 1 tháng 8, theo đó các công ty AI có thể tự nguyện chia sẻ các mô hình tiên tiến nhất của họ với chính phủ để xem xét trước khi phát hành. Mười ngày sau, Cục Công nghiệp và An ninh (BIS) của Bộ Thương mại thay vào đó đã yêu cầu các biện pháp kiểm soát xuất khẩu để tắt quyền truy cập vào Fable 5. Việc quản lý xuất khẩu phần mềm không phải là điều mới đối với BIS, vốn đã có các công cụ mã hóa kiểm soát xuất khẩu và phần mềm phòng thủ sử dụng kép trong nhiều thập kỷ. Nó đã mở rộng các công cụ này để giám sát các nhà cung cấp dịch vụ và đang thực thi các biện pháp kiểm soát chất bán dẫn ở Trung Quốc. Lần này là vậy ra lệnh cho nhân loại để loại bỏ Fable 5 và phiên bản bị hạn chế của nó, Mythos 5, đối với tất cả công dân nước ngoài, bao gồm cả nhân viên của Anthropic, dường như chỉ với ít nhất chín mươi phút theo. nhân loại nói nó “không có cách nào đáng tin cậy để xác minh quốc tịch trong thời gian thực”, vì vậy nó đã đình chỉ cả hai mô hình đối với tất cả người dùng vào tối hôm đó và không có mối đe dọa cụ thể nào được tiết lộ công khai. Một quan chức cấp cao của Nhà Trắng giấu tên cho biết Chính sách rằng kiểm soát xuất khẩu là “biện pháp cuối cùng sau nhiều giờ cầu xin họ hợp tác với chúng tôi”.
Quyết định này theo sau các báo cáo rằng Nhà nghiên cứu Amazon đã tìm ra cách vượt qua các biện pháp bảo vệ của Fable 5, cho phép mô hình thực hiện các nhiệm vụ an ninh mạng mà các biện pháp bảo vệ của nó nhằm mục đích ngăn chặn. Vấn đề là một khi các biện pháp bảo vệ bị phá vỡ, mô hình này có thể được sử dụng để thực hiện các cuộc tấn công mạng. trong một tuyên bố công khaiAnthropic cho biết khả năng được chứng minh đã có sẵn trên các mẫu được triển khai khác và phổ biến đối với những người bảo vệ mạng. Không có gì về Fable 5 khiến anh ta trở nên đặc biệt nguy hiểm như vậy. Hơn một trăm lãnh đạo an ninh mạng đã đưa ra quan điểm tương tự trong một bức thư ngỏ.
Việc đóng cửa cũng làm nổi bật sự mâu thuẫn về mặt thể chế. Vào tháng 3, Lầu Năm Góc được chỉ định Nhân loại, một rủi ro trong chuỗi cung ứng, một nhãn hiệu thường dành cho các đối thủ nước ngoài, dẫn đến các vụ kiện tụng đang diễn ra. Về phần mình, Bộ Thương mại duy trì thỏa thuận thử nghiệm trước khi triển khai với cùng một công ty. trong điều khiển nâng thưBộ trưởng Thương mại Howard Lutnick cho biết Anthropic đã đồng ý chủ động phát hiện các rủi ro bảo mật, điều phối các mô hình trong tương lai và báo cáo hoạt động độc hại, với Mythos 5 chỉ giới hạn cho các tổ chức được Hoa Kỳ phê duyệt. Không giống như nhiều hạn chế của BIS, được kèm theo các giải thích công khai trong Đăng ký Liên bang, Thỏa thuận này đã được đàm phán riêng tư, không để lại định hướng rõ ràng cho lần liên doanh tiếp theo.
Vấn đề sâu xa hơn là bản thân công cụ. Kiểm soát xuất khẩu đã có thể tiếp cận AInhưng chúng hoạt động bằng cách nhắm mục tiêu vào các mục đích sử dụng cuối đã được xác định, chẳng hạn như phát triển vũ khí, chứ không phải bằng cách sử dụng ngoại tuyến dịch vụ đã triển khai cho toàn bộ lớp người dùng. Đây là điều khiến mệnh lệnh Fable 5 không phù hợp, vì BIS không ràng buộc hành động của mình với một mục đích sử dụng bị cấm cụ thể mà thay vào đó đã đình chỉ toàn bộ mô hình đối với tất cả công dân nước ngoài trong một lần.
Ba cải cách để tránh lặp lại
Để tránh một hạn chế sâu rộng khác, cơ quan hành pháp và Quốc hội nên phản ứng theo ba cách.
Đầu tiên, Bộ Thương mại nên ban hành các tiêu chí rõ ràng và công khai để hạn chế mô hình được triển khai trong phạm vi mà lệnh hành pháp yêu cầu trước ngày 1 tháng 8, và sau đó Quốc hội nên đưa các tiêu chí đó thành luật, cùng với định nghĩa về những gì chính phủ có thể hoặc không thể yêu cầu đối với các nhà phát triển AI. Bởi vì khuôn khổ là hoàn toàn tự nguyệncác tiêu chí được công bố lại càng quan trọng hơn. Các doanh nghiệp cần có khả năng dự đoán khi quyết định có tham gia hay không và công chúng cần có cách để đánh giá liệu chính phủ có hành động dựa trên bằng chứng hay không. Ở mức tối thiểu, các tiêu chí phải xác định khả năng kích hoạt xem xét, ngưỡng mức độ nghiêm trọng tách biệt một lỗi có thể sửa chữa khỏi tình trạng khẩn cấp về an ninh quốc gia, khoảng thời gian thông báo trước khi lệnh có hiệu lực và quy trình kháng cáo hoặc hạn chế.
Khuyến nghị của tôi khác với nghị định ở một điểm quan trọng. Lệnh của Nhà Trắng đặt ra ngưỡng cho một mô hình được bảo hiểm thông qua quy trình đo điểm chuẩn được phân loại thay vì tiêu chuẩn công cộng. Mặc dù một số chi tiết kỹ thuật của quy trình này vẫn phải được giữ bí mật nhưng các tiêu chí khiến công ty gặp phải các hạn chế phải được công khai vì tiêu chuẩn mà không ai có thể nhìn thấy là tiêu chuẩn mà không công ty nào có thể lập kế hoạch. Luật không thể ngăn cản chính quyền tương lai hành động khác đi, nhưng nó sẽ cung cấp cho các doanh nghiệp một tiêu chuẩn rõ ràng để tuân theo và đưa ra một tiêu chuẩn rõ ràng để áp dụng.
Thứ hai, Quốc hội nên xác định nhiệm vụ của từng cơ quan thông qua luật pháp thay vì chỉ định một người đứng đầu AI duy nhất, bởi vì những người được đề cử có những chức năng cơ bản khác nhau. Lệnh điều hành đã phân công vai trò ở đây, chỉ đạo Cơ quan An ninh Quốc gia (NSA) tiến hành các phân tích so sánh được phân loại để xác định mô hình nào được coi là mô hình biên giới được bảo vệ, và Bộ Tài chính và Cơ quan An ninh Cơ sở hạ tầng và An ninh Mạng (CISA), cùng với NSA, thiết kế khuôn khổ truy cập tự nguyện với sự tham vấn của Viện Tiêu chuẩn và Công nghệ Quốc gia (NIST). Việc phân bổ này dựa vào các cơ quan tình báo và phòng thủ mạng và khiến NIST, cơ quan có chức năng đánh giá mô hình do chính phủ thành lập, đóng vai trò hỗ trợ.
Thay vào đó, vai trò đánh giá chính nên được giao cho Trung tâm Tiêu chuẩn và Đổi mới AI (CAISI) cho NIST thay vì cho các cơ quan tình báo và an ninh mạng vì cơ quan tiêu chuẩn đánh giá theo các thỏa thuận công khai minh bạch hơn so với tiêu chuẩn được phân loại. BIS về cơ bản không phải là cơ quan đánh giá mô hình, trong khi CAISI đã đánh giá các mô hình tiên phong theo thỏa thuận với các nhà phát triển, nhưng nó không có quyền hạn chế các mô hình. Một bộ phận rõ ràng hơn sẽ dành cho CAISI tiến hành đánh giá bảo mật, BIS chỉ áp dụng các hạn chế đối với phát hiện bằng văn bản từ CAISI và CISA cung cấp dữ liệu về mối đe dọa. Hai điểm bổ sung đáng được đề cập ở đây: thứ nhất, để CAISI đảm nhận vai trò này, nó sẽ cần phải phát triển; nó hiện đang thiếu vốn và thiếu một giám đốc cấp cao. Thứ hai, nếu việc tiết lộ CAISI có thể kích hoạt việc thực thi, các công ty có thể ngừng chia sẻ, do đó, ngưỡng xem xét sẽ không phụ thuộc vào sự sẵn lòng của công ty.
Thứ ba, Quốc hội nên đặt ra tiêu chuẩn bằng chứng cho hành động khẩn cấp đối với một sản phẩm thương mại được sử dụng rộng rãi. Để làm như vậy, họ nên dựa trên các mô hình mà họ đã tin tưởng, chẳng hạn như các phát hiện bằng văn bản và thông báo cho Quốc hội theo yêu cầu của các biện pháp trừng phạt và Đạo luật Đầu tư Nước ngoài. Trước khi ra lệnh cho một công ty đình chỉ quyền truy cập của công chúng vào một mô hình đã triển khai, cơ quan điều hành phải đưa ra kết luận bằng văn bản cho thấy tác hại đáng kể và đang tiếp diễn. Kết luận này sẽ đến được Ủy ban Thương mại và Tình báo của cả hai Viện trong vòng 48 giờ, và các lệnh khẩn cấp sẽ hết hiệu lực sau 30 ngày trừ khi có bằng chứng mới được gia hạn.

















