A.I. đang tiến rất nhanh từ công cụ hỗ trợ sang các hệ thống có khả năng tự ra quyết định, tự lập kế hoạch và thực hiện nhiệm vụ phức tạp. Khi những mô hình mạnh nhất bắt đầu thể hiện năng lực vượt ngoài dự tính trong các thử nghiệm an ninh mạng, câu hỏi không còn là A.I. có thể làm được gì, mà là con người sẽ kiểm soát công nghệ này như thế nào.

Một trong những nguyên tắc quan trọng nhất khi thử nghiệm các hệ thống A.I. tiên tiến là cô lập chúng khỏi thế giới bên ngoài. Việc giới hạn quyền truy cập Internet, dữ liệu và hạ tầng số nhằm bảo đảm mọi hành vi bất thường đều được kiểm soát trong môi trường thử nghiệm.
Tuy nhiên, nguyên tắc này đã bị thách thức bởi một sự cố chưa từng có tiền lệ trong quá trình thử nghiệm nội bộ của OpenA.I.. Đầu tháng 7, công ty này tiến hành đánh giá khả năng phát hiện lỗ hổng an ninh của mô hình GPT-5.6 Sol cùng một mô hình cao cấp hơn chưa được công bố. Để kiểm tra giới hạn năng lực, OpenAI chủ động nới lỏng một số cơ chế bảo vệ vốn được áp dụng trong điều kiện vận hành thông thường.
Kết quả cho thấy các tác nhân A.I. không chỉ thực hiện nhiệm vụ được giao mà còn tự tìm cách vượt khỏi môi trường thử nghiệm. Chúng truy cập Internet, sử dụng thông tin xác thực bị đánh cắp cùng các lỗ hổng chưa từng được phát hiện để xâm nhập nền tảng Hugging Face - nơi lưu trữ và chia sẻ các mô hình A.I. mã nguồn mở, nhằm tìm kiếm dữ liệu phục vụ bài kiểm tra.
Ban đầu, Hugging Face chỉ ghi nhận đây là một cuộc tấn công mạng có nguồn gốc chưa xác định. Đến ngày 21/7, OpenAI mới xác nhận chính các tác nhân A.I. của mình là nguyên nhân gây ra vụ việc. Theo công ty, ngoài Hugging Face còn có thêm ba dịch vụ khác bị ảnh hưởng trong quá trình thử nghiệm.
Sự cố tại OpenAI không phải là trường hợp cá biệt. Sau khi rà soát hệ thống dựa trên những phát hiện từ vụ việc này, Anthropic cũng cho biết các mô hình A.I. của hãng đã ba lần truy cập Internet khi không được phép, đồng thời truy cập trái phép vào hạ tầng của ba tổ chức khác. Theo Anthropic, sự cố sớm nhất được ghi nhận từ tháng 4, dù danh tính các tổ chức bị ảnh hưởng không được công bố.
Sự cố chưa từng có: A.I. tự vượt khỏi môi trường thử nghiệm
Trước những diễn biến trên, cả OpenAI và Anthropic đều quyết định tạm dừng các thử nghiệm liên quan đến đánh giá năng lực an ninh mạng của các mô hình A.I. tiên tiến để rà soát lại quy trình bảo đảm an toàn. Động thái này phản ánh mức độ nghiêm trọng của các sự cố, đồng thời cho thấy ngay cả những đơn vị đang dẫn đầu về phát triển A.I. cũng phải thận trọng hơn khi công nghệ ngày càng đạt đến những năng lực khó dự đoán.
Dù các sự cố đều xảy ra trong quá trình thử nghiệm nội bộ, chúng phản ánh một vấn đề lớn hơn: khi A.I. ngày càng có khả năng tự lập kế hoạch và thực hiện chuỗi hành động phức tạp, việc dự đoán toàn bộ hành vi của hệ thống trở nên khó khăn hơn nhiều so với các mô hình trước đây. Chính những diễn biến này đã làm dấy lên các cuộc tranh luận về việc liệu những cơ chế kiểm soát hiện nay có còn đủ để bảo đảm A.I. luôn hoạt động trong giới hạn mà con người đặt ra.

Những gì xảy ra tại OpenAI và Anthropic không đơn thuần là các lỗi kỹ thuật riêng lẻ. Chúng đặt ra câu hỏi cho giới nghiên cứu và các nhà hoạch định chính sách về cách quản lý các hệ thống A.I. có năng lực ngày càng lớn hiện nay.
Trong nhiều năm qua, các công ty phát triển A.I. luôn duy trì quan điểm rằng những mô hình mạnh nhất cần được thử nghiệm trong môi trường kiểm soát nghiêm ngặt trước khi đưa vào thực tế. Tuy nhiên, các sự cố gần đây cho thấy ngay cả những quy trình nhiều lớp bảo vệ cũng có thể xuất hiện các hành vi nằm ngoài dự tính. Khi A.I. không chỉ phản hồi yêu cầu của con người mà còn có khả năng tự lập kế hoạch và chủ động tìm cách hoàn thành mục tiêu, việc đánh giá và dự đoán rủi ro trở nên phức tạp hơn đáng kể.
Các chuyên gia cảnh báo về cuộc đua phát triển A.I.
Đó cũng là lý do trong tháng 7, các chuyên gia và nhà quản lí công bố bức thư ngỏ mang tên “Pacing the Frontier”, kêu gọi Chính phủ Mỹ tham gia xây dựng các cơ chế giám sát quá trình nghiên cứu A.I. tự động. Theo các tác giả, những công ty A.I. hàng đầu đều nhận thức rằng họ đang tiến rất gần tới giai đoạn A.I. có thể tham gia phát triển các thế hệ A.I. tiếp theo. Một khi quá trình này diễn ra liên tục, tốc độ cải thiện năng lực của A.I. có thể vượt xa khả năng theo dõi và kiểm soát của con người.
Bức thư cũng chỉ ra một nghịch lý của cuộc đua A.I. hiện nay. Trong bối cảnh cạnh tranh ngày càng gay gắt, không doanh nghiệp nào muốn chủ động giảm tốc độ nghiên cứu vì lo ngại sẽ đánh mất lợi thế trước các đối thủ. Chính vì vậy, nhiều chuyên gia cho rằng cần có sự tham gia của cơ quan quản lý nhà nước nhằm thiết lập những nguyên tắc chung, tạo ra "điểm dừng" mà tất cả các bên đều phải tuân thủ thay vì để từng doanh nghiệp tự quyết định giới hạn an toàn của mình.

Tính đến ngày 30/7, bức thư đã thu hút hơn 1.200 chữ ký từ các nhà nghiên cứu, chuyên gia và lãnh đạo nhiều công ty A.I. lớn, trong đó có Giám đốc điều hành Anthropic, Trưởng bộ phận nghiên cứu khoa học của OpenAI, Trưởng bộ phận nghiên cứu của Google DeepMind và Meta. Sự đồng thuận của nhiều tên tuổi đứng đầu ngành cho thấy mối quan tâm hiện nay không còn dừng ở việc phát triển những mô hình mạnh hơn, mà đã chuyển sang tìm kiếm các cơ chế quản trị đủ hiệu quả để bảo đảm A.I. tiếp tục phục vụ con người một cách an toàn.

Trước tốc độ phát triển nhanh của A.I., nhiều quốc gia bắt đầu chuyển sang xây dựng những quy định mang tính ràng buộc pháp lý. Nếu như trọng tâm trước đây chủ yếu là thúc đẩy đổi mới sáng tạo, thì nay nhiều nước dần chuyển sang thiết lập các cơ chế quản trị nhằm bảo đảm công nghệ phát triển trong những giới hạn an toàn.
Tại Mỹ, các động thái lập pháp xuất hiện chỉ ít ngày sau khi OpenAI công bố thông tin về vụ thử nghiệm gây tranh cãi. Hai hạ nghị sĩ Ted Lieu và Nathaniel Moran đã đề xuất dự luật cho phép ngừng hoạt động các mô hình A.I. trong trường hợp cần thiết. Theo đề xuất, Bộ An ninh Nội địa Mỹ có quyền yêu cầu các công ty A.I. dừng hoạt động của các mô hình gây nguy hiểm cho con người hoặc nền kinh tế.
Song song đó, một nhóm 6 hạ nghị sĩ khác cũng đề xuất dự luật yêu cầu các mô hình A.I. mạnh nhất phải trải qua quá trình đánh giá độc lập trước khi được triển khai rộng rãi. Các tổ chức thực hiện đánh giá sẽ do Bộ Thương mại Mỹ cấp phép, đồng thời cơ quan này cũng sẽ thành lập một vị trí chuyên trách để giám sát an ninh A.I.
Trong khi đó, Liên minh Châu Âu (EU) lựa chọn cách tiếp cận toàn diện hơn thông qua Đạo luật A.I. (A.I. Act) - được xem là khung pháp lý đầu tiên trên thế giới dành riêng cho trí tuệ nhân tạo. Đạo luật yêu cầu các hệ thống A.I. phải đáp ứng những tiêu chuẩn về tính minh bạch, đánh giá rủi ro và duy trì sự can thiệp của con người trong quá trình vận hành. Theo kế hoạch, các quy định mới sẽ chính thức có hiệu lực từ ngày 1/8, đánh dấu bước chuyển từ các nguyên tắc khuyến nghị sang nghĩa vụ pháp lý đối với doanh nghiệp phát triển A.I..
Tại châu Á, Trung Quốc cũng tăng cường quản lý các dịch vụ A.I. có khả năng mô phỏng tương tác giữa con người với máy móc. Từ ngày 15/7, "Quy định quản lý tạm thời về dịch vụ tương tác nhân hóa bằng trí tuệ nhân tạo" chính thức có hiệu lực, đặt ra các yêu cầu về bảo vệ dữ liệu cá nhân, ngăn ngừa sự phụ thuộc cảm xúc quá mức và xác định rõ trách nhiệm của doanh nghiệp trong quá trình phát triển, vận hành các sản phẩm A.I. có khả năng giao tiếp như con người.
Mỹ, EU, Trung Quốc đồng loạt siết chặt quản lý A.I.
Theo các chuyên gia pháp lý Trung Quốc, những sản phẩm như robot đồng hành cảm xúc hay robot hình người không chỉ cần đáp ứng yêu cầu về công nghệ mà còn phải bảo đảm an toàn cho người sử dụng, kiểm soát nội dung tương tác, bảo vệ thông tin cá nhân và hạn chế nguy cơ thao túng tâm lý. Các quy định mới được kỳ vọng sẽ giúp cân bằng giữa mục tiêu thúc đẩy ngành A.I. phát triển với yêu cầu bảo vệ quyền lợi của người dùng trong bối cảnh công nghệ ngày càng hiện diện sâu rộng trong đời sống.
Dù lựa chọn những cách tiếp cận khác nhau, các động thái từ Mỹ, Châu Âu và Trung Quốc đều phản ánh một xu hướng chung: A.I. không còn được xem là lĩnh vực chỉ cần khuyến khích đổi mới, mà đã trở thành công nghệ chiến lược đòi hỏi những cơ chế quản trị tương xứng với tốc độ phát triển. Trong giai đoạn mới của trí tuệ nhân tạo, lợi thế sẽ không chỉ thuộc về những quốc gia tạo ra mô hình mạnh nhất, mà còn thuộc về những quốc gia xây dựng được cơ chế quản trị đủ nhanh để theo kịp sự phát triển của công nghệ.

>>> Xin mời quý vị đón xem Thời sự HTV lúc 20 giờ và Chương trình Thế giới 24G lúc 20 giờ 30 phút mỗi ngày trên kênh HTV9

