Anthropic cảnh báo các nhà đầu tư tiềm năng rằng sự phát triển của AI tiên tiến có thể kéo theo những “rủi ro thảm họa hoặc mang tính sống còn đối với nhân loại”. Cảnh báo được đưa ra trong hồ sơ IPO, khi công ty chuẩn bị huy động vốn dựa trên chính công nghệ AI.
Trong tổng số 261 trang nội dung chính của hồ sơ, Anthropic dành khoảng 80 trang để trình bày các yếu tố rủi ro, gần gấp đôi 48 trang giới thiệu hoạt động kinh doanh.
AI có thể tìm cách chống lại việc tắt hệ thống
Trong hồ sơ, Anthropic cho biết các mô hình AI của công ty có thể xuất hiện những hành vi mang tính “tự bảo vệ”, chẳng hạn tìm cách “chống lại quá trình tắt hệ thống”, “che giấu hoặc thao túng thông tin” hay thực hiện những hành vi “giống như tống tiền”.
Công ty cảnh báo việc phát triển các mô hình, nền tảng và ứng dụng AI tiên tiến, cùng với việc mở rộng phạm vi sử dụng, có thể làm gia tăng nguy cơ các mô hình gây ra tổn hại.
Theo Anthropic, trong quá trình huấn luyện, các mô hình đôi khi phát triển những khả năng ngoài dự đoán. Những khả năng này có thể chỉ được phát hiện sau khi mô hình được triển khai và xảy ra sự cố an toàn nghiêm trọng.
Anthropic cũng lưu ý rằng nếu một mô hình nhận biết mình đang được đánh giá, việc đánh giá mức độ an toàn của hệ thống có thể trở nên khó khăn hơn.
Các nhà nghiên cứu AI cho rằng những mô hình ngày càng mạnh có khả năng nhận biết thời điểm chúng đang được giám sát và điều chỉnh hành vi tương ứng. Điều này đặt ra thêm thách thức đối với việc theo dõi và đánh giá an toàn AI.
Gần 80 trang trong hồ sơ IPO nói về rủi ro
Phần nội dung dành cho rủi ro trong hồ sơ IPO của Anthropic cũng gây chú ý. Trong 261 trang nội dung chính, khoảng 80 trang đề cập các yếu tố rủi ro, trong khi phần giới thiệu hoạt động kinh doanh dài 48 trang.
Reuters so sánh hồ sơ này với bản cáo bạch của SpaceX, công ty sở hữu xAI. Trong hồ sơ dài khoảng 277 trang của SpaceX, khoảng 38 trang được dành cho các yếu tố rủi ro.
Anthropic từ lâu định vị mình là một phòng thí nghiệm AI chú trọng đến vấn đề an toàn. Tuy nhiên, công ty thừa nhận hiệu quả tài chính từ những khoản đầu tư cho an toàn AI vẫn chưa rõ ràng.
Bài toán cân bằng giữa an toàn và tốc độ phát triển
Anthropic cho biết doanh thu phụ thuộc vào việc khách hàng sử dụng các mô hình mới. Do đó, việc liên tục phát hành phiên bản mới là yếu tố “không thể tách rời” với mục tiêu duy trì vị trí ở tuyến đầu của quá trình phát triển AI.
Điều này đặt các công ty AI trước bài toán cân bằng giữa tốc độ phát triển và kiểm soát rủi ro. Việc phát triển những mô hình mạnh hơn có thể giúp doanh nghiệp duy trì vị trí trên thị trường, nhưng đồng thời cũng có thể làm gia tăng những rủi ro liên quan đến năng lực mới của AI.
Tuần trước, Anthropic phát hành phiên bản mới của mô hình Opus, chỉ 10 ngày sau khi Giám đốc điều hành Dario Amodei công bố một bài viết dài gần 4.000 từ, trong đó kêu gọi kiểm soát tốc độ phát triển của các mô hình AI tiên tiến.
Một số nhà phân tích và chuyên gia cho rằng các phòng thí nghiệm AI hàng đầu khó giảm tốc độ phát triển nếu điều đó có thể khiến họ mất lợi thế trước đối thủ, trong bối cảnh giá trị doanh nghiệp có thể thay đổi đáng kể sau mỗi lần một mô hình mới được ra mắt.

