OpenAI hủy kế hoạch ra mắt mô hình mới do lo ngại về an toàn

Nguồn hình ảnh, Reuters
- Tác giả, Osmond Chia
- Vai trò, Phóng viên Kinh doanh
- Tác giả, Liv McMahon
- Vai trò, Phóng viên Công nghệ
- Được đăng
- Thời gian đọc: 9 phút
OpenAI thông báo sẽ không phát hành mô hình AI mới nhất do những lo ngại về vấn đề an toàn.
Theo bà Saachi Jain, người đứng đầu bộ phận hệ thống an toàn tại OpenAI, hệ thống GPT-6.1 Astra - vốn có khả năng tự thực hiện các tác vụ như duyệt web và tự sử dụng ứng dụng - "vẫn chưa hoàn toàn đáp ứng được" các tiêu chuẩn của công ty.
Công ty đứng sau ChatGPT cũng đưa ra thông tin cập nhật về các sự cố xảy ra hồi tháng Sáu nhưng mãi đến tuần trước mới được công khai; trong đó, các mô hình của hãng đã truy cập trái phép vào các trang web và hệ thống của chính phủ Úc.
Thông tin này được đưa ra trong bối cảnh các sự cố liên quan đến mô hình của những công ty AI lớn đang làm dấy lên các tranh luận về rủi ro mà công nghệ này mang lại; điển hình là việc Anthropic nhấn mạnh những lo ngại về nguy cơ AI đe dọa nhân loại ngay khi công ty này đang chuẩn bị IPO - phát hành cổ phiếu lần đầu ra công chúng.
Reuters đưa tin hôm 29/9 rằng Anthropic - công ty phát minh ra Claude, đối thủ cạnh tranh của ChatGPT - có kế hoạch sẽ cảnh báo các nhà đầu tư tiềm năng trong đợt IPO rằng công nghệ của họ có thể gây ra "những rủi ro thảm khốc hoặc đe dọa sự tồn vong của nhân loại", theo một bản cáo bạch mà Reuters tiếp cận được.
Bất chấp những cảnh báo nghiêm trọng đó, công ty này vẫn được kỳ vọng sẽ trở thành một trong những doanh nghiệp giá trị nhất thế giới khi niêm yết trên thị trường chứng khoán.
"Tôi thấy thật điên rồ khi các công ty vẫn tiếp tục đẩy mạnh phát triển những năng lực này, trong khi các sự cố xảy ra trong vài tháng qua đã cho thấy họ còn lâu mới đạt được mức độ an toàn và kiểm soát cần thiết", Jess Whittlestone, cố vấn cấp cao về chính sách AI tại tổ chức tư vấn Centre for Long-Term Resilience, nhận định.
Các nhà lãnh đạo hàng đầu trong lĩnh vực AI, trong đó có CEO Dario Amodei của Anthropic và Sam Altman của OpenAI, đã kêu gọi toàn ngành làm chậm tốc độ phát triển.
Những lo ngại ngày càng tăng về vấn đề an toàn
Quyết định của OpenAI - được Wall Street Journal đưa tin đầu tiên - là một trường hợp hiếm hoi khi một nhà phát triển AI lớn rút lại sản phẩm mới vì những lo ngại về an toàn.
Bà Jain cho biết mô hình này chưa đạt yêu cầu về việc "hoạt động trong phạm vi và thẩm quyền cho phép, cũng như cách thức phản hồi cho người dùng về loại công việc mà mô hình đã thực hiện".
"Chúng tôi muốn đảm bảo quy trình phát triển mô hình luôn an toàn, dù là trong nội bộ công ty hay khi cung cấp cho người dùng. Tuy nhiên, khi đưa sản phẩm đến tay người dùng, chúng tôi đặt ra những tiêu chuẩn cực kỳ cao về an toàn và mức độ tuân thủ các nguyên tắc định hướng hành vi," bà nói thêm.
Mô hình AI tác tử chủ lực GPT-6 Astra được phát hành vào tháng Chín, chuyên xử lý các tác vụ đòi hỏi khả năng suy luận phức tạp và tự chủ thực hiện nhiệm vụ. OpenAI cho biết mô hình này là kết quả của "nhiều năm nghiên cứu và những khoản đầu tư lớn".
OpenAI dự kiến tổ chức DevDay, hội nghị thường niên dành cho nhà phát triển, tại San Francisco hôm 30/9, nơi công ty được kỳ vọng sẽ đưa ra một số thông báo quan trọng. Hiện chưa rõ liệu phiên bản mới của Astra có nằm trong số đó hay không.
Các biện pháp kiểm soát an toàn của công ty đã bị giám sát chặt chẽ sau một số sự cố gây chú ý liên quan đến công nghệ của họ.
Đây không phải là lần đầu tiên một nhà phát triển AI lớn quyết định rút lại một mô hình mới.
Trước đó trong năm nay, Anthropic cho biết công ty sẽ không phát hành công khai Mythos – một phiên bản mạnh của mô hình Claude – vì khả năng phát hiện các lỗi phần mềm tiềm ẩn quá xuất sắc.
Vài tháng sau đó, công ty đã phát hành một phiên bản của mô hình này ra công chúng.
Trong khi đó, năm 2019, OpenAI tuyên bố sẽ không phát hành một trong các mô hình GPT vì cho rằng sẽ "quá nguy hiểm". Các mô hình GPT hiện được sử dụng để vận hành những công cụ như ChatGPT.
Giáo sư Tony Cohn, người phụ trách mảng mô hình nền tảng tại Viện Alan Turing, nhận định quyết định không phát hành công khai phiên bản mới nhất của Astra là "một tín hiệu đáng mừng cho thấy họ đang thực sự coi trọng các vấn đề an toàn".
Tuy nhiên, ông cũng nhấn mạnh rằng "vấn đề an toàn không nên chỉ phó mặc cho các nhà phát triển, mà cần phải do các cơ quan quản lý độc lập được chính phủ phê duyệt giám sát và kiểm chứng".
Giáo sư Gina Neff, thuộc Trung tâm Minderoo về Công nghệ và Dân chủ tại Đại học Cambridge, cho biết thông báo của OpenAI đã cho thấy "công ty còn cần phải nỗ lực nhiều hơn nữa để đảm bảo tính an toàn cho các sản phẩm AI của mình".
Bà chia sẻ với BBC rằng việc các phòng thí nghiệm độc lập - chẳng hạn như Viện An toàn AI của Vương quốc Anh - nơi thực hiện đánh giá tự nguyện đối với các hệ thống AI tiên tiến nhất - tiến hành kiểm thử các mô hình AI là điều "cực kỳ quan trọng", bởi vì "các công ty này đã chứng minh rằng chúng ta không thể chỉ dựa vào họ để đảm bảo sự an toàn cho chính mình".
Tin tặc Úc
Tuần trước, Thủ tướng Úc, ông Anthony Albanese, thông báo rằng một tác tử AI của OpenAI đã xâm nhập trái phép vào các trang web và hệ thống của chính phủ Úc hồi tháng Sáu, trong vụ việc mà các chuyên gia cho rằng chưa có tiền lệ trên thế giới.
Ông Albanese chỉ trích OpenAI vì đã thông báo cho chính phủ Australia thông qua một địa chỉ email chung chung thay vì liên hệ trực tiếp với các quan chức.
Trong một tuyên bố hôm 29/9, OpenAI xin lỗi về sự cố và nói rằng công ty "đáng lẽ phải xử lý tốt hơn".
OpenAI xác nhận rằng Services Australia, Cục Nghiên cứu và Thống kê Tội phạm NSW, Bộ Y tế Victoria và Viện Y tế và Phúc lợi Australia đều bị ảnh hưởng.
Công ty cho biết họ đã tiến hành điều tra ngay khi nhận thấy vấn đề vào giữa tháng Tám và thông báo cho các tổ chức bị ảnh hưởng trong khoảng thời gian từ ngày 10 đến ngày 24/9.
"Mục đích của chúng tôi là cung cấp cho các cơ quan bị ảnh hưởng một tài khoản chi tiết sau khi cuộc điều tra của chúng tôi hoàn tất", OpenAI cho biết và nói thêm rằng lẽ ra họ nên chia sẻ những phát hiện ban đầu kịp thời hơn và cập nhật cho chính quyền Úc.
OpenAI cho biết thêm rằng công ty sẽ xây dựng "các biện pháp thực tiễn" nhằm hỗ trợ các nhà phát triển và chính phủ xác định và công bố những sự cố AI trong tương lai.
Công ty sẽ tài trợ cho các biện pháp an ninh mạng, cung cấp hỗ trợ chuyên biệt cho các cơ quan bị ảnh hưởng và thành lập một nhóm chuyên trách để quản lý rủi ro từ các tác tử AI ngày càng tiên tiến.
OpenAI cũng thông báo rằng một lãnh đạo cấp cao của doanh nghiệp này sẽ tham dự phiên điều trần của Ủy ban Hỗn hợp Đặc biệt về AI tại Úc vào ngày 6/10.
Trước đó, vào tháng Bảy, OpenAI cho biết các hệ thống AI của họ đã truy cập Internet và xâm nhập vào Hugging Face - nền tảng dành cho cộng đồng phát triển mã nguồn mở - sự việc đã thúc đẩy các nhà nghiên cứu và giới chức trách kêu gọi siết chặt kiểm soát đối với công nghệ này.
Hôm thứ 28/9, "gã khổng lồ" chip Nvidia đã ra mắt một bộ công cụ phần mềm đảm bảo an toàn dành cho các nền tảng AI tự hành - hay còn gọi là các "tác tử" AI - mà hãng cho rằng có thể đã ngăn chặn được vụ tấn công mạng nhắm vào Hugging Face.
Một trong những công cụ mới này tận dụng các tính năng phần cứng trên chip của Nvidia để kiểm soát phạm vi hoạt động của các tác tử AI.
Tổng Giám đốc Nvidia Jensen Huang hầu như đã bác bỏ các lời kêu gọi siết chặt quy định về AI; ông cho rằng vấn đề các tác tử AI hoạt động ngoài tầm kiểm soát thực chất là một thách thức về mặt kỹ thuật có thể giải quyết được.
Trước đó trong tháng này, Nvidia đã đạt thỏa thuận mua lại Hugging Face với giá 12,9 tỷ USD.

Nguồn hình ảnh, EPA
Giáo hoàng - trong bài phát biểu hôm 28/9 khi thăm Pháp, nói rằng cần phải "coi trọng" AI - cho biết thêm ông từng đọc thông tin về việc ông Huang đề xuất khả năng thiết lập các cơ chế kiểm soát an toàn cho một số mô hình AI nhất định.
"Tuy nhiên, cũng chính người đó lại nói rằng không nên đặt ra bất kỳ giới hạn hay quy định nào từ phía chính phủ," Giáo hoàng nhận xét.
NVIDIA từ chối đưa ra bình luận chính thức.
Tổng thống Mỹ Donald Trump và Chủ tịch Hạ viện Mike Johnson dự kiến sẽ tiếp đón các lãnh đạo doanh nghiệp công nghệ tại Nhà Trắng vào cuối ngày 29/9 để thảo luận về các quy định liên quan đến AI.
Ông Trump từng xem nhẹ những lo ngại về rủi ro của AI và gọi đó là một "trò lừa bịp", lập luận rằng Mỹ đã có đủ luật lệ và "cơ chế kiểm soát" duy nhất mà công nghệ này cần chính là một vị tổng thống "mạnh mẽ và sáng suốt".






















