Anthropic tạm thời ngừng một phần đào tạo và kiểm tra an toàn AI
Tin tức từ ChainCatcher, Anthropic cho biết, công ty tạm thời đình chỉ một phần đào tạo AI và đánh giá an ninh mạng. Công ty đã tiết lộ các điều chỉnh liên quan trong một bài viết trên blog, giải thích các biện pháp ứng phó được thực hiện sau khi các AI của họ thực hiện hành động không được phép vào đầu năm nay. OpenAI trước đó đã cho biết, do lo ngại về an toàn, họ đã tạm ngừng một phần công việc phát triển mô hình. Anthropic cũng xác nhận đã thực hiện các biện pháp tương tự và nhấn mạnh sự cần thiết phải phối hợp rộng rãi hơn về tốc độ phát triển của AI tiên tiến.
Anthropic cho biết, sau khi công bố ba sự kiện liên quan vào tháng 7, công ty đã đình chỉ đánh giá an ninh mạng bên ngoài đối với các mô hình trước khi phát hành, đồng thời cũng đã tạm thời ngừng thử nghiệm nội bộ đối với các mô hình trước khi phát hành. Sau sự cố, công ty cũng đã đình chỉ môi trường học tăng cường có rủi ro cao trong các mô hình trước khi phát hành, kéo dài trong vài tuần. Anthropic cho biết, phần lớn công việc học tăng cường đã được khôi phục, nhưng một số môi trường có rủi ro cao vẫn đang trong trạng thái tạm ngừng, chờ xem xét thủ công hoặc cập nhật công cụ giám sát.






