OpenAI phát hành GPT-6 Astra, gọi đây là sự xuất hiện của thời đại AGI
OpenAI đã chính thức phát hành GPT-6 Astra vào thứ Năm, Tổng giám đốc Greg Brockman trong buổi họp báo đã gọi đây là "một bước nhảy vọt thế hệ về khả năng", và cho rằng mô hình này đã đạt tiêu chuẩn trí tuệ nhân tạo tổng quát (AGI), tức là trí tuệ nhân tạo có thể so sánh hoặc vượt qua khả năng của con người. Brockman cho biết: "Chào mừng đến với thời đại AGI." Nếu đánh giá này đúng, điều đó có nghĩa là các thực thể AI sẽ gần hơn trong việc hoàn thành các công việc suy luận mà con người có thể làm trong các nhiệm vụ phức tạp, thậm chí làm được nhiều hơn.
GPT-6 Astra là mô hình đầu tiên của OpenAI vượt qua ngưỡng "quan trọng" trong hệ thống đánh giá khả năng nguy hiểm nội bộ của họ, Preparedness Framework, điều này có nghĩa là nó có thể tự phát hiện các lỗ hổng phần mềm chưa biết trước đó (tức là lỗ hổng zero-day) mà không cần giám sát thủ công từng bước, và kết nối chúng thành các cuộc tấn công có thể hoạt động trong hệ thống được củng cố. Trong các thử nghiệm, mô hình này đạt 100% điểm số trên chuẩn ExploitBench; để loại trừ việc ghi nhớ câu trả lời dẫn đến việc tăng điểm giả, OpenAI đã thực hiện thử nghiệm thứ hai với 20 lỗ hổng gần đây của động cơ JavaScript Google V8, Astra không chỉ vượt qua phiên bản trước là GPT-5.6 Sol mà còn phát hiện và kết nối hai lỗ hổng zero-day chưa biết trước đó, các lỗ hổng liên quan vẫn đang được thông báo cho các bên bị ảnh hưởng.
Do có tính tự chủ cao, độ khó trong việc giám sát Astra cũng tăng lên. OpenAI thừa nhận rằng, trong việc đánh giá khả năng tránh giám sát, mô hình này khó theo dõi hơn so với các hệ thống trước đây.






