OpenAI vừa ra mắt GPT-5.6-Cyber, một mô hình dành riêng cho an ninh mạng, cung cấp cho các chuyên gia phòng thủ được phê duyệt các công cụ phục vụ nghiên cứu điểm yếu và phát triển khai thác lỗ hổng.
Công ty nhấn mạnh việc ra mắt này là để tranh thủ khoảng thời gian ngắn còn lại cho công tác phòng thủ trên không gian mạng. OpenAI cho rằng các đối tượng tấn công sẽ ngày càng tận dụng AI để thực hiện các đợt tấn công nhanh hơn, quy mô lớn hơn, thậm chí tự động hóa hoàn toàn các cuộc tấn công.
OpenAI cung cấp công cụ an ninh mạng tiên tiến cho các chuyên gia tin cậy
GPT-5.6-Cyber được phát triển trên nền tảng GPT-5.6 Sol, là mô hình tiêu chuẩn của OpenAI. Điểm nổi bật của mô hình này là giảm đáng kể tỷ lệ từ chối các yêu cầu như phát triển chuỗi khai thác, vượt qua xác thực, leo thang quyền hạn và các tình huống an ninh mạng nâng cao khác.
OpenAI cho biết mô hình này xử lý thành công 95% các yêu cầu loại này, trong khi đó GPT-5.6 Sol bản thường chỉ đáp ứng được 1.5%.
Công ty còn cho biết mô hình đã phát hiện hai lỗ hổng trong bộ máy V8 đang vận hành Google Chrome. Các lỗ hổng này đã được báo cáo cho Google với mã CVE-2026-15903. Ngoài ra, mô hình cũng đã phát hiện hơn 400 lỗ hổng liên quan đến kernel có khả năng leo thang quyền hạn.
Bên cạnh đó, OpenAI công bố mở rộng dịch vụ Daybreak lên hai cấp độ truy cập. Daybreak Blue cung cấp mô hình tổng hợp đa năng với tính năng bảo vệ an toàn, còn Daybreak Red cho phép truy cập các mô hình an ninh mạng chuyên biệt, bao gồm cả GPT-5.6-Cyber.
“Chúng tôi lựa chọn đặt trí tuệ nhân tạo tiên tiến vào tay các chuyên gia phòng thủ đáng tin cậy ở khắp nơi, trước khi các đối tượng tấn công có thể tận dụng AI để tấn công trên diện rộng,” đội ngũ OpenAI cho biết.
Theo dõi chúng tôi trên X để cập nhật tin tức nóng hổi mỗi ngày
Các vụ AI vượt kiểm soát khiến rủi ro trở nên nghiêm trọng hơn
Việc ra mắt mô hình này diễn ra ngay sau khi các mô hình AI đã vượt qua hệ thống ngoài trong quá trình thử nghiệm tại ba công ty lớn. Cả OpenAI, Anthropic và Meta đều xác nhận đã xảy ra các sự cố như vậy.
Bên phía OpenAI, các agent đã vượt khỏi “sandbox” và tấn công vào startup AI có tên Hugging Face. Anthropic khai nhận các mô hình Claude của họ đã truy cập vào hệ thống của ba tổ chức.
Meta cũng xác nhận rằng một trong các mô hình AI của họ đã vượt kiểm soát, truy cập hệ thống của một công ty bên ngoài. OpenAI nhấn mạnh GPT-5.6-Cyber không liên quan tới sự cố tại Hugging Face.
Đăng ký kênh YouTube của chúng tôi để xem các chuyên gia và nhà báo chia sẻ nhận định chuyên sâu









