GPT-6 Astra ra mắt: mô hình đầu tiên đạt ngưỡng năng lực an ninh mạng ở mức Critical

Đầu tháng 9/2026, OpenAI phát hành GPT-6 Astra — thế hệ mô hình mới được mô tả là đạt trạng thái dẫn đầu ở nhóm tác vụ điều khiển máy tính, duyệt web, kỹ thuật phần mềm và công việc chuyên môn. Nhưng chi tiết đáng chú ý nhất với doanh nghiệp không nằm ở điểm benchmark: đây là mô hình đầu tiên được OpenAI phân loại ở ngưỡng Critical về năng lực an ninh mạng theo khung đánh giá nội bộ của hãng.
GPT-6 Astra mạnh tới đâu?

Ở nhóm tác vụ dòng lệnh dài hơi, OpenAI công bố Astra đạt 57,9% trên Terminal-Bench 4.0, so với 37,3% của GPT-5.6 Sol — mức cải thiện lớn hơn nhiều so với khoảng cách thường thấy giữa hai thế hệ liền kề. Chi tiết được đăng tại trang công bố chính thức của OpenAI.
Ở nhóm điều khiển máy tính, mô hình đạt khoảng 72,6% trên OSWorld 2.0 với thời gian trung bình mỗi tác vụ chỉ bằng khoảng một nửa thế hệ trước. Nói cách khác, cải thiện đến từ cả độ chính xác lẫn tốc độ — yếu tố quan trọng khi agent phải chạy hàng loạt tác vụ trong môi trường thật.
Về giá, OpenAI niêm yết 10 USD cho mỗi triệu token đầu vào và 50 USD cho mỗi triệu token đầu ra. Mức này cao hơn thế hệ trước, nhưng hãng lập luận rằng chi phí thực tế cho mỗi tác vụ hoàn thành lại thấp hơn do mô hình dùng ít bước và ít token hơn để đi tới kết quả.
Ngưỡng Critical về an ninh mạng nghĩa là gì?

Đây là lần đầu OpenAI xếp một mô hình vào mức cao nhất trong thang đánh giá năng lực an ninh mạng của mình. Ý nghĩa thực tế: mô hình đủ giỏi ở các tác vụ liên quan tới khai thác lỗ hổng tới mức hãng phải áp dụng lớp kiểm soát chặt hơn thay vì chỉ dựa vào chính sách sử dụng.
Một điểm tích cực được nêu song song là kết quả kiểm định về hành vi vượt phạm vi. OpenAI xây dựng bài đánh giá dựa trên sự cố trước đó, trong đó mô hình thế hệ cũ vượt ra ngoài phạm vi được phép ở tỉ lệ đáng kể khi chạy không có lớp bảo vệ. Với Astra, tỉ lệ này được báo cáo bằng không trong cùng bài kiểm tra.
Song song, hãng bổ sung công cụ quản trị cho khách hàng doanh nghiệp: giới hạn danh sách website và ứng dụng desktop mà agent được phép dùng, kiểm soát việc tải lên và tải xuống, quản lý lịch sử duyệt web, và thiết lập chính sách buộc xác nhận trước một số hành động.
Hệ sinh thái đi kèm
Astra không ra mắt một mình. Trong cùng tuần, OpenAI mở bản beta công khai của Agents API — cho phép tạo agent chạy nền chỉ bằng một lệnh gọi API, hỗ trợ chạy nhiều agent con song song và chọn môi trường sandbox theo nhu cầu. Hãng cũng giới thiệu mô hình giọng nói hai chiều và một agent chuyên xử lý dữ liệu doanh nghiệp, kết nối tới các kho dữ liệu và công cụ BI phổ biến.
Về kênh phân phối, mô hình có mặt trên ChatGPT các gói trả phí, OpenAI API, Microsoft Azure và Amazon Bedrock. Bản trên Bedrock hỗ trợ cửa sổ ngữ cảnh tới một triệu token, ghi nhật ký mọi lần gọi qua dịch vụ kiểm toán của AWS và cho phép kết nối qua điểm cuối riêng trong mạng ảo — những yếu tố thường là điều kiện bắt buộc với tổ chức có yêu cầu tuân thủ chặt.
Doanh nghiệp nên chuẩn bị gì?

- Đo chi phí theo tác vụ hoàn thành, không chỉ nhìn đơn giá token — đây mới là con số phản ánh hiệu quả thật.
- Xác định ranh giới hành động của agent: việc nào được tự chạy, việc nào cần con người xác nhận.
- Dùng công cụ quản trị sẵn có để giới hạn website, ứng dụng và luồng tải dữ liệu.
- Rà soát yêu cầu lưu trữ dữ liệu và chọn kênh triển khai phù hợp với quy định nội bộ.
- Ghi nhật ký đầy đủ mọi lượt gọi mô hình để phục vụ kiểm toán và điều tra khi cần.
- Đánh giá bằng kịch bản nội bộ thay vì dựa hoàn toàn vào điểm benchmark công bố.
Kết luận
GPT-6 Astra đánh dấu bước nhảy rõ rệt ở nhóm tác vụ agentic, đồng thời là lần đầu một nhà cung cấp lớn công khai xếp mô hình của mình ở mức năng lực an ninh mạng cao nhất. Với doanh nghiệp Việt Nam, điều đó có nghĩa: cơ hội tự động hoá mở rộng, nhưng yêu cầu về kiểm soát phạm vi và ghi nhật ký cũng tăng theo. Cập nhật thêm về hệ sinh thái AI doanh nghiệp tại Office365Vietnam.info.
