OpenAI ra mắt GPT-6 Astra ngày 3/9, giới thiệu đây là mô hình thông minh và phù hợp nhất của hãng từ trước tới nay. Astra tập trung vào những nhiệm vụ đòi hỏi suy luận, lập trình và khả năng tự động làm việc trên máy tính.
Thay vì chỉ trả lời câu hỏi, mô hình có thể thực hiện quy trình gồm nhiều bước, sử dụng trình duyệt và phần mềm để nghiên cứu, phân tích dữ liệu, tạo tài liệu, bảng tính hay bài thuyết trình.
Theo OpenAI, Astra đạt 72,6% trên OSWorld 2.0, bài kiểm tra khả năng điều khiển máy tính của tác nhân AI, đồng thời hoàn thành tác vụ nhanh hơn khoảng 47% so với GPT-5.6 Sol trong mô phỏng độ trễ.
Chủ tịch OpenAI Greg Brockman thậm chí gọi sự xuất hiện của Astra là “kỷ nguyên siêu trí tuệ AGI” và cho rằng công ty đã đạt được mục tiêu về trí tuệ nhân tạo tổng quát (AGI).
Tuy nhiên, đây vẫn là quan điểm gây tranh luận bởi chưa có một tiêu chuẩn thống nhất để xác định một hệ thống AI đã thực sự đạt AGI hay chưa.
Gây ấn tượng với lập trình và thế giới 3D
Sau khi Astra ra mắt, nhiều nhà phát triển đã thử nghiệm khả năng của mô hình trong thiết kế 3D và phát triển trò chơi.
Nhà đầu tư Matt Shumer kết hợp Astra với Unreal Engine để tạo bản đồ 3D chi tiết khu vực Manhattan và xây dựng một thế giới mô phỏng với các nhân vật có tính cách riêng.
Một nhà phát triển Trung Quốc có biệt danh SuSu yêu cầu Astra tái tạo thành phố Hàng Châu và các khu vực xung quanh bằng Three.js. Trong 24 phút, công cụ tạo ra bản đồ tương tác với nhiều địa danh cùng chế độ hiển thị ngày và đêm.
Astra còn được thử nghiệm khả năng tự chơi Portal. Tác nhân AI hoàn thành toàn bộ trò chơi trong chưa đầy 24 giờ, dù chi phí sử dụng token lên tới 571,18 USD.
Tuy nhiên, mô hình không vượt trội ở mọi lĩnh vực. Một số thử nghiệm độc lập đánh giá khả năng viết và sáng tạo của Astra thấp hơn một số mô hình AI khác. Nhà nghiên cứu Gary Marcus cũng cho rằng Astra vẫn chưa đáp ứng đủ các tiêu chí để được xem là AGI.
Sức mạnh an ninh mạng gây lo ngại
Khả năng an ninh mạng là một trong những điểm đáng chú ý nhất của GPT-6 Astra.
Theo OpenAI, mô hình đạt 100% trên ExploitBench, bài kiểm tra năng lực an ninh mạng tấn công của các tác nhân AI. Trong thử nghiệm của công ty, Astra còn phát hiện hai lỗ hổng zero-day chưa từng được biết đến.
Điều này đồng nghĩa AI ngày càng có khả năng phát hiện và khai thác những điểm yếu phần mềm với mức độ tự chủ cao hơn, đồng thời đặt ra yêu cầu lớn hơn về các biện pháp kiểm soát.
Một vấn đề khác được giới nghiên cứu quan tâm là kỹ thuật suy luận mới của Astra. Theo The Information, mô hình sử dụng phương pháp “độ sâu lặp lại” (recurrent depth), cho phép xử lý một truy vấn nhiều lần trong một vòng lặp kín.
Một số chuyên gia an toàn AI lo ngại cách xử lý này có thể khiến quá trình suy luận bên trong mô hình khó giám sát hơn.
Buck Shlegeris, CEO tổ chức nghiên cứu an toàn AI Redwood Research, cho rằng đây là vấn đề đáng lo nếu các kỹ thuật tương tự tiếp tục được phát triển. Ryan Greenblatt, nhà khoa học trưởng của tổ chức này, cũng cảnh báo những mô hình tương lai có thể trở nên khó dự đoán hơn.
OpenAI chưa bình luận trực tiếp về những lo ngại liên quan đến cơ chế suy luận mới. Nhà khoa học trưởng Jakub Pachocki cho biết công ty vẫn nỗ lực duy trì khả năng giám sát quá trình suy luận của các mô hình.
Sự xuất hiện của GPT-6 Astra vì thế không chỉ tạo ra cuộc đua về việc AI có thể làm được những gì, mà còn đặt ra câu hỏi ngày càng quan trọng: con người sẽ giám sát và kiểm soát những hệ thống AI ngày càng mạnh và tự chủ bằng cách nào?









