Ngày 27/6, hai tin tức AI đáng chú ý bao gồm: OpenAI ra mắt dòng mô hình GPT-5.6 Sol nhưng chỉ phát hành cho một nhóm nhỏ đối tác được chính phủ Mỹ phê duyệt; Anthropic lần đầu công khai cáo buộc Alibaba thực hiện chiến dịch trích xuất trái phép lớn nhất từng ghi nhận nhắm vào Claude. Cả hai câu chuyện cùng phản ánh một bối cảnh: quyền tiếp cận các mô hình AI mạnh nhất đang trở thành vấn đề chính sách và an ninh, không còn thuần túy là chuyện công nghệ.
1. GPT-5.6 Sol: dòng mô hình mới nhất của OpenAI chỉ dành cho nhóm nhỏ đối tác được Nhà Trắng chấp thuận
OpenAI vừa công bố dòng GPT-5.6 gồm ba cấp: Sol (mô hình mạnh nhất), Terra (cân bằng) và Luna (nhanh, giá thấp). Trên benchmark Terminal-Bench 2.1 với 89 bài kiểm thử lập trình phức tạp, Sol đạt 88,8%; khi bật chế độ “ultra,” kết quả đạt 91,9%. Để so sánh, Claude Mythos 5 đạt 88,0% và Fable 5 ở mức 84,3%. Theo OpenAI, Sol dẫn trước Claude Mythos 5 ở mảng lập trình agentic và ngang ngửa ở mảng an ninh mạng. Riêng trên benchmark an ninh mạng ExploitBench, Sol đạt hiệu năng tương đương bản Mythos Preview nhưng chỉ tiêu thụ khoảng một phần ba lượng output token.
Về giá, Sol ở mức 5 USD mỗi triệu token đầu vào và 30 USD đầu ra; các con số tương đương cho Terra là 2,50 USD và 15 USD; cho Luna là 1 USD và 6 USD. Ở phân khúc thấp nhất, Luna cạnh tranh trực tiếp với nhiều mô hình phổ thông hiện có. Vì Sol dùng ít token hơn để đạt kết quả tương đương ở nhiều benchmark, chi phí thực tế cho mỗi tác vụ có thể thấp hơn các thế hệ trước.
Mặc dù vậy, điểm đáng chú ý không phải là thông số, mà là điều kiện phát hành. GPT-5.6 hiện chỉ tiếp cận được với một nhóm nhỏ đối tác mà OpenAI nói là “đã được chia sẻ danh sách với chính phủ.” Hạn chế này bắt nguồn từ khung chính sách trong sắc lệnh Tổng thống Trump ký ngày 2/6/2026, trong đó yêu cầu một số công ty AI tự nguyện nộp mô hình tiên tiến nhất cho chính phủ đánh giá tối đa 30 ngày trước khi phát hành. Đáng chú ý, cùng đợt này chính quyền cũng đã buộc Anthropic gỡ Fable 5 và Mythos 5. Vì vậy, hạn chế ảnh hưởng đến cả hai bên. OpenAI đã lên tiếng phản đối, “Chúng tôi không tin quy trình kiểm soát truy cập kiểu này nên trở thành mặc định lâu dài. Nó làm vuột mất những công cụ tốt nhất khỏi tay người dùng, nhà phát triển, doanh nghiệp và các đối tác toàn cầu đang cần chúng.”
Nói tóm lại, chế độ “ultra” là tính năng mới đáng theo dõi: hệ thống phối hợp nhiều subagent chạy song song để giải quyết các tác vụ phức tạp nhất. OpenAI cho biết sẽ mở rộng phạm vi phát hành GPT-5.6 cho ChatGPT, Codex và API trong vài tuần tới.
Nguồn: The Decoder / TechCrunch
Ghi chú thuật ngữ
- Benchmark: Bài kiểm thử chuẩn hoá để so sánh hiệu năng giữa các mô hình AI.
- Terminal-Bench 2.1: Tập hợp 89 bài kiểm thử lập trình phức tạp dùng để đánh giá mô hình AI trong môi trường thực tế.
- Subagent (tác nhân con): Một AI nhỏ được giao một phần việc; chế độ “ultra” của Sol điều phối nhiều subagent chạy song song để xử lý một tác vụ lớn.
- Token: Đơn vị văn bản mà mô hình AI xử lý; khoảng 0,75 từ tiếng Anh hoặc 1-2 ký tự tiếng Việt.
2. Alibaba bị tố sao chép Claude: 28,8 triệu phiên giả mạo trong 44 ngày
Trong bức thư gửi Ủy ban Ngân hàng Thượng viện Mỹ ngày 10/6/2026, gửi tới Thượng nghị sĩ Tim Scott và Elizabeth Warren, Anthropic cáo buộc Alibaba thực hiện “cuộc tấn công trích xuất (distillation) lớn nhất từng ghi nhận nhắm vào Anthropic.” Được biết, kỹ thuật này dùng đầu ra của một mô hình mạnh để huấn luyện một mô hình nhỏ hơn, qua đó sao chép năng lực của Claude mà không cần truy cập trực tiếp vào trọng số gốc. Từ ngày 22/4 đến 5/6/2026 (44 ngày), các bên liên quan đến Alibaba và phòng lab AI của hãng đã dùng gần 25.000 tài khoản giả mạo và dịch vụ proxy thương mại để vượt qua hạn chế địa lý ngăn thực thể Trung Quốc truy cập Claude.
Với 28,8 triệu phiên tương tác chỉ trong 44 ngày, Anthropic gọi đây là cuộc tấn công trích xuất đơn lẻ lớn nhất mà hãng từng ghi nhận, vượt xa quy mô từng thấy. Hồi tháng 2/2026, Anthropic cũng đã công bố ba chiến dịch trích xuất “quy mô công nghiệp” được tổ chức và tự động hoá ở mức rất lớn chứ không phải thử nghiệm lẻ tẻ từ DeepSeek, Moonshot và MiniMax, cảnh báo các chiến dịch này ngày càng tăng về cường độ lẫn mức độ tinh vi.
Tin tức này đặt ra một câu hỏi vận hành thực tế cho các tổ chức đang dùng API AI. Dữ liệu tương tác qua API có thể trở thành nguyên liệu huấn luyện nếu bị khai thác có chủ đích. Điều đó biến kiểm soát tài khoản và điều khoản sử dụng thành vấn đề an toàn thực sự, không chỉ là thủ tục hành chính.
Nguồn: CNBC
Ghi chú thuật ngữ
- Distillation (trích xuất): Kỹ thuật dùng đầu ra của một mô hình AI để huấn luyện mô hình khác, sao chép năng lực mà không cần truy cập trực tiếp vào trọng số gốc.
- API: Giao diện lập trình cho phép phần mềm bên ngoài kết nối và sử dụng một dịch vụ AI.
- Proxy: Dịch vụ trung gian giúp ẩn vị trí địa lý thực của người dùng, thường dùng để vượt qua hạn chế truy cập theo khu vực.
Bài viết của đội ngũ ZTO Labs, chuyên đào tạo và nghiên cứu AI tại Việt Nam.
