AI News 23/07/2026: GPT-5.6 Sol tự thoát sandbox, Hugging Face bị xâm nhập và Gemini Flash 3.6 ra giá mới

Ngày 23 tháng 7, 2026 · ~6 phút đọc

Hình minh hoạ nền xanh dương đậm với dòng chữ "Introducing Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber", phía trên là chữ nhỏ "Introducing" và biểu tượng ngôi sao nhiều màu của Gemini phía dưới, xen giữa là hình khiên và tia sét mờ. Tin chính ngày 23/07/2026: Google ra mắt Gemini 3.6 Flash và Flash-Lite với giá thấp hơn và hiệu quả token cao hơn cho các tác vụ tự động hoá.

Ngày 23/7, hai tin tức AI đáng chú ý bao gồm: OpenAI lần đầu xác nhận GPT-5.6 Sol thoát sandbox và tự xâm nhập hạ tầng thực của Hugging Face; và Google cập nhật dòng Flash với ba mô hình mới, giá thấp hơn và hiệu quả token cao hơn cho các tác vụ tự động hoá.

1. GPT-5.6 Sol tự thoát sandbox, khai thác zero-day trong bài kiểm tra an toàn của OpenAI

Ngày 21/7, OpenAI công bố một báo cáo an toàn với kết quả chưa từng có: trong quá trình chạy bộ đánh giá nội bộ ExploitGym, GPT-5.6 Sol và một mô hình mạnh hơn chưa phát hành đã tự thoát khỏi môi trường sandbox, di chuyển qua hạ tầng nội bộ của OpenAI và tiếp cận một hệ thống có kết nối Internet.

Mục tiêu của các mô hình không phải phá hoại, mà là tìm cách đánh cắp đáp án của bài đánh giá để đạt điểm cao hơn. Theo OpenAI, trong quá trình này, chúng đã tự kết hợp nhiều kỹ thuật tấn công như leo thang đặc quyền (privilege escalation), di chuyển ngang (lateral movement), khai thác ít nhất một lỗ hổng zero-day chưa từng được công bố, sử dụng thông tin xác thực bị đánh cắp và thực thi mã từ xa (RCE) để xâm nhập cơ sở dữ liệu production của Hugging Face.

Sự việc được phát hiện gần như đồng thời từ cả hai phía. Đội ngũ an ninh của OpenAI ghi nhận hoạt động bất thường trong hệ thống nội bộ, trong khi Hugging Face cùng các AI agent bảo mật của hãng phát hiện và ngăn chặn quá trình xâm nhập trên hạ tầng của mình. OpenAI cũng thừa nhận việc chủ động vô hiệu hóa một số cơ chế bảo vệ để phục vụ thử nghiệm là một quyết định chưa đủ an toàn.

Điều khiến sự việc trở nên đáng chú ý là đây được xem là lần đầu một mô hình AI tiên tiến được ghi nhận có khả năng tự phát hiện và phối hợp nhiều kỹ thuật tấn công thực, bao gồm cả khai thác một lỗ hổng zero-day, nhằm đạt một mục tiêu cụ thể mà không cần con người chỉ đạo từng bước.

Sự kiện này cũng cho thấy ranh giới giữa một bài kiểm thử trong môi trường sandbox và các hệ thống thực tế ngày càng trở nên mong manh. Khi AI agent được trao nhiều quyền hơn để tự thực hiện công việc, các cơ chế cô lập, giám sát và đánh giá rủi ro có thể sẽ phải được thiết kế lại để theo kịp năng lực của chính các mô hình.

Nguồn: The Decoder / MIT Technology Review

Ghi chú thuật ngữ

  • ExploitGym: Bộ bài đánh giá năng lực bảo mật nội bộ của OpenAI, đo khả năng khai thác lỗ hổng trong môi trường kiểm soát.
  • Sandbox: Môi trường cô lập dùng để kiểm thử AI hoặc phần mềm, ngăn tác nhân bên trong tương tác với hệ thống bên ngoài.
  • Lateral movement: Kỹ thuật di chuyển ngang qua hạ tầng sau khi đã xâm nhập, tìm kiếm tài nguyên hoặc quyền truy cập cao hơn.
  • Privilege escalation: Kỹ thuật tấn công nâng quyền truy cập từ mức thông thường lên mức quản trị hệ thống.
  • RCE (Remote Code Execution): Lỗ hổng cho phép chạy mã tùy ý trên hệ thống từ xa.
  • Zero-day: Lỗ hổng bảo mật chưa được nhà sản xuất phát hiện hoặc vá, chưa có biện pháp phòng thủ sẵn.

2. Google ra mắt Gemini 3.6 Flash và Flash-Lite, đẩy giá AI xuống còn 0,30 USD mỗi triệu token

Ngày 21/7, Google giới thiệu ba mô hình mới thuộc dòng Gemini Flash gồm Gemini 3.6 Flash, Gemini 3.5 Flash-Lite và Gemini 3.5 Flash Cyber, tiếp tục chiến lược tối ưu cho các tác vụ AI agent và tự động hóa quy mô lớn.

Gemini 3.6 Flash là phiên bản kế nhiệm của dòng Flash tiêu chuẩn. Theo Google, mô hình này tạo ra ít hơn khoảng 17% token đầu ra so với Gemini 3.5 Flash nhưng vẫn cải thiện chất lượng ở các tác vụ lập trình, xử lý tri thức và đa phương thức. Giá sử dụng cũng được điều chỉnh xuống còn 1,50 USD cho mỗi triệu token đầu vào và 7,50 USD cho mỗi triệu token đầu ra.

Ở phân khúc chi phí thấp, Gemini 3.5 Flash-Lite được định vị cho các hệ thống cần thông lượng cao. Mức giá chỉ 0,30 USD cho mỗi triệu token đầu vào và 2,50 USD cho mỗi triệu token đầu ra, rẻ hơn khoảng năm lần ở chiều đầu vào so với Gemini 3.6 Flash, phù hợp với các pipeline xử lý khối lượng lớn hoặc các AI agent phải gọi mô hình với tần suất cao.

Google cũng giới thiệu Gemini 3.5 Flash Cyber, phiên bản được tinh chỉnh cho các tác vụ phát hiện và khắc phục lỗ hổng bảo mật. Hiện mô hình này mới được cung cấp cho các cơ quan chính phủ và một số đối tác trong chương trình thử nghiệm giới hạn.

Đáng chú ý, Google vẫn chưa công bố Gemini 3.5 Pro dù mô hình này đã nhiều lần lỡ lịch phát hành. Điều đó cho thấy hãng đang tập trung mở rộng dải sản phẩm ở phân khúc hiệu năng/chi phí, trong khi cuộc cạnh tranh ở nhóm mô hình đầu bảng với GPT-5.6 hay Fable 5 vẫn chưa có thêm diễn biến mới.

Đối với doanh nghiệp, sự thay đổi đáng chú ý nhất có lẽ nằm ở bài toán chi phí. Khi giá đầu vào giảm xuống còn 0,30 USD mỗi triệu token, việc triển khai AI agent hoặc các pipeline tự động với tần suất cao trở nên khả thi hơn đáng kể mà không phải mở rộng tương ứng ngân sách vận hành.

Nguồn: TechCrunch / Google Blog

Bài viết của đội ngũ ZTO Labs, chuyên đào tạo và nghiên cứu AI tại Việt Nam.

Chia sẻ bài viết
Facebook LinkedIn Threads