Cộng đồng thường hỏi, liệu một mô hình ngôn ngữ lớn có thể tự động khai thác lỗ hổng bảo mật? – câu trả lời nằm trong mã nguồn của GLM-5.3.
Tuần trước, Zhipu AI—một công ty niêm yết trên sàn Hồng Kông (02513.HK)—tuyên bố phát hành GLM-5.3, được mệnh danh là "mô hình mã nguồn mở mạnh nhất hiện tại". Tuyên bố này không đơn thuần là một bản nâng cấp. Đó là một tín hiệu thị trường rõ ràng: cuộc đua AI đang chuyển từ kiến trúc cơ bản sang kỹ thuật hậu huấn luyện, và bảo mật mạng trở thành chiến trường mới.
Hãy mổ xẻ tuyên bố này. Zhipu xác nhận GLM-5.3 chia sẻ cùng một mô hình nền tảng với GLM-5.2. Mọi cải tiến về hiệu suất—từ mã hóa phức tạp đến khả năng khai thác lỗ hổng—đến từ quá trình hậu huấn luyện. Đây là một sự thay đổi chiến lược. Các công ty AI giờ đây có thể tạo ra các phiên bản mới chỉ trong vài tuần, thay vì nhiều tháng hoặc nhiều năm huấn luyện trước. Điều này giống như một kẻ chạy nước rút bước vào một cuộc đua đường dài và nói: "Tôi sẽ không chạy marathon, tôi sẽ chạy từng chặng một, và mỗi chặng đều nhanh hơn."
Nhưng đây mới là phần đáng sợ. Zhipu tuyên bố GLM-5.3 đã tăng gấp đôi khả năng "khai thác hậu kỳ" (post-exploitation) so với phiên bản tiền nhiệm. Điều này có nghĩa là mô hình không chỉ có thể xác định lỗ hổng, mà còn có thể di chuyển ngang, leo thang đặc quyền, và duy trì quyền truy cập trong một hệ thống bị xâm nhập. Nó đang trở thành một công cụ tự động cho cả đội xanh (blue team) và đội đỏ (red team). Dựa trên kinh nghiệm audit của tôi, đây là một bước nhảy vọt về khả năng. Các công cụ bảo mật truyền thống như Nessus hay OpenVAS chỉ quét lỗ hổng; chúng không thể tự động khai thác. GLM-5.3, nếu được huấn luyện đúng cách, có thể làm được điều đó.
Tuy nhiên, có một vấn đề. Tất cả các tuyên bố này đều dựa trên các điểm chuẩn nội bộ của Zhipu, đặc biệt là nền tảng CyberGym của họ. CyberGym là một môi trường mô phỏng an ninh mạng. Điểm chuẩn này có thể được thiết kế để làm nổi bật các thế mạnh của GLM-5.3, trong khi bỏ qua các điểm yếu. Cộng đồng mã nguồn mở—những người đã chứng kiến sự trỗi dậy và sụp đổ của nhiều mô hình—sẽ không dễ dàng tin tưởng. Họ sẽ yêu cầu bằng chứng trên các điểm chuẩn công khai như SWE-Bench Verified, LiveCodeBench, hoặc Aider Polyglot. Nếu GLM-5.3 đạt điểm cao trên các điểm chuẩn này, thì tuyên bố "mạnh nhất" mới có trọng lượng.
Chiến lược thương mại của Zhipu cũng rất thông minh. Họ phát hành trọng số mã nguồn mở, nhưng giữ lại các dịch vụ API cao cấp và kiểm toán bảo mật doanh nghiệp. Đây là một mô hình Open Core cổ điển. Nó cho phép họ xây dựng một hệ sinh thái nhà phát triển trong khi vẫn kiếm tiền từ các khách hàng doanh nghiệp. Các tổ chức tài chính, công ty bảo mật, và các cơ quan chính phủ sẽ là những người đầu tiên trả tiền cho một mô hình có thể tự động kiểm tra và khai thác lỗ hổng. Nhưng có một nghịch lý. Nếu trọng số là mã nguồn mở, bất kỳ ai cũng có thể tải xuống và sử dụng chúng cho các mục đích độc hại. Zhipu đang đặt cược rằng lợi ích của việc xây dựng một hệ sinh thái an toàn lớn hơn rủi ro của việc vũ khí hóa AI. Đó là một canh bạc.
Đối với các nhà đầu tư, GLM-5.3 là một tín hiệu hỗn hợp. Một mặt, chi phí phát triển thấp (không huấn luyện trước) và khả năng lặp lại nhanh chóng là những dấu hiệu tích cực. Mặt khác, không có số liệu doanh thu hoặc dữ liệu khách hàng nào được công bố. Cổ phiếu của Zhipu có thể tăng vọt dựa trên sự cường điệu, nhưng sự tăng trưởng bền vững đòi hỏi doanh thu thực tế từ các doanh nghiệp.
Rủi ro lớn nhất, theo quan điểm của tôi, là bảo mật. Zhipu thừa nhận rằng khả năng an ninh mạng của GLM-5.3 "phát triển nhanh hơn dự kiến". Điều này có nghĩa là họ không hoàn toàn kiểm soát được hành vi của mô hình. Họ đang dành hai tuần để "đánh giá và củng cố" trước khi phát hành. Nhưng đối với một mô hình mã nguồn mở, một khi trọng số được phát hành, không thể thu hồi lại. Một lỗ hổng bảo mật trong mô hình có thể dẫn đến một cuộc tấn công mạng quy mô lớn, được hỗ trợ bởi AI. Áp lực pháp lý và dư luận sẽ đổ dồn lên Zhipu.
Cộng đồng thường hỏi, liệu GLM-5.3 có thực sự là mô hình mã nguồn mở mạnh nhất không? – câu trả lời nằm trong mã nguồn, và chúng ta sẽ biết trong hai tuần tới. Hãy theo dõi các điểm chuẩn công khai. Hãy theo dõi các báo cáo về các công cụ tấn công mới dựa trên GLM-5.3. Và hãy theo dõi giá cổ phiếu của Zhipu. Dấu hiệu thực sự sẽ đến từ thị trường, không phải từ các tuyên bố PR.


