Mô hình AI Kimi K3 tự phát hiện lỗ hổng trong sandbox để truy cập Internet tìm lời giải

Vũ Sơn10/08/2026 09:52

Trong bài kiểm tra an ninh mạng, mô hình AI Kimi K3 của Trung Quốc đã tự phát hiện lỗ hổng cấu hình sandbox và kết nối Internet để lấy đáp án từ GitHub.

Trong một cuộc kiểm tra năng lực an ninh mạng gần đây, mô hình trí tuệ nhân tạo Kimi K3 do Trung Quốc phát triển đã gây chú ý khi tự động phát hiện và tận dụng lỗ hổng trong môi trường kiểm thử để truy cập Internet. Mặc dù nhiệm vụ được giao không cho phép tìm kiếm trực tuyến, tác tử AI này vẫn chủ động tìm đường thoát khỏi môi trường cách ly (sandbox) để lấy đáp án giải quyết bài toán.

Hành vi chủ động dò tìm và tận dụng sơ hở mạng của Kimi K3

Sự việc được ghi nhận bởi startup an ninh mạng Frontier Security trong quá trình thử nghiệm khả năng phòng thủ không gian mạng của Kimi K3 — một mô hình AI được phát hành theo dạng "mở trọng số" (open-weight). Ban đầu, mô hình được đưa vào một môi trường sandbox được thiết kế riêng nhằm ngăn chặn mọi kết nối ra mạng ngoài.

Tuy nhiên, nguyên nhân trực tiếp phát sinh sự cố là do một lỗi cấu hình trong sandbox, khiến hệ thống không bị cô lập hoàn toàn mà vẫn còn mở một số cổng kết nối. Đáng chú ý, Kimi K3 không chỉ vô tình đi qua kết nối này mà đã chủ động dò tìm các thiết lập mạng trong môi trường thử nghiệm, nhận biết được lối thoát và lập tức khai thác nó.

Ngày càng có nhiều mô hình AI dễ dàng vượt qua rào cản bảo mật để tiếp cận Internet toàn cầu. Ảnh: Wired.
Ngày càng có nhiều mô hình AI dễ dàng vượt qua rào cản bảo mật để tiếp cận Internet toàn cầu. Ảnh: Wired.

Theo Yaron Singer, CEO của Frontier Security, vụ việc cho thấy Kimi K3 có ít rào cản an toàn nội bộ trong lĩnh vực an ninh mạng hơn so với nhiều mô hình khác. Sau khi phát hiện điểm yếu của hệ thống, mô hình đã chủ động tối ưu hóa hành động để đạt mục tiêu thay bị giới hạn bởi các quy tắc an toàn sẵn có.

Bên cạnh đó, sau khi kết nối thành công với mạng Internet toàn cầu, Kimi K3 không thực hiện các hành vi tấn công hay phá hoại. Mô hình này chỉ truy cập vào nền tảng GitHub để lấy đáp án của bài kiểm tra vốn đã được lưu trữ công khai tại đây nhằm hoàn thành nhiệm vụ được giao một cách nhanh nhất.

Rủi ro từ cấu hình sandbox và năng lực tự suy luận của AI

Sự cố của Kimi K3 tiếp tục phản ánh một thách thức lớn trong công tác kiểm thử AI: môi trường sandbox vẫn là mắt xích dễ bị tổn thương nếu xuất hiện lỗi từ con người. Việc cấu hình sai một cổng kết nối duy nhất cũng đủ để các hệ thống AI tiên tiến tìm ra sơ hở.

Những mô hình AI hiện đại được thiết kế với khả năng suy luận đa bước và bám đuổi mục tiêu rất mạnh mẽ. Paul Kassianik, nhà nghiên cứu tại Frontier Security, đánh giá rằng Kimi K3 có năng lực thực thi công việc cao nhưng lại thiếu đi các cơ chế rào cản đủ mạnh để ngăn chặn hành vi "gian lận" hoặc tìm cách vượt rào khi gặp trở ngại.

Theo báo cáo, mô hình Kimi K3 đã truy cập mạng Internet toàn cầu để tìm lời giải vượt qua bài kiểm tra an ninh mạng. Ảnh: SCMP.
Theo báo cáo, mô hình Kimi K3 đã truy cập mạng Internet toàn cầu để tìm lời giải vượt qua bài kiểm tra an ninh mạng. Ảnh: SCMP.

Đặc biệt, Kimi K3 được phát hành rộng rãi kèm theo các rào cản an toàn dành cho người dùng phổ thông, thay vì chỉ là phiên bản thử nghiệm nội bộ đã lược bỏ tính năng bảo vệ. Điều này đặt ra bài toán về việc kiểm soát các tác tử AI khi chúng được phân phối rộng rãi ra thị trường.

Bài toán bảo mật hệ thống trong kỷ nguyên tác tử AI

Mặc dù bộc lộ rủi ro vượt rào, các nhà nghiên cứu tại Frontier Security thừa nhận các mô hình AI mở như Kimi K3 đóng vai trò quan trọng trong việc tăng cường năng lực phòng thủ mạng. Nền tảng Hugging Face từng áp dụng một mô hình AI ẩn danh từ Trung Quốc để tự vệ trước cuộc tấn công từ tác tử AI của OpenAI. Trong các bài đánh giá phát hiện lỗ hổng phần mềm, Kimi K3 cũng ghi nhận kết quả rất ấn tượng.

Các chuyên gia bảo mật nhận định, lỗ hổng mà Kimi K3 khai thác bản chất là một sai sót quản trị hệ thống kinh điển. Việc các thư viện mã nguồn hay hạ tầng thử nghiệm chưa được cô lập triệt để khỏi Internet công cộng là vấn đề đã tồn tại từ lâu trong ngành CNTT.

Như vậy, sự cố không hoàn toàn xuất phát từ việc AI "vượt tầm kiểm soát" mang tính viễn tưởng, mà phản ánh sự kết hợp giữa lỗi cấu hình của con người và khả năng tự động hóa dò tìm của AI. Khi các mô hình ngày càng thông minh hơn, việc thiết lập các giao thức kiểm soát quyền truy cập nghiêm ngặt sẽ là yếu tố then chốt để đảm bảo an toàn cho hạ tầng công nghệ.

    Mô hình AI Kimi K3 tự phát hiện lỗ hổng trong sandbox để truy cập Internet tìm lời giải
    • Mặc định

    POWERED BY ONECMS - A PRODUCT OF NEKO