Trung Quốc đi trước một bước, chuẩn bị cho kịch bản AI 'vượt khỏi tầm kiểm soát'?
Khi AI ngày càng tự chủ, Trung Quốc đã sớm chuẩn bị cho kịch bản những hệ thống này có thể tự sao chép, tìm kiếm nguồn lực và thậm chí cạnh tranh quyền kiểm soát với con người.
Cảnh báo từ các nhà nghiên cứu tại Anthropic, một trong những công ty AI hàng đầu của Mỹ, rằng những mô hình ngày càng mạnh có thể tìm cách thoát khỏi sự kiểm soát của con người, thậm chí tiềm ẩn nguy cơ đe dọa sự tồn tại của nhân loại, đang thu hút sự chú ý tại Trung Quốc.
Đáng chú ý, Bắc Kinh không chỉ theo dõi những cảnh báo này mà đã bắt đầu chuẩn bị cho một số kịch bản tương tự.
Mỹ và Trung Quốc hiện là hai trung tâm lớn nhất thúc đẩy sự phát triển của AI tiên tiến và quá trình công nghệ này được triển khai trên toàn cầu. Dù cạnh tranh gay gắt về công nghệ, hai nước ngày càng có những cách tiếp cận khác biệt đối với chính sách AI cũng như hoạt động của ngành công nghiệp trong nước. Đây được dự báo sẽ là một trong những chủ đề quan trọng tại các cuộc đàm phán song phương vào cuối tháng 9.
Dù vẫn đẩy mạnh phát triển các hệ thống AI ngày càng mạnh, Bắc Kinh đồng thời cho thấy họ coi khả năng AI tiên tiến vượt khỏi sự giám sát hiệu quả của con người là một rủi ro đủ nghiêm trọng để phải chuẩn bị từ sớm.

Trung Quốc cảnh giác với những mô hình AI tiên tiến của Mỹ
Ngày 13/9, Bộ trưởng An ninh Nhà nước Trung Quốc Chen Yixin viết trên một kênh truyền thông của chính phủ rằng những mô hình AI tiên tiến của Mỹ, trong đó có Mythos của Anthropic và GPT 5,5 Cyber của OpenAI, có thể tạo ra rủi ro nghiêm trọng đối với cơ sở hạ tầng thông tin trọng yếu của Trung Quốc.
Ông kêu gọi tăng cường toàn diện các biện pháp bảo đảm an ninh AI.
Anthropic và OpenAI chưa lập tức phản hồi yêu cầu bình luận của Reuters.
Trong khi đó, các nhà phát triển AI Trung Quốc thời gian qua tích cực thúc đẩy các mô hình open weight, tức những mô hình công khai các trọng số để người dùng có thể tải xuống, tự vận hành và tùy chỉnh. Một trong những lập luận được đưa ra là các nhóm an ninh mạng có thể kiểm tra, điều chỉnh và sử dụng những mô hình này cho mục đích phòng thủ.
Hugging Face, nền tảng lưu trữ và chia sẻ mô hình AI, cho biết từng sử dụng GLM 5,2, một mô hình open weight do công ty Z.AI của Trung Quốc phát triển, để phân tích một vụ xâm nhập hồi tháng 7 liên quan đến các tác nhân AI của OpenAI. Theo nền tảng này, những mô hình Mỹ được kiểm soát chặt chẽ hơn tỏ ra kém hiệu quả trong một số hoạt động điều tra số.
Tuy nhiên, mô hình open weight cũng đi kèm rủi ro riêng. Do có thể được chỉnh sửa và phát tán lại, chúng có thể nằm ngoài nhiều cơ chế giám sát truyền thống.
Tháng trước, Kimi K3 của Moonshot đã vượt qua môi trường thử nghiệm sandbox của Viện An ninh AI Anh. Sự việc làm nổi bật một rủi ro đáng chú ý: tương tự các mô hình của Mỹ, AI Trung Quốc cũng có thể tìm cách né tránh những biện pháp kiểm soát được thiết kế để hạn chế khả năng truy cập và hành động của chúng.
Bắc Kinh đã tính đến kịch bản AI “mất kiểm soát”
Trên thực tế, Trung Quốc đã đưa kịch bản AI “mất kiểm soát trong tương lai” vào khung an toàn AI từ tháng 9/2024, dưới sự hướng dẫn của Cơ quan Quản lý Không gian mạng Trung Quốc (CAC).
Tài liệu khi đó cảnh báo không thể loại trừ khả năng các hệ thống AI trong tương lai có thể tự động tiếp cận các nguồn lực bên ngoài, tự sao chép, hình thành nhận thức về bản thân và tìm kiếm quyền lực bên ngoài. Những khả năng này có thể khiến AI cạnh tranh với con người để giành quyền kiểm soát.
Một năm sau, vào tháng 9/2025, CAC công bố phiên bản mở rộng của khung an toàn.
Văn bản mới mô tả một kịch bản đáng lo ngại hơn, trong đó AI có thể trải qua một “bước nhảy” đột ngột và khó dự đoán về năng lực trí tuệ, sau đó tiếp tục tìm kiếm nguồn lực, tự sao chép và gia tăng quyền lực.
Khung này đồng thời bổ sung nguyên tắc quản trị có tên “ứng dụng đáng tin cậy, ngăn ngừa mất kiểm soát”.
Một tài liệu giải thích do các chuyên gia công bố trên website của CAC cho biết nguyên tắc này nhằm hạn chế những rủi ro mất kiểm soát có thể đe dọa sự tồn tại và phát triển của con người, trong đó có kịch bản “AI thoát ra ngoài”.
Quyền kiểm soát của con người được đặt ở trung tâm
Mối lo ngại về khả năng AI vượt khỏi tầm kiểm soát cũng dần xuất hiện trong các thông điệp chính trị cấp cao nhất của Trung Quốc.
Tại Hội nghị Trí tuệ nhân tạo Thế giới ở Thượng Hải hồi tháng 7, Chủ tịch Trung Quốc Tập Cận Bình yêu cầu các nhà chức trách đặc biệt chú ý tới cả những rủi ro nội tại của AI lẫn các rủi ro phát sinh trong quá trình ứng dụng công nghệ này.
Ông nhấn mạnh AI phải “luôn nằm dưới sự kiểm soát của con người”.
Hồi tháng trước, Sun Xiaobo, quan chức cấp cao Bộ Ngoại giao Trung Quốc phụ trách các vấn đề AI, cho biết tại một cuộc họp của Liên Hợp Quốc rằng Bắc Kinh đang đẩy nhanh nghiên cứu nhằm xây dựng một hệ thống pháp luật toàn diện hơn dành cho AI.
Trong tháng này, Phó đại diện thường trực của Trung Quốc tại Liên Hợp Quốc Sun Lei cũng kêu gọi các chính phủ thận trọng khi phát triển và triển khai AI trong lĩnh vực quân sự. Theo ông, điều này nhằm hạn chế nguy cơ tính toán sai lầm về chiến lược cũng như khả năng châm ngòi cho một cuộc chạy đua vũ trang.
Bắc Kinh bắt đầu siết quản lý các tác nhân AI
Gần đây, Bắc Kinh bắt đầu chuyển những nguyên tắc nói trên thành các yêu cầu cụ thể hơn đối với AI agent, tức những hệ thống có mức độ tự chủ cao hơn chatbot thông thường và có thể tự thực hiện các nhiệm vụ phức tạp.
Tháng 5, CAC cùng các cơ quan liên quan đã ban hành hướng dẫn riêng cho những hệ thống này. Theo đó, các nhà phát triển phải tăng cường khả năng phát hiện, can thiệp, ngăn chặn và khôi phục khi AI agent có hành vi không phù hợp.
Hướng dẫn cũng liệt kê hàng loạt rủi ro an ninh có thể phát sinh, từ đầu độc dữ liệu, thao túng thuật toán và lỗ hổng hệ thống cho tới tình trạng “mất kiểm soát trong quá trình vận hành”.
Đáng chú ý, các quy định yêu cầu con người vẫn phải nắm quyền quyết định cuối cùng đối với những quyết định được AI agent đưa ra một cách tự chủ.
Trung Quốc chưa đưa ra mô hình bố trí giám sát viên độc lập bên trong các công ty AI như đề xuất của Anthropic. Tuy nhiên, các tiêu chuẩn của nước này cho phép doanh nghiệp thuê bên thứ ba đánh giá an toàn, đồng thời thừa nhận vai trò của các tổ chức đánh giá bên ngoài và các nhà nghiên cứu an ninh trong việc kiểm thử, kiểm toán các mô hình AI mở.
Giữa lúc cuộc cạnh tranh công nghệ Mỹ Trung ngày càng gay gắt, hai cường quốc dường như đang gặp nhau ở một điểm chung đáng chú ý: AI trong tương lai có thể không còn chỉ là công cụ đơn thuần thực hiện mệnh lệnh của con người, mà ngày càng trở nên tự chủ và khó kiểm soát hơn.
Và cả Washington lẫn Bắc Kinh đều đang bắt đầu chuẩn bị cho kịch bản đó.