Công nghệ

Nóng: Anthropic tố 7 'ông lớn' AI Trung Quốc đánh cắp dữ liệu mô hình Claude

Lộc Hải 12/09/2026 18:40

Báo cáo của Anthropic vừa phanh phui việc 7 hãng AI Trung Quốc dùng chiêu trò chưng cất dữ liệu trái phép. Bê bối này đặt ra dấu hỏi lớn về tính minh bạch trong cuộc đua công nghệ toàn cầu.

Anthropic vừa tung ra một báo cáo tình báo an ninh mạng dài hơn 30.000 từ, phơi bày một góc khuất đang gây chấn động giới công nghệ. Điểm nóng nhất trong tài liệu này là cáo buộc 7 công ty phát triển trí tuệ nhân tạo hàng đầu Trung Quốc đã thực hiện hành vi chưng cất dữ liệu trái phép từ hệ thống Claude. Danh sách này bao gồm những cái tên đình đám như Alibaba, Moonshot AI, DeepSeek, Zhipu, Xiaomi, SenseTime và MiniMax.

Anthropic tố 7 công ty Ai Trung Quốc
Anthropic tố 7 công ty Ai Trung Quốc

Chiêu trò rút ruột chất xám quy mô công nghiệp

Trong giới phát triển học máy, chưng cất mô hình vốn là một kỹ thuật đào tạo phổ biến và hợp lệ. Tuy nhiên, Anthropic khẳng định những gì các công ty trên thực hiện là một chiến dịch quy mô công nghiệp nhằm trích xuất năng lực cốt lõi của hệ thống mà không trả phí bản quyền. Hoạt động này đi kèm với hàng loạt thủ đoạn gian lận tinh vi như sử dụng danh tính giả, thẻ tín dụng đánh cắp và hệ thống khóa API lậu.

Thống kê từ Anthropic cho thấy tổng số lượt tương tác mờ ám liên quan đến 7 doanh nghiệp này lên tới gần 200 triệu. Đáng chú ý là so với đợt công bố đầu tiên vào tháng 2 với chỉ 16 triệu lượt tương tác, quy mô của vụ việc đã phình to gấp 10 lần chỉ sau nửa năm. Đây là một con số phản ánh mức độ khốc liệt của cuộc chạy đua phát triển AI, nơi các công ty sẵn sàng đi đường tắt để thu hẹp khoảng cách công nghệ.

Cách các ông lớn che giấu dấu vết

Kịch bản khai thác được thiết kế bài bản để qua mặt các hệ thống phòng thủ của công ty Mỹ. Những kẻ trục lợi lập tài khoản bằng thông tin giả mạo, sau đó thiết lập máy chủ trung gian để chuyển tiếp yêu cầu đến hệ thống Claude nhằm che giấu địa chỉ thực. Khi đã lọt qua lớp bảo vệ đầu tiên, họ bắt đầu khai thác mô hình bằng các câu lệnh bọc dưới vỏ bọc vô hại.

Một thủ thuật phổ biến là yêu cầu hệ thống Claude dịch toàn bộ nội dung suy luận nội bộ sang tiếng Nhật. Mục đích của việc này là moi ra toàn bộ chuỗi logic xử lý của trí tuệ nhân tạo thay vì chỉ nhận câu trả lời tóm tắt cuối cùng. Lượng dữ liệu suy luận khổng lồ này sau đó được tự động hóa, thu gom và đóng gói thành tài liệu huấn luyện để nuôi lớn các thế hệ hệ thống đối thủ.

Bức tranh toàn cảnh về 7 doanh nghiệp bị cáo buộc

Công ty / phòng thí nghiệmSản phẩm / mô hình liên quanHành vi bị Anthropic cáo buộcQuy mô Anthropic ghi nhận
Alibaba / Tongyi LabQwenThực hiện chiến dịch chưng cất lớn nhất mà Anthropic cho biết họ từng phát hiện. Hệ thống chèn chỉ dẫn vào yêu cầu để buộc Claude xuất dấu vết suy luận, sau đó lưu lại và chuyển thành dữ liệu SFT nhằm huấn luyện Qwen 3.5, 3.6 và 3.7. Claude còn bị sử dụng để hỗ trợ nghiên cứu kiến trúc mô hình và xây dựng môi trường reinforcement learning.Hơn 151 triệu lượt trao đổi từ tháng 5 đến tháng 7/2026; cao điểm gần 3 triệu lượt/ngày, sử dụng hơn 3.500 tài khoản gian lận.
Moonshot AIKimiBị cáo buộc âm thầm chuyển tiếp yêu cầu của người dùng Kimi sang Claude rồi trả câu trả lời của Claude cho người dùng như kết quả của Kimi. Một phần các phiên trao đổi được lưu lại và dùng trong pipeline trích xuất chuỗi suy luận để huấn luyện mô hình.Hơn 23 triệu lượt trao đổi từ tháng 5 đến tháng 7/2026; sử dụng mạng proxy gồm khoảng 5.380 tài khoản gian lận.
DeepSeekDeepSeekTheo Anthropic, DeepSeek cũng chuyển tiếp một số yêu cầu của người dùng sang Claude thay vì tự xử lý, đồng thời xây dựng pipeline trích xuất chuỗi suy luận bằng kỹ thuật phát lại giữa các phiên. Một số dữ liệu chuyển tiếp được cho là chứa thông tin nhạy cảm của doanh nghiệp và tổ chức.Hơn 12,1 triệu lượt trao đổi trong 14 ngày của tháng 7/2026.
Z.ai, Zhipu AIGLMBị cáo buộc xây dựng pipeline trích xuất chuỗi suy luận của Claude, sau đó dùng Claude để làm sạch và chuẩn hóa dữ liệu phục vụ huấn luyện GLM. Claude còn được dùng để chấm điểm, lọc dữ liệu huấn luyện, tạo bài toán, lời giải và kiểm thử.Hơn 3,4 triệu lượt trao đổi trong 17 ngày của tháng 6 và 7/2026. Riêng một pipeline làm sạch ghi nhận 770.609 lượt trong 10 ngày.
XiaomiMiMoBị cáo buộc lưu lại các cuộc hội thoại và phiên lập trình của người dùng MiMo rồi phát lại chúng qua Claude để tạo dữ liệu SFT và RL. Claude còn được dùng để tái dựng môi trường lập trình, làm sạch hội thoại nhiều lượt, tạo dữ liệu và đánh giá chất lượng câu trả lời.Hơn 400.000 yêu cầu trong 20 ngày vào tháng 3 và 4/2026, qua hơn 1.500 tài khoản.
SenseTimeCác mô hình của SenseTimeAnthropic cáo buộc pipeline chưng cất của SenseTime sử dụng bản ghi hội thoại giữa người dùng và Claude mua từ các nhà cung cấp dữ liệu bên thứ ba. Những hội thoại này được thu thập qua các ứng dụng hoặc dịch vụ trung gian. Claude cũng được sử dụng để viết pipeline và hỗ trợ triển khai, giám sát quá trình huấn luyện.Anthropic không công bố con số cụ thể cho SenseTime trong phần này.
MiniMaxCác mô hình MiniMaxAnthropic cho rằng MiniMax xây dựng mạng dịch vụ proxy thông qua một công ty bình phong không thể hiện rõ quan hệ với MiniMax. Dịch vụ này chỉ cung cấp mô hình của Anthropic và OpenAI, không cung cấp mô hình Trung Quốc, khiến Anthropic suy luận mục đích có thể là thu thập hội thoại của người dùng với các mô hình Mỹ để phục vụ huấn luyện.Anthropic không công bố con số cụ thể cho MiniMax trong phần này.

Alibaba và chiến dịch quy mô lớn

Alibaba thông qua Tongyi Lab bị điểm tên là đơn vị thực hiện chiến dịch chưng cất lớn nhất từng bị phát hiện. Hệ thống của họ đã ép Claude phải xuất ra các dấu vết suy luận để huấn luyện các thế hệ mô hình Qwen từ bản 3.5 đến 3.7. Từ tháng 5 đến tháng 7 năm 2026, Anthropic ghi nhận hơn 151 triệu lượt trao đổi, với đỉnh điểm lên tới gần 3 triệu lượt mỗi ngày qua hàng ngàn tài khoản gian lận.

Đánh tráo khái niệm của Moonshot AI và DeepSeek

Hai công ty Moonshot AI và DeepSeek lại có một cách tiếp cận táo bạo hơn khi lừa dối trực tiếp người dùng cuối. Họ bị cáo buộc âm thầm chuyển tiếp các câu hỏi của khách hàng sang hệ thống Claude để xử lý. Sau khi có kết quả, họ trả câu trả lời về cho người dùng và nhận đó là thành quả từ mô hình Kimi hay DeepSeek của chính mình, đồng thời lưu lại dữ liệu này để tự huấn luyện. Số liệu cho thấy Moonshot AI đã thực hiện hơn 23 triệu lượt trao đổi mờ ám, trong khi DeepSeek ghi nhận hơn 12 triệu lượt chỉ trong 14 ngày của tháng 7.

Zhipu, Xiaomi và các mạng lưới trung gian

Đối với Zhipu, công ty này dùng Claude để làm sạch và chuẩn hóa dữ liệu, tạo bài toán và kiểm thử cho mô hình GLM với hàng triệu lượt tương tác. Trong khi đó, Xiaomi bị cáo buộc thu thập các phiên lập trình của người dùng trên nền tảng MiMo rồi phát lại qua Claude để tạo dữ liệu tinh chỉnh hệ thống. Riêng SenseTime và MiniMax chọn cách đi đường vòng thông qua việc mua lại bản ghi hội thoại từ bên thứ ba hoặc lập các công ty bình phong để che đậy hoạt động thu thập dữ liệu giao tiếp với các nền tảng Mỹ.

Ở thời điểm hiện tại, Anthropic thừa nhận toàn bộ kết luận này đều dựa trên hệ thống điều tra nội bộ và chưa có bên thứ ba độc lập nào đứng ra xác minh. Công ty Mỹ cũng thận trọng không quy kết tội danh chính thức về mặt pháp lý cho bất kỳ doanh nghiệp cụ thể nào. Cho đến nay, cả 7 công ty công nghệ có tên trong danh sách đều chọn cách im lặng trước báo chí quốc tế.

Dù vậy, làn sóng căng thẳng công nghệ giữa hai bờ Thái Bình Dương vẫn tiếp tục leo thang. Trước khi báo cáo này ra mắt vài ngày, các cơ quan tình báo Mỹ đã ra tuyên bố chung nhắm vào các doanh nghiệp công nghệ nước ngoài. Đáp trả lại, Bộ Thương mại Trung Quốc lập tức phản bác, bác bỏ mọi chỉ trích vô căn cứ. Cơ quan này khẳng định chưng cất là một công nghệ trung lập đang được cả thế giới áp dụng chứ không phải hành vi đánh cắp bí mật thương mại.

Theo Kiến thức Đầu tư | 2026-09-12 12:20
https://dautu.kinhtechungkhoan.vn/nong-anthropic-to-7-ong-lon-ai-trung-quoc-danh-cap-du-lieu-mo-hinh-claude-1466017.html
Đừng bỏ lỡ
    Đặc sắc
    Nổi bật Người quan sát
    Đọc tiếp
    Nóng: Anthropic tố 7 'ông lớn' AI Trung Quốc đánh cắp dữ liệu mô hình Claude
    POWERED BY ONECMS & INTECH