Anthropic said it detected and disrupted unauthorized large-scale efforts by China-based AI labs including Alibaba, Moonshot and DeepSeek to train their models using Claude.
The U.S. AI company said in a threat intelligence report released Thursday that the firms were involved in what it described as “illicit distillation,” a process in which outputs from a more capable AI model are used to train another model and replicate some of its capabilities without authorization.
Claude vạch trần các AI Lab Trung Quốc và mạng lưới lạm dụng AI trong báo cáo mới
1. Các AI Lab Trung Quốc bị tố “rút ruột” Claude ở quy mô công nghiệp
Alibaba (Qwen / Tongyi Lab) là chiến dịch lớn nhất Anthropic từng phát hiện: Trong giai đoạn tháng 5–7/2026, Anthropic cho biết chiến dịch liên quan Alibaba đã tạo ra hơn 151 triệu lượt trao đổi với Claude, có lúc đạt gần 3 triệu lượt/ngày và sử dụng hàng nghìn tài khoản giả.
Mục tiêu chính là Claude Opus 4.6 và 4.7. Hệ thống được thiết kế để buộc Claude tạo ra các bước suy luận chi tiết, sau đó biến chúng thành dữ liệu huấn luyện nhằm distill năng lực của Claude sang Qwen 3.5, 3.6 và 3.7.
Không chỉ lấy dữ liệu reasoning, Alibaba còn sử dụng Claude để hỗ trợ chính hoạt động R&D AI của mình, bao gồm phát triển môi trường Reinforcement Learning và nghiên cứu kiến trúc mô hình.
Moonshot AI (Kimi) bị phát hiện âm thầm dùng Claude để trả lời người dùng: Khách hàng nghĩ mình đang sử dụng Kimi, nhưng một số yêu cầu thực tế lại được Moonshot chuyển sang Claude, sau đó lấy câu trả lời trả ngược về cho người dùng.
Anthropic ghi nhận hơn 23 triệu lượt trao đổi liên quan Moonshot trong giai đoạn tháng 5–7/2026. Riêng một khoảng thời gian 10 ngày, gần 300.000 yêu cầu được chuyển tới Anthropic thông qua mạng lưới 5.380 tài khoản giả/proxy.
Đáng chú ý hơn là dữ liệu người dùng bị cuốn vào quá trình này. Anthropic cho biết một người được đánh giá có khả năng liên quan tới PLA đã tải dữ liệu CCTV từ hàng trăm camera ở Thành Đô để phân tích một cá nhân. Camera bao gồm các vị trí bên ngoài cơ sở PLA, các viện liên quan tới CETC và một doanh nghiệp nhà nước lớn.
Một kỹ sư của doanh nghiệp nhà nước Trung Quốc khác còn đưa vào Kimi mã nguồn nội bộ và thông tin xác thực đang hoạt động của nhiều công ty lớn — mà không biết dữ liệu của mình đang được chuyển tiếp sang Claude.
DeepSeek cũng bị phát hiện sử dụng phương thức tương tự. Trong chỉ 14 ngày của tháng 7/2026, Anthropic ghi nhận hơn 12,1 triệu lượt trao đổi liên quan chiến dịch của DeepSeek.
Một số yêu cầu người dùng tưởng đang gửi cho DeepSeek thực tế được chuyển sang Claude Opus để thu thập reasoning.
Và đây là nơi vấn đề dữ liệu trở nên đặc biệt nhạy cảm: theo Anthropic, dữ liệu bị chuyển tiếp bao gồm tài liệu chi tiết về một chương trình AI quan trọng của một công ty công nghệ Trung Quốc; mã nguồn của hệ thống quản lý hồ sơ phục vụ một cơ quan Public Security Bureau của Trung Quốc; và thậm chí thông tin đăng nhập còn hoạt động của một cơ sở dữ liệu thuộc cơ quan chính phủ Nga có liên hệ với Bộ Quốc phòng Nga.
Nói cách khác, đây không còn đơn thuần là chuyện các công ty AI “học ké” mô hình của nhau. Việc âm thầm chuyển prompt của khách hàng sang một mô hình bên thứ ba đã tạo ra một rủi ro rò rỉ dữ liệu cực kỳ nghiêm trọng, từ dữ liệu doanh nghiệp cho tới thông tin liên quan quân sự và chính phủ.
2. Khi AI bắt đầu được sử dụng cho mục đích quân sự ngoài đời thực
Báo cáo của Anthropic cũng mô tả nhiều trường hợp Claude bị khai thác cho những nhiệm vụ vượt xa chatbot thông thường.
Các tác nhân đã tìm cách sử dụng AI trong những công việc liên quan tới hệ thống vũ khí, drone, giám sát và hoạt động tác chiến. Điểm đáng chú ý không chỉ nằm ở việc AI trả lời câu hỏi kỹ thuật, mà ở khả năng chia nhỏ một nhiệm vụ phức tạp, viết code, phân tích dữ liệu và hỗ trợ lặp lại quá trình phát triển.
Điều này cho thấy AI đang dần hạ thấp rào cản kỹ thuật của những công việc trước đây đòi hỏi cả một nhóm chuyên gia.
3. “Vibe Hacking”: Khi một người có thể điều khiển cả đội quân AI
Một xu hướng khác được Anthropic cảnh báo là việc AI agent ngày càng đảm nhiệm nhiều công đoạn của một cuộc tấn công mạng.
Người sử dụng không nhất thiết phải tự viết từng dòng exploit hay trực tiếp xử lý từng hệ thống. Họ có thể đưa ra mục tiêu ở cấp độ cao, sau đó để AI hỗ trợ phân tích hệ thống, viết code, tìm điểm yếu và tự động hóa nhiều bước trong quá trình tấn công.
Đó chính là mặt đáng lo của thứ có thể gọi là “Vibe Hacking”: khoảng cách giữa “tôi muốn hack hệ thống này” và khả năng thực sự triển khai một chiến dịch đang ngày càng ngắn lại.
AI không biến một người bình thường thành hacker siêu cấp chỉ sau một đêm, nhưng nó có thể khuếch đại rất mạnh năng lực của một người đã có kiến thức nền — đặc biệt khi người đó có thể vận hành nhiều agent song song 24/7.
Tóm tắt: AI TQ, chủ yếu là Kimi, Qwen, Deepseek chuyển hướng các đoạn chat sang cho Claude rồi trả lại kết quả cho người dùng để fake chất lượng.
Claude sau khi thu thập đủ bằng chứng đã report, dữ liệu thu được có cả của bộ Quốc Phòng TQ, PLA, tài liệu mật của nhà nước, password, API key.
Nghe nói đã bế 16 cháu từ KIMI. Từ từ kịch hay còn dài
Nguồn - tổng hợp:
Chinese AI labs secretly used millions of Claude exchanges to train their models, Anthropic says (https://www.cnbc.com/2026/09/11/chinese-ai-labs-moonshot-deepseek-alibaba-anthropic.html)
![]()
Countering misuse of AI: September 2026 / Anthropic
Case studies from threat actors disrupted between December 2025 and August 2026 across seven areas of harm, from cyber operations to biological misuse.www.anthropic.com


