dogamer06
Senior Member
Trong bối cảnh Trung Quốc đang nỗ lực vượt ra ngoài việc chỉ sử dụng chip nội địa cho suy luận mô hình, gã khổng lồ giao đồ ăn Meituan đã công bố điều mà họ cho là mô hình trí tuệ nhân tạo lớn nhất của nước này được huấn luyện hoàn toàn trên phần cứng do Trung Quốc tự phát triển.
Hôm thứ Ba, tập đoàn dịch vụ theo yêu cầu có trụ sở tại Bắc Kinh đã mã nguồn mở LongCat-2.0, một mô hình ngôn ngữ lớn (LLM) mới sở hữu 1,6 nghìn tỷ tham số và cửa sổ ngữ cảnh 1 triệu token. Quy mô này tương đương với V4-pro, mô hình chủ lực mới nhất của DeepSeek ra mắt vào tháng 4.
Meituan tuyên bố LongCat-2.0 là mô hình đầu tiên trong ngành có quy mô nghìn tỷ tham số hoàn thành toàn bộ quá trình huấn luyện và suy luận trên một cụm năng lực tính toán nội địa gồm 50.000 card tăng tốc.
Trong khi DeepSeek-V4-pro chỉ dựa vào chip nội địa cho suy luận — quá trình mô hình đã được huấn luyện chạy để trả lời truy vấn của người dùng — LongCat-2.0 sử dụng phần cứng nội địa cho cả suy luận lẫn tiền huấn luyện, theo Meituan.
Tiền huấn luyện là quá trình đòi hỏi năng lực tính toán lớn hơn rất nhiều, trong đó mô hình AI xử lý các tập dữ liệu khổng lồ để học những quy luật và mẫu cơ bản.
Meituan cho biết LongCat-2.0 được xây dựng hoàn toàn trên “các cụm quy mô lớn gồm hàng chục nghìn siêu pod AI ASIC”, qua đó thể hiện khả năng “thực hiện huấn luyện ở quy mô biên giới công nghệ trên các nền tảng phần cứng thay thế”. ASIC, hay mạch tích hợp chuyên dụng theo ứng dụng, là loại chip được tùy biến cho các khối lượng công việc cụ thể, trái ngược với bộ xử lý đa dụng.
Dù Meituan không nêu rõ nhà cung cấp phần cứng, công ty cho biết trong một bài đăng WeChat hôm thứ Ba rằng họ đã sử dụng Thư viện Giao tiếp Tập thể Huawei (Huawei Collective Communication Library, HCCL) để nâng cao độ ổn định của quá trình huấn luyện. HCCL là một hệ thống giao tiếp chip-với-chip tương tự Thư viện Giao tiếp Tập thể Nvidia (Nvidia Collective Communication Library, NCCL).
Meituan và Huawei Technologies chưa phản hồi ngay các yêu cầu bình luận hôm thứ Ba.
Chip AI nội địa của Trung Quốc đã được áp dụng rộng rãi cho suy luận mô hình, trong bối cảnh Bắc Kinh thúc đẩy tự chủ công nghệ. Tuy nhiên, phần cứng nội địa từ lâu bị xem là chưa đủ khả năng cho tiền huấn luyện LLM; phần lớn các mô hình Trung Quốc được huấn luyện bằng phần cứng trong nước trước đây либо có quy mô nhỏ, hoặc chỉ giới hạn ở các tác vụ đa phương thức.
Bước đột phá của Meituan lập tức thu hút sự chú ý từ các quan sát viên trong ngành.
“Điều này đã xóa bỏ mọi lo ngại rằng Atlas-950 SuperPoDs không thể huấn luyện các LLM lớn cho Zhipu AI và DeepSeek,” nhà phân tích công nghệ nổi tiếng TP Huang viết trên nền tảng mạng xã hội X hôm thứ Ba, đề cập đến các sản phẩm cụm tính toán mà Huawei giới thiệu tại Trung Quốc vào năm ngoái và ở nước ngoài vào tháng 3.
“Hiệu năng gần mức dẫn đầu, được huấn luyện trên 50.000 bộ tăng tốc nội địa của Trung Quốc,” Hanchi Sun, nghiên cứu sinh tiến sĩ khoa học máy tính tại Đại học Lehigh, tập trung nghiên cứu LLM, viết trên X. “Lần đầu tiên điều này được thực hiện!”
Theo Meituan, LongCat-2.0 thể hiện năng lực mạnh trong lập trình và các tác vụ tác tử AI.
Meituan cho biết mô hình này vượt qua Gemini 3.1 Pro đời cũ của Google trên một số bài đánh giá, bao gồm Terminal-Bench 2.1 và SWE-Bench Pro. Tuy nhiên, công ty cũng thừa nhận LongCat-2.0 vẫn thua các mô hình dẫn đầu toàn cầu như GPT-5.5 của OpenAI và Claude 4.8 Opus của Anthropic.
Mô hình mới của Meituan hiện vẫn chưa được đánh giá trên các bảng xếp hạng hàng đầu như Artificial Analysis và Arena, hoặc trên những bài kiểm tra tiên tiến như Agents’ Last Exam và CyberGym.
Dù đạt được cột mốc này, Meituan cho biết họ vẫn đối mặt với những trở ngại lớn trong việc thay thế hoàn toàn GPU phương Tây.
“So với hệ sinh thái GPU Nvidia đã trưởng thành, cộng đồng phần mềm hỗ trợ vẫn còn kém phát triển hơn,” công ty cho biết trong báo cáo kỹ thuật đi kèm lần ra mắt.
Meituan cho biết việc tiền huấn luyện mô hình trên một cụm hơn 50.000 chip tạo ra “những thách thức đáng kể ở cấp độ hệ thống do cả quy mô mô hình lẫn quy mô cụm”, đồng thời nói thêm rằng bộ nhớ là “nút thắt chính”.
Meituan cho biết các bộ tăng tốc nội địa của họ có bộ nhớ trên mỗi thiết bị thấp hơn đáng kể so với chip H800 của Nvidia, loại chip bị cấm xuất khẩu sang Trung Quốc theo các quy định của Mỹ.
Để vượt qua những hạn chế này, gã khổng lồ giao đồ ăn cho biết họ đã phải bỏ ra “nỗ lực đáng kể để xây dựng hạ tầng ổn định, an toàn và có khả năng mở rộng”, đồng thời triển khai nhiều biện pháp tối ưu hóa.
Meituan claims China’s biggest AI model trained on local chips
LongCat-2.0 boasts 1.6 trillion parameters and a million-token context window, on par with DeepSeek’s latest flagship model.



