dogamer06
Senior Member
DeepSeek vừa chính thức mở thử nghiệm công khai (public beta) API của mô hình DeepSeek-V4-Flash, đồng thời xác nhận phiên bản DeepSeek-V4-Pro hoàn chỉnh sẽ ra mắt vào đầu tháng 8.
Không chỉ tiếp tục duy trì lợi thế về chi phí thấp, DeepSeek còn tập trung nâng cấp mạnh khả năng tác tử AI, lĩnh vực đang được xem là "mặt trận" cạnh tranh quyết liệt nhất giữa các mô hình ngôn ngữ lớn. Động thái này diễn ra trong bối cảnh OpenAI vừa hạ giá mạnh nhiều dòng mô hình, cho thấy cuộc đua AI đang chuyển từ cạnh tranh về giá sang cạnh tranh về năng lực thực thi.
...Trong các bài kiểm tra đánh giá tác tử AI, DeepSeek-V4-Flash đạt nhiều kết quả đáng chú ý.
Ở bài kiểm tra Terminal Bench 2.1, mô hình đạt 82,7 điểm; Cybergym đạt 76,7 điểm; Toolathlon Verified đạt 70,3 điểm; trong khi các bài đánh giá về lập trình như DSBench-FullStack và DSBench-Hard lần lượt đạt 68,7 và 59,6 điểm.
Những kết quả này cho thấy khả năng sử dụng công cụ, tự động hóa quy trình và thực hiện các tác vụ lập trình của DeepSeek đã được cải thiện đáng kể so với thế hệ trước.
Trước đó, vào tháng 4, DeepSeek từng công bố hai phiên bản thử nghiệm gồm V4-Pro và V4-Flash.
Trong đó, V4-Pro hướng tới hiệu năng tối đa nhằm cạnh tranh trực tiếp với các mô hình thương mại hàng đầu như GPT hay Claude, còn V4-Flash được thiết kế với quy mô nhỏ hơn để giảm độ trễ và chi phí vận hành.
Theo đánh giá nội bộ của DeepSeek, phiên bản V4-Pro Preview đã nằm trong nhóm dẫn đầu các mô hình nguồn mở ở nhiều bài kiểm tra về tác tử AI và lập trình. Hiệu quả làm việc của mô hình được cho là đã tiệm cận Claude Opus 4.6 ở chế độ thông thường và đạt trình độ gần ngang các mô hình thương mại hàng đầu trong các bài toán toán học, STEM và lập trình phức tạp.
DeepSeek-V4-Flash chính thức ra mắt, tăng tốc cuộc đua tác tử AI với OpenAI
DeepSeek vừa chính thức mở thử nghiệm công khai (public beta) API của mô hình DeepSeek-V4-Flash, đồng thời xác nhận phiên bản DeepSeek-V4-Pro hoàn chỉnh sẽ ra mắt vào đầu tháng 8.



))