DeepSeek âm thầm ra phiên bản AI mới

  • Người tạo chủ đề Người tạo chủ đề ooopsvn
  • Ngày bắt đầu Ngày bắt đầu

ooopsvn

Senior Member
Công ty khởi nghiệp trí tuệ nhân tạo DeepSeek vừa ra mắt một mô hình AI có sức mạnh đáng kinh ngạc.

Mô hình này có 685 tỷ tham số, được phát hành dưới giấy phép mã nguồn mở. Các kết quả thử nghiệm ban đầu cho thấy hiệu năng không thua kém những hệ thống độc quyền từ OpenAI hay Anthropic, đồng thời mở ra hướng tiếp cận mới trong việc phát triển và phân phối các mô hình AI tiên tiến.

Hiệu năng và chi phí


Ngay sau khi xuất hiện trên nền tảng Hugging Face, DeepSeek V3.1 đạt 71,6% trong bài kiểm tra lập trình Aider. Về mặt kỹ thuật, mô hình có khả năng xử lý ngữ cảnh lên tới 128.000 token (tương đương một cuốn sách khoảng 400 trang). Cấu trúc được giới thiệu là dạng “lai”, tích hợp các chức năng trò chuyện, suy luận và lập trình.

Nhà nghiên cứu AI Andrew Christianson cho biết trên mạng xã hội X: “DeepSeek V3.1 đạt 71,6% trên Aider, cao hơn Claude Opus 4 khoảng 1% trong khi chi phí thấp hơn đáng kể”.

Theo tính toán, chi phí trung bình để hoàn thành một tác vụ lập trình bằng V3.1 vào khoảng 1,01 USD, trong khi các hệ thống tương đương có thể tốn gần 70 USD.

Một số nhà phát triển cộng đồng cũng ghi nhận sự xuất hiện của bốn “token đặc biệt” trong kiến trúc, cho phép mô hình tích hợp tìm kiếm web theo thời gian thực và xử lý các quy trình suy luận phức tạp.

Sự chênh lệch này đồng nghĩa với việc tiết kiệm hàng triệu đô la cho các doanh nghiệp xử lý hàng nghìn tương tác AI mỗi ngày.

Lợi thế thay đổi cuộc chơi

Thời điểm ra mắt V3.1 diễn ra chỉ vài tuần sau khi OpenAI và Anthropic công bố các mô hình mới. Với việc lựa chọn hướng tiếp cận mã nguồn mở, DeepSeek đi theo chiến lược khác biệt so với nhiều công ty Mỹ vốn thương mại hóa mô hình AI thông qua API có phí.

Một số ý kiến cho rằng việc cung cấp rộng rãi các khả năng tiên tiến có thể tạo điều kiện cho các tổ chức và doanh nghiệp triển khai nhanh hơn, đồng thời đặt ra thách thức cho những mô hình kinh doanh dựa trên độc quyền công nghệ.

Sự xuất hiện của DeepSeek V3.1 cho thấy AI tiên tiến không chỉ thuộc về các tập đoàn lớn mà cả những nhóm nghiên cứu nhỏ hơn cũng có thể tham gia.

Cuộc cạnh tranh trong lĩnh vực này không còn giới hạn ở việc xây dựng hệ thống mạnh nhất, mà còn xoay quanh khả năng làm cho công nghệ trở nên dễ tiếp cận, với chi phí hợp lý.

Trong bối cảnh đó, câu hỏi đặt ra cho các công ty công nghệ là làm thế nào để duy trì giá trị thương mại khi xuất hiện ngày càng nhiều mô hình mã nguồn mở có hiệu năng và chi phí cạnh tranh.

release gap giữa Deepseek và các top AI models của mẽo giờ chỉ còn tính bằng tuần
 
Giờ còn ai xài deepseek không nhỉ
còn nhiều. bạn bị thiên kiến kẻ sống sót che mờ thông tin rồi. thằng lên báo nhiều không tương đương 1 mình nó ăn hết thị phần.
soi thử openrouter statistic nhé: https://openrouter.ai/rankings
ngoài ra thì statistic từ nội địa tàu khựa rất hiếm hoặc không phổ biến rộng rãi. nhưng tóm lại các model AI của mẽo gần như không được sử dụng hoặc bị cấm ở tàu, vậy nên thị trường 1 tỷ dân này các AI tàu húp chọn.
 
Bong bóng Deepshit sắp nổ rồi

Deepseek nó làm b2b chứ đâu làm b2c mà đưa bài này. Mấy thằng b2c còn đang lao vào cuộc đốt tiền thì dại gì mà lao vào
 
Giờ còn ai xài deepseek không nhỉ
deepseek này trả lời mấy câu về bệnh học, lâm sàng hỗ trợ bác sĩ ngon phết đấy. những ca khó, m hay hỏi vào api của các con AI thông dụng nhất như gpt5-high, o3, gemini 2.5pro, grok 3/4, claude opus/sonnet 4.1, deepseek r1 thì cho ra những ý kiến rất đáng cân nhắc.
Thường claude là kém nhất (trả lời chung chung, hời hợt, huề vốn)
grok, gpt, gemini thay nhau hạng nhất tuỳ ca. grok thích nói dài dòng
deepseek hay cho ra những ý tưởng khác biệt hẳn với những con còn lại, mà mấy con kia hay bị bỏ qua
 
Hỏi con này về sử Tàu nó còn đếch biết. Đúng là introboy

IMG_0162.png
 
Bảo nó viết code thì thằng ngu đầu tiên là gemini thứ 2 là ChatGPT, thứ 3 grok cuối cùng là deepseek. Và tuyệt nhiên ngoại trừ thằng deepseek ra thì mấy thằng kia code cực ngu, riêng google chỉ đề xuất qua loa. Còn deepseek nó think xong tổ hợp mấy thuật toán xong nó tìm thư viện, cuối cùng nó sẽ viết, tất nhiên đa số là simple, và cần đọc các thư viện và đi tìm cách giải quyết. Mấy cái kia thì tạo code đơn giản như CRUD bằng web hoặc bằng app thì như nhau, nhưng để làm code chuyên sâu thì deepseek đưa ra ok nhất, xong tự tìm hiểu thêm và code, còn mấy thằng kia thì chịu.
 
chatgpt còn đang lỗ chổng vó, năm 2024 openai lỗ 5 tỏi usd, vậy biết khi nào mới bù lỗ cho 1 triệu card, còn 50k card đúng là hạt cát thì so sánh làm éo gì
50k card ăn được ai mà đòi B2B? Alibaba ra mô hình Qwen giờ còn ngon hơn cái con Deepshit vớ vẩn này nữa, Huawei còn phải đi ăn cắp từ con Qwen này, nó có thèm quan tâm Deepshit đâu.

AI là tương lai nên hút rất nhiều tập đoàn sẵn sàng đầu tư, Apple chả thèm thuồng con ChatGPT, nó điên lên dám mua luôn đó chứ.
 
Bảo nó viết code thì thằng ngu đầu tiên là gemini thứ 2 là ChatGPT, thứ 3 grok cuối cùng là deepseek. Và tuyệt nhiên ngoại trừ thằng deepseek ra thì mấy thằng kia code cực ngu, riêng google chỉ đề xuất qua loa. Còn deepseek nó think xong tổ hợp mấy thuật toán xong nó tìm thư viện, cuối cùng nó sẽ viết, tất nhiên đa số là simple, và cần đọc các thư viện và đi tìm cách giải quyết. Mấy cái kia thì tạo code đơn giản như CRUD bằng web hoặc bằng app thì như nhau, nhưng để làm code chuyên sâu thì deepseek đưa ra ok nhất, xong tự tìm hiểu thêm và code, còn mấy thằng kia thì chịu.
công nhận
dạo này thấy thằng chatgpt code ngu vkl, sửa mấy lần cũng không xong
 
Bảo nó viết code thì thằng ngu đầu tiên là gemini thứ 2 là ChatGPT, thứ 3 grok cuối cùng là deepseek. Và tuyệt nhiên ngoại trừ thằng deepseek ra thì mấy thằng kia code cực ngu, riêng google chỉ đề xuất qua loa. Còn deepseek nó think xong tổ hợp mấy thuật toán xong nó tìm thư viện, cuối cùng nó sẽ viết, tất nhiên đa số là simple, và cần đọc các thư viện và đi tìm cách giải quyết. Mấy cái kia thì tạo code đơn giản như CRUD bằng web hoặc bằng app thì như nhau, nhưng để làm code chuyên sâu thì deepseek đưa ra ok nhất, xong tự tìm hiểu thêm và code, còn mấy thằng kia thì chịu.
Vì đơn giản là mấy con kia nó chưa bật web research thôi chứ có mie gì đâu :go:
 
50k card ăn được ai mà đòi B2B? Alibaba ra mô hình Qwen giờ còn ngon hơn cái con Deepshit vớ vẩn này nữa, Huawei còn phải đi ăn cắp từ con Qwen này, nó có thèm quan tâm Deepshit đâu.

AI là tương lai nên hút rất nhiều tập đoàn sẵn sàng đầu tư, Apple chả thèm thuồng con ChatGPT, nó điên lên dám mua luôn đó chứ.
Biết B2B deepseek đang làm gì ko mà nhắc đến vụ card.
 
Giờ còn ai xài deepseek không nhỉ
Vẫn xài đầy mà, mày đừng hỏi những câu ngu si nữa
còn nhiều. bạn bị thiên kiến kẻ sống sót che mờ thông tin rồi. thằng lên báo nhiều không tương đương 1 mình nó ăn hết thị phần.
soi thử openrouter statistic nhé: https://openrouter.ai/rankings
ngoài ra thì statistic từ nội địa tàu khựa rất hiếm hoặc không phổ biến rộng rãi. nhưng tóm lại các model AI của mẽo gần như không được sử dụng hoặc bị cấm ở tàu, vậy nên thị trường 1 tỷ dân này các AI tàu húp chọn.
Chính OpenAI cấm IP từ China từ trước lun mà nên người dùng TQ cũng ko dùng dc OpenAI
 

Thống kê chủ đề

Ngày tạo
ooopsvn,
Người trả lời cuối
Minh2255,
Trả lời
104
Lượt xem
9.833
Quay lại
Lên đầu trang