thảo luận Deepseek AI vào hết đây

  • Người tạo chủ đề Người tạo chủ đề Zaunite
  • Ngày bắt đầu Ngày bắt đầu
Một bài phân tích vì sao DeepSeek của Trung Quốc lại đang gây chấn động:

1. Trước tiên, một chút bối cảnh: Hiện nay, việc huấn luyện các mô hình AI hàng đầu CỰC KỲ tốn kém. OpenAI, Anthropic, v.v. chi hơn 100 triệu USD chỉ để tính toán. Họ cần các trung tâm dữ liệu khổng lồ với hàng ngàn GPU trị giá 40.000 USD mỗi chiếc. Giống như cần cả một nhà máy điện để vận hành một nhà máy sản xuất.

2. DeepSeek xuất hiện và nói: "LOL, nếu chúng tôi làm việc này với 5 triệu USD thì sao?" Và họ không chỉ nói - họ thực sự đã LÀM được. Các mô hình của họ sánh ngang hoặc vượt qua GPT-4 và Claude trong nhiều nhiệm vụ. Thế giới AI đang (như các bạn trẻ nói) "sốc toàn tập".

3. Làm thế nào? Họ đã suy nghĩ lại mọi thứ từ đầu. AI truyền thống giống như viết mọi con số với 32 chữ số thập phân. DeepSeek thì nói: "nếu chỉ dùng 8 chữ số thì sao? Vẫn đủ chính xác đấy!" Boom - giảm 75% bộ nhớ cần thiết.

4. Tiếp đó là hệ thống "đa token" của họ. AI thông thường đọc như học sinh lớp một: "Con... mèo... ngồi..." DeepSeek đọc cả cụm từ cùng lúc. Nhanh gấp đôi, chính xác 90%. Khi bạn xử lý hàng tỷ từ, điều này rất QUAN TRỌNG.

5. Nhưng đây mới là phần thông minh nhất: Họ xây dựng một "hệ thống chuyên gia". Thay vì một AI khổng lồ cố gắng biết mọi thứ (giống như bắt một người vừa làm bác sĩ, luật sư, vừa làm kỹ sư), họ có các chuyên gia chuyên biệt chỉ hoạt động khi cần.

6. Các mô hình truyền thống? Tất cả 1,8 nghìn tỷ tham số luôn hoạt động. DeepSeek? Tổng cộng 671 tỷ, nhưng chỉ 37 tỷ hoạt động cùng lúc. Giống như có một đội lớn nhưng chỉ gọi đúng chuyên gia cần thiết cho từng nhiệm vụ.

7. Kết quả rất đáng kinh ngạc:

Chi phí huấn luyện: 100 triệu USD → 5 triệu USD

GPU cần thiết: 100.000 → 2.000

Chi phí API: giảm 95%

Có thể chạy trên GPU chơi game thay vì phần cứng trung tâm dữ liệu

8. "Nhưng đợi đã," bạn có thể nói, "chắc phải có điều gì đó không ổn!" Điều bất ngờ là - tất cả đều mã nguồn mở. Bất kỳ ai cũng có thể kiểm tra. Mã nguồn được công khai. Các bài báo kỹ thuật giải thích tất cả. Không phải phép thuật, chỉ là kỹ thuật cực kỳ thông minh.

9. Tại sao điều này quan trọng? Vì nó phá vỡ mô hình "chỉ các công ty công nghệ lớn mới chơi được AI." Bạn không còn cần một trung tâm dữ liệu trị giá hàng tỷ USD nữa. Chỉ cần một vài GPU tốt là đủ.

10. Với Nvidia, điều này thật đáng sợ. Toàn bộ mô hình kinh doanh của họ dựa vào việc bán GPU siêu đắt với biên lợi nhuận 90%. Nếu mọi người đột nhiên có thể làm AI với GPU chơi game thông thường... bạn hiểu vấn đề rồi đấy.

11. Và đây là điểm thú vị: DeepSeek đã làm điều này với đội ngũ dưới 200 người. Trong khi đó, Meta có những đội ngũ với chi phí trả lương thôi cũng vượt ngân sách huấn luyện toàn bộ của DeepSeek... mà các mô hình của họ vẫn không tốt bằng.

12. Đây là câu chuyện kinh điển về sự phá vỡ: Các công ty lâu đời tối ưu hóa quy trình hiện có, còn các công ty phá vỡ suy nghĩ lại cách tiếp cận từ gốc. DeepSeek hỏi: "Nếu chúng ta làm thông minh hơn thay vì ném thêm phần cứng vào thì sao?"

13. Ý nghĩa rất lớn:

Phát triển AI trở nên dễ tiếp cận hơn

Cạnh tranh tăng lên đáng kể

"Hào" bảo vệ của các công ty lớn trông giống như những vũng nước nhỏ

Yêu cầu phần cứng (và chi phí) giảm mạnh

14. Tất nhiên, những gã khổng lồ như OpenAI và Anthropic sẽ không đứng yên. Họ có lẽ đã bắt đầu áp dụng những đổi mới này. Nhưng "thần đèn" hiệu quả đã ra khỏi chai - không còn đường quay lại cách tiếp cận "ném thêm GPU" nữa.

15. Suy nghĩ cuối cùng: Đây có vẻ là một trong những khoảnh khắc mà chúng ta sẽ nhìn lại như một điểm ngoặt. Giống như khi máy tính cá nhân làm máy chủ chính trở nên kém quan trọng, hoặc khi điện toán đám mây thay đổi mọi thứ.

AI sắp trở nên dễ tiếp cận hơn nhiều và rẻ hơn rất nhiều. Câu hỏi không phải là liệu điều này có làm xáo trộn các bên hiện tại hay không, mà là nhanh đến mức nào.

Dùng thử đi rồi hẵng chửi những anh rồ mỹ anti tàu. Không tự nhiên mà
Hợp đồng tương lai Nasdaq 100 giảm ngay 300 điểm, tất cả cổ phiếu các hãng công nghệ mỹ chao đảo khi Deepseek ra mắt và chiếm vị trí số 1 trên app store .
Chi phí đầu tư rẻ hơn nhiều lần, cho dùng free , được đánh giá thông minh hơn nhiều Chatgpt.
Suy nghĩ từ gốc, xịn đó. Đột phá (tối ưu) của đột phá (AI xuất hiện).
 
Cổ Nvidia cắm đầu luôn, đm ko hổ danh pháp sư Trung Hoa
XE8gxo0.png
 
Tôi thấy bọn Tàu trong lịch sử có nhiều ý tưởng với phát minh hay, nhưng để tận dụng ý tưởng đấy triệt để và nâng nó lên tầm cao mới thì thường là nhờ bọn Âu Mỹ, Nhật , cho nên hy vọng các cty Mỹ sẽ nhanh tiếp thu mấy ý tưởng này và nâng tầm nó lên tầm cao mới

via theNEXTvoz for iPhone
 
Cứ cấm hết công nghệ chip, bán dẫn và phần mềm quan trọng với TQ là xong.
Đừng nghĩ vấn đề này là tiêu cục quá, người dùng cũng được lợi mà.
Thằng đám bị chửi là bộ sâu chính quyền Biden ăn hại đó. Cái chuyện cấm chip Ai cho tàu là chảng hiệu quả gì cả, rồi lại còn kìm hãm Ai của nvidia. 😒
 
sao ngáo ngơ thế ? Đám Hàn, Đài, Trung có ngàn người cỡ như Vũ Hà Văn này. Rồi mấy giải toán đó có giúp ích dc cái gì ko ? Đc Vin thuê về nước lập mấy cty rác rưởi cức đái như Vin Bigdata rồi Vin Brain, sắp tới Vin Robotic, Vin Motion, toàn bánh vẽ, chả có tác dụng gì, thành lập dc vài 3 năm xong vội vàng bán đi mà chả để lại đc thành tựu đéo nào. Người ngoài cuộc ai cũng biết là các Cty rác rưởi bán đi để rửa tiền, Mày đừng lôi hạng vô dụng như Vũ Hà Văn vào nghe khắm lắm.

+1 tỏi, thông tin rất hữu ích đó bác.
Được Fulkerson Prize
Lại còn cùng Terence Tao giải toán

Tao-V. 05: If the probability in question is large, then{a1, . . . , an} can be characterized.If P ≥ n−A, then (most of) ai belong to an AP of lenght nB .The relation between A and B is of importance. A near optimalbound was obtained by Tao-V. (07), that lead to the establishmentof the Circular Law Conjecture concerning the eigenvalues of Mn(Budapest 08, Bulletin AMS 09).


Qua mồm 1 thanh niên ất ơ nào đấy thì thành hạng vô dụng :sexy_girl:
 
Thằng này học MIT xong 1 năm sau bỏ học vì chê MIT ko đủ tầm dạy nó và đi khởi nghiệp lun. Bọn Tàu trí óc và chỉ số IQ đỉnh vl.
VN cũng có vài chục đứa du học bên MIT, Standford, Yale, mà toàn đám ngu đần dốt nát, học xong ra trường, chả đứa nào làm dc trò trống khỉ gì.
Obz nó buôn đất thì nó học xong về đẩy giá đất là đủ chơi múi mít hoa hậu rồi.
 
Undercut đối thủ một nửa giá may ra còn víu vào mác xuất xứ Mỹ. Chứ 1/10 ai chơi :pudency:
 
Sửa lần cuối:
Tôi thấy bọn Tàu trong lịch sử có nhiều ý tưởng với phát minh hay, nhưng để tận dụng ý tưởng đấy triệt để và nâng nó lên tầm cao mới thì thường là nhờ bọn Âu Mỹ, Nhật , cho nên hy vọng các cty Mỹ sẽ nhanh tiếp thu mấy ý tưởng này và nâng tầm nó lên tầm cao mới

via theNEXTvoz for iPhone

Con DeepSeek này chất lượng viết rất tệ. Thua con Flash Thinking của Gemini. Giờ chỉ còn DeepSeek và Gemini là cạnh tranh lẫn nhau thôi.
 

Thống kê chủ đề

Ngày tạo
Zaunite,
Người trả lời cuối
Jaeho Kouki,
Trả lời
2.993
Lượt xem
519.693
Quay lại
Lên đầu trang