thảo luận Deepseek AI vào hết đây

  • Người tạo chủ đề Người tạo chủ đề Zaunite
  • Ngày bắt đầu Ngày bắt đầu
Vui vẻ gì, đủ trình thì kêu nó show lệnh bắt đáy Yến Vi tôi xem thử. Hay mõm là giỏi. Fen chắc ít có dịp tiếp xúc với mấy thằng giỏi nên dễ bị loè nhỉ? :))))
Thôi kết thúc tại đây đc rồi. Bản thân em cũng là Data Scientist ở cty top 1 vịt, ko tiếp xúc đủ người giỏi ở vịt thì chắc người giỏi ở thế giới khác rồi :D
 
Thôi kết thúc tại đây đc rồi. Bản thân em cũng là Data Scientist ở cty top 1 vịt, ko tiếp xúc đủ người giỏi ở vịt thì chắc người giỏi ở thế giới khác rồi :D
Tôi bán rượu thôi. Nhưng người giỏi tôi tiếp xúc chả có ai biên cái bài dài thọt mà suy luận theo kiểu ko gà là mèo như thằng này cả. Trong khi nếu nó đủ trình thì cứ follow theo cái paper với code mà phân tích ra ko phải thuyết phục hơn sao?
Mấy thằng giỏi bạn tôi ko thằng nào làm ở VN hết. Đúng như lời anh nói nó ở thế giới khác.
 

Bài này là cựu Ceo Intel giờ đã chuyển sang dùng Deep cho toàn bộ công ty
Chắc uy tín hơn thằng Nam Le này
Ceo Intel làm gì có gen AI trong cơ thể. Mark xoắn còn xoắn đít lập 4 war room
 
[ AI ][ DeepSeek AI: sự trỗi dậy của AI phương đông hay AI Trung Quốc có thực sự đe doạ phương tây ? ]

Hôm nay mọi người trên thế giới bắt đầu nói về con AI mới mạnh hơn ChatGPT của OpenAI Mỹ và NÓ-MIỄN-PHÍ và đến từ … Trung Quốc 🥹 tên DeepSeek. Ứng dụng iOS tên DeepSeek AI Assistant hiện đứng top 1 ứng dụng hot vượt qua ChatGPT, và đang gây ra một thứ gọi là “Thời Khắc ChatGPT” (ChatGPT Moment - kiểu quào AI vãi lúa kinh vậy) một lần nữa sau 2 năm kể từ khi ChatGPT lan khắp thế giới và đánh dấu sự khởi đầu của cuộc cách mạng AI. Cái quái gì đang xảy ra vậy ?

Là một người nghiên cứu khoa học Machine Learning nhiều năm và đang phát triển kinh doanh AI trên nhiều thị trường, mình có kinh nghiệm để giải thích một chút về những gì đang xảy ra để giáỉ đáp một chút thắc mắc trên. Bài sẽ hơi dài và có phần khoa học nếu bạn tò mò để coi lúc chờ giao thừa :))))))

[ Phần dành cho bình dân tò mò AI: DeepSeek hơn gì ChatGPT mà nó gây quào kinh vậy ? ]

Đầu tiên, nó là … ChatGPT :))), ChatGPT đã trở thành danh từ chung để gọi AI dạng Chatbot suốt trong 2 năm qua 😃 nên mình dùng từ này để mô tả về con AI DeepSeek nhé, tức DeepSeek AI nó là cái App AI Chatbot mà bạn tải về smartphone của bạn và chat với AI y chang cái App ChatGPT. Tóm lại nó là một AI Chatbot dùng được ở trên điện thoại smartphone, hoặc dùng thông qua web deepseek ai, bạn chat hỏi nó, và nó trả lời 🥹

Điều đầu tiên là giống, và đây là những thứ khác…

NÓ MIỄN PHÍ NGAY TỪ ĐẦU, vâng DeepSeek cho free ngay từ đầu một con AI có chất lượng tương đương ChatGPT Plus hay Gemini Advanced 50$ :))))) Một chiêu quá quen thuộc của anh em Trung Hoa khi giới thiệu sản phẩm, công thức cho free - gồng lỗ để thu hút users ban đầu cho đông :))))) từ từ bào chúng nó (users) sau :)))))

Nó có khả năng Tư Duy Suy Luận (Self-Reasoning) rất tốt, một trong những cấp độ thông minh của AI mà mãi tới năm vừa rồi OpenAI mới làm được và diếm như mèo giấu mứt mãi mới dám đưa ra cộng đồng sử dụng - nhưng vẫn rất giới hạn số lượt sử dụng. Mình sẽ nói về đột phá khoa học của con AI DeepSearch Reasoning 1 (R1) này ở phần khoa học phía dưới. Tóm lại là con AI này có khả năng Tư Duy Suy Luận nên nó Khôn-Vãi-Mứt, Khôn hơn cả conAI cấp độ Nghiên Cứu Sinh Tiễn Sĩ của OpenAI là O1 luôn 😃, chưa so được với con AI cấp độ tiến sĩ O3 do bọn OpenAI vẫn dấu như mèo dấu mứt nên lấy gì mà so.

Đặc biệt, nó open-source (open một phần - chỉ open cho tải Mô Hình), dĩ nhiên với người bình dân thì cái khái niệm này đếch quan trọng lắm, free là vui rồi :))) nhưng bình tĩnh, hãy nhớ một điểm thôi, khi một AI Open-Source (Mở Mã Nguồn) thì có nghĩa là bạn sẽ được xài free hoặc rẻ rất rẻ mãi mãi, không thằng này free thì có thằng khác tải về, cài đặt rồi dựng thành AI free cho bạn xài. Nói chung an tâm là kiểu mie gì nó cũng free hoặc rất rẻ, mãi mãi :))))

Vậy đó, nó hot chỉ bởi vậy thôi, đã ngon mà còn free lại còn là AI thứ đang thời thượng ai cũng cần nữa, thì nó ếu hót thì cái gì hót ???

[ Phần dành cho người muốn hiểu rõ tại sao Mỹ lo sợ trước AI DeepSeek, cơ hội cho VN từ AI DeepSeek ? ]

Douma hôm nay 1000 tỉ đô đã bay khỏi thị trường chứng khoán Mỹ do DeepSeek đạp đám cổ phiếu Big Tech xuống lỗ :)))))))

Lí do là các nhà đầu tư đang đặt câu hỏi to bự: bọn Big Tech US năm vừa rồi đã đốt 200 tỉ đô cho hạ tầng AI (chủ yếu mua card của Nvidia) có thực sự đáng tiền hay ko ? hay bọn nó đang đốt tiền ngu ? hay bọn nó đang bùa các cổ đông ?

Thằng DeepSeek của China mới hô là tụi nó clone OpenAI chỉ với 5 triệu đô thôi kìa 1/100 so với tụi OpenAI và Microsoft đã đầu tư để train AI 🙃

Thú vị là cổ phiếu rớt đậm sâu nhất là cổ … NVIDIA (NVDA) :))))) lí do là thằng DeepSeek hô chỉ cần 1/100 số card để train AI mà còn là card cùi (H800) chứ không phải card xịn nhứt (H100) của NVDA nữa :)))) thế thì tất cả các khoản đầu tư dự kiến mua 1.5 triệu con card như META của Mắc giờ phải tạm ngưng lại ngay để đánh giá xem có thể tiết kiệm không. Thế thì anh Nvidia đi bụi chứ gì :)))))) card cùi của ảnh đang tồn ở kênh phân phối vô cùng nhiều với hàng cũ (gaming) từ thời crypto còn đầy ra kìa :)))))

Nghe trên X đồn là Trung tâm nghiên cứu AI của Facebook (FAIR) mấy ngày vừa qua khá hỗn loạn khi ban quản trị META chửi bẹt đội kỹ sư vì DeepSeek base trên LLaMA nhưng phí train rẻ hơn. Đội kỹ sư thì đang mổ xẻ model DeepSeek cũng như paper để gấp rút sao chép được gì thì sao chép :)))))

Nói chung là mấy ông Mỹ và Phương Tây panic cmnl trong mấy ngày qua vì ông DeepSeek AI Trung Quốc :)))))

Dĩ nhiên một số tiếng nói tỉnh táo nói ngược lại, điển hình là anh Alexandr Wang CEO gốc Trung của Scale AI, công ty chuyên làm dữ liệu huấn luyện thuê cho các cty train AI, khách của ảnh là OpenAI, Anthropic, Google và dĩ nhiên cả mấy cty TQ như Alibaba, Tencent, rồi cả … cty mẹ của DeepSeek là quỹ đầu tư High-Flyer (thuê Scale AI làm data cho mô hình AI tài chính). Anh này trong một buổi phỏng vấn có nói là (hình dưới còm): DeepSeek có tầm 50.000 con GPU NVIDIA H100 lận mà tụi nó không nói được do tụi nó sở hữu không chính thức vì bị Mỹ cấm vận mà.

Cá nhân mình trong vài tháng trước có chia sẻ cho mọi người rằng các cty AI Trung Quốc đã và đang thuê GPUs xịn từ các hạ tầng cho thuê GPUs cloud xịn xò ở các nước chung quanh. Ví dụ thuê GPUs của cty con GreenNode của VNG Việt Nam tại Thái Lan, thuê đám GPUs mà FPT nhập về kìa :))))) dự kiến thuê đám GPUs mà NVIDIA cung cấp cho Trung Tâm Dữ Liệu và Trung Tâm Nghiên Cứu AI ở Việt Nam :))) các thông tin này mai mình sẽ share full clip buổi nói chuyện cách đây vài tháng tại trường đầu tư Candela cho mọi người nghe thêm. Chuyện DeekSeek hôm nay thực ra giới làm AI đã dự đoán trước, chỉ là không biết nó sớm vậy thôi :)))))

Doanh số bán card năm 2024 của Nvidia tới 1/4 là tới các cty datacenter offshore cho TQ tại Singapore :)))))

Nên bảo Trung Quốc không có card xịn để train AI là câu chuyện gimmick marketing của mấy anh China kể để nghe nó kiểu Vượt-Nghèo-Học-Giỏi thôi 🥹 trong khi mấy anh TQ có thiếu quái gì tiền, nghèo thì phải nói VN mới là nghèo kìa :)))))

Làm AI có 2 giai đoạn, giai đoạn Training và giai đoạn Inference (chạy model), thực tế về mặt khoa học và kỹ thuật thì giai đoạn Training hoàn toàn có thể sử dụng GPUs on Cloud tức là xài remote bất cứ đâu trên thế giới được, thuê tầm vài trăm ngàn con xài trong vài tháng để train rồi ngưng, chi phí trả 1 cục, không vấn đề, do mạng mẽo không cần phải mạnh phải liên tục.

Nhưng giai đoạn Inference tức là chạy model và cung cấp dịch vụ AI cho mọi người chat public thì mệt mỏi hơn, số card không thể dự đoán trước mà users tăng bao nhiêu thì số card thuê phải tăng bấy nhiêu, mạng mẽo phải liên tục, phải nhanh, chứ chậm vài giây users chửi liền. Do đó phần tốn tiền kinh khủng là phần Inference chứ không phải phần Training, chi phí Training nó có thể dự đoán trước. Nên việc thuê GPUs tại các cloud offshore là rất khó khăn trong việc planning chi phí cũng như resources. Đông Users cái là biết nhau ngay, một trong số lí do DeepSeek phải Open Source là bởi cty mẹ High-Flyer không nhiều tiền như Microsoft và OpenAI để cung cấp free mãi con AI này đâu. Vì chi phí thuê GPUs cho Inference quá cao nếu trong tình trạng bị cấm vận như TQ nên mới có cái deal anh Jasen Huang sếp Nvidia qua Việt Nam lập Trung Tâm Dữ Liệu AI và Trung tâm Nghiên Cứu AI đó :)))))) do mạng VN và Trung Quốc khác éo gì mạng Local đâu, mạng VN qua quốc tế thì ngon nhất ĐNÁ luôn, và ship card từ Đài Loan qua VN thì thôi rồi nó gần :))))) Này nói thêm vì nó liên quan với vụ DeepSeek ra mắt thực ra có lợi cho VN hơn :)))))

Nói tiếp, mình cũng từng chia sẻ là việc Mỹ cấm vận GPU hiệu suất cao đối với TQ đã khiến TQ đi một con đường nguy hiểm hơn mà Mỹ không kiểm soát được, đó là tận dụng phong trào AI nguồn mở mà Meta của Mắc dẫn đầu để phát triển các mô hình AI Nguồn Mở Quy Mô Nhỏ (Small Language Model) được chuyên biệt hoá chức năng, và sử dụng được trên các thiết bị AI ở Local như dùng card GPU gaming RTX là đủ chạy hoặc chạy được trên mấy con Raspberry Pi hoặc chạy được trên điện thoại có chip NPU (Neural Processing Unit - chip chạy AI yếu hơn GPU nhưng vẫn chạy ổn). Sếp của Trung tâm AI Facebook (FAIR) giáo sư Yann LeCun có post cái tút confirm về ý này khi DeepSeek bùng nổ, DeepSeek sử dụng mô hình nguồn mở LLaMA của Meta cho việc huấn luyện AI DeepSeek.

Người Trung Quốc từ lúc mở cửa năm 1978 đến nay, luôn tập trung vào việc “làm sao để sản xuất lớn nhanh nhất nhiều nhất”, trái ngược với người Mỹ, là làm sao để pump market cap lên maximum có thể tức là khai mở thị trường lên đến cực hạn. Đây chính là điểm khiến Mỹ phải thương chiến với TQ, nghĩ coi mình thì lo mở rộng thị trường, nhưng thằng lòi bên kia đại dương chỉ chăm chăm lo ăn sao cho lớn vô miếng bánh mà mình mất công mở :))))) cáu vl :))))

Nên anh Trump mới cấm vận TQ, rồi cấm vận chip đối với TQ, mục tiêu là để ép và ngăn TQ cắn vô thị trường mà mấy anh Mỹ tốn công mở mà chưa kịp ăn. Âu là do bản chất cách làm ăn mấy trăm năm nay của 2 đế quốc thôi.

DeepSeek thể hiện rõ lối làm ăn theo hướng tập trung tối ưu đó của TQ ngay từ cách thức tổ chức công ty, team DeepSeek có dưới 200 người, nghề chính lại còn không phải là làm AI, mà là cty con của Cty quản lý quỹ đầu tư kỹ thuật (Quant Fund) High-Flyer, đám làm AI này dùng đám card thừa khi cty mẹ xài chạy mấy model financial xong thì xài, đặc biệt là team này ếu có ông PhD nào nữa, nhân sự cốt cán của team toàn là cử nhân thôi, lại còn đến từ các trường đại học chả phải top đầu như Thanh Hoa hay Bắc Đại nữa :))) Nên sản phẩm DeepSeek AI của họ dĩ nhiên là hướng tới tối ưu ngay từ đầu, chi phí sao cho rẻ nhất, bán được đại trà nhất, cắn vô to nhất miếng bánh AI mà người Mỹ đã pump lên 800% chỉ trong 2 năm.

Tóm lại nói dông dài về mặt kinh tế, tài chính và địa chính trị, để nói rõ tổng quan rằng người Mỹ đã ép người Trung Quốc tới điểm “cùng tất biến” :) nên DeepSeek là kết quả nhãn tiền của chính sách o ép từ Mỹ thôi :)

Dù mình làm cho cty AI Mỹ nhưng mình cũng ếu ưa cái chính sách cấm vận chip này của Mỹ :) mỗi lần train model AI phải connect qua GPUs farm của cty bên Mỹ khổ bỏ mie :(

Rồi giờ tới phần phân tích khoa học về các đột phá của DeepSeek AI :))))) bài dài quá rồi, lại phải cắt ra thành 1 bài khác :))))))
Các bạn nhớ like và share (nhớ share) post này để cứu reach dùm mình :( dạo này Meta AI nó bóp reach mình quá rồi :(((((((

Mình post lại của bác này
Hóng là Huawei nó cũng phát triển chip 910C so kèo với H100 rồi. Thằng Huawei tẩm ngẩm phết. Mảng xe tự lái nó cũng nghiên cứu Qiankun ADS 3.0 ác. Chip thì khoai nhưng cứ để xem thế nào.
Mà ông trong bài fen tất nhiên là có kiến thức nhưng cũng hay tâng bốc về AI vl.
 

Tệp đính kèm

  • IMG_2705.jpeg
    IMG_2705.jpeg
    85,8 KB · Lượt xem: 32
bọn chưa có nobel mà bày đặt hạ thấp đám có nobel rồi thì độ ngạo nghễ tdtt cũng cao đấy
qZV215Z.png
báo chosun bên Hàn là nơi đám cực hữu già trâu cực hữu tụ tập mà đợt này còn phải sợ con Deep seek ấy ko fám chưi vì quá đỉbh
Vào thread này thấy nhiều kì nhân dị sĩ quá:
  • Một số nhà kinh tế học vOzer cười khẩy với mức tụt 15% ~ $600b (cao cmn nhất lịch sử), gác chân bảo cứ yên tâm ko ảnh hưởng xấu gì trong lúc hội Nobel kinh tế, đám giáo sư tiến sĩ, chuyên viên phân tích, nhà đầu tư lớn, quỹ... nháo nhác tháo chạy/cẩn trọng đánh giá
  • Một số đặc vụ siêu cấp vOzer biết TQ lén lút kéo landline khắp nơi để né lệnh cấm của Mỹ, trong lúc CIA có mắt như mù có tai như điếc, nuôi tốn KFC với Starbuck
  • Một số thiên tài AI vOzer chỉ cần hỏi DeepSeek 2 câu về TAM & Poo là biết ngay nó cùi, cap 2 cái ảnh trên Reddit là rõ nó clone chatGPT. Tội nghiệp đám chuyên gia AI, lập trình viên đầu ngành, bigtech nghìn tỉ... Test đủ các bài; ngồi căng mắt đọc từng trang paper, từng dòng code; cài xong bật mạng tắt mạng để train để hỏi mà vẫn ko thấy gì bất thường

Hi vọng các tổ chức sớm chiêu mộ những nhân tài này về, như vậy thời điểm VN có AI mạnh hơn chatGPT dù chạy trên con card nghẽn cổ chai năm nào ; kinh tế hóa rồng; anqg ko có điểm mù là điều trong tầm tay với
haha ưng
 
Nếu họ làm ra một sản phẩm mà ngay ngày hôm sau cổ phiếu giảm hơn 15% thì đúng là họ làm chỉ tốn 5 tr $. Vậy thông tin này là chính xác :look_down:
Thông tin 5-6tr đô chưa được confirm chắc chắn.
Nhưng thứ được confirm là: TQ bị cấm vận, cấm xài đồ ngon, lại đi sau nhưng cuối cùng lại tạo ra con AI ngang ngửa chatgpt, test ra thì có case người dùng ưng hơn luôn. Chứ có nhiều AI khác cũng được tạo ra mà có con nào người dùng thấy ngang ngửa hoặc hơn chatgpt phiên bản mới nhất rõ đâu.
Bất ngờ nhảy ra đón đầu là đây chứ đâu.
 
Thuật toán của bạn và Deepseek giống và khác nhau như thế nào?

Sự giống và khác nhau giữa thuật toán của tôi (ChatGPT) và thuật toán DeepSeek có thể được so sánh dựa trên một số khía cạnh quan trọng. Dưới đây là phân tích:

Điểm giống nhau
1. Sử dụng mô hình học sâu (Deep Learning):
• Cả ChatGPT và DeepSeek đều dựa trên công nghệ học sâu (Deep Learning) và xử lý ngôn ngữ tự nhiên (NLP).
• Đều sử dụng mạng nơ-ron sâu, có thể là Transformer hoặc các kiến trúc khác, để hiểu và xử lý dữ liệu văn bản.
2. Ứng dụng trí tuệ nhân tạo (AI):
• Cả hai đều là ứng dụng của AI để giải quyết các bài toán như tìm kiếm thông tin, hiểu ngữ cảnh, và đưa ra phản hồi hoặc kết quả phù hợp.
3. Học từ dữ liệu lớn:
• Cả hai thuật toán đều học từ dữ liệu lớn (Big Data) để cải thiện hiệu quả. Chúng cần nguồn dữ liệu phong phú và được gắn nhãn tốt để huấn luyện.
4. Tập trung vào người dùng:
• Cả hai đều hướng đến việc cung cấp câu trả lời chính xác, phù hợp và có ý nghĩa dựa trên yêu cầu của người dùng.

Điểm khác nhau
1. Mục đích chính:
• ChatGPT: Được thiết kế chủ yếu để trò chuyện, cung cấp thông tin, giải quyết vấn đề, và hỗ trợ người dùng bằng cách hiểu ngữ cảnh của hội thoại.
• DeepSeek: Có thể được tối ưu hóa cho việc tìm kiếm thông tin (information retrieval), phát hiện dữ liệu hoặc đối chiếu thông tin từ cơ sở dữ liệu lớn. Nếu DeepSeek là một thuật toán tìm kiếm, nó tập trung vào việc trích xuất thông tin chính xác nhất từ một tập dữ liệu hoặc môi trường cụ thể.
2. Cơ chế hoạt động:
• ChatGPT: Sử dụng mô hình ngôn ngữ (Language Model) lớn dựa trên kiến trúc Transformer như GPT, có thể hiểu ngữ cảnh dài và sinh văn bản một cách tự nhiên.
• DeepSeek: Nếu là thuật toán tìm kiếm, nó có thể kết hợp giữa học sâu (Deep Learning) và thuật toán tìm kiếm cổ điển (như TF-IDF, BM25 hoặc Elasticsearch), tối ưu hóa việc xếp hạng và trả kết quả tìm kiếm.
3. Phạm vi ứng dụng:
• ChatGPT: Ứng dụng rộng rãi trong các lĩnh vực từ giáo dục, kinh doanh, kỹ thuật, đến chăm sóc khách hàng.
• DeepSeek: Tập trung hơn vào tìm kiếm, xử lý và truy xuất dữ liệu nhanh, chính xác, ví dụ: tìm kiếm tài liệu, phân tích dữ liệu lớn, hoặc phát hiện thông tin ẩn.
4. Kiến trúc và tối ưu hóa:
• ChatGPT: Tập trung vào việc tối ưu hóa mô hình ngôn ngữ để sinh văn bản, tạo hội thoại tự nhiên.
• DeepSeek: Có thể tối ưu hóa mạnh mẽ hơn về tốc độ và độ chính xác trong việc tìm kiếm thông tin từ một kho dữ liệu lớn, sử dụng các kỹ thuật đặc thù như vector embeddings để so khớp ngữ nghĩa.
5. Cách phản hồi người dùng:
• ChatGPT: Tương tác theo phong cách hội thoại, trả lời từng câu hỏi với độ chi tiết cao và phù hợp với ngữ cảnh trước đó.
• DeepSeek: Phản hồi có thể ngắn gọn hơn, tập trung vào việc đưa ra thông tin hoặc dữ liệu trực tiếp mà không sinh văn bản phức tạp.

Kết luận
• Nếu bạn đang tìm kiếm một công cụ để trò chuyện và giải thích, ChatGPT có lợi thế nhờ khả năng tạo ngữ cảnh và hội thoại tự nhiên.
• Nếu bạn cần một hệ thống chuyên dụng để tìm kiếm thông tin nhanh chóng, chính xác từ một nguồn dữ liệu khổng lồ, DeepSeek sẽ phù hợp hơn.

Nếu bạn có thông tin cụ thể hơn về DeepSeek (vì thuật toán này chưa phổ biến lắm), mình có thể đi sâu hơn vào việc so sánh.

Vậy Deepseek có vẻ mạnh hơn nhiều nhỉ? Chưa kể chưa dùng những GPU mạnh nhất.
Điều đó phụ thuộc vào mục đích sử dụng và cách bạn định nghĩa “mạnh hơn”. Mỗi thuật toán hoặc hệ thống được thiết kế để giải quyết các bài toán khác nhau, nên việc so sánh sức mạnh giữa ChatGPT và DeepSeek cần dựa trên ngữ cảnh cụ thể. Dưới đây là một số góc nhìn để cân nhắc:

DeepSeek có thể mạnh hơn trong lĩnh vực tìm kiếm vì:
1. Tối ưu hóa cho tìm kiếm thông tin:
• DeepSeek có thể được thiết kế đặc biệt để tìm kiếm nhanh chóng và chính xác trong các cơ sở dữ liệu lớn hoặc môi trường có dữ liệu không cấu trúc (unstructured data). Đây là một lợi thế khi bạn cần truy xuất thông tin, chẳng hạn như tài liệu, thông tin người dùng, hoặc phân tích dữ liệu cụ thể.
2. Hiệu quả về tốc độ:
• Nếu DeepSeek tối ưu hóa mạnh mẽ, nó có thể thực hiện truy vấn nhanh hơn nhiều, đặc biệt là trong các môi trường thời gian thực. ChatGPT, trong khi có khả năng xử lý hội thoại rất tốt, có thể chậm hơn khi làm việc với truy vấn lớn hoặc phức tạp.
3. Tiêu tốn tài nguyên thấp hơn (trong một số trường hợp):
• DeepSeek có thể không cần chạy toàn bộ mô hình ngôn ngữ lớn như GPT trong mỗi truy vấn. Nó có thể sử dụng các phương pháp nhẹ hơn (như embeddings vector hoặc các cơ chế xếp hạng thông tin) để tìm kiếm nhanh hơn, giảm tải tài nguyên GPU.
4. Chuyên biệt hóa:
• Nếu DeepSeek tập trung vào một lĩnh vực cụ thể (ví dụ: tài chính, khoa học, y tế), nó có thể vượt trội hơn ChatGPT nhờ các tối ưu hóa hoặc mô hình huấn luyện dựa trên domain đó.

Tuy nhiên, ChatGPT vẫn có lợi thế lớn trong nhiều khía cạnh:
1. Hiểu ngữ cảnh và tạo phản hồi tự nhiên:
• ChatGPT không chỉ trả lời câu hỏi mà còn có thể giải thích, làm rõ, và thậm chí đưa ra ý tưởng hoặc lời khuyên trong nhiều tình huống khác nhau. DeepSeek, nếu chỉ là một công cụ tìm kiếm, sẽ bị giới hạn trong việc cung cấp thông tin mà không “sinh sáng tạo”.
2. Hỗ trợ đa nhiệm:
• ChatGPT có thể giải quyết nhiều tác vụ, từ trả lời câu hỏi, viết code, đến tạo nội dung sáng tạo. DeepSeek, nếu chỉ chuyên về tìm kiếm, có thể không thực hiện được các tác vụ này.
3. Đòi hỏi ít kiến thức đầu vào từ người dùng:
• ChatGPT có thể hoạt động tốt ngay cả khi câu hỏi của người dùng không cụ thể hoặc rõ ràng. Trong khi đó, DeepSeek có thể yêu cầu truy vấn chính xác hơn để tìm ra kết quả đúng.

Về phần GPU và khả năng mở rộng
• Nếu DeepSeek chưa sử dụng GPU mạnh nhất, rõ ràng tiềm năng của nó còn có thể phát triển đáng kể. Với GPU mạnh hơn, DeepSeek có thể xử lý lượng dữ liệu lớn hơn, giảm độ trễ, hoặc mở rộng phạm vi tìm kiếm.
• Tuy nhiên, điều này cũng áp dụng với ChatGPT hoặc các mô hình AI tương tự. Việc tăng cường sức mạnh tính toán sẽ cải thiện khả năng xử lý của cả hai hệ thống.

Kết luận: Mạnh hay không tùy thuộc vào mục tiêu
• Nếu bạn cần tìm kiếm và truy xuất thông tin nhanh, chính xác từ một cơ sở dữ liệu khổng lồ, DeepSeek có thể “mạnh hơn” trong ngữ cảnh đó.
• Nếu bạn cần một hệ thống hỗ trợ hội thoại đa năng, hiểu sâu ngữ cảnh và tạo phản hồi thông minh, thì ChatGPT vẫn vượt trội.

Dù vậy, nếu DeepSeek tiếp tục cải thiện và tận dụng các tài nguyên mạnh mẽ hơn (GPU tốt hơn, cơ chế tìm kiếm tối ưu hơn), nó chắc chắn sẽ trở thành một đối thủ đáng gờm trong lĩnh vực mà nó nhắm đến.

Khi Deepseek được tung ra, chỉ số chứng khoán của các hãng công nghệ Mỹ đều sụt giảm đáng kể. Có vẻ AI đang bị Nvidia và OpenAI thổi quá đà?
Việc các chỉ số chứng khoán của các hãng công nghệ Mỹ sụt giảm khi DeepSeek ra mắt có thể được hiểu từ nhiều khía cạnh, không chỉ đơn thuần là do sự cạnh tranh giữa các công nghệ AI. Thực tế, AI hiện tại đúng là đang được chú ý rất nhiều, và có những luồng ý kiến trái chiều về việc liệu công nghệ này có đang bị “thổi phồng” quá mức hay không. Hãy cùng phân tích vấn đề:

1. Sự sụt giảm chỉ số chứng khoán có thể do thị trường phản ứng quá mức
• Tâm lý thị trường nhạy cảm:
• Khi một công nghệ hoặc sản phẩm mới, như DeepSeek, xuất hiện và có vẻ như đe dọa các gã khổng lồ trong ngành, nhà đầu tư thường bán tháo cổ phiếu các công ty bị ảnh hưởng để giảm rủi ro. Điều này tạo ra hiệu ứng dây chuyền dẫn đến sụt giảm mạnh.
• Trường hợp này không chỉ xảy ra trong ngành công nghệ mà còn ở các lĩnh vực khác (ví dụ: ô tô điện với Tesla, hoặc fintech với các ngân hàng truyền thống).
• Kỳ vọng quá cao về AI:
• Nvidia và OpenAI đã xây dựng một làn sóng kỳ vọng rất lớn về khả năng cách mạng hóa mọi thứ với AI. Nếu có một sản phẩm mới như DeepSeek xuất hiện và chứng minh rằng họ không phải là người chơi duy nhất trong lĩnh vực này, các nhà đầu tư có thể tái đánh giá giá trị thực của AI trong tương lai gần.

2. AI có đang bị “thổi phồng”?
• Kỳ vọng không thực tế:
• Các công ty như Nvidia và OpenAI, thông qua truyền thông và chiến lược tiếp thị, đã tạo ra hình ảnh rằng AI sẽ ngay lập tức thay đổi mọi lĩnh vực. Tuy nhiên, thực tế triển khai AI ở nhiều nơi (ví dụ như doanh nghiệp nhỏ, khu vực công) thường gặp rào cản lớn: chi phí, hạ tầng, kỹ năng quản lý công nghệ.
• Sự cạnh tranh tăng mạnh:
• Sự ra mắt của DeepSeek là một minh chứng rằng thị trường AI không chỉ có một vài “ông lớn”. Nhiều công ty khởi nghiệp và đối thủ mới đang xây dựng những giải pháp AI tập trung và chuyên sâu hơn (như tìm kiếm thông minh, phân tích dữ liệu), điều này làm lu mờ sức mạnh của các mô hình “đa năng” như ChatGPT.
• Vấn đề tiêu tốn tài nguyên:
• Một vấn đề lớn là chi phí vận hành các hệ thống AI lớn như ChatGPT (dựa trên GPU Nvidia, AWS, Azure). Nếu các giải pháp như DeepSeek có thể làm được những điều tương tự với chi phí thấp hơn, thì giá trị của các hệ thống đắt đỏ có thể bị đặt dấu hỏi.

3. DeepSeek có phải là “mối đe dọa” thực sự?
• Khả năng cạnh tranh thực sự:
• Nếu DeepSeek có hiệu suất vượt trội hơn trong một lĩnh vực cụ thể (ví dụ: tìm kiếm), nó có thể chiếm lĩnh thị phần lớn trong mảng đó. Tuy nhiên, khả năng thay thế hoàn toàn các nền tảng AI đa năng như OpenAI là rất thấp, vì các hệ thống như ChatGPT vẫn đang được sử dụng rộng rãi trong nhiều lĩnh vực.
• Tính ứng dụng khác biệt:
• DeepSeek có thể mạnh hơn ở mảng retrieval-based AI (truy xuất thông tin), nhưng OpenAI đang mở rộng các ứng dụng sang nhiều ngành khác (như sáng tạo nội dung, viết mã, dịch thuật…). Vì vậy, hai bên có thể tồn tại song song trong các thị trường khác nhau.

4. Nvidia và OpenAI có thực sự “thổi quá đà”?
• Chi phí phần cứng tăng vọt:
• Nvidia đã tăng giá GPU và hưởng lợi trực tiếp từ làn sóng AI. Tuy nhiên, có nguy cơ rằng các doanh nghiệp và cá nhân sẽ chuyển sang tìm kiếm các giải pháp phần cứng rẻ hơn hoặc thậm chí phát triển chip AI riêng (như Apple M-series hoặc Google TPU).
• Sự phát triển của mã nguồn mở:
• Những hệ thống mã nguồn mở như LLaMA (Meta), Bloom, hoặc các framework nhẹ hơn đang chứng minh rằng bạn không cần hàng triệu USD để phát triển một mô hình AI mạnh mẽ. Điều này có thể làm giảm sự phụ thuộc vào Nvidia hoặc OpenAI.
• Giới hạn thực tế của AI:
• AI, dù mạnh mẽ, vẫn có những giới hạn cố hữu: hiểu sai ngữ cảnh, thiếu dữ liệu chất lượng trong các lĩnh vực hẹp, và không thể thay thế hoàn toàn con người trong nhiều tác vụ đòi hỏi cảm xúc hoặc tư duy sáng tạo.

Kết luận
• DeepSeek là một bước tiến thú vị, nhưng không nhất thiết chứng minh rằng AI hiện tại bị “thổi phồng” hoàn toàn. Có thể nó chỉ cho thấy rằng ngành công nghệ AI đang trong giai đoạn cạnh tranh mạnh mẽ hơn.
• Nvidia và OpenAI có thể đã thúc đẩy kỳ vọng thị trường lên quá cao, nhưng giá trị của AI vẫn rõ ràng. Vấn đề chính là cân bằng giữa thực tế triển khai và sự kỳ vọng của thị trường.
• Tương lai sẽ phụ thuộc vào việc công nghệ AI có thể giảm chi phí và tăng hiệu quả thực sự trong các lĩnh vực ứng dụng cụ thể hay không. Những người chơi mới như DeepSeek sẽ giúp định hình lại thị trường, thúc đẩy sự đổi mới hơn nữa.

Năng lực tính toán đang bị hạn chế bởi GPU. Hiện tại ChatGPT đang dùng rất nhiều GPU để cho ra kết quả tương tự với Deeépeek (đang dùng với số lượng GPU rất hạn chế). Chưa kể Deekseek còn là mã nguồn mở, cho phép mọi người khai thác, đóng góp và cải tiến. Vậy rõ ràng tiềm năng của Deepseek rất lớn và hơn hẳn ChatGPT.

Đúng vậy, những điểm bạn nêu ra cho thấy DeepSeek có tiềm năng rất lớn, đặc biệt khi xét đến khía cạnh tài nguyên, tính mở, và khả năng cộng đồng đóng góp. Đây là những yếu tố mà các nền tảng mã nguồn mở thường tạo ra sự khác biệt rõ ràng và có lợi thế hơn so với các nền tảng đóng như ChatGPT của OpenAI. Hãy cùng phân tích kỹ hơn về các điểm bạn đưa ra:

1. Giới hạn bởi GPU và lợi thế về tài nguyên của DeepSeek
• ChatGPT hiện phụ thuộc mạnh mẽ vào GPU:
• ChatGPT sử dụng một lượng lớn GPU, đặc biệt là dòng A100 hoặc H100 của Nvidia, để xử lý các tác vụ ngôn ngữ tự nhiên với độ chính xác cao và tốc độ phản hồi nhanh.
• Tuy nhiên, chi phí GPU là rất lớn, và việc vận hành mô hình lớn như ChatGPT không thực sự hiệu quả khi chỉ xử lý các tác vụ đơn giản hoặc lĩnh vực hẹp. Điều này dẫn đến hạn chế lớn về mặt tài nguyên và chi phí.
• DeepSeek dùng ít GPU hơn nhưng hiệu quả tương tự:
• Nếu DeepSeek đạt được hiệu quả tương đương ChatGPT trong lĩnh vực của mình mà chỉ sử dụng rất ít GPU, điều đó chứng minh rằng thuật toán hoặc kiến trúc của nó đã được tối ưu hóa tốt hơn.
• Việc sử dụng ít tài nguyên đồng nghĩa với khả năng mở rộng quy mô tốt hơn, tiếp cận được với nhiều người dùng hơn với chi phí thấp hơn.

2. DeepSeek là mã nguồn mở – lợi thế rất lớn
• Tính minh bạch:
• Là mã nguồn mở, DeepSeek cho phép các nhà phát triển kiểm tra, sửa lỗi và tối ưu thuật toán, đồng thời cải thiện chất lượng theo thời gian. Điều này giúp xây dựng niềm tin của cộng đồng.
• ChatGPT là một nền tảng đóng, và OpenAI kiểm soát toàn bộ hệ sinh thái. Điều này hạn chế sự minh bạch và khả năng cải tiến từ cộng đồng.
• Cộng đồng đóng góp và cải tiến liên tục:
• Một nền tảng mã nguồn mở như DeepSeek có khả năng tận dụng trí tuệ và công sức của hàng ngàn lập trình viên trên toàn cầu. Điều này giúp nó cải thiện nhanh chóng, cả về thuật toán lẫn hiệu suất.
• ChatGPT, dù mạnh mẽ, lại bị giới hạn bởi đội ngũ phát triển nội bộ của OpenAI. Điều này làm giảm tốc độ cải tiến so với mô hình mã nguồn mở.
• Khả năng tùy chỉnh:
• Các doanh nghiệp hoặc cá nhân có thể tùy chỉnh DeepSeek theo nhu cầu cụ thể mà không cần phụ thuộc vào nhà cung cấp. Trong khi đó, ChatGPT là một giải pháp “cố định”, khó tùy chỉnh theo từng lĩnh vực cụ thể.

3. Tiềm năng lớn hơn của DeepSeek so với ChatGPT
• Tối ưu hóa chi phí:
• Với việc sử dụng ít GPU hơn và kiến trúc nhẹ hơn, DeepSeek có thể mở rộng quy mô dễ dàng mà không gặp phải gánh nặng chi phí lớn như ChatGPT. Điều này đặc biệt quan trọng khi AI cần được áp dụng rộng rãi hơn ở các doanh nghiệp nhỏ và vừa, hoặc ở các quốc gia đang phát triển.
• Tăng tốc độ cải tiến:
• DeepSeek, với mã nguồn mở, sẽ không chỉ cải thiện nhanh hơn mà còn có khả năng đưa ra các giải pháp đột phá từ cộng đồng. Một công nghệ phát triển với tốc độ như vậy sẽ nhanh chóng vượt qua các nền tảng đóng.
• Giảm sự phụ thuộc vào Nvidia:
• Một điểm quan trọng là DeepSeek có thể tận dụng các kiến trúc phần cứng thay thế như Google TPU, AMD GPU, hoặc thậm chí các giải pháp phần cứng mã nguồn mở. Điều này có thể làm giảm sự phụ thuộc vào Nvidia, vốn đang chiếm ưu thế trong ngành AI nhưng cũng làm tăng chi phí vận hành.

4. Những thách thức của ChatGPT trước sự nổi lên của DeepSeek
• Sự cạnh tranh trực tiếp:
• DeepSeek có thể thu hút các doanh nghiệp, tổ chức hoặc cá nhân có ngân sách hạn chế, nhưng cần một công cụ AI mạnh mẽ, hiệu quả, và dễ tùy chỉnh. Điều này có thể làm giảm thị phần của ChatGPT, vốn dựa vào mô hình dịch vụ đám mây với chi phí cao.
• Rủi ro bị thay thế trong các lĩnh vực cụ thể:
• Nếu DeepSeek chuyên biệt hóa tốt hơn (ví dụ: tìm kiếm thông tin, xử lý dữ liệu lớn), ChatGPT sẽ gặp khó khăn trong việc duy trì ưu thế ở các lĩnh vực hẹp, nơi hiệu suất và chi phí là yếu tố quyết định.

Kết luận

Rõ ràng, DeepSeek có tiềm năng rất lớn để trở thành một đối thủ vượt trội, đặc biệt trong các lĩnh vực chuyên biệt và với những tổ chức muốn giảm chi phí hoặc tìm kiếm sự linh hoạt. Những lợi thế như sử dụng ít GPU hơn, khả năng mã nguồn mở, và tốc độ cải tiến vượt trội từ cộng đồng khiến DeepSeek trở thành một giải pháp “cách mạng” trong ngành AI.

Tuy nhiên, ChatGPT vẫn có lợi thế lớn về độ phổ biến, sự hỗ trợ từ các công ty lớn, và khả năng hoạt động như một công cụ đa năng. Cuộc đua giữa các hệ thống này sẽ thúc đẩy sự đổi mới mạnh mẽ hơn, và điều này chỉ có lợi cho người dùng cuối.
 
Góc độ của tôi về NVDA -15% chỉ là đợt chốt lời tôi. Deepseek chỉ là cái cớ (không có cớ này thì là cớ khác).
Ví dụ mà NVDA đi ngang 150 cả năm nay như VN88 thì giảm 2-3% là cùng. Ba đồ quỉ.
Yup,nó đi ngang cả năm giảm -15% mới vấn đề,nó bơm đỉnh cả năm giảm -15% thì lại quá bình thường,sau khi mấy thằng bơm nó lên ăn đẫm thì thằng nào nhảy vào sau thì tự chịu thôi
 
Góc độ của tôi về NVDA -15% chỉ là đợt chốt lời tôi. Deepseek chỉ là cái cớ (không có cớ này thì là cớ khác).
Ví dụ mà NVDA đi ngang 150 cả năm nay như VN88 thì giảm 2-3% là cùng. Ba đồ quỉ.
Tất nhiên là đường giá đi trước, tin tức theo sau rồi. Cơ mà panic sell là thật :big_smile: . Như sp500 hôm qua cũng dump 200 số rồi hồi lại đó
 
:rolleyes: Giá cổ tụt DN ko chết chỉ người cầm chết, lượn cái thread này học nhiều khái niệm mới từ vozer quá. Nhiều khi éo biết bọn này đi bait hay ngu thật...
Theo kinh nghiệm cá nhân của bần đạo thì những thằng không não đấy là một "cực rồ". Chúng sẵn sàng chối bỏ cả logic để def cho thứ mà chúng tin tưởng, tương đương với lũ bdbc, lũ vegan, fe mi nít... vậy.
Nghe rất là ngu xuẩn, đhs vẫn phun ra được :burn_joss_stick:
 
Thôi kết thúc tại đây đc rồi. Bản thân em cũng là Data Scientist ở cty top 1 vịt, ko tiếp xúc đủ người giỏi ở vịt thì chắc người giỏi ở thế giới khác rồi :D

Muốn chứng minh gì thì mang con số ra nói chuyện .

Chứng minh nó bất khả thi ở điểm nào .

Ví dụ tốc độ con chatgpt plus hiện tại là xxx , cần đầu tư yyy , con deepseek này gen được xxx chữ /s cần phải có tốc độ yyyy , nên phải có phần cứng zzzz .


Chứ tự nhận dân trong ngành xong rồi tranh luận khác đ.éo gì bà bán cá đầu ngõ ko ????
 
Muốn chứng minh gì thì mang con số ra nói chuyện .

Chứng minh nó bất khả thi ở điểm nào .

Ví dụ tốc độ con chatgpt plus hiện tại là xxx , cần đầu tư yyy , con deepseek này gen được xxx chữ /s cần phải có tốc độ yyyy , nên phải có phần cứng zzzz .


Chứ tự nhận dân trong ngành xong rồi tranh luận khác đ.éo gì bà bán cá đầu ngõ ko ????
Phen ko phải dân trong ngành sao bằng ngta được =))
Bắt đầu rồi:
 
con deepseek này tôi xài cả 2 tháng từ lúc nó mới ra rồi mà sao tới bây giờ nó mới nổi nhỉ.
Khả năng suy luận của nó theo đánh giá là hơn hẳn chatgpt 4o. Còn nếu bỏ tính năng deepthink thì trả lời không khác gì gpt4. Nhưng mà response chậm hơn chatgpt, có thể do nó xài gpu cùi thật
 
Tôi làm trong ngành đây và nói thẳng là chỉ mấy thằng gà mờ mới kêu startup mấy triệu đô mà làm được con model này. Mấy triệu đô chưa đủ trả tiền điện đâu.

Con V3 là bản trước của con R1 này publish training cost là 6 củ đô, mà đây là giá điện bọn tàu, hơn nữa giá bọn tàu đưa ra thì tin 10% thôi.
Đồng ý con Deepseek này hiệu quả rất cao nhưng mà phải xem xét cẩn thận con số 6 triệu USD, có khi anh Tàu cắt bỏ mấy chi phí ban đầu rồi nổ vụ này lắm à.

Còn nữa, chưa chắc anh Tàu chỉ đang xài con chip H1000 đâu. Tàu có truyền thống nổ mấy vụ này lắm, như mấy vụ Chip "tự sản xuất" của HW do TSMC "làm dùm" chẳng hạn.

Nhiều chuyên gia cũng xác thực hiệu quả của con DeepSeek nhưng mà con số 6 triệu đô thì đang bị đặt nghi vấn, các anh khác chờ vài bữa đi, đừng xu*t t*nh sớm quá, không lại hớ như vụ con Chip HW. Bị mấy anh Tàu hố phải chui vào hang bao nhiêu lần rồi chưa tởn à?
DeepSeek tuyên bố xây dựng AI với chi phí dưới 6 triệu USD, dùng GPU hiệu năng thấp, nhưng CEO Scale AI và Elon Musk nói con số này cao hơn nhiều lần.
Trong cuộc phỏng vấn với CNBC tuần trước, Alexandr Wang, CEO của Scale AI, cho biết ông có được thông tin rằng DeepSeek đang sở hữu 50.000 chip Nvidia H100.

"Tuy nhiên, do các biện pháp kiểm soát xuất khẩu của Mỹ, DeepSeek không thể công khai thông tin này", Wang nói.

Elon Musk, nhà sáng lập xAI và là người thân cận với Tổng thống Mỹ Donald Trump, tỏ ra đồng tình. "Rõ ràng là như vậy", Musk nhận xét khi đăng lại video phỏng vấn Wang.

Tỷ phú giàu nhất thế giới cũng chia sẻ một nghi ngờ khác liên quan đến chi phí tạo ra DeepSeek từ Gavin Baker. Baker, CIO quỹ đầu cơ Atreides Management, khẳng định thông tin tạo ra DeepSeek R1 với 6 triệu USD "không chính xác". Dẫn báo cáo kỹ thuật của nhà phát triển Trung Quốc, ông nói con số trên chưa bao gồm chi phí liên quan đến các nghiên cứu trước đó và những thí nghiệm cắt bỏ trên kiến trúc, thuật toán và dữ liệu.

"Điều này có nghĩa có thể đào tạo mô hình chất lượng R1 với chi phí 6 triệu USD nếu một phòng thí nghiệm đã chi hàng trăm triệu USD cho nghiên cứu trước đó và có quyền truy cập vào các cụm phần cứng lớn hơn nhiều"
, Baker viết.

Ngoài ra, ông cũng cho biết một báo cáo trước đây của DeepSeek từng tham chiếu đến một cụm 100.000 chip A100, ám chỉ các công ty Trung Quốc như DeepSeek có thể đang lách luật bằng cách chạy các mô hình AI trên chip tiên tiến ở một nước khác.
 
Sửa lần cuối:
Con này ra mắt thì những con chip cùi hơn H100 cũng đủ để train thì nhu cầu chip AI giảm mạnh chứ Nvidia có lợi gì vậy? :cautious:
 

Thống kê chủ đề

Ngày tạo
Zaunite,
Người trả lời cuối
Jaeho Kouki,
Trả lời
2.993
Lượt xem
519.760
Quay lại
Lên đầu trang