(Mỹ) Phố Wall có thể lại sụp đổ vì siêu AI Trung Quốc này

  • Người tạo chủ đề Người tạo chủ đề ChatGPT AI
  • Ngày bắt đầu Ngày bắt đầu
Nhìn cái hệ điều hành laptop, hệ điều hành điện thoại đấy, AI rồi cũng vậy thôi nhé, có cớt mà ngang nhé, tier 2 hay tier 3 thì may ra còn được.
 
Gemini và gpt nó có theo dõi lịch sử chat, nên ai dùng quen cái gì thì thấy cái đó tốt, nói nhẹ cái nó hiểu đúng ý mình luôn, hỏi con deepseek thì nó bảo mỗi khung chat của nó là độc lập, nên promt phải chuẩn.
Nên mới có chuyện ông nào dùng quen gemini chuyển sang gpt thấy nó hơi ngoo , và ngược lại.
Chắc tại tôi già, nhưng gemini nó dài văn chương tôi thích, còn mấy con kia ngắn gọn hơn
 
Gemini và gpt nó có theo dõi lịch sử chat, nên ai dùng quen cái gì thì thấy cái đó tốt, nói nhẹ cái nó hiểu đúng ý mình luôn, hỏi con deepseek thì nó bảo mỗi khung chat của nó là độc lập, nên promt phải chuẩn.
Nên mới có chuyện ông nào dùng quen gemini chuyển sang gpt thấy nó hơi ngoo , và ngược lại.
Deepseek thì xài qua VSCode, tự soạn instruction cho riêng nó, tự chế harness, tự cấu hình trong custom provider mới ngon

Con hàng này k dành cho non-tech xài vì nó không ưu tiên làm hệ sinh thái mì ăn liền, mà con chatbot nó dùng chán
 
Con DS nó có ưu tiên chatbot đâu :D anh Phong còn bảo là từng muốn bỏ chatbot nhưng xung quanh ai cũng làm nên phải để đó mà :D

Btw, đọc cái leak của anh Phong tuần trước mới thấy tầm nhìn của mấy anh fapsu quá đỉnh :D mục tiêu là AGI và hiệu năng dựa trên nội lực tự chủ. Ascend 950 vẫn đi sau nhưng không phải là vấn đề một khi tự chủ :D

Trước đó thì GLM mới hoàn thiện con gigawatt DC chạy 100% hàng nhà trồng nữa :D
 
giờ chỉ có khủng hoảng năng lượng không đủ điện trên toàn thế giới thì may ra mới kìm chân đc bọn AI này
4yPi1HB.jpg
 
Con DS nó có ưu tiên chatbot đâu :D anh Phong còn bảo là từng muốn bỏ chatbot nhưng xung quanh ai cũng làm nên phải để đó mà :D

Btw, đọc cái leak của anh Phong tuần trước mới thấy tầm nhìn của mấy anh fapsu quá đỉnh :D mục tiêu là AGI và hiệu năng dựa trên nội lực tự chủ. Ascend 950 vẫn đi sau nhưng không phải là vấn đề một khi tự chủ :D

Trước đó thì GLM mới hoàn thiện con gigawatt DC chạy 100% hàng nhà trồng nữa :D
Trước vẩu dơ không hiểu sao tung ra con deepseek lại opensource , mãi sau mới thấy tầm nhìn nó vl thật
 
Nhìn cái hệ điều hành laptop, hệ điều hành điện thoại đấy, AI rồi cũng vậy thôi nhé, có cớt mà ngang nhé, tier 2 hay tier 3 thì may ra còn được.
hệ điều hành nó liên quan đến ứng dụng và hiệu ứng mạng lưới, ko so sánh đc.
 
Xài deepseek thấy bt mà nhìu ng tung hô, tôi thấy gemini best nhất
Không biết fen để ý không chứ gần đây tôi thấy chất lượng của Gemini đi xuống thì phải, so với GPT và Claude thì có khoảng cách xa lắm.
Mấy con AI Tàu dùng thử Qwen, Kimi và Deepseek, thì phải nói DS vẫn là nhất, tra mạng tìm thông tin tổng hợp nhanh, kém cái là ít tính năng thôi.
 
Không biết fen để ý không chứ gần đây tôi thấy chất lượng của Gemini đi xuống thì phải, so với GPT và Claude thì có khoảng cách xa lắm.
Mấy con AI Tàu dùng thử Qwen, Kimi và Deepseek, thì phải nói DS vẫn là nhất, tra mạng tìm thông tin tổng hợp nhanh, kém cái là ít tính năng thôi.
Đr fen, gói free lúc trước bao ngon nhé, giờ thành gói fast..
 
Không biết fen để ý không chứ gần đây tôi thấy chất lượng của Gemini đi xuống thì phải, so với GPT và Claude thì có khoảng cách xa lắm.
Mấy con AI Tàu dùng thử Qwen, Kimi và Deepseek, thì phải nói DS vẫn là nhất, tra mạng tìm thông tin tổng hợp nhanh, kém cái là ít tính năng thôi.
Ít tính năng chả qua là vì nó không tích hợp sẵn để mì ăn liền. Chứ nó cũng có vision, cũng xử lí code, cũng có web search. Tư duy của kĩ sư deepseek là end user tự chế harness, tự làm mcp, tự làm instruction,... cho các mục đích riêng, người ta chỉ cung cấp cái model - như 1 bộ não không
 
Mà chưng cất là chưng cất dữ liệu chứ làm sao mà chưng cất được cái mô hình (model). Cũng không ai rõ là dữ liệu được chưng cất có giúp cho việc huấn luyện (train) model hội tụ nhanh hơn không.

Nếu dữ liệu là thứ duy nhất anh có hơn người khác chứ không phải là kỹ thuật huấn luyện thì việc anh bị bắt kịp chỉ là vấn đề thời gian vì dữ liệu có thể được xây dựng bằng cách bỏ tiền ra.
Chúng nó ra rả chưng cất copy nhưng có hiểu là cái gì đâu.
Api nó public đấy giỏi thì vào mà chưng cất ra deepseek, kimi
:misdoubt:
 
Ít tính năng chả qua là vì nó không tích hợp sẵn để mì ăn liền. Chứ nó cũng có vision, cũng parse code, cũng có web search, tư duy của kĩ sư deepseek là end user tự chế harness, tự làm mcp, tự làm instruction, cho các mục đích riêng, người ta chỉ cung cấp cái model - như 1 bộ não không
Chắc vậy fen à, nhưng người bình thường như tôi cũng đánh giá nó rất cao. Tư duy tốt, nhanh, context windows lớn, nói chuyện thân thiện, vậy là đủ rồi.
 
Ít tính năng chả qua là vì nó không tích hợp sẵn để mì ăn liền. Chứ nó cũng có vision, cũng xử lí code, cũng có web search. Tư duy của kĩ sư deepseek là end user tự chế harness, tự làm mcp, tự làm instruction,... cho các mục đích riêng, người ta chỉ cung cấp cái model - như 1 bộ não không
Vn nếu 2000 giờ forum mọc ra như nấm chỉ cách build AI riêng rồi, tiếc là thời đó desktop app. Tạo desktop app riêng :D
 
Tại sao anh nghĩ là cần nhiều toán để làm mấy cái này? Nếu anh học deep learning hay đọc bài báo transformer thì lượng toán không nhiều như anh nghĩ. Chủ yếu cần kiến thức toán đại học.

Dân Việt Nam có cái là đề cao Toán quá mức. Rất nhiều vấn đề này là vấn đề kỹ thuật. Làm sao để lưu dữ liệu nhanh, làm sao để luân chuyển dữ liệu giữa GPU, CPU và bộ nhớ nhanh, làm sao để gộp nhiều vòng lặp lại để xử lý nhanh hơn. Nó không phải là toán theo cái cách mà anh nghĩ. Anh có thể xem bài báo về PageAttention hay speculative decoding là một số ví dụ.
k biết sao chứ tôi thấy dân vn đề cao toán sợ cấp, toán mẹo thôi chứ mấy ai quan tâm đến toán cao cấp đâu. Phong trào toán ở dưới lớp 12 mạnh lên đại học mấy ai quan tâm. Có các thầy quan tâm nhưng cũng chả mấy ai thích nghiên cứu, le que vài ông thì “dân vn đề cao toán quá mức” là k có đâu.
 
Tại sao anh nghĩ là cần nhiều toán để làm mấy cái này? Nếu anh học deep learning hay đọc bài báo transformer thì lượng toán không nhiều như anh nghĩ. Chủ yếu cần kiến thức toán đại học.

Dân Việt Nam có cái là đề cao Toán quá mức. Rất nhiều vấn đề này là vấn đề kỹ thuật. Làm sao để lưu dữ liệu nhanh, làm sao để luân chuyển dữ liệu giữa GPU, CPU và bộ nhớ nhanh, làm sao để gộp nhiều vòng lặp lại để xử lý nhanh hơn. Nó không phải là toán theo cái cách mà anh nghĩ. Anh có thể xem bài báo về PageAttention hay speculative decoding là một số ví dụ.

Vấn đề về tiền thôi fen.

Train được 1 model xịn cần quá nhiều tiền. Mà làm ra được cũng không bằng của thế giới nên lãnh đạo VN chơi "đường tắt" là ... khỏi làm :big_smile:. Xài thẳng hàng open source cho rồi

Chứ thật ra để hiểu được toán trong Deep Learning chỉ cần xác suất thống kê ở bậc đại học là được (Để phát triển nó thì đuơng nhiên phải cao hơn)
 
Mà chưng cất là chưng cất dữ liệu chứ làm sao mà chưng cất được cái mô hình (model). Cũng không ai rõ là dữ liệu được chưng cất có giúp cho việc huấn luyện (train) model hội tụ nhanh hơn không.

Nếu dữ liệu là thứ duy nhất anh có hơn người khác chứ không phải là kỹ thuật huấn luyện thì việc anh bị bắt kịp chỉ là vấn đề thời gian vì dữ liệu có thể được xây dựng bằng cách bỏ tiền ra.
Nghe dễ thế thằng Google nó có cả đống data người dùng, lại còn cả đội engineer với researcher đằng sau thì nó phải đấm con Fable ra bã rồi chứ không phải giờ này con Gemini nó bị từ Claude, GPT cho đến model Tàu nó hành cho ra bã.

Model phế quá đến nỗi Google cắt token của Claude trong Antigravity đi, để người dùng chuyển sang Gemini nhưng làm thế bọn nó bỏ luôn Antigravity :go:
 

Thống kê chủ đề

Ngày tạo
ChatGPT AI,
Người trả lời cuối
Anonim,
Trả lời
73
Lượt xem
11.668
Quay lại
Lên đầu trang