làm gì có mô hình nào chưng cất mà bench cao hơn cả model gốc được.bọn mĩ xiaolol thôi,có bằng chứng nó đã đăng rồiMỹ đau đầu với chiêu chưng cất của Tàu nhỉ. Khó đối phó quá.
Chắc tại tôi già, nhưng gemini nó dài văn chương tôi thích, còn mấy con kia ngắn gọn hơnGemini và gpt nó có theo dõi lịch sử chat, nên ai dùng quen cái gì thì thấy cái đó tốt, nói nhẹ cái nó hiểu đúng ý mình luôn, hỏi con deepseek thì nó bảo mỗi khung chat của nó là độc lập, nên promt phải chuẩn.
Nên mới có chuyện ông nào dùng quen gemini chuyển sang gpt thấy nó hơi ngoo , và ngược lại.
Deepseek thì xài qua VSCode, tự soạn instruction cho riêng nó, tự chế harness, tự cấu hình trong custom provider mới ngonGemini và gpt nó có theo dõi lịch sử chat, nên ai dùng quen cái gì thì thấy cái đó tốt, nói nhẹ cái nó hiểu đúng ý mình luôn, hỏi con deepseek thì nó bảo mỗi khung chat của nó là độc lập, nên promt phải chuẩn.
Nên mới có chuyện ông nào dùng quen gemini chuyển sang gpt thấy nó hơi ngoo , và ngược lại.
5g thì sao,pin,đất hiếm?solarNhìn cái hệ điều hành laptop, hệ điều hành điện thoại đấy, AI rồi cũng vậy thôi nhé, có cớt mà ngang nhé, tier 2 hay tier 3 thì may ra còn được.
anh Phong còn bảo là từng muốn bỏ chatbot nhưng xung quanh ai cũng làm nên phải để đó mà 
mục tiêu là AGI và hiệu năng dựa trên nội lực tự chủ. Ascend 950 vẫn đi sau nhưng không phải là vấn đề một khi tự chủ 

Trước vẩu dơ không hiểu sao tung ra con deepseek lại opensource , mãi sau mới thấy tầm nhìn nó vl thậtCon DS nó có ưu tiên chatbot đâuanh Phong còn bảo là từng muốn bỏ chatbot nhưng xung quanh ai cũng làm nên phải để đó mà
Btw, đọc cái leak của anh Phong tuần trước mới thấy tầm nhìn của mấy anh fapsu quá đỉnhmục tiêu là AGI và hiệu năng dựa trên nội lực tự chủ. Ascend 950 vẫn đi sau nhưng không phải là vấn đề một khi tự chủ
Trước đó thì GLM mới hoàn thiện con gigawatt DC chạy 100% hàng nhà trồng nữa![]()
công nhận quen chat với Gemini nó nói dài dòng văn chương vl, chuyển sang ChatGPT nó trả lời ngắn gọn quá mất hứng vlChắc tại tôi già, nhưng gemini nó dài văn chương tôi thích, còn mấy con kia ngắn gọn hơn
dốt toán và ngu lý, nhưng lại rất khôn lỏi và có thói gatoDân Việt Nam vốn dốt toán và coi thường toán nên ko làm mấy con này dc đâu. Làm mấy ứng dụng là ngon lắm rồi![]()
hệ điều hành nó liên quan đến ứng dụng và hiệu ứng mạng lưới, ko so sánh đc.Nhìn cái hệ điều hành laptop, hệ điều hành điện thoại đấy, AI rồi cũng vậy thôi nhé, có cớt mà ngang nhé, tier 2 hay tier 3 thì may ra còn được.
Không biết fen để ý không chứ gần đây tôi thấy chất lượng của Gemini đi xuống thì phải, so với GPT và Claude thì có khoảng cách xa lắm.Xài deepseek thấy bt mà nhìu ng tung hô, tôi thấy gemini best nhất
Đr fen, gói free lúc trước bao ngon nhé, giờ thành gói fast..Không biết fen để ý không chứ gần đây tôi thấy chất lượng của Gemini đi xuống thì phải, so với GPT và Claude thì có khoảng cách xa lắm.
Mấy con AI Tàu dùng thử Qwen, Kimi và Deepseek, thì phải nói DS vẫn là nhất, tra mạng tìm thông tin tổng hợp nhanh, kém cái là ít tính năng thôi.
Ít tính năng chả qua là vì nó không tích hợp sẵn để mì ăn liền. Chứ nó cũng có vision, cũng xử lí code, cũng có web search. Tư duy của kĩ sư deepseek là end user tự chế harness, tự làm mcp, tự làm instruction,... cho các mục đích riêng, người ta chỉ cung cấp cái model - như 1 bộ não khôngKhông biết fen để ý không chứ gần đây tôi thấy chất lượng của Gemini đi xuống thì phải, so với GPT và Claude thì có khoảng cách xa lắm.
Mấy con AI Tàu dùng thử Qwen, Kimi và Deepseek, thì phải nói DS vẫn là nhất, tra mạng tìm thông tin tổng hợp nhanh, kém cái là ít tính năng thôi.
Chúng nó ra rả chưng cất copy nhưng có hiểu là cái gì đâu.Mà chưng cất là chưng cất dữ liệu chứ làm sao mà chưng cất được cái mô hình (model). Cũng không ai rõ là dữ liệu được chưng cất có giúp cho việc huấn luyện (train) model hội tụ nhanh hơn không.
Nếu dữ liệu là thứ duy nhất anh có hơn người khác chứ không phải là kỹ thuật huấn luyện thì việc anh bị bắt kịp chỉ là vấn đề thời gian vì dữ liệu có thể được xây dựng bằng cách bỏ tiền ra.

Chắc vậy fen à, nhưng người bình thường như tôi cũng đánh giá nó rất cao. Tư duy tốt, nhanh, context windows lớn, nói chuyện thân thiện, vậy là đủ rồi.Ít tính năng chả qua là vì nó không tích hợp sẵn để mì ăn liền. Chứ nó cũng có vision, cũng parse code, cũng có web search, tư duy của kĩ sư deepseek là end user tự chế harness, tự làm mcp, tự làm instruction, cho các mục đích riêng, người ta chỉ cung cấp cái model - như 1 bộ não không
Vn nếu 2000 giờ forum mọc ra như nấm chỉ cách build AI riêng rồi, tiếc là thời đó desktop app. Tạo desktop app riêngÍt tính năng chả qua là vì nó không tích hợp sẵn để mì ăn liền. Chứ nó cũng có vision, cũng xử lí code, cũng có web search. Tư duy của kĩ sư deepseek là end user tự chế harness, tự làm mcp, tự làm instruction,... cho các mục đích riêng, người ta chỉ cung cấp cái model - như 1 bộ não không

k biết sao chứ tôi thấy dân vn đề cao toán sợ cấp, toán mẹo thôi chứ mấy ai quan tâm đến toán cao cấp đâu. Phong trào toán ở dưới lớp 12 mạnh lên đại học mấy ai quan tâm. Có các thầy quan tâm nhưng cũng chả mấy ai thích nghiên cứu, le que vài ông thì “dân vn đề cao toán quá mức” là k có đâu.Tại sao anh nghĩ là cần nhiều toán để làm mấy cái này? Nếu anh học deep learning hay đọc bài báo transformer thì lượng toán không nhiều như anh nghĩ. Chủ yếu cần kiến thức toán đại học.
Dân Việt Nam có cái là đề cao Toán quá mức. Rất nhiều vấn đề này là vấn đề kỹ thuật. Làm sao để lưu dữ liệu nhanh, làm sao để luân chuyển dữ liệu giữa GPU, CPU và bộ nhớ nhanh, làm sao để gộp nhiều vòng lặp lại để xử lý nhanh hơn. Nó không phải là toán theo cái cách mà anh nghĩ. Anh có thể xem bài báo về PageAttention hay speculative decoding là một số ví dụ.
Tại sao anh nghĩ là cần nhiều toán để làm mấy cái này? Nếu anh học deep learning hay đọc bài báo transformer thì lượng toán không nhiều như anh nghĩ. Chủ yếu cần kiến thức toán đại học.
Dân Việt Nam có cái là đề cao Toán quá mức. Rất nhiều vấn đề này là vấn đề kỹ thuật. Làm sao để lưu dữ liệu nhanh, làm sao để luân chuyển dữ liệu giữa GPU, CPU và bộ nhớ nhanh, làm sao để gộp nhiều vòng lặp lại để xử lý nhanh hơn. Nó không phải là toán theo cái cách mà anh nghĩ. Anh có thể xem bài báo về PageAttention hay speculative decoding là một số ví dụ.
. Xài thẳng hàng open source cho rồiNghe dễ thế thằng Google nó có cả đống data người dùng, lại còn cả đội engineer với researcher đằng sau thì nó phải đấm con Fable ra bã rồi chứ không phải giờ này con Gemini nó bị từ Claude, GPT cho đến model Tàu nó hành cho ra bã.Mà chưng cất là chưng cất dữ liệu chứ làm sao mà chưng cất được cái mô hình (model). Cũng không ai rõ là dữ liệu được chưng cất có giúp cho việc huấn luyện (train) model hội tụ nhanh hơn không.
Nếu dữ liệu là thứ duy nhất anh có hơn người khác chứ không phải là kỹ thuật huấn luyện thì việc anh bị bắt kịp chỉ là vấn đề thời gian vì dữ liệu có thể được xây dựng bằng cách bỏ tiền ra.
