(Mỹ) Phố Wall có thể lại sụp đổ vì siêu AI Trung Quốc này

  • Người tạo chủ đề Người tạo chủ đề ChatGPT AI
  • Ngày bắt đầu Ngày bắt đầu
k biết sao chứ tôi thấy dân vn đề cao toán sợ cấp, toán mẹo thôi chứ mấy ai quan tâm đến toán cao cấp đâu. Phong trào toán ở dưới lớp 12 mạnh lên đại học mấy ai quan tâm. Có các thầy quan tâm nhưng cũng chả mấy ai thích nghiên cứu, le que vài ông thì “dân vn đề cao toán quá mức” là k có đâu.
VN cũng chưa từng đề cao toán sơ cấp nốt.
Không có cái kiểu học toán nào mà lại đi học mẹo nhưng mà bỏ qua bản chất cả, đấy không phải là học.
 
bọn TQ nó free vì nhắm vào nền tảng công nghiệp.
các hãng muốn tự host AI hơn là thuê ngoài (lộ thông tin)
ai muốn support thì call hãng tq
 
Anh đừng trích dẫn của tôi nữa được không? Một người không hiểu là trong cuộc đời không phải lúc nào cũng đâm đầu vào bái toán khó nhất mà phải chọn bài toán phù hợp với khả năng của mình thì không đáng để tôi mất thời gian. Tôi không làm phiền anh, anh cũng đừng làm phiền tôi.
À tưởng thế nào :go:
Tức là không làm được thì nói làm không làm được cho nó nhanh gọn đi, ngồi kêu không cần thiết giống mấy thằng lùa gà ở VN :go:
 
Có con AI nào của TQ dùng để chỉnh ảnh ngon ko?
chúng nó dùng ai làm cả hoạt hình 3d , tô điểm cho đẹp hơn.
sắp tới 1 loạt hh3d sẽ đc làm = ai đấy. sắp chiếu rồi. mà tôi quên cmn tên rồi
1 trong số đó : " ta là tà đế " - nv là : " cố cmg đó. "
 
Vấn đề về tiền thôi fen.

Train được 1 model xịn cần quá nhiều tiền. Mà làm ra được cũng không bằng của thế giới nên lãnh đạo VN chơi "đường tắt" là ... khỏi làm :big_smile:. Xài thẳng hàng open source cho rồi

Chứ thật ra để hiểu được toán trong Deep Learning chỉ cần xác suất thống kê ở bậc đại học là được (Để phát triển nó thì đuơng nhiên phải cao hơn)
trọng dụng nhân tài : -1
lương cho nhân tài : -1
vốn đổ vào quá nhiều : -1
cần quá nhiều thời gian để cumback : -1

forland : +9000 lực chiến

chúng nó dùng ai làm cả hoạt hình 3d , tô điểm cho đẹp hơn.
sắp tới 1 loạt hh3d sẽ đc làm = ai đấy. sắp chiếu rồi. mà tôi quên cmn tên rồi
1 trong số đó : " ta là tà đế " - nv là : " cố cmg đó. "
đầy rồi mà :D, cùng 1 plot 1 motip, nó xào ra chục bản # nhau nữa :D, do train = chính hàng nhà trồng nênđôi khi thấy lậpđen, an than,v.v. :D

nhưng fan của mấy bộ như MTK, thấy dùng AI ngu nó bash cho sấp mặt, nên chỉ dám dùng AI cho background


.vv.

 
Ít tính năng chả qua là vì nó không tích hợp sẵn để mì ăn liền. Chứ nó cũng có vision, cũng xử lí code, cũng có web search. Tư duy của kĩ sư deepseek là end user tự chế harness, tự làm mcp, tự làm instruction,... cho các mục đích riêng, người ta chỉ cung cấp cái model - như 1 bộ não không
Có tút nào xịn xịn chút về cái này ko fen, có mua 10$ API deepseek mà đang để đấy.
Hay đưa thằng Claude nó cook cho nhỉ
 
chúng nó dùng ai làm cả hoạt hình 3d , tô điểm cho đẹp hơn.
sắp tới 1 loạt hh3d sẽ đc làm = ai đấy. sắp chiếu rồi. mà tôi quên cmn tên rồi
1 trong số đó : " ta là tà đế " - nv là : " cố cmg đó. "
Xạo à. Bản quyền đâu mà làm
 
Có tút nào xịn xịn chút về cái này ko fen, có mua 10$ API deepseek mà đang để đấy.
Hay đưa thằng Claude nó cook cho nhỉ
Claude design
DeepSeek implement

Còn muốn hàng ăn liền hơn tí thì Kimi

Nhưng mà chỉ nên dùng code hoặc phân tích text thôi, DeepSeek không mạnh phân tích vision bằng các model khác của TQ.
 
Có tút nào xịn xịn chút về cái này ko fen, có mua 10$ API deepseek mà đang để đấy.
Hay đưa thằng Claude nó cook cho nhỉ
1 cách là xài Claude với DeepSeek Max, 2 là thím xài Reasonix, xài tới tết chưa hết token.
cách xài cũng dễ thôi, thím hãy dùng công thức cơ bản là RPI, research planning implementation. Rồi vào plan mode lập plan gõ thôi, làm biếng thì cài thêm Matt Pocock grill-me để cho dễ plan, xong implement thì cứ gõ thế này cho tôi
"/goal implement plan đó cho tôi đến khi nào xong, test code đầy đủ" :big_smile:
Dễ hơn nữa là thím cứ nói con Claude hay DeepSeek gì đấy "cho tôi biết RPI là gì và hãy làm xxx theo cách đó" nó chỉ cho. Dùng DeepSeek-v4-flash cho nó ngon bổ rẻ.
 
Claude design
DeepSeek implement

Còn muốn hàng ăn liền hơn tí thì Kimi

Nhưng mà chỉ nên dùng code hoặc phân tích text thôi, DeepSeek không mạnh phân tích vision bằng các model khác của TQ.

1 cách là xài Claude với DeepSeek Max, 2 là thím xài Reasonix, xài tới tết chưa hết token.
cách xài cũng dễ thôi, thím hãy dùng công thức cơ bản là RPI, research planning implementation. Rồi vào plan mode lập plan gõ thôi, làm biếng thì cài thêm Matt Pocock grill-me để cho dễ plan, xong implement thì cứ gõ thế này cho tôi
"/goal implement plan đó cho tôi đến khi nào xong, test code đầy đủ" :big_smile:
Dễ hơn nữa là thím cứ nói con Claude hay DeepSeek gì đấy "cho tôi biết RPI là gì và hãy làm xxx theo cách đó" nó chỉ cho. Dùng DeepSeek-v4-flash cho nó ngon bổ rẻ.
Cảm ơn 2 thím.
Tóm lại là dùng Claude lên plan rồi lấy cái master plan đó ném qua DS implement nhỉ.
2 thím có đánh giá về output của DS so với Claude code ko, được mấy phần chả hạn ý.
 
Cảm ơn 2 thím.
Tóm lại là dùng Claude lên plan rồi lấy cái master plan đó ném qua DS implement nhỉ.
2 thím có đánh giá về output của DS so với Claude code ko, được mấy phần chả hạn ý.
Để nó code ít ít gọn gọn chia task từng phần thì ngon
Nhưng task to cần reasoning nhiều thì chia nhỏ nó ra, cố gắng để Claude nó viết plan càng chi tiết càng tốt. Thật ra nếu bật max reasoning trên DS V4 Pro cũng tạm, nhưng đến mức đấy nó không tận dụng được hoàn toàn cái tính giá rẻ của DS như kiểu culi nữa.
 
Đợt Deekseek cũng lên báo rầm rộ xong lại đâu vào đấy, cười ỉa

DeepSeek nó kiểu freestyle không cần tiền thế éo nào ấy chứ. Không phải ngẫu nhiên mà dân mạng có câu "Deepseek moment".

Mấy cái paper của nó là xương sống của đám LLM open-source luôn. Kimi, GLM đều theo kiến trúc của th DeepSeek


Theo tình hình hiện tại thì

  • GLM ~ Kimi: Theo hướng ng dùng, kiếm tiền
  • Deepseek: Theo hướng học thuật. Những paper của nó vẫn bá vcc
 
hông ai đưa tin về opus 5 à, thấy quảng cáo điểm benchmark kinh khủng lắm, có cái vượt fable 5 cả khúc :shame:
anthropic đã phải delay release 1 ngày, chắc để cheat điểm bench, chứ không ra mắt mà thua kimi k3 thì biết giấu mặt mũi vào đâu
8JgyqcC.gif
 
1785091734225.webp

đang xài browser của tàu, nói chung ngon nhé...
trước ucbrowser chưa có bản chính thức pc nay có rồi.
có xài maxthon của hongkong nữa

Nếu nói tàu giỏi cái gì thì đó là thuật toán nén dung lượng, nhẹ phết nhưng lại ngon.
 
Tại sao anh nghĩ là cần nhiều toán để làm mấy cái này? Nếu anh học deep learning hay đọc bài báo transformer thì lượng toán không nhiều như anh nghĩ. Chủ yếu cần kiến thức toán đại học.

Dân Việt Nam có cái là đề cao Toán quá mức. Rất nhiều vấn đề này là vấn đề kỹ thuật. Làm sao để lưu dữ liệu nhanh, làm sao để luân chuyển dữ liệu giữa GPU, CPU và bộ nhớ nhanh, làm sao để gộp nhiều vòng lặp lại để xử lý nhanh hơn. Nó không phải là toán theo cái cách mà anh nghĩ. Anh có thể xem bài báo về PageAttention hay speculative decoding là một số ví dụ.
Cái anh nói chỉ đúng cho bn ktmt và lm phần cứng thôi. Đám front tier vẫn dùng nhiều toán. Mà deep learning nào k nặng toán? Anh nghĩ hc xong mấy cái regression hay lan truyền ngc là xong chắc
 
Vấn đề về tiền thôi fen.

Train được 1 model xịn cần quá nhiều tiền. Mà làm ra được cũng không bằng của thế giới nên lãnh đạo VN chơi "đường tắt" là ... khỏi làm :big_smile:. Xài thẳng hàng open source cho rồi

Chứ thật ra để hiểu được toán trong Deep Learning chỉ cần xác suất thống kê ở bậc đại học là được (Để phát triển nó thì đuơng nhiên phải cao hơn)
The fck. Deep learning đòi hc mỗi xstk là hiểu? Xstk nào dạy hàm mục tiêu thế ( cái này dạy trg tối uư hóa) ? Về sau hc lan truyền ngc chủ yếu là dstt + đạo hàm nhiều biến. Xstk nào dạy cái này?
 

Tệp đính kèm

  • Screenshot_20260727_021916_com_google_android_apps_docs_InternalProjectorActivity_edit_159153...webp
    Screenshot_20260727_021916_com_google_android_apps_docs_InternalProjectorActivity_edit_159153...webp
    56,7 KB · Lượt xem: 13
Anh có thể cho tôi biết kiến thức toán nào cần thiết để làm deep learning được không? Tôi không rõ là các frontier labs dùng nhiều toán thế nào nhưng những bài báo tôi đọc thì không cần nhiều toán để hiểu. Anh có thể cho tôi biết cụ thể là các frontier labs dùng nhiều toán thế nào?

Theo kinh nghiệm của tôi, hầu hết các thuật toán chạy đểu là dạng heuristics nghĩa là người ta chỉ cảm thấy rằng làm thế có hiệu quả còn không giải thích cụ thể là tại sao. Người ta thử và kết quả nó tốt hơn chứ không phải người ta ngồi làm Toán rồi bằng cách giải bài toán đó dẫn đến kết quả tốt hơn.
Vd cụ thể về DL nặng toán thì flow matching đấy thôi. Chủ yếu dùng ptvp.
Có p DL nào cx dùng heuratics theo kinh nghiệm đâu.
 
Sửa lần cuối:
Deepseek thì xài qua VSCode, tự soạn instruction cho riêng nó, tự chế harness, tự cấu hình trong custom provider mới ngon

Con hàng này k dành cho non-tech xài vì nó không ưu tiên làm hệ sinh thái mì ăn liền, mà con chatbot nó dùng chán
Hôm tôi có hỏi token free kêu được tầm 2000 trang word gì đấy, mà gửi file python cho nó sửa, được mấy tin đã hết 1% rồi, kêu file nặng, công nhận nó làm nhanh và gọn chứ không huyên thuyên như thằng gpt
 

Thống kê chủ đề

Ngày tạo
ChatGPT AI,
Người trả lời cuối
Anonim,
Trả lời
73
Lượt xem
11.668
Quay lại
Lên đầu trang