(Trung Quốc) Token AI giá rẻ của Trung Quốc: Lợi thế cạnh tranh mới trong cuộc đua AI tại châu Á

  • Người tạo chủ đề Người tạo chủ đề ChatGPT AI
  • Ngày bắt đầu Ngày bắt đầu
local để làm assistant chứ ai bắt nó code đâu các bác ?
qwen, gemma có VGA ngon thì làm trợ lý, phụ trách mấy việc như dịch thuật, TTS, STT,... quá ngon
như TTS mà xài gemini TTS nó đốt tiền vkl
trong khi xài model local chạy rẻ hơn nhiều
Assistant cũng ko ăn thua, để dịch local ngon với đủ nhanh thì cũng cần card nvidia xịn, cũng mấy chục củ, tính ra chi phí ko rẻ hơn cloud dc, mình đã từng build local rồi mình biết, tính toán kĩ thì mua cloud của tq xài tẹt ga, rẻ chán, cộng thêm mây con free của google nữa thì local ko bao giờ ăn dc
 
Giờ cần mấy anh tàu làm con agent vip pro hơn claude cowork/claude code cơ. Chứ model dần dần sẽ bị bão hòa thôi.
 
Assistant cũng ko ăn thua, để dịch local ngon với đủ nhanh thì cũng cần card nvidia xịn, cũng mấy chục củ, tính ra chi phí ko rẻ hơn cloud dc, mình đã từng build local rồi mình biết, tính toán kĩ thì mua cloud của tq xài tẹt ga, rẻ chán, cộng thêm mây con free của google nữa thì local ko bao giờ ăn dc
5070 giờ chạy vô tư rồi
Blackwell chạy nén của nvidia vô tư

Chạy gemini tts vài tiếng đã hết cả trăm k rồi
Chạy 1 ngày là móm lun

Hoặc chạy ocr minerU (document -> md)tài liệu cũng hao lắm
 
Sao nó làm được giá rẻ như vậy ?
EB2RUU6.gif
 
deepseek mới là vua giá
con GLM 5.2 chất lượng cũng top tier,nếu giá mà như deepseek nữa là best
 
5070 giờ chạy vô tư rồi
Blackwell chạy nén của nvidia vô tư

Chạy gemini tts vài tiếng đã hết cả trăm k rồi
Chạy 1 ngày là móm lun

Hoặc chạy ocr minerU (document -> md)tài liệu cũng hao lắm
Cho mình hỏi 5070 16GB vs 3090 24GB thì TTS con nào hơn nhỉ?
 
Hình như mấy thằng Tây nó đẻ ra mô hình mới cái là mô hình cũ sẽ ngu dần đi thì phải. Xưa mới xài thì thấy con Opus 4.6 ngon bao nhiêu, hỏi gì trả lời cũng nhanh, cũng chuẩn. Sau nó đẻ ra 4.8 thì thấy con 4.6 của mình cứ đần đần kiểu gì ấy, hỏi phải 2 3 lần nó mới trả lời đúng chủ đề như xưa. Có thể là do mình lười prompt hơn xưa, hoặc nó ngu đi thật
Tụi tư bản bị chửi cũng không oan, iPhone mới mua mạnh bao nhiêu sau khoảng vài lần update iOS là chậm dần.
Macbook cũng vậy, con Macbook Air M1 ngày xưa chạy xé gió, lên MacOS 26 hiệu ứng Liquid Glass tào lao gì đó bị lag, vãi thật.
 
Assistant cũng ko ăn thua, để dịch local ngon với đủ nhanh thì cũng cần card nvidia xịn, cũng mấy chục củ, tính ra chi phí ko rẻ hơn cloud dc, mình đã từng build local rồi mình biết, tính toán kĩ thì mua cloud của tq xài tẹt ga, rẻ chán, cộng thêm mây con free của google nữa thì local ko bao giờ ăn dc
Mình cũng không rõ nhưng bây giờ những con Mac M chạy được local LLM đang hot quá chừng, kiếm con cũ ram cao mua càng khó. Cái thời đại quái quỉ thật.
 
Mình cũng không rõ nhưng bây giờ những con Mac M chạy được local LLM đang hot quá chừng, kiếm con cũ ram cao mua càng khó. Cái thời đại quái quỉ thật.
Chắc mấy con m4 mini chạy openclaw, tụi này nó chạy AI cloud chứ local gì, còn con m5 max 64 gb ram chạy cũng chỉ dx khoảng 30, 40 token/s, chạy thì 100% cpu nó hú kinh vl
 
Opensource Model càng ngày càng nhiều tham số. Năm nay opensource model đuổi kịp frontier thì frontier lại ra model mới mạnh hơn, khiên local model lại bị tụt hậu và nhiều tham số thi lại đòi phần cứng dữ hơn. Các hãng đang đua nhau về tham số chứ chưa thấy cuộc đua giảm tham số và giảm chi phí tính toán. Nếu giảm chi phí tính toán một, nhưng model mới lại đòi token tăng 2 thì cũng k ổn. Hiện tại opensource model chạy được trên các máy phải khá mạnh mới ổn nhưng xu hướng tăng tham số thì tiền ram, gpu lại tăng lên, người dùng cá nhân sẽ khó có đủ khả năng chạy đua local model.

Chưa biết tình hình tương lai thế nào thôi cứ tạm dùng cloud model kết hợp với opensource để giảm chi phí thôi
 
Opensource Model càng ngày càng nhiều tham số. Năm nay opensource model đuổi kịp frontier thì frontier lại ra model mới mạnh hơn, khiên local model lại bị tụt hậu và nhiều tham số thi lại đòi phần cứng dữ hơn. Các hãng đang đua nhau về tham số chứ chưa thấy cuộc đua giảm tham số và giảm chi phí tính toán. Nếu giảm chi phí tính toán một, nhưng model mới lại đòi token tăng 2 thì cũng k ổn. Hiện tại opensource model chạy được trên các máy phải khá mạnh mới ổn nhưng xu hướng tăng tham số thì tiền ram, gpu lại tăng lên, người dùng cá nhân sẽ khó có đủ khả năng chạy đua local model.

Chưa biết tình hình tương lai thế nào thôi cứ tạm dùng cloud model kết hợp với opensource để giảm chi phí thôi
Bây giờ cố tối ưu ở tầng service/agent chứ model khó tối ưu lắm. Đội nghiên cứu cũng đang rẽ thử hướng khác rồi
 
Opensource Model càng ngày càng nhiều tham số. Năm nay opensource model đuổi kịp frontier thì frontier lại ra model mới mạnh hơn, khiên local model lại bị tụt hậu và nhiều tham số thi lại đòi phần cứng dữ hơn. Các hãng đang đua nhau về tham số chứ chưa thấy cuộc đua giảm tham số và giảm chi phí tính toán. Nếu giảm chi phí tính toán một, nhưng model mới lại đòi token tăng 2 thì cũng k ổn. Hiện tại opensource model chạy được trên các máy phải khá mạnh mới ổn nhưng xu hướng tăng tham số thì tiền ram, gpu lại tăng lên, người dùng cá nhân sẽ khó có đủ khả năng chạy đua local model.

Chưa biết tình hình tương lai thế nào thôi cứ tạm dùng cloud model kết hợp với opensource để giảm chi phí thôi
Bây giờ cố tối ưu ở tầng service/agent chứ model khó tối ưu lắm. Đội nghiên cứu cũng đang rẽ thử hướng khác rồi
 
5070 có 12GB thôi
nhưng nếu chạy model nhỏ thì nó chạy nhanh hơn 3090,
chưa kể kiến trúc mới chạy được nén NVFP4
nhưng model lớn thì ko đủ VRAM
nhưng đã vram to thì chả tội gì test model nhỏ cả :D llm thì vram là quan trọng nhất rồi
đợt rồi hốt cú chót con mimi m4 16gb 12tr5 định chạy local mấy model nhỏ, mà nó ngốn mớ ram lag hết máy chả ăn thua. đợi dư giả tí mua vga ram to cắm homelab chơi chứ máy làm việc ko chơi dc
 
nhưng đã vram to thì chả tội gì test model nhỏ cả :D llm thì vram là quan trọng nhất rồi
đợt rồi hốt cú chót con mimi m4 16gb 12tr5 định chạy local mấy model nhỏ, mà nó ngốn mớ ram lag hết máy chả ăn thua. đợi dư giả tí mua vga ram to cắm homelab chơi chứ máy làm việc ko chơi dc
Đâu phải cái j cũng nhét llm đâu
SLM cho từng nhu cầu đặc thù
Hoặc chạy nén cho các tác vụ ko cần suy luận hoặc độ chính xác cao
 

Thống kê chủ đề

Ngày tạo
ChatGPT AI,
Người trả lời cuối
vanhai493,
Trả lời
55
Lượt xem
6.664
Quay lại
Lên đầu trang