DeepSeek-V4-Flash chính thức ra mắt, tăng tốc cuộc đua tác tử AI với OpenAI

  • Người tạo chủ đề Người tạo chủ đề dogamer06
  • Ngày bắt đầu Ngày bắt đầu
chửi tôi cẩu nô tôi cũng chịu, chứ rẻ thối thế này ngu gì ko dùng, chịu khó instruction cho nó thôi cũng đủ dùng rồi
uq1dgnk.png

Xem tệp đính kèm 3739156
Mới tuyên bố tăng giá gấp đôi nếu thời điểm đó có nhiều người dùng kìa. Đồng thời cũng hoãn IPO trong giai đoạn này rồi.
 
Mới tuyên bố tăng giá gấp đôi nếu thời điểm đó có nhiều người dùng kìa. Đồng thời cũng hoãn IPO trong giai đoạn này rồi.
cũng đâu vấn đề gì, vẫn rẻ mà, vấn đề khi dùng deepseek chủ yếu spam con flash thôi, còn ít dùng con pro lắm chỉ khi dùng cho tác vụ reasoning thôi
 
Sửa lần cuối:
Deepseek trước giờ không chơi benchmaxxing.
Deepseek là cụ tổ của ngành benchmaxxing luôn ấy chứ. Nó dùng harness riêng, post-train để cắn điểm benchmark.
Qwen/Minimax/GLM là những thằng uy tín hơn. Nhất là thằng Qwen, khá xanh chín, không chơi harness riêng để cheat lỏ. Vì thế ở TQ thì dù con Qwen giá cao hơn, điểm benchmark thấp hơn nhiều nhưng được tin dùng hơn hẳn Deepseek. Ưu điểm lớn của Deepseek là rẻ nhất trong số những thằng agentic hiện tại. Còn tiền nào của đấy thôi.
 
Thế có phải ngớ ngẩn không khi cho một con quá dốt làm task khiến bước review và test phải dùng nhiều token của model khôn để vá víu cho nó trong khi cuối cùng thì chất lượng code vẫn rất kém, thiếu tối ưu vì nó vẫn là code do con model ngu viết ra.
Bảo cho Opus/Sol làm plan rồi GLM/Kimi/Qwen Max/Terra/Luna/Deepseek Pro làm task nó còn có lý. Deepseek Flash làm thì đầu ra nó có ra cái gì đâu. Chẳng rác rưởi benchmaxx. Benchmaxx đến mức đè cả GLM 5.2, suýt bằng Terra và Opus thì nó lại chả láo toét vkl.
như này ổn không thím.
em dùng model cùi để làm task thấy nó bị nông, sai, không rõ ý, dù plan khá ok. Cuối cùng dùng model khôn sửa lại thì tính tổng tốn token mà công check còn nhiều hơn.
 
như này ổn không thím.
em dùng model cùi để làm task thấy nó bị nông, sai, không rõ ý, dù plan khá ok. Cuối cùng dùng model khôn sửa lại thì tính tổng tốn token mà công check còn nhiều hơn.
Làm lụng kiếm ăn thì cứ quất lấy 1 con ChatGPT Plus. Plan tử tế vào, tách task nguyên tử. Plan bằng Sol medium/high là đủ. Xong ném cho Terra medium hoặc Luna Max thực thi. Chỉ $20 mà quota đủ làm thoải mái cả tháng. Nếu sinh viên nghèo chưa có tiền thì làm cái thẻ ngân hàng đăng ký cái trial của ChatGPT Plus cũng dùng được 1 tháng.

Nghèo quá còn không có nổi thẻ ngân hàng thì chơi ChatGPT Go 3 tháng (thông qua gói của Shopee) để lấy model mà plan. Rồi làm 1 tài khoản Command Code nó đang sale $1/tháng để lấy model mà chạy (mặt hàng này tôi thấy share trên mạng, chưa dùng thử)
 
Làm lụng kiếm ăn thì cứ quất lấy 1 con ChatGPT Plus. Plan tử tế vào, tách task nguyên tử. Plan bằng Sol medium/high là đủ. Xong ném cho Terra medium hoặc Luna Max thực thi. Chỉ $20 mà quota đủ làm thoải mái cả tháng. Nếu sinh viên nghèo chưa có tiền thì làm cái thẻ ngân hàng đăng ký cái trial của ChatGPT Plus cũng dùng được 1 tháng.
Nghèo quá còn không có nổi thẻ ngân hàng thì chơi ChatGPT Go 3 tháng (thông qua gói của Shopee) để lấy model mà plan. Rồi làm 1 tài khoản Command Code nó đang sale $1/tháng để lấy model mà chạy (mặt hàng này tôi thấy share trên mạng, chưa dùng thử)

Mua lậu một tháng có tầm 150-200k thôi ấy bác. Còn 150k/tháng ko có thì...
Emoji


Sent from ‎ via VOZVNApp
 
Làm lụng kiếm ăn thì cứ quất lấy 1 con ChatGPT Plus. Plan tử tế vào, tách task nguyên tử. Plan bằng Sol medium/high là đủ. Xong ném cho Terra medium hoặc Luna Max thực thi. Chỉ $20 mà quota đủ làm thoải mái cả tháng. Nếu sinh viên nghèo chưa có tiền thì làm cái thẻ ngân hàng đăng ký cái trial của ChatGPT Plus cũng dùng được 1 tháng.

Nghèo quá còn không có nổi thẻ ngân hàng thì chơi ChatGPT Go 3 tháng (thông qua gói của Shopee) để lấy model mà plan. Rồi làm 1 tài khoản Command Code nó đang sale $1/tháng để lấy model mà chạy (mặt hàng này tôi thấy share trên mạng, chưa dùng thử)
bữa mình cũng làm vầy nè. Mà kết quả không ưng ý lắm.

Task mình chia làm 10 phần. Phần 1-2 dùng thẳng Sol High luôn, ra kết quả rất chi tiết, ưng ý.
Phần 3-4-5 dùng Luna Terra là thấy vấn đề liền, thiếu thông tin, ngữ cảnh không đủ, nội dung không đúng. Kêu nó lấy phần 1-2 làm tham khảo cũng không được

Cuối cùng phải làm lại với Sol High luôn.
 
bữa mình cũng làm vầy nè. Mà kết quả không ưng ý lắm.

Task mình chia làm 10 phần. Phần 1-2 dùng thẳng Sol High luôn, ra kết quả rất chi tiết, ưng ý.
Phần 3-4-5 dùng Luna Terra là thấy vấn đề liền, thiếu thông tin, ngữ cảnh không đủ, nội dung không đúng. Kêu nó lấy phần 1-2 làm tham khảo cũng không được

Cuối cùng phải làm lại với Sol High luôn.
Thế thì phen chưa biết làm /docs rồi. Phải có /docs đầy đủ cho dự án, cho feature và tự động nạp đầu session.

via theNEXTvoz for iPhone
 
Mình phân tích dữ liệu, database thì có sẵn, có cách nào mỗi lần phân tích mới codex nó vô đúng các cột lấy ra mà không cần audit không các bác?
 
anh em cứ dùng claude hay gpt mà viết plan thật xịn, chia sẵn plan ra làm mấy phase khác nhau rồi dùng model Tàu làm thợ code thôi, sau khi code xong dùng lại model top tier để review, check, tìm bug, sau lại đưa ra plan fix bug cho đám model Tàu vào fix

chứ éo ai để đám model tàu vừa nghĩ vừa code, vừa nghĩ vừa code thì đến claude hay gpt nhiều lúc còn ngu chứ nói gì model tàu
uxby0Nl.gif
 
Tôi viết design với test sẵn rồi cho V4 Flash nó viết code tận tình theo cái doc đấy để tận dụng giá rẻ chứ tôi có bao giờ để nó nghĩ thay tôi đâu mà phải lo lủng
nhưng nó nát thật mà anh, bét lắm cũng v4 pro chứ, con v4 flash dùng để code t thấy nó phải kém cỡ gpt-120b
 
nhưng nó nát thật mà anh, bét lắm cũng v4 pro chứ, con v4 flash dùng để code t thấy nó phải kém cỡ gpt-120b
Fen có động gì đến frontend không
Nếu FE thì DeepSeek nó khá là oẳng (bọn nó chưa có xử lý vision ngon với có vẻ không train cho FE)
Còn thuần backend thì nó là ngon lắm
 

Thống kê chủ đề

Ngày tạo
dogamer06,
Người trả lời cuối
beovila1,
Trả lời
88
Lượt xem
14.281
Quay lại
Lên đầu trang