DeepSeek-V4-Flash chính thức ra mắt, tăng tốc cuộc đua tác tử AI với OpenAI

  • Người tạo chủ đề Người tạo chủ đề dogamer06
  • Ngày bắt đầu Ngày bắt đầu
nhờ các cao nhân giúp mình một pipeline dùng phân tích dữ liệu mà có thể dùng deepseek được, dùng Sora ngốn tiền quá.
 
bữa mình cũng làm vầy nè. Mà kết quả không ưng ý lắm.
Task mình chia làm 10 phần. Phần 1-2 dùng thẳng Sol High luôn, ra kết quả rất chi tiết, ưng ý.
Phần 3-4-5 dùng Luna Terra là thấy vấn đề liền, thiếu thông tin, ngữ cảnh không đủ, nội dung không đúng. Kêu nó lấy phần 1-2 làm tham khảo cũng không được
Cuối cùng phải làm lại với Sol High luôn.

thử xài skill handoff đi bác

Sent from ‎ via VOZVNApp
 
chửi tôi cẩu nô tôi cũng chịu, chứ rẻ thối thế này ngu gì ko dùng, chịu khó instruction cho nó thôi cũng đủ dùng rồi
uq1dgnk.png

Xem tệp đính kèm 3739156
Bác dùng cho tác vụ gì thế? Coding được không?

via theNEXTvoz for iPhone
 
Bác dùng cho tác vụ gì thế? Coding được không?

via theNEXTvoz for iPhone
Coding là chủ yếu, dùng theo hướng mấy bác comment ở trên, dùng model xịn để plan chi tiết, deepseek flash implement với fix bug, mà coding thì code FE né deepseek ra vì nó bị mù ko đọc dc ảnh code ngu lắm, nhưng code thuần logic, backend hay SQL lại rất ổn.
Ngoài ra mình dùng deepseek flash làm LLM cho hermes agent để tự host một web chat AI thay thế cho chatgpt, gemini vì tận dụng dc nhiều tool call khi tìm hiểu cái gì đó

À hiện tại mình dùng claude code với deepseek API để code, mình thời gian dài dùng claude để code nên làm biếng đổi sang agent coding khác

via theNEXTvoz for iPhone
 
Khuyên anh em đừng tham rẻ, hỏng mẹ nó hết project.
Nãy thử fork cái dự án đang làm 100% bằng Kimi K3, vất cho K3 làm task tiếp theo nhưng thử thêm con đíp shit này làm sub agent phụ, nó chạy hơn tiếng hết limit con Ollama Cloud xong rồi tịt. Đấy là K3 nó prompt dài như cái sớ rồi đấy, bố của chi tiết luôn mà còn éo làm được cái gì
Tốt nhất dùng cho mấy việc lặt vặt thôi, còn dự án khuyên ae cứ K3, Opus, Sol mà giã. Hết limit thì ngồi đợi chứ đừng cho bọn rẻ thò mũi vào
 
tôi hơi chậm chân vụ AI, bắt đầu dùng từ hồi con deepseek v4 này ra, thấy cũng ổn mà, kiểu mình chỉ cần 1 con làm những gì mình bảo thôi :))
 
Khuyên anh em đừng tham rẻ, hỏng mẹ nó hết project.
Nãy thử fork cái dự án đang làm 100% bằng Kimi K3, vất cho K3 làm task tiếp theo nhưng thử thêm con đíp shit này làm sub agent phụ, nó chạy hơn tiếng hết limit con Ollama Cloud xong rồi tịt. Đấy là K3 nó prompt dài như cái sớ rồi đấy, bố của chi tiết luôn mà còn éo làm được cái gì
Tốt nhất dùng cho mấy việc lặt vặt thôi, còn dự án khuyên ae cứ K3, Opus, Sol mà giã. Hết limit thì ngồi đợi chứ đừng cho bọn rẻ thò mũi vào
Gớm. Với đội quân vibe code, chỉ biết oneshot, codebase không có tí ownership nào thì có dùng Mythos cũng nát thôi. Những kĩ sư làm việc thật, trình độ thật thì model tàu self-host thôi cũng đủ 10x rồi.
 
Con flash cứ như đồ ăn ấy nhỉ, người khen ngon, kẻ chê dở :D chả hiểu sao mình dùng từ lúc mới preview tới giờ chả có gì để chê với cái giá bỏ ra :D qua nay đang xem chỉnh lại guardrail để tận dụng con GA mới xem hiệu quả tăng thế nào :D

1785597839846.webp
 
Mình phân tích dữ liệu, database thì có sẵn, có cách nào mỗi lần phân tích mới codex nó vô đúng các cột lấy ra mà không cần audit không các bác?
Nên cho nó viết 1 chương trình phân tích dữ liệu, khi nào chạy thì bác chạy chương trình đó, hoặc bảo AI agent dùng chương trình đó phân tích và báo cáo kết quả cho bác
 
Con flash cứ như đồ ăn ấy nhỉ, người khen ngon, kẻ chê dở :D chả hiểu sao mình dùng từ lúc mới preview tới giờ chả có gì để chê với cái giá bỏ ra :D qua nay đang xem chỉnh lại guardrail để tận dụng con GA mới xem hiệu quả tăng thế nào :D

Xem tệp đính kèm 3739640
Vì thế giới giờ toàn vibecoder có hiểu gì về thiết kế hay hệ thống đâu, toàn muốn oneshot... Mà cái món này thì model to may ra có winrate cao hơn bọn nhỏ. Ngồi test con ds4f 0731 mấy hôm mà thấy ngon quá so với giá., fix 1 mớ lỗi bọn khác không làm được
 
benchmark hiện tại con deepseek mới release 3107 hơn nhiều model, rẻ hơn cả chục lần
Con deepseek mới với luna hiện tại gần = nhau, nhưng con deepseek rẻ hơn 1 chút.
Xem tệp đính kèm 3740223
Xem tệp đính kèm 3740220
Xem tệp đính kèm 3740219
Xem tệp đính kèm 3740218

1785662962849.webp


được cái rẻ, chứ so GPT dùng vẫn thua Opus

sáng thử dùng deepseek-flash thấy hơi chậm có vẻ giờ cao điểm thiếu cạc
 
Xem tệp đính kèm 3740227

được cái rẻ, chứ so GPT dùng vẫn thua Opus

sáng thử dùng deepseek-flash thấy hơi chậm có vẻ giờ cao điểm thiếu cạc
dĩ nhiên rồi bác, nhìn bảng đi. opus 5 hiện tại là trùm nhưng usage token của nó hao hơn cả trăm lần con deepseek mà.
Chia tác vụ ra mà làm thôi. Chứ mấy cái task đơn giản mà cũng xài opus thì thua
 

Thống kê chủ đề

Ngày tạo
dogamer06,
Người trả lời cuối
beovila1,
Trả lời
88
Lượt xem
14.360
Quay lại
Lên đầu trang