DeepSeek-V4-Flash chính thức ra mắt, tăng tốc cuộc đua tác tử AI với OpenAI

  • Người tạo chủ đề Người tạo chủ đề dogamer06
  • Ngày bắt đầu Ngày bắt đầu
dĩ nhiên rồi bác, nhìn bảng đi. opus 5 hiện tại là trùm nhưng usage token của nó hao hơn cả trăm lần con deepseek mà.
Chia tác vụ ra mà làm thôi. Chứ mấy cái task đơn giản mà cũng xài opus thì thua
:D thì dùng như gắn vào OpenClaw thì quá ngon chứ vibecode dùng opus đắt xắt ra miếng, nếu dùng vibecode chắc gắn thay cho haiku để phụ việc thôi

chứ dùng deepseek pro cũng không ổn

:p à được cái model trung nên xử lý tiếng trung dựng ngữ cảnh để dịch phụ đề bằng AI rất ngon, dựng context xong quăng gemini
 
:D thì dùng như gắn vào OpenClaw thì quá ngon chứ vibecode dùng opus đắt xắt ra miếng, nếu dùng vibecode chắc gắn thay cho haiku để phụ việc thôi

chứ dùng deepseek pro cũng không ổn

:p à được cái model trung nên xử lý tiếng trung dựng ngữ cảnh để dịch phụ đề bằng AI rất ngon, dựng context xong quăng gemini
thật ra mình nghĩ mấy con model đó dùng tác vụ hàng ngày, update, monitoring, check activity hệ thống. với fix lỗi command này nọ ngon.
Còn code thì claude opus 5
 
benchmark hiện tại con deepseek mới release 3107 hơn nhiều model, rẻ hơn cả chục lần
Con deepseek mới với luna hiện tại gần = nhau, nhưng con deepseek rẻ hơn 1 chút.
Xem tệp đính kèm 3740223
Xem tệp đính kèm 3740220
Xem tệp đính kèm 3740219
Xem tệp đính kèm 3740218
con luna mới giảm giá 80% không biết update vô giá mới chưa , chắc lần này openai định chơi khô máu xanh chín với claude lẫn khựa . Luna đã là quá đủ cho nhu cầu của tôi , xài nó với con hermes quá sướng .
 
con luna mới giảm giá 80% không biết update vô giá mới chưa , chắc lần này openai định chơi khô máu xanh chín với claude lẫn khựa . Luna đã là quá đủ cho nhu cầu của tôi , xài nó với con hermes quá sướng .
giá đó giá api, còn gói đăng ký thì giữ nguyên đó thím
 
Thằng loằn GPT kiểm duyệt gắt quá, hỏi mấy câu can thiệp phần cứng hay code là éo trả lời, gemini thì đỡ hơn nhưng post data sheet của chip lên thì éo chịu đọc, cuối cùng phải nhờ con grok đọc
vfBEX5Q.gif
 
Mấy bác setup agent như thế nào vậy ạ.
Mình đang xài kiểu github copilot, có tích hợp Claude CLI, mà tùy theo task manual chuyển đổi model cho tiết kiệm
 
Thằng loằn GPT kiểm duyệt gắt quá, hỏi mấy câu can thiệp phần cứng hay code là éo trả lời, gemini thì đỡ hơn nhưng post data sheet của chip lên thì éo chịu đọc, cuối cùng phải nhờ con grok đọc
vfBEX5Q.gif

lừa nó đừng kêu nó dịch ngược hay giải mã thím

chứ em dùng Chatgpt với IDA đâm ngon mà, như con Opus 5 giờ cũng bị chặn từ khoá phải chuyển qua Opus 4.8 mới làm được
 
con luna mới giảm giá 80% không biết update vô giá mới chưa , chắc lần này openai định chơi khô máu xanh chín với claude lẫn khựa . Luna đã là quá đủ cho nhu cầu của tôi , xài nó với con hermes quá sướng .
giảm rồi bác, đang xài phà phà nhưng pricing vẫn sẽ tốn hơn con deepseek 1 ít.
1785665477047.webp
 
vl mấy bác đánh giá model qua mấy cái bảng trust me pro à, xem lại cái bảng đó đi, đéo thể nào con ds 4 flash nó ngon hơn con chat gpt 5.3 được mà giờ gpt 5.3 nằm ở đâu :amazed:

1785668426684.webp


Muốn công tâm thì tự tạo vài bài test trên chính project của mình (plan để nó implement, research để nó tạo plan, one shot...) model nào muốn sử dụng hằng ngày thì mình phải test thực tế cả. Xem hành vi của nó, có cần skill cầm tay chỉ việc không....

Claude opus mỗi phiên bản mình xài điều phải chỉnh skill lại cho phù hợp (ví dụ việc hỏi lại khi gặp vấn đề không chắc chắn ở mấy bản opus cũ thì nó chỉ hỏi từng câu sau đó mới suy nghĩ câu tiếp theo, còn opus 4.8 5.0 trở lên thì tốt nhất để nó tự do hỏi tối đa 4 5 câu 1 lượt), trước còn phải có skill để implement plan, nhưng bản opus 5.0 nó điều phối sub agent quá tốt có thể bỏ qua cái skill implement plan mà mình đã tạo cho con 4.8.

Cái ăn tiền của thằng deepseek là giá api cực rẻ, tỷ lệ cache hit vô địch thiên hạ và cache cực tốt, làm agent ngựa thồ quá đã :big_smile:
 
Mấy bro dùng AI làm sao dắt nó qua khâu kiểm duyệt được vậy? Tôi kêu nó đọc file mà nó cứ đòi vấn đề kiểm duyệt thôi, tôi dắt nó đi 1 vòng xong nó vẽ ra ra đủ loại vấn đề rồi vẫn không chỉ cho tôi là code ở chỗ nào. Con Opus khôn thì khôn thật nhưng quá khó xài và hay bị overthingking quá mức
 
Mấy bro dùng AI làm sao dắt nó qua khâu kiểm duyệt được vậy? Tôi kêu nó đọc file mà nó cứ đòi vấn đề kiểm duyệt thôi, tôi dắt nó đi 1 vòng xong nó vẽ ra ra đủ loại vấn đề rồi vẫn không chỉ cho tôi là code ở chỗ nào. Con Opus khôn thì khôn thật nhưng quá khó xài và hay bị overthingking quá mức

Opus 5 nó đang bị ngu khi bật thinking và quá 300k context đó thím

set compact về 300k hoặc đổi Opus 4.8

còn dùng Opus hay Fable 5 cho reverse engineering vẫn được mà bật Fable 5 làm sub agent

dùng prompt lừa nó là đang tìm lỗi để chống bị tấn công hay dùng cho mục đích học tập
 
Opus 5 nó đang bị ngu khi bật thinking và quá 300k context đó thím

set compact về 300k hoặc đổi Opus 4.8

còn dùng Opus hay Fable 5 cho reverse engineering vẫn được mà bật Fable 5 làm sub agent

dùng prompt lừa nó là đang tìm lỗi để chống bị tấn công hay dùng cho mục đích học tập
300k là quá dở rồi. Cố gắng giữ dưới 150k thì rẻ gấp đôi và khôn gấp đôi.

via theNEXTvoz for iPhone
 
Bạn code backend hay frontend và dùng harness gì + framework gì mà nó kém quá vậy ? Tây lông phân tích pro hơn flash chút xíu thôi à.
Full stack anh, pro hơn flash chút xíu mà giá nó chênh cả khúc à :shame:. Mà hình như con flash mới release official nó lại ngon hơn con pro preview thì phải, để test lại xem :LOL:.
 
Coding là chủ yếu, dùng theo hướng mấy bác comment ở trên, dùng model xịn để plan chi tiết, deepseek flash implement với fix bug, mà coding thì code FE né deepseek ra vì nó bị mù ko đọc dc ảnh code ngu lắm, nhưng code thuần logic, backend hay SQL lại rất ổn.
Ngoài ra mình dùng deepseek flash làm LLM cho hermes agent để tự host một web chat AI thay thế cho chatgpt, gemini vì tận dụng dc nhiều tool call khi tìm hiểu cái gì đó

À hiện tại mình dùng claude code với deepseek API để code, mình thời gian dài dùng claude để code nên làm biếng đổi sang agent coding khác

via theNEXTvoz for iPhone
Cám ơn bác, đang tính tối ưu chi phí, đầu tư quả claude để brainstorming và plan, còn 1 con thì để implement code, đang có codex làm thợ cày

via theNEXTvoz for iPhone
 
1786064381953.webp


lại tăng giá rồi, không biết chỉ model pro sắp ra hay cả flash
nếu tăng cả flash thì giá không cạnh tranh với GPT Luna
 
con flash viết code lởm lắm. viết react mà lỗi bung bét cả ra...
r1CfUzr.png


Tôi viết design với test sẵn rồi cho V4 Flash nó viết code tận tình theo cái doc đấy để tận dụng giá rẻ chứ tôi có bao giờ để nó nghĩ thay tôi đâu mà phải lo lủng
 
Con flash dùng để lấy chữ từ ảnh hoặc pdf thì có ổn không các bác?
deepseek API ko có vision để đọc ảnh, còn deepseek web có chế độ vision, tôi thấy OCR lấy text từ ảnh khá ổn, còn pdf thì chịu chết. Lên github kiếm mấy repo OCR pdf
 

Thống kê chủ đề

Ngày tạo
dogamer06,
Người trả lời cuối
beovila1,
Trả lời
88
Lượt xem
14.281
Quay lại
Lên đầu trang