(Dịch) DeepSeek bắt đầu giai đoạn thử nghiệm beta có thời hạn của mô hình đa phương thức mới DeepSeek Flash V4.1.

  • Người tạo chủ đề Người tạo chủ đề ooopsvn
  • Ngày bắt đầu Ngày bắt đầu
Microsoft với Google đang deal kèo hosting Kimi K3 mã nguồn mở của cty China (tất nhiên là có trả tiền chia doanh thu) để có giá token cạnh tranh với OpenAI, Anthropic nữa kìa
Sẽ không còn con Gehihi code ngu như heo nữa đâu :sure:
Tôi thấy vài anh hồi khen con Gemini 3.7 Flash oke lắm, xài gói cũng rẻ, tôi thì chưa thử. Harness thì giờ kiểu thích thằng nào xài thằng đó thôi, chả cần cứng nhắc.

Làm web app đơn giản thì được, chứ gặp cái gì khoai khoai thì đốt tiền nhanh như claude mà chưa chắc đã ra kết quả gì. Nguồn: tôi vừa đốt hết $2 với deepseek trong 1 buổi chiều mà chả làm được cc gì.
Tầm này thì chỉ kiếm worker giá input rẻ bèo là chính thôi, anh kiếm frontier class thì lại quay về đám to cho nhanh. Input $0.00xx mà IntIndex cỡ Astra thì không có đâu. :doubt:

À hàng benchmaxxed version giả cầy thì cũng có giá đó đấy. :shame:
 
chuẩn bác ơi, em nghĩ sẽ sau này các tác vụ sẽ đẩy về biên nữa cơ
Mới nửa năm đồ về trước thôi gần như người ta phải cắn răng chọn đám frontier vì chỉ đám đó mới làm được việc. Từ khi mấy con deepseek 4.0 flash là đảo chiều dần. Giờ thì AI đã quá thông minh và dư dùng thường nhật nên con deepseek 4.1 flash này sẽ cạnh tranh cực manh. Mạnh bằng 8/10 đám frontier và đủ dùng nhưng rẻ bằng 1/20 và nhanh gấp 3 lần thì đúng là quá bá

via theNEXTvoz for iPhone
 
DeepSeek-V4.1-Flash
Kiến trúc bất đối xứng. Thông minh hơn, chi phí thấp hơn
  • 552B tham số MoE (gần gấp đôi V4 Flash)
  • Kiến trúc mã hóa-giải mã nhân quả mới: bất đối xứng, chỉ 8B tham số hoạt động cho input, 16B cho output
  • Phương pháp huấn luyện trước mới kết hợp với huấn luyện sau bằng học tăng cường quy mô lớn hơn mang lại kết quả vượt trội so với các mô hình hàng đầu, bao gồm cả DeepSeek-V4-Pro

Bộ nhớ cache KV nhỏ hơn. Tiết kiệm hơn.
Kiến trúc chia sẻ bộ nhớ mới của DeepSeek Compressed Sparse Attention 2 (CSA2) kết hợp với FP4 KV caching. So với thế hệ trước, bộ nhớ đệm KV của V4.1-Flash chỉ cần:
  • 1/4 HBM
  • 1/8 dung lượng lưu trữ SSD
Chi phí truy cập bộ nhớ cache thường chiếm một phần lớn chi phí của AI Agent. Việc nén bộ nhớ cache giúp giảm đáng kể các chi phí này

Openweight model đã có thể tải về deepseek-ai/DeepSeek-V4.1-Flash · Hugging Face (https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash)
Technical report DeepSeek_V41_Tech_Report.pdf · deepseek-ai/DeepSeek-V4.1-Flash at main (https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash/blob/main/DeepSeek_V41_Tech_Report.pdf)


1789047113942.webp
 
Trước không có thằng nào hay ho thì còn cố đâm Claude Max.
Chứ phần mềm Deepseek Harness cũng mới ra tầm 3 tuần trước chứ mấy. Ban AI công ty CNTT nào cũng thử và thấy rẻ với tốt quá nên mới yêu cầu cắt gói Claude Max cho từng lập trình viên.
Còn Mỹ đế dính điều khoản bảo mật an ninh thì toàn tự host AI China mã nguồn mở chạy nhé:spiderman:
Tôi vẫn chờ thím đưa ra lý do vì sao xài Claude Code là ngu là cùi mà thím toàn nói luyên thuyên vậy
Cái câu "Ban AI công ty CNTT nào cũng thử và thấy rẻ với tốt quá nên mới yêu cầu cắt gói Claude Max cho từng lập trình viên." thím lấy thông tin đâu ra?
 
Tôi vẫn chờ thím đưa ra lý do vì sao xài Claude Code là ngu là cùi mà thím toàn nói luyên thuyên vậy
Cái câu "Ban AI công ty CNTT nào cũng thử và thấy rẻ với tốt quá nên mới yêu cầu cắt gói Claude Max cho từng lập trình viên." thím lấy thông tin đâu ra?
Thím làm công ty nào ở Việt Nam ? Ban bệ cắt tiền Claude 200$ tháng chuyển sang thằng AI rẻ hơn chưa ?
Hay nhân viên lại phải tự bỏ tiền túi ra cho AI
 
Tôi đang thật sự muốn hỏi thím vì sao xài Claude Code là ngu vs cùi vì cty tôi bỏ cả đống tiền để xài. thím nói để tôi nói mấy giám đốc thử
Tôi chắc chắn giờ này vẫn dùng Claude Max 100-200$ là chứng tỏ trình dev cùi đó
Show acc Claude Max của công ty lên đây xem nào ?
 
Chỉ có mấy thằng không biết 1 dòng code nào hoặc trình code cùi vl mới dùng Claude Code từ đầu đến cuối
Tôi chắc chắn giờ này vẫn dùng Claude 200$ là chứng tỏ trình dev cùi đó
Show acc Claude Max của công ty lên đây xem nào ?
Tôi chỉ muốn hỏi lý do vài sao xài Claude Code là ngu vs cùi thôi. sao thím cứ lòng vòng vậy?
Nếu k reply dc thì cứ nói là mình chém gió đi
Tại sao phải show acc cty cho thím xem, thím có quyền j ycau chuyện đó?
 
Đang dùng thử Kimi 3, Deepseek Flash 4.1 và GLM 5.3 cho một số dự án tương đối phức tạp. Thực sự thì không khác Claude nhiều.
 
Chỉ có mấy thằng không biết 1 dòng code nào hoặc trình code cùi vl mới dùng Claude Code từ đầu đến cuối chứ Deepseek API cắm vào Deepseek Harness 1 tháng promt nhòe hết chưa đến 10$ dùng làm được mọi thứ task web, app, backend Fullstack như ý muốn :spiderman:
dùng con claude này nhiều vào ngu hẳn đi vì nó làm hết sạch , thậm chí tư duy giải quyết vấn đề nó tốt vl , nó biết tự phản biện chính nó luôn , có trừ khi context function quá rộng nó cover 1 lúc không hết được thì mới xảy ra lỗi vì mình đưa thiếu ngữ cảnh, chứ nếu đủ ngữ cảnh , nó code tốt hơn dev tầm junior , mid

bác linus là 1 người khá cứng đầu trong việc sài AI để gen code , mà sau khi sài xong bác còn vỗ đùi đen đét là hiểu rồi =))
 
mẹo này hay phết nhỉ, cứ tưởng phải cấu hình lại từ đầu chứ gọi kiểu này vừa nhanh vừa bớt được mớ tiền :D
 
dùng con claude này nhiều vào ngu hẳn đi vì nó làm hết sạch , thậm chí tư duy giải quyết vấn đề nó tốt vl , nó biết tự phản biện chính nó luôn , có trừ khi context function quá rộng nó cover 1 lúc không hết được thì mới xảy ra lỗi vì mình đưa thiếu ngữ cảnh, chứ nếu đủ ngữ cảnh , nó code tốt hơn dev tầm junior , mid

bác linus là 1 người khá cứng đầu trong việc sài AI để gen code , mà sau khi sài xong bác còn vỗ đùi đen đét là hiểu rồi =))
Anh cứ dùng đồ cùi Tàu deepseek flash Api này đi thấy nó gen code vẫn đúng vcl. Còn ngữ cảnh thì thằng AI nào chả 1M ngữ cảnh
 
ds trước khi tăng giá thì thấy khá ngon vì nhanh, rẻ, mạnh tầm 7-8/10 so với hàng frontier. sau khi tăng giá thì hết ngon, t chỉ cắm api ds vào nuôi hindsight mà 1 ngày hết 2$ =((. Giờ setup ổn định gpt 5.6 terra + glm 5.3 flash/muse spark 1.3 cho task nhẹ
hindsight xài ổn không thím mà làm gì cần đến hindsight ghê vậy ? Nghe nói tốn token lắm cho mấy cái vụ recall re kéo.
 
ngoài text thì model còn được huấn luyện và chấp nhận với nhiều loại dữ liệu khác nữa, như là hình ảnh, âm thanh ... nó sẽ trở thành multimodal model
Này thím tự dịch hay nhờ AI dịch thế? Dịch multi-modal là “đa phương thức” là sai rồi nhé, phải là “đa mô thái” mới đúng. “Mô” trong “mô hình”, “thái” trong “trạng thái”. Dịch “đa phương thức” dễ bị hiểu lầm là thông qua nhiều cách huấn luyện khác nhau.
AI bản chất là khoa học nên thím chịu khó dùng đúng từ ngữ chuyên môn.
 

Thống kê chủ đề

Ngày tạo
ooopsvn,
Người trả lời cuối
warsong,
Trả lời
86
Lượt xem
9.064
Quay lại
Lên đầu trang