thảo luận Dùng Claude Opus là phí tiền

  • Người tạo chủ đề Người tạo chủ đề hoctrokha
  • Ngày bắt đầu Ngày bắt đầu
Đâu rảnh. Mà nói thật, thời điểm hiện tại ai dùng AI mà khen nó khôn thì chắc cũng ở mức Junior.
B muốn chứng minh ngược lại thì cứ thử gen ra 1 project gì đó chơi chơi đi, up code lên github rồi t chỉ cho vài chỗ code ngu.
Prompt ngu thì nó code ngu chư sao. Trong khi tất cả big tech, công ty đa số dùng AI code. Dùng Ai như 1 parner thì không dùng. kiêu nó làm 1 thứ nhiều khi mình còn không hiểu thì có kit mà làm tốt. AI là mô hình xác suất. mong đợi nó làm đúng, tốt từ đầu thì chỉ có ngây thơ thôi.
Và có 1 số lũ ngu ngoài ngành thích kiếm thành tích trên git, kiêu AI tìm bug trên opensouce mà ếu hiểu nó làm gì nên PR mới tệ đến vậy.
Chú thử lấy cái sourc code của chú tự tin là chú code tốt đưa con AI tìm lõi xem. xem nó có tím ra 1 đống bug không. nhưng nhiều khi bug đó ếu xảy ra đươc.
Btw, mới đọc 1 bài khá hay tren blog:
 
Prompt ngu thì nó code ngu chư sao. Trong khi tất cả big tech, công ty đa số dùng AI code. Dùng Ai như 1 parner thì không dùng. kiêu nó làm 1 thứ nhiều khi mình còn không hiểu thì có kit mà làm tốt. AI là mô hình xác suất. mong đợi nó làm đúng, tốt từ đầu thì chỉ có ngây thơ thôi.
Và có 1 số lũ ngu ngoài ngành thích kiếm thành tích trên git, kiêu AI tìm bug trên opensouce mà ếu hiểu nó làm gì nên PR mới tệ đến vậy.
Chú thử lấy cái sourc code của chú tự tin là chú code tốt đưa con AI tìm lõi xem. xem nó có tím ra 1 đống bug không. nhưng nhiều khi bug đó ếu xảy ra đươc.
Btw, mới đọc 1 bài khá hay tren blog:
Thứ nhất, ông có vấn đề đọc hiểu hay gì? Tôi có nói không nên dùng AI đâu, tôi nói Claude ko đáng tiền bằng các model trung quốc nếu như có tool và MCP.
Còn nếu gen code bằng model mặc định mà ông bảo claude Opus nó tốt vượt trội, chỉ cần prompt chuẩn là giải quyết hết đc vấn đề thì ông chửi thằng anthropic á, bảo nó tạo ra MCP làm mịa gì nữa? prompt thôi là được rồi.
Ko ai mong đợi AI nó code ra ko có lỗi cả, tôi đang nói đến giá tiền giữa Claude và Minimax/GPL so với chất lượng đem lại là ko đáng.
Tôi cũng chả nói là code tôi không có lỗi bao h cả, sao t phải đi chứng minh vs b?
Sau lên mạng comment thì đọc hiểu trước rồi hãy nói, ko mất công gây war lắm nha b.

Còn cái bài bạn dẫn, nó đơn giản là khái niệm ubiquitous language từ DDD của Eric Evans. Cuốn này mình xem từ năm 2017 rồi b, sách vẫn đang còn trong tủ đây, không biết bạn đã đọc qua bao h chưa. Mở cái bài b dẫn ra đọc vài câu là biết ngay nó nói đến ubiquitous language rồi, mình ctrl+F rồi search phát là đoạn sau y chang ra ngay.
Nói chung là ông bớt khinh người lại hộ cái.
 
Công nhận tiên đề này
Mình setup workflow khá bài bản cho Agent chạy, từ product planning rồi ra architecture
Rồi chê nó code ngu thì có khả năng tự mâu thuẫn đấy.

Thái độ này giống như đa số mọi người vào năm 2024, nhưng giờ là 2026 rồi mà? Hoặc đây là phương pháp cứ vứt 1 phát biểu tào lao lên rồi chờ người vào sửa cho. Nhưng tôi thì nhất trí, fen nói đúng.
Mâu thuẫn chỗ nào nhỉ? T có nói product planning + architecture nó gen ra là tốt đâu? T phải chỉnh chán chê mới ok á.
 
Năm ngoái: Dùng Copilot để vibe ra cái web tự động đánh cờ caro, nó làm done tuy nhiên xử lý hơi chậm, vòng vèo 1 hồi nó sửa code thành hư luôn app. Tuy nhiên trước đó ghi nhận AI đã thành công tuy còn chậm.

Hiện tại, vibe tiếp ra 1 cái app nhỏ automation công việc xử lý ảnh, dùng Codex, cũng full vibe chỉ với 1 câu request ban đầu duy nhất.

Chứng tỏ hiện tại AI cũng khá làm được việc ở các app nhỏ, hoặc các stack mà nó quen thuộc. Còn project lớn của tôi thì áp dụng mấy cái nhỏ nhỏ được, chứ full vào thấy không si nhê
 
Năm ngoái: Dùng Copilot để vibe ra cái web tự động đánh cờ caro, nó làm done tuy nhiên xử lý hơi chậm, vòng vèo 1 hồi nó sửa code thành hư luôn app. Tuy nhiên trước đó ghi nhận AI đã thành công tuy còn chậm.

Hiện tại, vibe tiếp ra 1 cái app nhỏ automation công việc xử lý ảnh, dùng Codex, cũng full vibe chỉ với 1 câu request ban đầu duy nhất.

Chứng tỏ hiện tại AI cũng khá làm được việc ở các app nhỏ, hoặc các stack mà nó quen thuộc. Còn project lớn của tôi thì áp dụng mấy cái nhỏ nhỏ được, chứ full vào thấy không si nhê
Nên mình thấy Dev giờ tồn tại được toàn mấy o tay nghề cao thôi bác. Vẫn là người giỏi tồn tại người gà mờ thất thế, giờ doanh nghiệp mấy tác vụ nhỏ ko cần thuê dev cỏ làm nữa có người vibe code là ngon rồi. Dự án lớn lương dev xịn vẫn cao ngất ngưởng thôi.
Cơ mà sau có 1 đống tool với mcp, thì ko biết có dùng AI làm được project lớn ko nhỉ, này ước chảy nước :D. M cũng vibe code được 1 thời gian rồi, giờ làm cái gì thấy to to cũng ngồi plan 1 chút ko còn "Viết cho t code abc nữa".
 
thím dùg stack gì với mcp skill gì á lắm quá méo bt cài cái nào
Ko biết bạn hỏi stack Ai hay là techstack của product.
product mình dùng backend .Net Orleans + Astro JS, frontend Astrojs, db kurrentdb, postgres, redis.
Infra K3s, ArgoCD, Infisical, self host bằng cloudflare tunnel, monitor bằng LGTM stack.
Auth qua Auth0.

Còn Ai thì mình thử cả openclaw, claude code với github copiot. MCP thì mình tự code thôi, nhưng phần lớn là để automate document source, còn khi test thì cứ đưa document trực tiếp cho AI cho nó fetch, nếu thấy có cải thiện thì mới tính tiếp.

Vấn đề của bọn này là nếu lib có update mới quá thì nó k theo kịp, hoặc phải mò document rất lâu. Ví dụ lúc đầu mình muốn xài Proto.Actor, nhưng do API của proto.actor nó đổi nên AI mò mãi k xong nên cuối cùng phải đổi qua Orleans. The same cho KurrentDb.
 
Mình bên infra nên gà code, vô cty mấy tg dev tg nào cũng tôn opus 4.7 lên như thánh. Chắc toàn mấy thằng gà chứ nghe tụi senior thật sự hay mấy thằng kĩ sư trên youtube nó bảo là code như con kak thôi scaling ra đéo dc
 
Mình bên infra nên gà code, vô cty mấy tg dev tg nào cũng tôn opus 4.7 lên như thánh. Chắc toàn mấy thằng gà chứ nghe tụi senior thật sự hay mấy thằng kĩ sư trên youtube nó bảo là code như con kak thôi scaling ra đéo dc
Scale bình thường nếu vẫn check code bằng tay còn vibe xong đẩy hẳn pr rồi để con AI check lại thì vẫn chưa ổn. Trước còn thuê các team devops riêng giờ merge vô với team dev luôn, giờ tuyển cty tuyển dev phải yêu cầu biết devops, hoặc ít nhất tự biết mò vào k8s mà tìm lỗi nếu cty không có đủ monitoring.
 
Chuẩn luôn, nên mình mới đang đi research một hướng khác xem có giải được bài toán chi phí và route model không.

Bên mình đang thử build một AI Gateway cho team/dev:
  • 1 API chung kiểu OpenAI-compatible
  • route qua Claude / GPT / Gemini / DeepSeek
  • nhìn rõ model / provider / cost
  • sub-key cho từng người
  • fallback khi 1 bên lỗi hoặc rate limit

Không phải shared account, cũng không phải fake model.

Mình muốn hỏi thật anh em đang dùng hằng ngày:
1. Cái đau nhất hiện tại là giá model, token hao nhanh hay rate limit?
2. Nếu có 1 chỗ nhìn rõ request đang chạy qua đâu và tốn bao nhiêu thì anh em có dùng không?
3. Điều gì làm anh em không tin dạng service này?

Mình có làm 1 form ngắn để gom feedback:
Tham gia danh sách chờ
 
Chuẩn luôn, nên mình mới đang đi research một hướng khác xem có giải được bài toán chi phí và route model không.

Bên mình đang thử build một AI Gateway cho team/dev:
  • 1 API chung kiểu OpenAI-compatible
  • route qua Claude / GPT / Gemini / DeepSeek
  • nhìn rõ model / provider / cost
  • sub-key cho từng người
  • fallback khi 1 bên lỗi hoặc rate limit

Không phải shared account, cũng không phải fake model.

Mình muốn hỏi thật anh em đang dùng hằng ngày:
1. Cái đau nhất hiện tại là giá model, token hao nhanh hay rate limit?
2. Nếu có 1 chỗ nhìn rõ request đang chạy qua đâu và tốn bao nhiêu thì anh em có dùng không?
3. Điều gì làm anh em không tin dạng service này?

Mình có làm 1 form ngắn để gom feedback:
Tham gia danh sách chờ
Mình thấy claude giờ là rẻ nhất rồi, tính toán khối lượng rồi đóng 20x. Dễ kiểm soát chi phí và hiệu quả. Khi nào thấy thực sự dùng AI thay đổi đc rõ rệt rồi tối ưu token, chi phí sau. Tranh thủ bào chứ mấy nữa IPO xong chắc giá nó tăng ầm ầm, lúc đó tha hồ mà tối ưu :D
 
nếu chỉ riêng mảng coding , tất cả AI hiện tại ko cái nào bằng claude , viết ba cái crud , hay giao diện đơn giản thì ko thấy sự vượt trội đâu

làm nhưng task khó , không common , tối ưu network , perform , cần đào sâu vào source , và phân tích logic , thì claude gọi mấy con AI khác là dbrr thế cho vuông
 
nếu chỉ riêng mảng coding , tất cả AI hiện tại ko cái nào bằng claude , viết ba cái crud , hay giao diện đơn giản thì ko thấy sự vượt trội đâu

làm nhưng task khó , không common , tối ưu network , perform , cần đào sâu vào source , và phân tích logic , thì claude gọi mấy con AI khác là dbrr thế cho vuông
Claude tốt hơn, nhưng nó chỉ đáng tiền nếu như ông k muốn động não vào hướng dẫn nó và cũng k muốn review code. Một khi đã lên production rồi thì kiểu gì chả phải check từng dòng, mà nếu mình k có khả năng check từng dòng mà tin AI luôn thì cơ bản t k muốn làm cùng ng đó.
Thành thử việc claude là số 1 là đúng, nhưng nó đáng giá hay k lại là chuyện khác.
 
Claude tốt hơn, nhưng nó chỉ đáng tiền nếu như ông k muốn động não vào hướng dẫn nó và cũng k muốn review code. Một khi đã lên production rồi thì kiểu gì chả phải check từng dòng, mà nếu mình k có khả năng check từng dòng mà tin AI luôn thì cơ bản t k muốn làm cùng ng đó.
Thành thử việc claude là số 1 là đúng, nhưng nó đáng giá hay k lại là chuyện khác.
claude nó có phân suy luận của nó , follow theo , nếu đủ kiến thức và logic thì ok , còn thể loại vibe mất não ko có kiến thức thì trình đâu mà làm production to , làm dăm cái tool ghẻ thôi
 
chủ thớt nói đúng ấy
mình vừa xem qua 1 video của khứa Dex Horty CEO human layer nói về cách làm harness engineering kết hợp với workflow mới
sau đó mình nghiên cứu thêm 1 vài video khác nói về cách LLM đốt token, thì hiểu ra mọi thứ nằm ở context management chứ k phải ở model
cứ ngồi đốt tiền cho model mắc tiền, khi nó k ra đc kq, nghĩ là đm model xịn nhất mà còn k làm đc, cứ loay hoay ngồi chờ model xịn hơn. thật ra bạn thay đổi cách quản lí context là có thể nó còn ngon hơn việc trông chờ vào model
 
Nói đúng rồi còn gì nữa tôi vẫn đang combo gpt 5.5 plan deepseek 4 pro implement vẫn kiếm tiền đều đều
 
claude mỗi tháng hơn 4 củ là rẻ với kết quả nó đưa r còn gì, khá chi tiết nếu biết vẽ workflow ngon chứ ko ngu đần bảo nó tự vẽ wf vv từ a>z :D
 
Mình bên infra nên gà code, vô cty mấy tg dev tg nào cũng tôn opus 4.7 lên như thánh. Chắc toàn mấy thằng gà chứ nghe tụi senior thật sự hay mấy thằng kĩ sư trên youtube nó bảo là code như con kak thôi scaling ra đéo dc
Mình cũng bên infra, code sml Terraform, ansible, ... Không có mấy con Opus 4.6 cứu thì ngồi phân tích thiết kết rồi đi code cũng ói ẻ.
Đợt rồi làm 1 con khá to trên AWS, 3 người làm, thời gian có 2 tuần, không có con đấy thì ae chết sặc tiết. Mặt tối là nó code cũng như k*c nhưng thôi, đỡ được 1 đống tài liệu + code, chuyển từ code sang review nó làm đúng sai như nào.

Workload 1 ngày quên switch từ Deepseek sang Claude đây. Không có nó cứu thì đúng khổ.
1780462606237.webp
 

Thống kê chủ đề

Ngày tạo
hoctrokha,
Người trả lời cuối
nghe mà bưa tề,
Trả lời
41
Lượt xem
9.257
Quay lại
Lên đầu trang