[Mỹ]'Thảm họa' Claude Code

  • Người tạo chủ đề Người tạo chủ đề System Design
  • Ngày bắt đầu Ngày bắt đầu
Chưa kể app bình thường nó lớn dần như 1 cái cây, review từng đoạn code lên, còn vibe thì ụp 1 phát nguyên project lên, đến hồi nó bị gì mà AI mò không ra được thì tự mò chắc tung não

Đek phải lo xa thế đâu .

Lỗi mà claude "không thể" xử lý nổi , thì đến 99% dev cũng đek xử lý nổi .
 
Đek phải lo xa thế đâu .

Lỗi mà claude "không thể" xử lý nổi , thì đến 99% dev cũng đek xử lý nổi .
Lâu lâu nó đặt tên biến trùng nhau
Rồi kết quả lỗi không biết vì sao
May mà đọc lại Git với chia nhỏ commit
Không thì debug cũng mệt nghỉ

Mà lỗi nó cũng đơn giản thôi …
 
Lâu lâu nó đặt tên biến trùng nhau
Rồi kết quả lỗi không biết vì sao
May mà đọc lại Git với chia nhỏ commit
Không thì debug cũng mệt nghỉ

Mà lỗi nó cũng đơn giản thôi …

mấy cái này là do ko có tóm tắt dự án , đến lúc tạo session mới thì nó quên sạch chứ sao nữa .

phải có mấy file tóm tắt lại dự án , các hàm nào , ở đâu , tác dụng gì , đã sử dụng các biến gì phải có đủ chứ .

nó code tiếp thì tự động cập nhật thêm vào , để session mới còn biết mà xử lý .

Mà mấy cái lỗi này không nằm trong danh sách lỗi siêu khó .
 
mấy cái này là do ko có tóm tắt dự án , đến lúc tạo session mới thì nó quên sạch chứ sao nữa .

phải có mấy file tóm tắt lại dự án , các hàm nào , ở đâu , tác dụng gì , đã sử dụng các biến gì phải có đủ chứ .

nó code tiếp thì tự động cập nhật thêm vào , để session mới còn biết mà xử lý .

Mà mấy cái lỗi này không nằm trong danh sách lỗi siêu khó .

Chính con Claude nó viết doc 1 lượt
Xong t bắt nó tự mở rộng code đấy

Mấy lỗi lặt vặt này nó tìm còn lâu hơn mấy cái vấn đề phức tạp

Khả năng do Claude Code nó không được train xử lý tỉ mỉ lặt vặt kiểu này. Cũng là lý do tại sao test code lập trình thi đấu Codex nó lại ăn được Claude Code khoản reasoning.
 
GPT-5.5 ra mắt và đây là so sánh giá của 1 bài viết trên reddit, sắp đến cái thời 1,2 prompt là cạn tiền sớm rồi :sweat:
Cụ thể GPT-5.5 mắc x2 so với GPT-5.4 và mắc hơn 20% so với Opus 4.7

1776995089972.webp
 
Chính con Claude nó viết doc 1 lượt
Xong t bắt nó tự mở rộng code đấy

Mấy lỗi lặt vặt này nó tìm còn lâu hơn mấy cái vấn đề phức tạp

Khả năng do Claude Code nó không được train xử lý tỉ mỉ lặt vặt kiểu này. Cũng là lý do tại sao test code lập trình thi đấu Codex nó lại ăn được Claude Code khoản reasoning.
:sad: Xác nhận là thi thoảng phải "tư duy" dùm Claude để nó debug theo hướng mình nghi vấn.
Thi thoảng debug nó vẫn leo lẻo cãi, clear context rồi chỉ định luôn debug theo kiểu A/B/C mình nghi vì lý do X/Y/Z thì nó dò ra đúng. :doubt:
 



Bọn khác thì đi qua các plugin hỗ trợ đọc vid chứ đâu, bản chất vid thì vẫn đọc được ảnh theo từng frame.

Đọc xong thì bọn nó sẽ phân tích layout để làm lại 1 cái tương tự.

Gọi là tốn là tính theo plan hàng tháng ấy
Thường họ kỳ vọng trả 20 USD hàng tháng sẽ phải hiệu quả hơn 15 USD hàng tháng


Chứ để thằng 15 USD / tháng nó ra kết quả ngon hơn 20 USD / tháng thì thôi bỏ

Có Claude Opus là đứa duy nhất đúng nghĩa tiền nào của đấy trong việc coding ở tier cao thôi

Đấy là chưa kể giờ bọn nó vứt vid thẳng vào chat trên ChatGPT hay Kimi Chat rồi lấy project được prototype đấy đi sửa tiếp, không nhất thiết lúc nào cũng CLI.

Mà kể cả khả năng phân tích ảnh rồi auto build lại web dựa trên ảnh của GPT cũng không ngon lắm
TQ nó không cạnh tranh nổi và thừa biết model cùi hơn rất nhiều nên nó mới đi ngách để tối ưu cho những thứ như thế. Vẫn chưa thấy độ thực tế của việc dùng video demo để vibecode, còn như nói ở trên dù monthly/annual plan hay là pay as you go thì TQ chỉ được cái token rẻ, token rẻ thì nó cứ làm sai làm thiếu lại bảo fix lại theo dạng đổi thời gian để tiết kiệm tiền. Thị trường nó vẫn phản ánh chất lượng sản phẩm thôi, nếu tốt nếu ngon thì nó đã phổ biến.
 
Claude chơi ngu thật sự, đang được ủng hộ rầm rộ từ vụ từ chối Bộ Chiến Tranh nên nghĩ nhiều người dùng thì có thể bắt đầu cắt hẹ à.
Muốn bào tiền ko sai, muốn bóp quota lại để tối đa hoá lợi nhuận cũng ko sai... nhưng tỉ lệ phải phù hợp. Ít nhất hãy để công việc chạy được 1 chút, "ra được chút vấn đề" rồi limit -> tạo nhu cầu nâng cấp. Đằng này giới hạn bị bóp từ 10 xuống còn 3, tạo ra cảm giác ức chế và khó chịu khi mọi thứ thậm chí còn chưa kịp thành hình và cho dù nâng cấp thì vẫn mắc kẹt trong cái vòng lặp limit ức chế này...

Con hàng grok thì chính thức hoá rác. Đã khoá tạo video free (và có nâng cấp cũng đủ các giới hạn, thời gian thì chả thêm được bao nhiêu, ngoài ngày xưa tạo được vid 18+ thì các mặt còn lại hít khói cho bọn Tàu), text thì báo bận còn hơn cả con deepseek thời kỳ hot nhất.

gMYWKaM.gif

Thôi bỏ cũng dc, còn hơn dùng mà ức chế, 1 prompt dựng docker từ source base có sẵn mà hết sạch quota 5 tiếng. :go:

via theNEXTvoz for iPhone
 
TQ nó không cạnh tranh nổi và thừa biết model cùi hơn rất nhiều nên nó mới đi ngách để tối ưu cho những thứ như thế. Vẫn chưa thấy độ thực tế của việc dùng video demo để vibecode, còn như nói ở trên dù monthly/annual plan hay là pay as you go thì TQ chỉ được cái token rẻ, token rẻ thì nó cứ làm sai làm thiếu lại bảo fix lại theo dạng đổi thời gian để tiết kiệm tiền. Thị trường nó vẫn phản ánh chất lượng sản phẩm thôi, nếu tốt nếu ngon thì nó đã phổ biến.

Thế thì đơn giản như Claude với OpenAI đi

Trả 20 USD / tháng
Claude vứt loạt ảnh vào cho nó phân tích rồi làm ra 1 cái tương tự

OpenAI vứt loạt ảnh vào rồi không đạt theo yêu cầu

Thế chẳng lẽ lại hiểu là Claude không lại OpenAI nên phải theo hướng phân tích ảnh để làm ra cái tốt hơn OpenAI?

Nếu tính theo hướng làm ra sản phẩm để đạt yêu cầu, bất chấp token bao nhiêu thì OpenAI trong cái trường hợp đấy nó đã không đạt rồi đấy.

Mà tính theo thị trường, thì thị phần của OpenAI luôn dẫn đầu luôn.

Tính theo chi phí thì trả 1 thằng mà không làm ra được cái như ý thì nó chẳng tốn hơn?

Hay Claude nó có riêng Claude Design để code lại 1 cái prototype dựa trên design doc đấy, thị trường ngách nhưng thằng Claude còn nhảy vào trong khi OpenAI đấm không lại cả Claude hay TQ thì nên hiểu theo cách nào?
 
Thế thì đơn giản như Claude với OpenAI đi

Trả 20 USD / tháng
Claude vứt loạt ảnh vào cho nó phân tích rồi làm ra 1 cái tương tự

OpenAI vứt loạt ảnh vào rồi không đạt theo yêu cầu

Thế chẳng lẽ lại hiểu là Claude không lại OpenAI nên phải theo hướng phân tích ảnh để làm ra cái tốt hơn OpenAI?

Nếu tính theo hướng làm ra sản phẩm để đạt yêu cầu, bất chấp token bao nhiêu thì OpenAI trong cái trường hợp đấy nó đã không đạt rồi đấy.

Mà tính theo thị trường, thì thị phần của OpenAI luôn dẫn đầu luôn.

Tính theo chi phí thì trả 1 thằng mà không làm ra được cái như ý thì nó chẳng tốn hơn?

Hay Claude nó có riêng Claude Design để code lại 1 cái prototype dựa trên design doc đấy, thị trường ngách nhưng thằng Claude còn nhảy vào trong khi OpenAI đấm không lại cả Claude hay TQ thì nên hiểu theo cách nào?
Tóm lại là như nào nhỉ, lan man một hồi vẫn chưa hiểu có dẫn chứng gì để cho thấy model Tàu tốt và đáng cân nhắc để sử dụng thay thế cho Claude. Rõ ràng nếu không dùng Claude thì người ta sẽ đổ qua GPT hoặc Gemini. Và chất lượng của model Tàu hay các opensource nói chung vẫn có khoảng cách đủ lớn để thị trường không lựa chọn, thị trường vẫn đang trả lời như thế mà.
Còn thằng Claude nó đi sau GPT, nó cũng phải dùng ngách Coding để có thể phát triển, sau đó mới mở rộng từ ngách ra. Và nó không bị giới hạn công nghệ + data như model Tàu, thứ mà model Tàu thua ngay từ đầu, như GLM cũng đang bị nghi ngờ log code của user để train model. Có thể thời gian sau model Tàu nó sẽ tìm ra cách để có thể xoá được khoảng cách kia, nhưng ít nhất bây giờ nó không "ngon" thực sự, mà chỉ là vì nó rẻ nên người ta thấy nó "ngon" giống kiểu miếng sườn trong nhà hàng và miếng sườn trong đĩa cơm tấm vỉa hè.
 
Tóm lại là như nào nhỉ, lan man một hồi vẫn chưa hiểu có dẫn chứng gì để cho thấy model Tàu tốt và đáng cân nhắc để sử dụng thay thế cho Claude. Rõ ràng nếu không dùng Claude thì người ta sẽ đổ qua GPT hoặc Gemini. Và chất lượng của model Tàu hay các opensource nói chung vẫn có khoảng cách đủ lớn để thị trường không lựa chọn, thị trường vẫn đang trả lời như thế mà.
Còn thằng Claude nó đi sau GPT, nó cũng phải dùng ngách Coding để có thể phát triển, sau đó mới mở rộng từ ngách ra. Và nó không bị giới hạn công nghệ + data như model Tàu, thứ mà model Tàu thua ngay từ đầu, như GLM cũng đang bị nghi ngờ log code của user để train model. Có thể thời gian sau model Tàu nó sẽ tìm ra cách để có thể xoá được khoảng cách kia, nhưng ít nhất bây giờ nó không "ngon" thực sự, mà chỉ là vì nó rẻ nên người ta thấy nó "ngon" giống kiểu miếng sườn trong nhà hàng và miếng sườn trong đĩa cơm tấm vỉa hè.
:sweat: Cái này các anh bias quá chứ nói thật nếu plan kĩ, không phải vibe code và dùng ngôn ngữ lập trình phổ biến, thì đồ bọn tàu cũng chả kém như anh tả đâu. Có cái là vibe code theo kiểu I have no idea what i'm doing thì claude code ngon hơn là đúng
 
Thì cứ plan bằng claude, code bằng bọn tàu không khỏe sao. Tại sao chỉ được chọn 1 trong 2 zị. Openrouter bọn tàu có bao giờ vắng bóng đâu.
 
:sweat: Cái này các anh bias quá chứ nói thật nếu plan kĩ, không phải vibe code và dùng ngôn ngữ lập trình phổ biến, thì đồ bọn tàu cũng chả kém như anh tả đâu. Có cái là vibe code theo kiểu I have no idea what i'm doing thì claude code ngon hơn là đúng
Đơn giản là model Tàu thì giống bọn Junior thôi, cầm tay chỉ việc, nói nó thì nó vẫn làm tốt, nó sẽ sai nhiều hoặc làm những cái thừa thãi.
 
Thì cứ plan bằng claude, code bằng bọn tàu không khỏe sao. Tại sao chỉ được chọn 1 trong 2 zị. Openrouter bọn tàu có bao giờ vắng bóng đâu.
Đã test như vậy rồi mà kết quả cho ra nó vẫn tệ hơn ấy chứ. Cùng 1 plan + stitch để làm thì tóm lại
Model tàu vỡ layout, text không chỉnh màu khiến lẫn vào màu background
GPT không vỡ layout nhưng lỗi tiếng Việt, dùng font tả pía lù, 1 screen dùng tới 3 loại font
Claude bám sát layout, font chữ chuẩn chỉnh nhưng vẫn bị lỗi ở một số chỗ dùng icon
 
Tóm lại là như nào nhỉ, lan man một hồi vẫn chưa hiểu có dẫn chứng gì để cho thấy model Tàu tốt và đáng cân nhắc để sử dụng thay thế cho Claude. Rõ ràng nếu không dùng Claude thì người ta sẽ đổ qua GPT hoặc Gemini. Và chất lượng của model Tàu hay các opensource nói chung vẫn có khoảng cách đủ lớn để thị trường không lựa chọn, thị trường vẫn đang trả lời như thế mà.
Còn thằng Claude nó đi sau GPT, nó cũng phải dùng ngách Coding để có thể phát triển, sau đó mới mở rộng từ ngách ra. Và nó không bị giới hạn công nghệ + data như model Tàu, thứ mà model Tàu thua ngay từ đầu, như GLM cũng đang bị nghi ngờ log code của user để train model. Có thể thời gian sau model Tàu nó sẽ tìm ra cách để có thể xoá được khoảng cách kia, nhưng ít nhất bây giờ nó không "ngon" thực sự, mà chỉ là vì nó rẻ nên người ta thấy nó "ngon" giống kiểu miếng sườn trong nhà hàng và miếng sườn trong đĩa cơm tấm vỉa hè.
Là bench nó phản ánh đúng chứ còn sao nữa?

Bench thậm chí phản ánh tác vụ liên quan SWE thì Opus với GPT (Codex) dẫn đầu
Nhưng code cần convert từ ảnh sang thì Kimi nó chỉ dưới Opus và trên GPT


Mà Nếu không dùng Claude thì người ta đổ sang Antigravity và gọi … Claude từ Antigravity.
 
:sweat: Cái này các anh bias quá chứ nói thật nếu plan kĩ, không phải vibe code và dùng ngôn ngữ lập trình phổ biến, thì đồ bọn tàu cũng chả kém như anh tả đâu. Có cái là vibe code theo kiểu I have no idea what i'm doing thì claude code ngon hơn là đúng
Bias rõ ràng chứ sao :)))
Đến bọn Âu Mẽo thấy con Kimi K2.6 ngon mấy hôm nay kéo sang làm tôi bị báo busy không chơi được nữa :sad:

Mà đám model TQ bọn nó toàn chơi cắn qua gọi API là chính cho tối ưu, bọn engineer chúng nó thấy con nào ngon mảng nào thì dùng mảng đấy trong build hệ thống chứ cố đấm ăn xôi 1 model làm gì cho khổ :))

Tương lai phát triển phần mềm cần build nhanh mock nhanh thằng Claude với đám TQ thấy được đang phát triển theo hướng phân tích visual từ media. Thế nào qua các anh ấy lại thành model không đọ lại coding GPT nên chuyển sang chơi ngách phân tích ảnh, vid để code :))
 
TQ nó không cạnh tranh nổi và thừa biết model cùi hơn rất nhiều nên nó mới đi ngách để tối ưu cho những thứ như thế. Vẫn chưa thấy độ thực tế của việc dùng video demo để vibecode, còn như nói ở trên dù monthly/annual plan hay là pay as you go thì TQ chỉ được cái token rẻ, token rẻ thì nó cứ làm sai làm thiếu lại bảo fix lại theo dạng đổi thời gian để tiết kiệm tiền. Thị trường nó vẫn phản ánh chất lượng sản phẩm thôi, nếu tốt nếu ngon thì nó đã phổ biến.

Người ta vẫn xài model của bọn Tàu ầm ầm. Kém hơn thì có nhưng không phải rất nhiều.
Dev có kinh nghiệm người ta cũng chỉ cần model nói sao làm vậy thôi. Chứ để AI code nguyên cả đống thì thời gian ngồi đọc hiểu tối ưu còn quá cha thời gian tự code.




 
Codex giờ xúc ở đâu uy tín các bro nhỉ, nhiều gian thương quá ko biết chọn kiểu gì
 

Thống kê chủ đề

Ngày tạo
System Design,
Người trả lời cuối
vodanh1213,
Trả lời
373
Lượt xem
63.384
Quay lại
Lên đầu trang