[Mỹ]'Thảm họa' Claude Code

  • Người tạo chủ đề Người tạo chủ đề System Design
  • Ngày bắt đầu Ngày bắt đầu
Qua giờ có 2 tin

1. Anthropic đang loại bỏ Claude Code khỏi gói Pro 20$, cái này thì cá nhân mình thấy không sao hết, chả ảnh hưởng mấy, vì thực tế gói 20$ chả đủ để làm gì, tí là hết token
2. Ở Anh đã bỏ gói 100$, chỉ còn 200$ với token x5 gói Pro (tức là gói 200$ bên này tương đương gói 100$ ở khu vực khác) -> cái này mới là cái đáng quan tâm hơn

Cá nhân mình thì đánh giá hoặc là Anthropic nổi lòng tham sớm hoặc là chi phí quá khủng khiếp so với thực tế
tại vì có những thứ giờ nó đôt token kinh khủng khiếp, nhất là những đứa black mmo nó bào nát bấy luôn, không chừa một kẽ hở token nào ấy bác. Vibe code cũng vậy mỗi 1 prompt vibe code nó làm 20 chục phát api call, rồi cứ thế nhân lên, làm 4 5 prompt liên tiếp lượng token còn đốt theo cấp số nhân, $200 tháng nhưng tiền nó bào phải trên 5k thì ai chịu nỗi:burn_joss_stick:
 
Mình không có kiến thức sâu về AI, nhưng mà những gì mình đang cảm nhận là AI đang thông minh theo tỷ lệ tăng của phần cứng đồng nghĩa là chi phí tăng, thay vì khôn hơn, phần cứng tăng ít hoặc giữ nguyên, để chi phí giảm để đại trà hơn.

Nên ít nhất thời gian này IT vẫn còn đất sống. Để ý thì Claude Opus 4.5 -> 4.6 -> 4.7 không tạo ra sự khác biệt rõ rệt qua từng bản update giống như Sonnet -> Opus

Có vẻ đến giai đoạn đi ngang của phát triển AI một thời gian rồi chăng!!!
Các mô hình AI (LLM?) hiện tại đã đụng trần giới hạn rồi, bản chất vẫn bắt nguồn từ Transformer của Google, scale lên == scale hardware ko còn hiệu quả nữa vì chi phí tăng rất cao doanh nghiệp ko có lời.

Muốn AI có đột phá lớn thật sự thì phải có chuỗi đột phá:
  • Hardware rẻ hơn và hiệu quả hơn (kiểu như build ASIC hay vì phải dựa trên Nvidia GPU), chỗ này thì kỳ vọng các pháp sư Trung Hoa có đột phá.
  • Điện rẻ hơn (nuclear?)
  • Model hiệu quả hơn, train cần ít data hơn.
...

Tất cả đều nhằm mục đích cost/token rẻ hơn nữa. Túm lại vẫn là quay về bài toán kinh tế kinh điển, doanh nghiệp phải có lời, đột phá về lượng sẽ dẫn đến đột phá về chất.

Đến hiện tại Google là thằng duy nhất có đầy đủ công cụ nhất: có tiền, có paper, có TPU, có DC, có cáp quang... Nên có lẽ nó sẽ là thằng có đột phá sớm nhất chứ k phải đám OpenAI, Anthropic, X...
 
Mình không có kiến thức sâu về AI, nhưng mà những gì mình đang cảm nhận là AI đang thông minh theo tỷ lệ tăng của phần cứng đồng nghĩa là chi phí tăng, thay vì khôn hơn, phần cứng tăng ít hoặc giữ nguyên, để chi phí giảm để đại trà hơn.

Nên ít nhất thời gian này IT vẫn còn đất sống. Để ý thì Claude Opus 4.5 -> 4.6 -> 4.7 không tạo ra sự khác biệt rõ rệt qua từng bản update giống như Sonnet -> Opus

Có vẻ đến giai đoạn đi ngang của phát triển AI một thời gian rồi chăng!!!
không phải không khôn hơn, mà nó đang cross lại các thứ nó gầy lên sau khi tối đa mở rộng data từ chính user cung cấp, để ý giờ nếu bắt nó viết bừa thì nó sẽ vòng vo không làm nếu không bị dụ, nghĩa là nó đang tự cảm nhận được ngữ cảnh chứ không phải làm bất chấp cho kết quả, nhìn thì thấy không có gì thay đổi với người nhập chính xác từ những dòng yêu cầu đầu tiên, nhưng với yêu cầu trước đó mà bắt nó làm là nó sẽ bắt đầu đưa ra output phân tích trước hơn là cắm đầu làm, nói chung là phải cross lại chứ không thì lắm rác lắm : ))
 
Rồi dần dần cũng quay về tự host model riêng để chạy thôi, ít ra anh em Ops vẫn còn đất thở. Tính ra 100$/month cũng nhiều chứ đâu ít
 
Các mô hình AI (LLM?) hiện tại đã đụng trần giới hạn rồi, bản chất vẫn bắt nguồn từ Transformer của Google, scale lên == scale hardware ko còn hiệu quả nữa vì chi phí tăng rất cao doanh nghiệp ko có lời.

Muốn AI có đột phá lớn thật sự thì phải có chuỗi đột phá:
  • Hardware rẻ hơn và hiệu quả hơn (kiểu như build ASIC hay vì phải dựa trên Nvidia GPU), chỗ này thì kỳ vọng các pháp sư Trung Hoa có đột phá.
  • Điện rẻ hơn (nuclear?)
  • Model hiệu quả hơn, train cần ít data hơn.
...

Tất cả đều nhằm mục đích cost/token rẻ hơn nữa. Túm lại vẫn là quay về bài toán kinh tế kinh điển, doanh nghiệp phải có lời, đột phá về lượng sẽ dẫn đến đột phá về chất.

Đến hiện tại Google là thằng duy nhất có đầy đủ công cụ nhất: có tiền, có paper, có TPU, có DC, có cáp quang... Nên có lẽ nó sẽ là thằng có đột phá sớm nhất chứ k phải đám OpenAI, Anthropic, X...

bác nói đúng những gì mình đang nghĩ, AI đang thông minh bằng cách đẩy phần cứng lên chứ không phải bằng cách cải thiện được những cải mà bác đề cập. :byebye:

Gần đây Claude Code mình dùng rất hay bị tạch, có vẻ server quá tải lắm rồi
 
Sửa lần cuối:
Có cách nào swap qua lại hai con ko thím. Đang chạy lệnh claude trên terminal thôi. Vs code hay ... tháng sau mấy ổng mới review bảo mật xong
Thím xem cái codex-plugin-cc của OpenAI ấy, có hướng dẫn chạy Codex bên trong Claude Code

Mình chưa thử vụ chạy kiểu này, toàn chạy truyền thống kiểu chạy các model trong Github Copilot / Antigravity, tất nhiên qua đám Copilot hay Antigravity thì chất lượng cùi hơn, không biết chạy Codex trong Claude Code thì ra sao

Còn rẻ hơn thì chơi Kimi, chắc ngon quá tối qua còn test được chứ sáng nay bọn nó báo server busy hết
 
Thím xem cái codex-plugin-cc của OpenAI ấy, có hướng dẫn chạy Codex bên trong Claude Code

Mình chưa thử vụ chạy kiểu này, toàn chạy truyền thống kiểu chạy các model trong Github Copilot / Antigravity, tất nhiên qua đám Copilot hay Antigravity thì chất lượng cùi hơn, không biết chạy Codex trong Claude Code thì ra sao

Còn rẻ hơn thì chơi Kimi, chắc ngon quá tối quá còn test được chứ sáng nay bọn nó báo server busy hết
Qua giờ Anthropic lộ tin cắt Claude Code khỏi gói Pro là bọn nó đổ xô sang Kimi với GLM rồi, chắc server quá tải :doubt:
 
mấy thằng GLM cũng biết bắt thời cơ lắm, sáng sớm đã gửi 1 cái mail cho free 2 tháng, rồi giảm giá 50% cho gói 3 tháng tiếp theo:byebye:
Bản chất vẫn là bài toán kinh doanh thôi, tranh thủ mà hút end-user chứ về sau user nó tạo được thói quen rồi thì khó hút lắm
 
mấy thằng GLM cũng biết bắt thời cơ lắm, sáng sớm đã gửi 1 cái mail cho free 2 tháng, rồi giảm giá 50% cho gói 3 tháng tiếp theo:byebye:
Nhưng ko ai biết trước đó gói Quarter của nó chỉ có 72$, nâng giá x3 rồi giảm 50% thì vẫn cao gấp rưỡi giá cũ. Và nó code cũng gọi là ổn thôi, kết hợp với opencode thì tạm được, đã test cùng 1 prompt, cùng phần plan + stitch thì nó code ra cái giao diện tởm và lỗi nhiều nhất trong 3 thằng Claude, Codex, GLM (API qua opencode)
 
Nhưng ko ai biết trước đó gói Quarter của nó chỉ có 72$, nâng giá x3 rồi giảm 50% thì vẫn cao gấp rưỡi giá cũ. Và nó code cũng gọi là ổn thôi, kết hợp với opencode thì tạm được, đã test cùng 1 prompt, cùng phần plan + stitch thì nó code ra cái giao diện tởm và lỗi nhiều nhất trong 3 thằng Claude, Codex, GLM (API qua opencode)
anh so nó với Claude, codex thì tội nó quá, nên so với bộ tam Minimax, Kimi, với nó thôi:amazed:
Trước tôi xài khi nó mới ra bản 4.6 ha gì đó, $3/m rẻ như cứt chim
 
có con máy chạy Unix dùng rtx 4090 / i9-13900K định cài local model test, ae nào gợi ý phát, qwen có ngon ko?
 
Có AI nào free không nhỉ, hoàn toàn open source free cho người dùng ấy, llama của meta hình như là dạng này thì phải.

Ai test thử thấy chất lượng của nó so với mấy con chatGPT, gemini với claude thế nào chưa ?
 
Host đc model bao nhiêu mà tự host, gemma 4 sợ chạy còn ỳ ạch ko nổi. :))
Quan trọng là nhu cầu của anh đến đâu thôi, trên X t đang theo dõi một ông chuyên fine-tune lại các model để có thể tự host trên máy cá nhân được. Cũng hi vọng hướng này sáng sủa chút.
 
anh so nó với Claude, codex thì tội nó quá, nên so với bộ tam Minimax, Kimi, với nó thôi:amazed:
Trước tôi xài khi nó mới ra bản 4.6 ha gì đó, $3/m rẻ như cứt chim
Dùng bản 5.1 mới nhất rồi cũng vậy thôi, hàng Tàu dành cho dev là tốt nhất, biết guide nó dùng cai gì và code như thế nào
 
Chạy Local chơi mấy cái NSFW 18+ hay séc sủng noni ấy à. Chứ mắc công set up rồi vài bữa nó ra model mới thì Local làm mẹ gì. :doubt:
 
có con máy chạy Unix dùng rtx 4090 / i9-13900K định cài local model test, ae nào gợi ý phát, qwen có ngon ko?

quang trọng a làm gì nữa, tại mấy model nhỏ thì tuỳ model, ví dụ con Gemma 4 thì xử lý văn bản, dịch rất tốt. qwen 3.6 thì mạnh về code hơn Gemma 4.
Chui vô đây dạo 1 vòng là thấy giờ chỉ có 2 model này múa Reddit - Please wait for verification (https://www.reddit.com/r/LocalLLaMA/)
 

Thống kê chủ đề

Ngày tạo
System Design,
Người trả lời cuối
vodanh1213,
Trả lời
373
Lượt xem
63.384
Quay lại
Lên đầu trang