(Trung Quốc) GLM-5.2: Vũ khí AI giá rẻ từ Trung Quốc tạo áp lực lớn lên ChatGPT và Claude

  • Người tạo chủ đề Người tạo chủ đề Quaritch
  • Ngày bắt đầu Ngày bắt đầu
tôi daan ngoại đạo mai fen cho hỏi lên plan chi tiết v làm sao để xử lí vấn đề context? project của tôi docs mặc dù k nhiều nhưng tôi k biết làm sao để input context triệt để. Dù đã chia task nhỏ nhưng feed docs vào thì prompt đầu đã tốn tầm 100-150k context r (đang dùng claude). Docs của tôi tầm vài chục md file cho nhiều module mỗi module đã chia nhỏ ra, project cá nhân k nhiều.
Hướng dẫn đơn giản chút cho nontech nhé. Đầu tiên phen dùng AGENTS.md hoặc Claude.md để điều hướng /docs. Chia tài liệu trong /docs ra thành 2 loại:
  • Loại 1 là luôn luôn load ở mọi session. Ví dụ như techstack, progress...gì đó phen hãy hỏi AI
  • Loại 2 là docs của từng feature, động đến đâu load đến đấy. Phen có thể tổ chức dạng /docs/features/feature1

Thông thường dự án án nhỏ thì phần load docs đầu tiên chỉ nên tầm 20k thôi. 100k là quá kém hiệu quả rồi. Với kiểm tra xem có cài MCP hay skills gì không.
 
Hướng dẫn đơn giản chút cho nontech nhé. Đầu tiên phen dùng AGENTS.md hoặc Claude.md để điều hướng /docs. Chia tài liệu trong /docs ra thành 2 loại:
  • Loại 1 là luôn luôn load ở mọi session. Ví dụ như techstack, progress...gì đó phen hãy hỏi AI
  • Loại 2 là docs của từng feature, động đến đâu load đến đấy. Phen có thể tổ chức dạng /docs/features/feature1

Thông thường dự án án nhỏ thì phần load docs đầu tiên chỉ nên tầm 20k thôi. 100k là quá kém hiệu quả rồi. Với kiểm tra xem có cài MCP hay skills gì không.
k có mcp chỉ có vài skill à. Docs chủ yếu là files tổng hợp từ research paper, experiment data (project của tôi cần phải process data từ những lần chạy thử), với finding từ đống data đó. Cơ mà càng dev thì data càng phình to ra. Chứ k phải có plan 1 lần là xong ngay.
À còn 1 cái nữa do k có kinh nghiệm làm system design hay project manager nên project của tôi bị rối á. Module phụ thuộc lẫn nhau vào kết quả chạy thử, r module a bị khoá nếu như module b chưa xong với nhiều thứ nữa, nên nhiều lúc bị rối k biết phải quản lí dự án sao cho đúng. Càng làm mới thấy k phải có ai là xong, phải tìm hiểu đủ thứ.
Mấy cái fen đề cử t có làm hết r, cơ mà lượng thông tin càng ngày càng nhiều nên khá đau đầu k biết xử lí sao. Tôi đang đọc về rag, graph rag các kiểu mà thấy khá mông lung, k biết có giúp dc k. Sợ giảm context thì cũng giảm chất lượng.
 
k có mcp chỉ có vài skill à. Docs chủ yếu là files tổng hợp từ research paper, experiment data (project của tôi cần phải process data từ những lần chạy thử), với finding từ đống data đó. Cơ mà càng dev thì data càng phình to ra. Chứ k phải có plan 1 lần là xong ngay.
À còn 1 cái nữa do k có kinh nghiệm làm system design hay project manager nên project của tôi bị rối á. Module phụ thuộc lẫn nhau vào kết quả chạy thử, r module a bị khoá nếu như module b chưa xong với nhiều thứ nữa, nên nhiều lúc bị rối k biết phải quản lí dự án sao cho đúng. Càng làm mới thấy k phải có ai là xong, phải tìm hiểu đủ thứ.
Mấy cái fen đề cử t có làm hết r, cơ mà lượng thông tin càng ngày càng nhiều nên khá đau đầu k biết xử lí sao. Tôi đang đọc về rag, graph rag các kiểu mà thấy khá mông lung, k biết có giúp dc k. Sợ giảm context thì cũng giảm chất lượng.
Cách dễ nhất là tách đống docs đó ra thành các file nhỏ hơn rồi build các summary card gắn link với từng file docs đó. Kêu AI nó build sao để Obsidian có thể quản lý được đống summary card và docs ấy. Nhớ là chia chủ đề file docs càng chi tiết càng tốt nhưng summary card phải ngắn gọn 5 - 10 dòng thôi.

Obsidian có cái tiện là chỉ định folder vault được, view thay đổi trực tiếp, không cần phải clone ra import vào như Notion, Anytype. Nhược điểm là Obsidian UI như cái đầu bùi, bị lậm UI của mấy tool code editor, cần cài thêm mớ plugin nữa thì office user mới dùng tàm tạm được.

Không quen Obsidian thì kêu AI nó build hẳn html luôn, tốn token để build và update file html thôi.

Không thì dùng GitNexus, Graphify, Understand anything, OpenWiki. Không nữa thì dùng drawio-skill.

Mổi cái có cái ưu nhược điểm khác nhau, dùng thử ưng cái nào xài cái đó.
 
Cách dễ nhất là tách đống docs đó ra thành các file nhỏ hơn rồi build các summary card gắn link với từng file docs đó. Kêu AI nó build sao để Obsidian có thể quản lý được đống summary card và docs ấy. Nhớ là chia chủ đề file docs càng chi tiết càng tốt nhưng summary card phải ngắn gọn 5 - 10 dòng thôi.

Obsidian có cái tiện là chỉ định folder vault được, view thay đổi trực tiếp, không cần phải clone ra import vào như Notion, Anytype. Nhược điểm là Obsidian UI như cái đầu bùi, bị lậm UI của mấy tool code editor, cần cài thêm mớ plugin nữa thì office user mới dùng tàm tạm được.

Không quen Obsidian thì kêu AI nó build hẳn html luôn, tốn token để build và update file html thôi.

Không thì dùng GitNexus, Graphify, Understand anything, OpenWiki. Không nữa thì dùng drawio-skill.

Mổi cái có cái ưu nhược điểm khác nhau, dùng thử ưng cái nào xài cái đó.
e đang muốn đọc cải thiện phần vibe code này, hiện tại chỉ đang dừng ở mức viết skill và mcp thôi. Giờ đang muốn học sâu hơn thì nên tiếp tục nghiên cứu gì, với có chỗ nào học về phần này k
 
e đang muốn đọc cải thiện phần vibe code này, hiện tại chỉ đang dừng ở mức viết skill và mcp thôi. Giờ đang muốn học sâu hơn thì nên tiếp tục nghiên cứu gì, với có chỗ nào học về phần này k
Châm ngôn của tôi khi nói về AI là: Bạn không cần học AI, bạn chỉ cần 1 chủ đề để học AI.

Về vibe code thì cũng tương tự, bạn không cần học vibe code, bạn cần một ý tưởng để bắt đầu vibe code.

Dù ý tưởng của bạn có là phát minh lại cái bánh xe thì cũng được chả sao cả. Chẳng phải đó là việc từ nhỏ chúng ta đã làm hay sao? Giải những bài toán đã được giải hàng trăm, hàng ngàn năm trước đó rồi. Nếu việc đó là vô nghĩa thì tại sao ta vẫn bị bắt phải làm lại?

Trở lại câu hỏi của bạn, tôi nghĩ là bạn nên chăm lướt tiktok, facebook về chủ đề AI, Vibe code một chút và lưu chúng lại. Dù mấy clip, post ấy tất cả đều ngắn, không chứa nhiều kiến thức sâu xa gì, mang tính chất tổng hợp thông tin, thậm chí là lùa gà bán khóa học nhưng mà chí ít nó mang lại cho bạn những cái tên repo, những khái niệm mới mẻ, những thuật ngữ lập trình chưa hề biết, những sự kiện được cập nhật...

Từ những thứ góp nhặt ấy, hãy hỏi AI về chúng và hãy nhớ không có câu hỏi nào là vô nghĩa hết. Mổi câu hỏi của bạn, mổi câu trả lời của AI đều mang lại kiến thức, hiểu biết cho bạn.

Thứ làm một senoir khác bạn chính là thời gian họ dành cho lập trình.
 
Châm ngôn của tôi khi nói về AI là: Bạn không cần học AI, bạn chỉ cần 1 chủ đề để học AI.

Về vibe code thì cũng tương tự, bạn không cần học vibe code, bạn cần một ý tưởng để bắt đầu vibe code.

Dù ý tưởng của bạn có là phát minh lại cái bánh xe thì cũng được chả sao cả. Chẳng phải đó là việc từ nhỏ chúng ta đã làm hay sao? Giải những bài toán đã được giải hàng trăm, hàng ngàn năm trước đó rồi. Nếu việc đó là vô nghĩa thì tại sao ta vẫn bị bắt phải làm lại?

Trở lại câu hỏi của bạn, tôi nghĩ là bạn nên chăm lướt tiktok, facebook về chủ đề AI, Vibe code một chút và lưu chúng lại. Dù mấy clip, post ấy tất cả đều ngắn, không chứa nhiều kiến thức sâu xa gì, mang tính chất tổng hợp thông tin, thậm chí là lùa gà bán khóa học nhưng mà chí ít nó mang lại cho bạn những cái tên repo, những khái niệm mới mẻ, những thuật ngữ lập trình chưa hề biết, những sự kiện được cập nhật...

Từ những thứ góp nhặt ấy, hãy hỏi AI về chúng và hãy nhớ không có câu hỏi nào là vô nghĩa hết. Mổi câu hỏi của bạn, mổi câu trả lời của AI đều mang lại kiến thức, hiểu biết cho bạn.

Thứ làm một senoir khác bạn chính là thời gian họ dành cho lập trình.
Em đang làm mobile, mục tiêu là tự động hóa quá trình code của em, cũng có lên các diễn đàn như reddit các thứ tham khảo, cũng tăng đc kha khá tốc độ, giờ muốn tối ưu về mặt chi phí token, tối ưu hóa thêm. Hiện đang chỉ sử dụng claude thôi, đang muốn ghép thêm với mấy model tàu để giảm chi tiêu đi tí
 
tôi daan ngoại đạo mai fen cho hỏi lên plan chi tiết v làm sao để xử lí vấn đề context? project của tôi docs mặc dù k nhiều nhưng tôi k biết làm sao để input context triệt để. Dù đã chia task nhỏ nhưng feed docs vào thì prompt đầu đã tốn tầm 100-150k context r (đang dùng claude). Docs của tôi tầm vài chục md file cho nhiều module mỗi module đã chia nhỏ ra, project cá nhân k nhiều.
Vãi đái, Model Opus cũng chỉ suy luận tốt nhất ở cái khoản 200k context thôi mà bác chơi câu đầu đã nhai 100-150k thì làm ăn gì nữa, lý do lúc trước thằng Anthopic phải tăng giá ở mức 200k context, model sẽ tăng giá x2 input và x1.5 output. bác nên đọc docs của claude code vào để biết cách hoạt động, cũng như harness mức độ ưu tiên của từng phần trong context.... sử dụng bất cứ thứ gì muốn hiệu quả thì bác nên hiểu cách nó hoạt động như thế nào, và nên đọc docs của chính thằng làm ra nó trước khi tin lời thằng chuyên gia trên mạng nào.

Dưới đây là biểu đồ cơ bản context của một harness hiện đại, hầu như tất cả agent AI điều hoạt đông như thế này.

1783479072042.webp


Ảnh này trích từ tài liệu gần đây của google, bác nào muốn đọc thì mình có dịch sẵn, nửa đầu rất hay và sát với hiện tại, còn khúc sau thì hơi lan mang.

Bản dịch sẵn: SDLC Mới Với Vibe Coding — Từ prompting ad-hoc đến Agentic Engineering (https://agentic.trongnguyenchromeos.workers.dev/)
Link tài liệu gốc của google: The New SDLC With Vibe Coding (https://www.kaggle.com/whitepaper-the-new-SDLC-with-vibe-coding)
 
Sửa lần cuối:
một video giải thích cách agent code hoạt động và nhai token như thế nào, rất hay và dễ hiểu:big_smile:


Lồng tiếng việt vô cho bác nào không nghe tốt tiếng anh:byebye:

 
Sửa lần cuối:
Em đang làm mobile, mục tiêu là tự động hóa quá trình code của em, cũng có lên các diễn đàn như reddit các thứ tham khảo, cũng tăng đc kha khá tốc độ, giờ muốn tối ưu về mặt chi phí token, tối ưu hóa thêm. Hiện đang chỉ sử dụng claude thôi, đang muốn ghép thêm với mấy model tàu để giảm chi tiêu đi tí
Tôi nghĩ là nếu hỏi bất kỳ một senior nào về việc thiết kế vòng lặp agent tự code, agent tự review code, agent tự viết unit test, agent tư debug, agent tự fix bug... thì đều sẽ cùng trả lời một câu trả lời: "Tao còn đéo tin tưởng cả bản thân tao nữa là, bảo tao tin con Ai, có mứt ấy".

Còn về vụ gắn model khác với Claude thì tôi khuyên gắn Codex. Plugin chính chủ đây:


Tại sao là Codex, vì trình độ suy luận, nắm ý của con ChatGPT 5.5 nó ngang Opus 4.8 mà quota token lại nhiều hơn.

Với dân vibe code thì thường không biết là mình đang muốn gì, phải thảo luận, brainstorm với con AI nhiều hơn là senoir. Vì vibe code là không biết phải mô tả, nói theo ngôn ngữ lập trình nên con AI nó phải có trình độ suy luận, nắm ý rất cao mới cho ra câu trả lời chất lượng được với dân vibe code. Nếu không thì một vấn đề dễ phải nói đi nói lại nhiều lần để mới cho ra kết quả tạm ổn được.

Còn senoir thì khác, họ biết họ muốn gì và phải nói sao cho AI làm đúng ý cho nên gắn model tàu làm công nhân được vì họ promp kỹ lưỡng, giao task rất rõ.

Giống như trong thiết kế, dân vibe code không khác gì khách hàng mù tịt về thiết kế mỹ thuật, không biết mình đang muốn cái gì chỉ giao task cho designer là thiết kế cho chị đẹp, lung linh, thời thượng, sang trọng, tinh tế, quý tộc...

Designer giỏi thì như Claude với Codex có kinh nghiệm, có trải nghiệm, nắm được khách đang hình dung dạng thế nào, cho ra được cái thiết kế tàm tạm rồi sửa theo ý khách trên cái base thiết kế đó.

Designer gà thì như mấy model tàu cho ra thiết kế cục mịch đưa ra là khách lắc đầu chê.

Nhưng designer gà đó mà có ông art director xách giấy viết ra vẽ chỉ mày dùng layout thế này, logo đặt chổ này, sản phẩm đặt chở kia, background là gì, graphic có gì, effect ra sao, tone màu gì... thì làm ngon ơ.

Nó là vậy á
 
Tôi nghĩ là nếu hỏi bất kỳ một senior nào về việc thiết kế vòng lặp agent tự code, agent tự review code, agent tự viết unit test, agent tư debug, agent tự fix bug... thì đều sẽ cùng trả lời một câu trả lời: "Tao còn đéo tin tưởng cả bản thân tao nữa là, bảo tao tin con Ai, có mứt ấy".

Còn về vụ gắn model khác với Claude thì tôi khuyên gắn Codex. Plugin chính chủ đây:


Tại sao là Codex, vì trình độ suy luận, nắm ý của con ChatGPT 5.5 nó ngang Opus 4.8 mà quota token lại nhiều hơn.

Với dân vibe code thì thường không biết là mình đang muốn gì, phải thảo luận, brainstorm với con AI nhiều hơn là senoir. Vì vibe code là không biết phải mô tả, nói theo ngôn ngữ lập trình nên con AI nó phải có trình độ suy luận, nắm ý rất cao mới cho ra câu trả lời chất lượng được với dân vibe code. Nếu không thì một vấn đề dễ phải nói đi nói lại nhiều lần để mới cho ra kết quả tạm ổn được.

Còn senoir thì khác, họ biết họ muốn gì và phải nói sao cho AI làm đúng ý cho nên gắn model tàu làm công nhân được vì họ promp kỹ lưỡng, giao task rất rõ.

Giống như trong thiết kế, dân vibe code không khác gì khách hàng mù tịt về thiết kế mỹ thuật, không biết mình đang muốn cái gì chỉ giao task cho designer là thiết kế cho chị đẹp, lung linh, thời thượng, sang trọng, tinh tế, quý tộc...

Designer giỏi thì như Claude với Codex có kinh nghiệm, có trải nghiệm, nắm được khách đang hình dung dạng thế nào, cho ra được cái thiết kế tàm tạm rồi sửa theo ý khách trên cái base thiết kế đó.

Designer gà thì như mấy model tàu cho ra thiết kế cục mịch đưa ra là khách lắc đầu chê.

Nhưng designer gà đó mà có ông art director xách giấy viết ra vẽ chỉ mày dùng layout thế này, logo đặt chổ này, sản phẩm đặt chở kia, background là gì, graphic có gì, effect ra sao, tone màu gì... thì làm ngon ơ.

Nó là vậy á
Mấy ông mà chạy loop agent tự động cho hết cái quy trình, tôi thật sự chẳng hiểu là mấy ổng đang xây cái mả mẹ gì, chất lượng ra sao luôn, toàn thấy nói flow này, loop nọ nhưng chả biết sản phẩm là cái gì:amazed:

Opus mà không kiểm tra, lèo lái nó còn làm khùng làm điên, chứ đừng nới mấy model tàu khựa, để nó đốt token qua đêm.
Có đường lên hết spec rồi đưa nó tự chạy tự test, nhưng kết quả tôi nghĩ cũng như cứt thôi :byebye:
 
càng tốt, mấy thằng vẩu dơ rách cứ chửi hố nan với cổ nâu thoải mái chứ tôi chỉ mong về mảng công nghệ thằng TQ big win, thống trị luôn càng tốt chứ nhờ ơn mấy con chó tây lông mà bố m mãi mãi phải chơi game 3A ngoài net hoặc cloud đcm chúng mày, AI token thì đắt lòi bản họng gen dc cái ảnh đã đòi tiền
UKiCiKh.png
 
Mấy ông mà chạy loop agent tự động cho hết cái quy trình, tôi thật sự chẳng hiểu là mấy ổng đang xây cái mả mẹ gì, chất lượng ra sao luôn, toàn thấy nói flow này, loop nọ nhưng chả biết sản phẩm là cái gì:amazed:

Opus mà không kiểm tra, lèo lái nó còn làm khùng làm điên, chứ đừng nới mấy model tàu khựa, để nó đốt token qua đêm.
Có đường lên hết spec rồi đưa nó tự chạy tự test, nhưng kết quả tôi nghĩ cũng như cứt thôi :byebye:
Theo tôi đoán là mấy ông nào mà kêu chạy loop này, flow nọ là mấy ông chạy hermes, openclaw chạy seo, chạy content, affiliate marketing, gắn giỏ hàng toktok, digital marketing cho brand trên fb, yt hoặc bán khóa học. Có vậy mới giấu cái mình build thôi, chứ không nói thẳng ra mình đang build gì, tên gì thì thiếu gì cách nói mé mé về mặt kỹ thuật.

Chỉ có đội đó thì mới cần ra hàng nhanh, hàng loạt, tự động hóa chứ đội code production ngồi soi diff thí mịa ra, tin thế quái nào được agentic loop. Production dính bug là tăng ca phờ râu, QA mắc võng ngủ chung luôn ở đó để chạy automatic.
 
Mấy ông mà chạy loop agent tự động cho hết cái quy trình, tôi thật sự chẳng hiểu là mấy ổng đang xây cái mả mẹ gì, chất lượng ra sao luôn, toàn thấy nói flow này, loop nọ nhưng chả biết sản phẩm là cái gì:amazed:

Opus mà không kiểm tra, lèo lái nó còn làm khùng làm điên, chứ đừng nới mấy model tàu khựa, để nó đốt token qua đêm.
Có đường lên hết spec rồi đưa nó tự chạy tự test, nhưng kết quả tôi nghĩ cũng như cứt thôi :byebye:
Đội dev chuyên dùng AI agent nó verify qua nhiều level lắm rồi: Eval test, regression test, automation test... hết rồi, chứ để nó tự test theo specs thì vẫn như mứt thôi.
 
tôi daan ngoại đạo mai fen cho hỏi lên plan chi tiết v làm sao để xử lí vấn đề context? project của tôi docs mặc dù k nhiều nhưng tôi k biết làm sao để input context triệt để. Dù đã chia task nhỏ nhưng feed docs vào thì prompt đầu đã tốn tầm 100-150k context r (đang dùng claude). Docs của tôi tầm vài chục md file cho nhiều module mỗi module đã chia nhỏ ra, project cá nhân k nhiều.
Ở file instruction gốc (AGENTS.md hoặc CLAUDE.md) chỉ nên là chỉ mục cho agent đến từng file cụ thể trong workflow thôi. Mỗi stage trong workflow chỉ có 1 file làm source of truth, và track file đó trong workflow state control. Mỗi lần spawn agent mới nó sẽ đọc theo chỉ mục AGENTS.md -> workflow state control -> source of truth của state.
 
Mấy ông mà chạy loop agent tự động cho hết cái quy trình, tôi thật sự chẳng hiểu là mấy ổng đang xây cái mả mẹ gì, chất lượng ra sao luôn, toàn thấy nói flow này, loop nọ nhưng chả biết sản phẩm là cái gì:amazed:

Opus mà không kiểm tra, lèo lái nó còn làm khùng làm điên, chứ đừng nới mấy model tàu khựa, để nó đốt token qua đêm.
Có đường lên hết spec rồi đưa nó tự chạy tự test, nhưng kết quả tôi nghĩ cũng như cứt thôi :byebye:
vì mục đích của họ k phải là code mà để tiết kiệm thời gian
. Ví dụ như mình làm content ngại nhất là phần thu thập, phân tích và bóc tách dữ liệu. dùng loop agent thì thay vì phải đi tìm tay từng cái một thì nhắn cái là nó tìm cho mình luôn. Content cũng thế. Việc mình cần còn lại là tập trung vào nội dung content và edit thôi.
Một ví dụ khác là dùng Loop agent để clipping. Thay vì ngồi xem highlight thì máy nó tự làm luôn cũng tiện mà
Mình đang tìm hiểu cách vibecode 1 app auto edit cá nhân, bằng hữu hưu duyễn chỉ lộ này cho tại hạ đc k? Đội ơn bằng hữu nhiều.
 
vì mục đích của họ k phải là code mà để tiết kiệm thời gian
. Ví dụ như mình làm content ngại nhất là phần thu thập, phân tích và bóc tách dữ liệu. dùng loop agent thì thay vì phải đi tìm tay từng cái một thì nhắn cái là nó tìm cho mình luôn. Content cũng thế. Việc mình cần còn lại là tập trung vào nội dung content và edit thôi.
Một ví dụ khác là dùng Loop agent để clipping. Thay vì ngồi xem highlight thì máy nó tự làm luôn cũng tiện mà
Mình đang tìm hiểu cách vibecode 1 app auto edit cá nhân, bằng hữu hưu duyễn chỉ lộ này cho tại hạ đc k? Đội ơn bằng hữu nhiều.


Đang nói mấy ông vibe code á, chứ còn làm việc thì loop là bình thường, mình vẫn hay dùng để dịch sách, phân tích thị trường, tìm thông tin (qua openclaw).

Loop agent để clipping thì bác nghiên cứu thử:
Tận dung mấy cái có sẵn này mình nghĩ là đủ phần core để bác làm rồi á, việc còn lại là thiết kế skill và sub agent + flow để xử lý thôi.

Còn rảnh thì có thẻ tự viết hết: ffmpeg + whisper + pyannote + OmniVoice....
 

Thống kê chủ đề

Ngày tạo
Quaritch,
Người trả lời cuối
Conan áo vàng,
Trả lời
128
Lượt xem
18.672
Quay lại
Lên đầu trang