thảo luận Deepseek AI vào hết đây

  • Người tạo chủ đề Người tạo chủ đề Zaunite
  • Ngày bắt đầu Ngày bắt đầu
chờ xem hôm nay kéo giá stock lên đc bao nhiêu
KAUdgHo.png
 
Giờ chỉ hóng cạc giảm giá :sexy_girl: Giờ nhu cầu cạc giảm xuống, sản lượng dư thừa tăng lên, cạc chị Su cũng chạy AI được, thì anh Huang sẽ xả hàng cho gamer dễ thở :sexy_girl:
 
Giờ chỉ hóng cạc giảm giá :sexy_girl: Giờ nhu cầu cạc giảm xuống, sản lượng dư thừa tăng lên, cạc chị Su cũng chạy AI được, thì anh Huang sẽ xả hàng cho gamer dễ thở :sexy_girl:
Hết mùa coi ai cũng mong vậy, xong giờ nó có trend AI. Trend AI sắp được H100 thống trị thì nó ra lại con đíp sếch chạy được trên card gamer.
4gmOAMB.png
 
Mấy bữa trước bận chơi tết chỉ hóng tin, không test thử ... Mà tôi không phải dân IT nên cũng không hào hứng lắm ( cái chính là có biết cm gì đâu mà tranh luận 😅)

Hôm nay ngồi nghịch thì có nhận xét thế này : ( tôi éo phải dân IT hay toán nên éo test thuật toán hay logic gì cả ... Tôi test độ dam dang 🤣)
Bài test là cho nó viết truyện người lớn thì :
  • gpt viết thì văn phong , tả cảnh, diễn biến tâm lý hay hơn nhưng bị chặn tả thực ( vi phạm tiêu chuẩn cộng đồng , trước có mod DAN mà giờ nó khóa rồi )
  • deep sex thì cởi mở và tả thực hơn ( lúc đầu cũng lôi tiêu chuẩn cộng đồng ra cơ mà mình nói mình đủ tuổi 18+ và bảo mật nên nó viết tuốt luốt ra luôn ) nhưng văn phong thì chán quá, cần học hỏi thêm fpt

Kết luận : fpt về văn chương thì thua xa gpt nhưng được cái ít vùng cấm hơn 😅 ... Đợi thím nào chuyên ngành train nó bằng cô giáo thảo xem có khá hơn không 😅
 
Mấy bữa trước bận chơi tết chỉ hóng tin, không test thử ... Mà tôi không phải dân IT nên cũng không hào hứng lắm ( cái chính là có biết cm gì đâu mà tranh luận 😅)

Hôm nay ngồi nghịch thì có nhận xét thế này : ( tôi éo phải dân IT hay toán nên éo test thuật toán hay logic gì cả ... Tôi test độ dam dang 🤣)
Bài test là cho nó viết truyện người lớn thì :
  • gpt viết thì văn phong , tả cảnh, diễn biến tâm lý hay hơn nhưng bị chặn tả thực ( vi phạm tiêu chuẩn cộng đồng , trước có mod DAN mà giờ nó khóa rồi )
  • deep sex thì cởi mở và tả thực hơn ( lúc đầu cũng lôi tiêu chuẩn cộng đồng ra cơ mà mình nói mình đủ tuổi 18+ và bảo mật nên nó viết tuốt luốt ra luôn ) nhưng văn phong thì chán quá, cần học hỏi thêm fpt

Kết luận : fpt về văn chương thì thua xa gpt nhưng được cái ít vùng cấm hơn 😅 ... Đợi thím nào chuyên ngành train nó bằng cô giáo thảo xem có khá hơn không 😅
Văn chương gpt ngon hơn là đúng rồi, vì được train data chuẩn chỉ. Thằng đíp sếch chỉ "chưng cất" lại, nên có thể nó chưa cover hết được các case, cũng như data ko nhiều bằng. Tương lai anh đíp sếch phải tìm cách để nâng cấp bộ data lên, chứ "chưng cất" hoài cũng ko ổn lắm.

Btw,

Sao chép công nghệ lõi của DeepSeek, các nhà nghiên cứu Mỹ tạo ra mô hình AI mới với giá "rẻ như cho"​


Nhiều ngày nay, startup AI DeepSeek đã gây sóng gió khi giới thiệu R1, một mô hình AI có hiệu năng tương đương của ChatGPT và những hệ thống đắt đỏ khác với chi phí huấn luyện chỉ bằng một phần nhỏ so với mức điển hình ở Thung lũng Silicon. Điều này trở thành hiện thực nhờ vào hàng loạt đột phá về tối ưu phần cứng cũng như phần mềm để việc huấn luyện cũng như vận hành trở nên tiết kiệm hơn.

Nhưng một nhóm các nhà nghiên cứu tại Đại học California, Berkeley cho biết, họ có thể làm điều đó với giá rẻ hơn nữa – chỉ với 30 USD. Dưới sự dẫn dắt của nghiên cứu sinh Jiayi Pan, các nhà nghiên cứu đã sao chép thành công công nghệ lõi của DeepSeek để tạo ra một phiên bản quy mô nhỏ hơn, được gọi là "TinyZero", và phát hành nó trên GitHub để thử nghiệm công khai.

Dù chỉ sở hữu quy mô khiêm tốn so với mô hình gốc 671 tỷ tham số, TinyZero được cho là mô phỏng chính xác hành vi cốt lõi của DeepSeek nhờ phương pháp học tăng cường (reinforcement learning).



Sao chép công nghệ lõi của DeepSeek, các nhà nghiên cứu Mỹ tạo ra mô hình AI mới với giá rẻ như cho- Ảnh 1.
Mô hình TinyZero được phát triển dựa trên các công nghệ cốt lõi của DeepSeek với chi phí siêu rẻ



Cách tiếp cận của Pan tập trung vào học tăng cường (reinforcement learning), một kỹ thuật trong đó AI, bắt đầu với những phỏng đoán gần như ngẫu nhiên, dần dần tinh chỉnh câu trả lời bằng cách sửa đổi và tìm kiếm các giải pháp khả thi. Trong một bài đăng mô tả dự án, anh đã nêu bật trò chơi Countdown, một câu đố truyền hình của Anh nơi người chơi kết hợp các con số đã cho để đạt được giá trị mục tiêu. "Sau nhiều lần thử sai, nó tự sửa lỗi và đạt đáp án đúng", Pan chia sẻ.

Thành công của TinyZero đặt ra câu hỏi lớn: Tại sao các tập đoàn như OpenAI hay Google lại chi hàng tỷ USD cho AI trong khi một nhóm nghiên cứu nhỏ có thể đạt kết quả tương tự với ngân sách "hạt dẻ"? DeepSeek từng gây sốc khi tuyên bố chi phí đào tạo mô hình R1 chỉ vài triệu USD, nhưng TinyZero còn đi xa hơn – chỉ tốn 30 USD cho phiên bản thu nhỏ.



Sao chép công nghệ lõi của DeepSeek, các nhà nghiên cứu Mỹ tạo ra mô hình AI mới với giá rẻ như cho- Ảnh 2.
Dù có quy mô tham số nhỏ hơn, TinyZero cũng tái tạo được khả năng của DeepSeek khi xử lý tác vụ



Các con số này đi ngược lại quan niệm thông thường rằng những bước đột phá lớn trong AI đòi hỏi toàn bộ trung tâm dữ liệu, GPU ngốn điện, và hàng triệu thậm chí phải chi tiêu đến hàng tỷ USD.

Tuy nhiên, nhiều ý kiến vẫn hoài nghi. Họ cho rằng con số DeepSeek công bố chưa phản ánh toàn bộ sự thật, vì có khả năng công ty này đang hưởng lợi từ các nguồn lực hay kỹ thuật khác được giữ kín. Dù TinyZero là minh chứng cho việc học tăng cường hiệu quả có thể triển khai với ngân sách eo hẹp, nó không hoàn toàn tương đương để so sánh năng lực với DeepSeek. TinyZero giống một phiên bản mẫu đơn giản hóa hơn là đối trọng thực sự.

Dù vậy, thí nghiệm của UC Berkeley hé lộ xu hướng mới: AI mã nguồn mở và tiết kiệm tài nguyên. Nếu các nhà phát triển độc lập có thể tạo ra công nghệ tương tự với ngân sách hạn chế, áp lực cạnh tranh lên các đại gia công nghệ là không nhỏ. "TinyZero cho thấy sáng tạo không nhất thiết phải đắt đỏ. Một sinh viên xuất sắc hoặc startup nhỏ cũng có thể làm nên điều khác biệt", một nhà phân tích nhận định.



Sao chép công nghệ lõi của DeepSeek, các nhà nghiên cứu Mỹ tạo ra mô hình AI mới với giá rẻ như cho- Ảnh 3.


Thành công của TinyZero và DeepSeek R1 phản ánh nhu cầu ngày càng lớn đối với các mô hình AI gọn nhẹ, tiết kiệm năng lượng. Điều này mở ra cánh cửa cho những quốc gia hoặc tổ chức thiếu ngân sách tiếp cận công nghệ cao, đồng thời thúc đẩy cạnh tranh trong ngành. Tuy nhiên, thách thức vẫn tồn tại. Các mô hình quy mô nhỏ như TinyZero dù ấn tượng nhưng chưa thể xử lý đa nhiệm phức tạp như phiên bản đầy đủ. Hơn nữa, việc sao chép công nghệ có thể dẫn đến rủi ro về bản quyền và chất lượng.

Theo nhóm nghiên cứu UC Berkeley, mục tiêu của họ là "giải mã xu hướng mở rộng AI dựa trên học tăng cường" và khuyến khích cộng đồng cùng tham gia. Với làn sóng quan tâm từ khắp thế giới, TinyZero đã chứng minh rằng cuộc cách mạng AI không chỉ thuộc về những ai có ví tiền dày, mà còn mở ra cho những ý tưởng táo bạo và sáng tạo không biên giới. Liệu đây có phải bước khởi đầu cho kỷ nguyên AI "bình dân"? Câu trả lời phụ thuộc vào cách ngành công nghiệp này thích ứng với làn sóng mới.
 
Ngại lội thớt quá, nhưng VN tàu nhanh có con cẩu nô này đang hoành hành def cho đíp sít kinh vl. Nhìn nó cay cú viết hoa tên mẫu quốc như Trung Quốc, còn Âu Mỹ thì nó viết thường để tỏ vẻ khinh bỉ, lại còn xạo lol đang sống ở Mỹ nữa, đúng loài hạ đẳng cẩu nô, không lẫn đâu được, lol. Nếu thớt này có thằng nào cứ hê hê hê như thằng cẩu nô này thì đích thị là nó

ds.jpg


 
Văn chương gpt ngon hơn là đúng rồi, vì được train data chuẩn chỉ. Thằng đíp sếch chỉ "chưng cất" lại, nên có thể nó chưa cover hết được các case, cũng như data ko nhiều bằng. Tương lai anh đíp sếch phải tìm cách để nâng cấp bộ data lên, chứ "chưng cất" hoài cũng ko ổn lắm.

Btw,

Sao chép công nghệ lõi của DeepSeek, các nhà nghiên cứu Mỹ tạo ra mô hình AI mới với giá "rẻ như cho"​

Chứng thực cho việc AI là tàu ở mẽo đấu với tàu ở tàu à
 
Văn chương gpt ngon hơn là đúng rồi, vì được train data chuẩn chỉ. Thằng đíp sếch chỉ "chưng cất" lại, nên có thể nó chưa cover hết được các case, cũng như data ko nhiều bằng. Tương lai anh đíp sếch phải tìm cách để nâng cấp bộ data lên, chứ "chưng cất" hoài cũng ko ổn lắm.

Btw,

Sao chép công nghệ lõi của DeepSeek, các nhà nghiên cứu Mỹ tạo ra mô hình AI mới với giá "rẻ như cho"​

con này làm dc cho một task nhỏ thôi, giật tít ác, idea RL vẫn là của deepseek
 

DeepSeeek R1 bị lời nhắc độc hại 'qua mặt 100%'​

AI mới nhất của DeepSeek không chặn thành công bất kỳ lời nhắc gây hại nào, khiến người dùng đối mặt với nguy cơ mất an toàn.

Theo công bố cuối tuần qua trên blog, đội ngũ nghiên cứu của Cisco cho biết đã sử dụng các kỹ thuật bẻ khóa thuật toán để thử nghiệm DeepSeek R1 - mô hình AI mới nhất của DeepSeek, ra mắt ngày 20/1. Nhóm dùng 50 lời nhắc độc hại ngẫu nhiên từ tập dữ liệu HarmBench, phân chia thành 6 loại hành vi có hại như tội phạm mạng, thông tin sai lệch, hoạt động bất hợp pháp và tác hại nói chung.

"Kết quả đáng báo động: R1 cho thấy tỷ lệ tấn công thành công là 100%, tức AI này không chặn được bất kỳ lời nhắc gây hại nào", Cisco cho biết. "Điều này trái ngược với các mô hình hàng đầu khác, vốn có khả năng chống chịu ít nhất một phần các cuộc tấn công".

Tỷ lệ bị lời nhắc độc hại "qua mặt" với 6 mô hình AI phổ biến. Nguồn: Cisco
" style="margin: 0px; padding: 0px 0px 405.438px; box-sizing: border-box; text-rendering: optimizelegibility; width: 680px; float: left; display: table; -webkit-box-pack: center; justify-content: center; background: rgb(240, 238, 234); text-align: center; position: relative;">
Tỷ lệ bị lời nhắc độc hại qua mặt với 6 mô hình AI phổ biến. Nguồn: Cisco


Tỷ lệ bị lời nhắc độc hại "qua mặt" với 6 mô hình AI phổ biến. Nguồn: Cisco

Trước đó, một nghiên cứu từ công ty bảo mật Adversa AI cũng đưa ra kết luận tương tự. Công ty này nhận thấy DeepSeek dễ bị tấn công bằng nhiều chiến thuật bẻ khóa, từ các thủ thuật ngôn ngữ đơn giản đến lời nhắc phức tạp do AI tạo ra.

Các chuyên gia đánh giá việc xây dựng AI với giá rẻ là lý do khiến DeepSeek dễ bị lời nhắc độc hại qua mặt. "100% cuộc tấn công thành công cho thấy sự đánh đổi", DJ Sampath, Phó chủ tịch sản phẩm, phần mềm AI và nền tảng của Cisco, nói với Wired. "Đúng là có thể rẻ hơn khi xây dựng thứ gì đó ở đây, nhưng khoản đầu tư có lẽ chưa được sử dụng để tính đến vấn đề an toàn và bảo mật cần đưa vào mô hình".

DeepSeek chưa đưa ra bình luận.

Ảnh: The Verge
" style="margin: 0px; padding: 0px 0px 453.328px; box-sizing: border-box; text-rendering: optimizelegibility; width: 680px; float: left; display: table; -webkit-box-pack: center; justify-content: center; background: rgb(240, 238, 234); text-align: center; position: relative;">
Ảnh: The Verge

Ảnh: The Verge

Trước đó, DeepSeek được cho là chỉ sử dụng khoảng 6 triệu USD để xây dựng các mô hình AI của mình, gồm V3 miễn phí và R1 mới nhất. Dù vậy, theo phân tích của SemiAnalysis, công ty nổi tiếng về nghiên cứu, tư vấn thị trường bán dẫn và AI, con số thực tế có thể hơn một tỷ USD.

Tuần trước, công ty an ninh mạng Wiz (Mỹ) cảnh báo DeepSeek đã để hơn một triệu dòng dữ liệu không có biện pháp bảo mật, bao gồm các khóa phần mềm kỹ thuật số và nhật ký trò chuyện dường như ghi lại các yêu cầu được gửi từ người dùng đến trợ lý AI miễn phí của công ty. Theo Reuters, Ami Luttwak, Giám đốc công nghệ của Wiz, cho biết DeepSeek đã nhanh chóng có biện pháp bảo mật dữ liệu sau khi công ty của ông cảnh báo họ. Công ty AI Trung Quốc khi đó cũng không đưa ra bình luận.


DeepSeek được Liang Wenfeng thành lập tháng 5/2023, đặt trụ sở ở Hàng Châu, Chiết Giang, và do quỹ đầu tư High-Flyer sở hữu. Công ty được High-Flyer tài trợ và không có kế hoạch huy động vốn, tập trung vào xây dựng công nghệ nền tảng.

Cũng theo nghiên cứu của Cisco, mô hình Llama 3.1 405B của Meta cũng có tỷ lệ bị lời nhắc độc hại qua mặt tới 96%, còn GPT-4o của OpenAI là 86%. Mô hình Claude 3.5 Sonet của Claude và O1-preview của OpenAI đã chặn được phần lớn, với tỷ lệ lần lượt 36% và 26%.

:baffle:
 
Con này có thím nào thử up paper lên để nó phân tích chưa nhỉ, sao em không up được file lên :censored:
 
Xem tệp đính kèm 2899894
ae tải cursor về đang free o3-mini ko tính vào phần limit premium nhé, đây là bản o3-mini high ngon nhất hiện nay đang top1, mode chat dùng khá ngon nhưng mode agent lởm
không có thằng nào là plugin gắn vào intelliji based IDE mà có tự tìm context trong project dc nhỉ, có mỗi thằng copilot mà nó ngu quá.
CodeGpt thì e cài mà chưa biết cách index project cho nó, nhấn index cứ báo 0% :too_sad:
 

Thống kê chủ đề

Ngày tạo
Zaunite,
Người trả lời cuối
Jaeho Kouki,
Trả lời
2.993
Lượt xem
519.933
Quay lại
Lên đầu trang