[Mỹ] Ông lớn AI rơi vào vòng xoáy không lối thoát

  • Người tạo chủ đề Người tạo chủ đề atomwaffen
  • Ngày bắt đầu Ngày bắt đầu

atomwaffen

Senior Member
Các công ty AI từng bảo vệ việc thu thập dữ liệu Internet để huấn luyện mô hình, giờ đây lại đối mặt với nghịch lý khi chính AI của mình trở thành nguồn dữ liệu cho đối thủ.


Dario_Amodei.jpg



Anthropic liên tục cáo buộc một số công ty AI lấy đầu ra của Claude để huấn luyện mô hình. Ảnh: Bloomberg.


Trong nhiều năm, các công ty phát triển trí tuệ nhân tạo như OpenAI, Anthropic hay Google đã dựa vào lượng dữ liệu khổng lồ trên Internet để huấn luyện mô hình ngôn ngữ. Họ lập luận rằng việc thu thập nội dung công khai trên web là phù hợp với nguyên tắc sử dụng hợp lý hoặc được pháp luật cho phép trong một số trường hợp.
Thế nhưng khi AI ngày càng phát triển, chính những công ty này lại phải đối mặt với một nghịch lý. Thay vì chỉ dựa vào dữ liệu do con người tạo ra, các công ty AI giờ đây còn sử dụng chính đầu ra của những mô hình AI khác để huấn luyện hệ thống của mình.
Theo Business Insider, kỹ thuật này mang tên distillation (chưng cất mô hình). Nhờ đó, mô hình mới có thể đạt chất lượng tương đối cao với chi phí thấp hơn đáng kể.
Những tháng gần đây, Anthropic liên tục lên tiếng cáo buộc một số công ty AI, trong đó có Alibaba, lợi dụng kỹ thuật này để khai thác đầu ra của Claude nhằm phát triển mô hình riêng. OpenAI và Google cũng từng bày tỏ quan điểm tương tự khi cho rằng các mô hình tiên tiến đang trở thành mục tiêu của hoạt động "sao chép" quy mô lớn.
Trước đây, nhiều công ty AI từng bảo vệ quan điểm thu thập dữ liệu công khai trên Internet cho việc huấn luyện mô hình. Tuy nhiên, khi chính các mô hình AI của họ bị sử dụng làm nguồn dữ liệu cho đối thủ, lập luận này lại trở nên khó bảo vệ hơn.
Các nhà nghiên cứu AI cho rằng chưng cất mô hình không giống với việc thu thập dữ liệu từ Internet. Tuy nhiên, ngay trong ngành AI vẫn chưa có sự thống nhất về việc kỹ thuật này có được xem là hợp lý hay không, cũng như đâu là ranh giới giữa học hỏi công nghệ và sao chép thành quả.
Theo Business Insider, việc tận dụng kết quả từ mô hình của đối thủ không phải hiện tượng mới và cũng không chỉ diễn ra ở Trung Quốc. Google từng thuê lực lượng cộng tác viên tạo và chỉnh sửa câu trả lời dựa trên ChatGPT nhằm cải thiện chất lượng Gemini trong giai đoạn hãng chạy đua với OpenAI.
Lập luận có phần mâu thuẫn này đang dần bị thực tế khắc nghiệt của Internet hiện đại phơi bày. Trong nhiều tháng qua, Anthropic liên tục siết chặt quyền truy cập vào các mô hình AI tiên tiến nhất của mình nhằm ngăn đối thủ học hỏi quá nhiều từ Claude.
Tuy nhiên, những biện pháp này hoặc không mang lại hiệu quả như mong muốn, hoặc chỉ khiến các đối thủ tìm ra những cách thức tinh vi hơn để vượt qua rào cản.
............................................
 
Các anh vô tư lấy và sử dụng dữ liệu của người khác, không bỏ dù chỉ là một cắc cho nỗ lực của các nghệ sĩ, nhà văn, nhà báo, các anh IT đít đầy trĩ... Sự đạo đức giả hôm nào đang cười vào mặt các anh những tiếng "ha ha ha" khi nước mắt các anh đang nhỏ xuống, chẳng phải cũng rất công bằng sao.
 
Các anh vô tư lấy và sử dụng dữ liệu của người khác, không bỏ dù chỉ là một cắc cho nỗ lực của các nghệ sĩ, nhà văn, nhà báo, các anh IT đít đầy trĩ... Sự đạo đức giả hôm nào đang cười vào mặt các anh những tiếng "ha ha ha" khi nước mắt các anh đang nhỏ xuống, chẳng phải cũng rất công bằng sao.
Vụ này chính bọn bên Mẽo cũng chỉ biết thả haha cái đám này
Mà riêng về VN lại def cho đám Anthropic với OpenAI vụ này, điển hình như ngay trên đây mấy topic về AI ở F33 :shame:
 
Cách đây một năm , nghe đám thờ AI nào AI làm phim , năm sau nó sẽ làm , cuối cùng sau một năm chả thấy con mẹ gì , vẫn nhựa nhựa và giả . Không biết một năm của các anh thờ AI là bao lâu .
Điểm chung của bọn thờ AI là chúng rất ngu và hầu như nghĩ mình giỏi công nghệ .
Giờ lên fb , youtube là thấy một đống kiểu phim AI gen hoạt hoạ , mặt vừa ngu dáng vừa đơ , các anh thờ AI ơi , bao giờ thay thế hoàn toàn thế
 
Vụ này chính bọn bên Mẽo cũng chỉ biết thả haha cái đám này
Mà riêng về VN lại def cho đám Anthropic với OpenAI vụ này, điển hình như ngay trên đây mấy topic về AI ở F33 :shame:
bọn nó cũng mất tiền, mất thời gian để thu thập, lọc dữ liệu, dán nhãn, train mà, xong làm chưa đc bao lâu thì lại bị mấy anh tàu cop trong phát một với thời gian và chi phí rẻ hơn thì ai chả cay :feel_good:
 
AI tạo ra nội dung sau đó lại đi thu thập nội dung này về huấn luyện AI, nghe cứ như kiểu ăn xong lại ỉa, rồi lại ăn vào ý nhỉ =)))
Nguồn dinh dưỡng vô tận, không lãng phí, thứ mà con người luôn hướng tới còn gì (vật liệu tái chế, thịt nhân tạo từ sh*t)? :doubt:
 
Đấy là cái giá của tiên phong, cũng giống như Lazada đốt tiền thay đổi xu hướng mua sắm sau đó Shopee, Tiktok hưởng lợi
 
có then cha trọc trọc nào đó kêu sài vài trăm con agent để tạo thành mạng lưới kiến thức gì gì đó rồi còn tự hào mình là top 1% ng sài claude dc anthropic công nhận nữa mé nghe ảo vl :ah: :ah: :ah: :ah: mặc dù méo biết sài đó được gì mà lùa dc nhiều gà thật
 
bọn nó cũng mất tiền, mất thời gian để thu thập, lọc dữ liệu, dán nhãn, train mà, xong làm chưa đc bao lâu thì lại bị mấy anh tàu cop trong phát một với thời gian và chi phí rẻ hơn thì ai chả cay :feel_good:
:adore: Nó là câu chuyện thằng ăn cắp và thằng ăn cướp đó. Y chang thời xưa S.Jobs đi ăn cắp ý tưởng os về, xong bị Bill ăn cướp thế là giong mồm lên chửi, Bill vặn lại cho m cũng đi ăn cắp chứ đâu ra, thế là nín luôn
 
đĩ nói chuyện trinh tiết, lũ chó đẻ ai ăn cắp lại la làng, vừa lòng t lắm :haha:
 
giờ lên mạng bội thực content AI luôn, mà ko biết mọi người có như tôi ko, nhìn mấy content AI như là hình, video, nhạc nó cứ có cảm giác khó chịu vì rất là nhiều lỗi vặt trong đó, nó có thể tạo ra tổng thể ok, nhưng nhìn kĩ thì nó kì vl.
 

Thống kê chủ đề

Ngày tạo
atomwaffen,
Người trả lời cuối
0baque,
Trả lời
77
Lượt xem
11.911
Quay lại
Lên đầu trang