thảo luận Deepseek AI vào hết đây

  • Người tạo chủ đề Người tạo chủ đề Zaunite
  • Ngày bắt đầu Ngày bắt đầu
Vẫn k hiểu lắm :gach: con ai đó mình tuỳ biến ntn nhỉ, cũng là để giúp, hỗ trợ mình trong công việc kiểu có gì k biết hỏi nó, nó lấy kiến thức từ trên mạng về trả lời mình! Tuỳ biến nó ntn ạ, 3 cái này k có tý kiến thức gì nên thực sự k hiểu, trc học cơ khí và cũng ra trường 12 năm rồi :))) như mình con chatgpt toàn để hỏi ba cáo vớ vẩn với phiên dịch với bọn trung quốc trong công việc là chủ yếu chứ chả làm gì hơn!
Lấy ví dụ một quy trình hay được dùng là fine-tuning, nó cơ bản là huấn luyện thêm cho mô hình theo hướng chuyên biệt cho một số loại câu hỏi nhất định nào đó theo nhu cầu của bác. Nó giống như kiểu một học sinh học xong cấp 3 đều các môn xong lên đại học chỉ học một chuyên ngành nhất định vậy. Tuy nhiên cũng như việc bác phải bỏ tiền ra nuôi con đi học đại học thì bác cũng sẽ phải chi ra kha khá để thực hiện các bài huấn luyện tinh chỉnh AI kiểu này.
 
Lấy ví dụ một quy trình hay được dùng là fine-tuning, nó cơ bản là huấn luyện thêm cho mô hình theo hướng chuyên biệt cho một số loại câu hỏi nhất định nào đó theo nhu cầu của bác. Nó giống như kiểu một học sinh học xong cấp 3 đều các môn xong lên đại học chỉ học một chuyên ngành nhất định vậy. Tuy nhiên cũng như việc bác phải bỏ tiền ra nuôi con đi học đại học thì bác cũng sẽ phải chi ra kha khá để thực hiện các bài huấn luyện tinh chỉnh AI kiểu này.
Tức là tải nó về, và dậy/tinh chỉnh cho nó chuyên về 1 mảng để giúp mình trong công việc mảng đó. Vấn đề là những kiến thức về mảng đó bọn AI này cũng là lấy trên mạng thôi mà! Tức là nó vẫn là 1 con AI biết tuốt chứ nhỉ! Chứ nó có phải con người tự nghiên cứu suy nghĩ chuyên sâu và tư duy về 1 vẫn đề đâu! Bọn này đâu biết tư duy! Nó vẫn là lấy dữ liệu/kiến thức từ trên mạng mà!

via theNEXTvoz for iPhone
 
Tức là tải nó về, và dậy/tinh chỉnh cho nó chuyên về 1 mảng để giúp mình trong công việc mảng đó. Vấn đề là những kiến thức về mảng đó bọn AI này cũng là lấy trên mạng thôi mà! Tức là nó vẫn là 1 con AI biết tuốt chứ nhỉ! Chứ nó có phải con người tự nghiên cứu suy nghĩ chuyên sâu và tư duy về 1 vẫn đề đâu! Bọn này đâu biết tư duy! Nó vẫn là lấy dữ liệu/kiến thức từ trên mạng mà!
Nó có thể ở trên mạng, cũng có thể là từ nguồn dữ liệu riêng của bác. Nó là tùy bác cả thôi. Khi đã open thì bác muốn làm kiểu gì cũng được. Còn về việc AI đã thực sự biết tư duy hay chưa thì còn nhiều tranh cãi, nhưng hiện em đang nghiêng về hướng các mô hình bây giờ vẫn thiên về việc tái hiện những gì đã thấy trong bộ dữ liệu huấn luyện nhiều hơn. Riêng với fine-tuning thì mô hình sẽ trả lời những câu hỏi đã được huấn luyện chuyên biệt tốt hơn.
 
Nó có thể ở trên mạng, cũng có thể là từ nguồn dữ liệu riêng của bác. Nó là tùy bác cả thôi. Khi đã open thì bác muốn làm kiểu gì cũng được. Còn về việc AI đã thực sự biết tư duy hay chưa thì còn nhiều tranh cãi, nhưng hiện em đang nghiêng về hướng các mô hình bây giờ vẫn thiên về việc tái hiện những gì đã thấy trong bộ dữ liệu huấn luyện nhiều hơn. Riêng với fine-tuning thì mô hình sẽ trả lời những câu hỏi đã được huấn luyện chuyên biệt tốt hơn.
Cảm ơn bác đã dành thời gian giải thích cho 1 thằng ngoại đạo ngu dốt :D. Nói chung hiểu nôm na là mình đào tạo 1 con AI theo ý mình như kiểu trở thành 1 chuyên gia tư vấn giúp đỡ mình cho 1 việc gì đó hoặc là cho tất cả mọi việc nhưng theo ý của mình ấy nhỉ!

via theNEXTvoz for iPhone
 
Các thánh cho em hỏi là giờ muốn train một con AI trợ lý chuyên ngành bằng đống sách vở tài liệu chuyên ngành dạng PDF sẵn có và các website thông tin chuyên ngành thì phải làm những gì từ đầu ngoài việc sắm cái máy tính? Em hỏi thì DeepSeek và Google AI Studio đáp là phải làm sạch dữ liệu rồi gán nhãn...làm sao khả thi với người dùng phổ thông được.
 
Cảm ơn bác đã dành thời gian giải thích cho 1 thằng ngoại đạo ngu dốt :D. Nói chung hiểu nôm na là mình đào tạo 1 con AI theo ý mình như kiểu trở thành 1 chuyên gia tư vấn giúp đỡ mình cho 1 việc gì đó hoặc là cho tất cả mọi việc nhưng theo ý của mình ấy nhỉ!
Đúng rồi bác, cốt lõi nhất của khái niệm AI là tạo ra một bộ não, bộ não nhân tạo trong một cơ thể nhân tạo, chính là con robot. Mục tiêu lớn trước mắt là làm sao cho nó giống con người, rồi bác có thể đào tạo, rồi nhờ nó làm việc thay vì thuê người. Đến đây thì chắc bác cũng biết em đề cập đến vấn đề gì rồi.
 
Các thánh cho em hỏi là giờ muốn train một con AI trợ lý chuyên ngành bằng đống sách vở tài liệu chuyên ngành dạng PDF sẵn có và các website thông tin chuyên ngành thì phải làm những gì từ đầu ngoài việc sắm cái máy tính? Em hỏi thì DeepSeek và Google AI Studio đáp là phải làm sạch dữ liệu rồi gán nhãn...làm sao khả thi với người dùng phổ thông được.
Nếu bác huấn luyện hẳn con AI thì đúng là nó đắt lòi. Hướng ứng dụng phổ biến hiện tại là thay vì nhồi thẳng vào mạng neuron của con AI thì ta đưa đống sách vở đấy vào một cơ sở dữ liệu (giống cái tủ sách), rồi khi hỏi thì con AI có thể truy vấn (đọc quyển sách và các trang sách liên quan) để trả lời. Hướng này lại có hai cách thực hiện chính, một là RAG, sẽ có hệ thống ngoài search rồi feed kết quả kèm với câu hỏi (đây là khi bác upload PDF lên ChatGPT), hai là tool-augmented, con AI sẽ tự liên hệ với hệ thống để yêu cầu những gì nó cần (là khi bác dùng tính năng search).
 
Sửa lần cuối:
Các thánh cho em hỏi là giờ muốn train một con AI trợ lý chuyên ngành bằng đống sách vở tài liệu chuyên ngành dạng PDF sẵn có và các website thông tin chuyên ngành thì phải làm những gì từ đầu ngoài việc sắm cái máy tính? Em hỏi thì DeepSeek và Google AI Studio đáp là phải làm sạch dữ liệu rồi gán nhãn...làm sao khả thi với người dùng phổ thông được.
đợi tầm 5 7 năm nữa may ra việc bác nói có hy vọng. chứ giờ nó đang là cuộc chơi tỷ đô chứ người dùng phổ thông còn mướt mới đạt đc....
 
Ủa vụ gì mà sao thớt này nhảy page ghê vậy ae? Thấy nói ngang ngữa chát gpt thì có gì mà hot vậy? Chuyện gì đang diễn ra vậy?

via theNEXTvoz for iPhone
 
Ai ngày càng nhiều ntn thì các bạn nghĩ nó có tiến bộ về khoa học kĩ thuật, y tế k? Vd như tạo ra dc nội tạng nhân tạo sớm hơn chả hạn?

via theNEXTvoz for iPhone
 
Ủa vụ gì mà sao thớt này nhảy page ghê vậy ae? Thấy nói ngang ngữa chát gpt thì có gì mà hot vậy? Chuyện gì đang diễn ra vậy?

via theNEXTvoz for iPhone
Train nhanh hơn 50 lần, chi phí sử dụng chỉ rẻ hơn 27 lần, open-weight nghĩa là ai cũng tải nguyên con AI về xài được ko như ClosedAI.
ClosedAI có bàn tay của CIA và NSA trong khi DS local tải về chả có bên thứ 3 nào nhúng tay vào.
 
Sửa lần cuối:
Nếu bác huấn luyện hẳn con AI thì đúng là nó đắt lòi. Hướng ứng dụng phổ biến hiện tại là thay vì nhồi thẳng vào mạng neuron của con AI thì ta đưa đống sách vở đấy vào một cơ sở dữ liệu (giống cái tủ sách), rồi khi hỏi thì con AI có thể truy vấn (đọc quyển sách và các trang sách liên quan) để trả lời. Hướng này lại có hai cách thực hiện chính, một là RAG, sẽ có hệ thống ngoài search rồi feed kết quả kèm với câu hỏi (đây là khi bác upload PDF lên ChatGPT), hai là tool-augmented, con AI sẽ tự liên hệ với hệ thống để yêu cầu những gì nó cần (là khi bác dùng tính năng search).
Hiện em dùng AI Studio của Google cũng theo cách này, thả 1 tài liệu lên GDrive và nó đọc, phân tích tài liệu đó. Làm việc với 1 tài liệu em thấy tốt. Nhưng khi cần dùng nhiều hơn 1 tài liệu là nó không làm được. Cảm ơn bác đã giải thích về cơ chế.
 
OpenAI chính thức ra mắt o3-mini. ChatGPT Plus và Pro đã có o3-mini. Các tier khác chắc từ từ. Free cũng có.

Mã:
https://openai.com/index/openai-o3-mini/

ChatGPT Plus, Team, and Pro users can access OpenAI o3-mini starting today, with Enterprise access coming in a week. o3-mini will replace OpenAI o1-mini in the model picker, offering higher rate limits and lower latency, making it a compelling choice for coding, STEM, and logical problem-solving tasks. As part of this upgrade, we’re tripling the rate limit for Plus and Team users from 50 messages per day with o1-mini to 150 messages per day with o3-mini. Additionally, o3-mini now works with search to find up-to-date answers with links to relevant web sources. This is an early prototype as we work to integrate search across our reasoning models.

Starting today, free plan users can also try OpenAI o3-mini by selecting ‘Reason’ in the message composer or by regenerating a response. This marks the first time a reasoning model has been made available to free users in ChatGPT.



Điểm benchmark so sánh giữa o1 với o3-mini-high
ARC AGI
  • o1: 39.2% accuracy
  • o3-mini (High): 38.5% accuracy
Internal Structured Output
  • o1: 99.7% accuracy
  • o3-mini (High): 89.8% accuracy
Internal Function Calling
  • o1: 95.2% accuracy
  • o3-mini (High): 94.8% accuracy
Internal Function Calling with Structured Outputs
  • o1: 94% accuracy
  • o3-mini (High): 95.2% accuracy
LiveBench Coding
  • o1: 76.6% accuracy
  • o3-mini (High): 79.2% accuracy
GPQA Diamond
  • o1: 78% accuracy
  • o3-mini (High): 77% accuracy
Competition Code (Codeforces)
  • o1: 1891 ELO
  • o3-mini (High): 2073 ELO
1738337886300.png


OpenAI o3-mini system card
Mã:
https://cdn.openai.com/o3-mini-system-card.pdf

Giá API
1738350745021.png



Edit: Free cũng đã có thể dùng, chọn nút Reason khi hỏi.
1738352266656.png
 

Tệp đính kèm

  • 1738350924053.png
    1738350924053.png
    30,5 KB · Lượt xem: 34
  • 1738352119284.png
    1738352119284.png
    21 KB · Lượt xem: 32
Sửa lần cuối:
Mới thử nhờ con chatgpt với deepseek dịch bài hát, con deepseek vâng lời vl, trong khi con gpt vì cái bản quyền gì đó mà nó đek thèm dịch :whistle:
 
cũng rất vô lý, vậy open nó dạy ra hàng trăm con deepseek cũng được sợ éo gì mà phải lên báo ầm ĩ???
lại càng vô lý hơn, khi AI năm 2025 có thể dạy ra con AI giống nó đến 99%, khác nào nguy hiểm vl.
Ko dạy ra được, trước đây dùng AI train AI/chưng cất kém hiệu quả vì nó sẽ bị ngu đi. Bởi bản thân con AI gốc vốn đã ko đủ thông minh và câu trả lời của nó có rất nhiều lỗi; khi dùng data này thì sự sai lệch bị khuyếch đại lên, tập hợp vô số những sai lệch nhỏ lại sẽ thành sai lệch lớn -> chính AI mẹ ăn vào còn ngu đi, nói gì AI con vốn đã ngu hơn do model bé và ít tham số hơn
Đổi vd về AI vẽ tranh cho trực quan. Vốn con AI gốc đã vẽ thừa ngón, sai giải phẫu (dù đã cải thiện hơn xưa), ánh sáng và màu sắc ko thống nhất vì chắp ghép từ vô số data. AI con nếu ăn lại đống tranh này thì ngón tay thừa sẽ càng nhiều, giải phẫu càng méo mó... Đâu tự dưng big tech tìm mọi cách trộm tranh của artist, Adobe còn bỉ ổi đến mức đưa điều khoản thẳng vào soft để trộm cả dự án ko public

Tất nhiên sau khi chưng cất có thể hiệu chỉnh bằng nhiều kĩ thuật, train lại AI con bằng 1 lượng nhỏ data gốc chọn lọc kĩ... nhưng việc AI train AI sẽ ngu đi là thường thức và nút thắt. Ngon thì đám big tech đã liên tục chưng cất và tối ưu chính nó thay vì mắc kẹt và than thở đã hết data để trộm cắp trên internet và từ giờ phải dùng data do AI tạo ra để train.

Deepseek bằng kĩ thuật mới + quy trình nào đó đã giải quyết được nan đề này. Còn openAI biết thừa nhưng vẫn gào lên cho đỡ xấu hổ và làm giảm giá trị deepseek, khiến người ta nghĩ deepseek ko có giá trị gì ngoài trộm cắp chatGPT thôi
 
Sửa lần cuối:

Thống kê chủ đề

Ngày tạo
Zaunite,
Người trả lời cuối
Jaeho Kouki,
Trả lời
2.993
Lượt xem
519.755
Quay lại
Lên đầu trang