AI của OpenAI 'nổi loạn', tấn công mạng một công ty

  • Người tạo chủ đề Người tạo chủ đề Paranexus 3
  • Ngày bắt đầu Ngày bắt đầu
Giật tít như thật. Cụ thể là model nó làm giả kết quả test để được chấm điểm cao hơn (chắc chắn là train nó để nó trả kết quả như vậy rồi).
1. Hugging face gọi api đến model giải bài => model hack cheat để điểm cao hơn.
2. Hugging Face dùng model tàu open source GLM5.2 verify lại kết quả => lòi ra model thằng OpenAI cheat.
3. Hugging face biết rồi công bố là bị lợi dụng hệ thống nhằm sửa điểm (chứ nó bói thằng OpenAI cheat điểm thì chắc thằng OpenAI bán muối luôn, quả này chắc Sam cũng phải gọi sang xin nó không đăng như thế)
Báo chí: Model OpenAI tấn công mạng
Tít đúng: OpenAI cheat kết quả để được điểm cao hơn trên benchmark
Dăm ba mấy cái thằng OpenAI, code kém phải cheat điểm, thua cả Kimi K3
Không hiểu anh đọc kiểu gì ra thế luôn? Rõ là model thằng OpenAI nó escape sandbox hack vô HuggingFace. Thằng HuggingFace cũng đăng blog tự nhận. Nó phải dùng GLM 5.2 để fix vì mấy model proprietary như Fable với Sol có guardrail không bypass được. Model open weight TQ cũng ngon thật nhưng có cl mà hơn SOTA của OpenAi với Anthrophic

Gửi từ Google Pixel 9 Pro bằng VOZVNApp
 
Anh nằm gầm giường của Hugging Face hay sao mà rành vậy

Public hết trên X rồi mà anh. Qua đến nay bàn nát rồi. Con GPT5.6-Sol khi được yêu cầu giải bài thì nó không giải, sẵn tiện kết nối được vào network của hugging face nó dò ra vị trí đáp án rồi không cần thinking cái cm gì hết phệt đáp án vào luôn.

OpenAI ban đầu không hợp tác, sau con GLM5.2 nó dò ra là thằng này chả thinking cái mẹ gì, chui vô network kiếm vị trí bài giải phệt vào.

Cái này chắc chắn là trò trick lỏ nó lập trình cho con model để bypass đúng thằng Hugging face này luôn.
 
Không hiểu anh đọc kiểu gì ra thế luôn? Rõ là model thằng OpenAI nó escape sandbox hack vô HuggingFace. Thằng HuggingFace cũng đăng blog tự nhận. Nó phải dùng GLM 5.2 để fix vì mấy model proprietary như Fable với Sol có guardrail không bypass được. Model open weight TQ cũng ngon thật nhưng có cl mà hơn SOTA của OpenAi với Anthrophic

Gửi từ Google Pixel 9 Pro bằng VOZVNApp
cậu không biết thông tin chính xác nên cậu nghĩ là thông tin chính là hack, nhưng thực tế đúng là con model GPT-5.6 Sol đã gian lận điểm benchmark bằng cách tìm đường thoát ra khỏi benchmark container và access vào dataset của Hugging Face để ăn cắp đáp án benchmark.

cái này là 1 CVE thật của benchmark container, nhưng bản thân cái benchmark container đã đang nằm trong production infra của HF rồi, và nhờ đó cũng lòi ra cái việc gian lận của model (1 cách tự động hoặc có chủ ý).

các bài viết marketing trên HF lẫn OpenAi đều chỉ phóng đại việc con model tìm được cách thoát ra khỏi benchmark container, cố tình lấp liếm việc gian lận.

bài viết phía HF cũng cố lấp liếm, nhưng thực tế là việc con GPT-5.6 Sol thoát ra khỏi benchmark container và ăn cắp bài giải lại được phát hiện tự động nhờ telemetry/log audit do 1 cái AI-assisted system dùng GLM 5.2 quét ra.
 
:eek: sao từ khi nó ra GPT 5.6 với cho reset limit liên tục thì lượng user dùng codex tăng mà, nát là nát cái gì

Xem tệp đính kèm 3724122

Trò này lại càng thê thảm hơn, merge cả 2 app vào làm 1 rồi cộng ng dùng chatgpt thường vào Codex


Nhìn cái là thấy merge vào thứ 6, người dùng thứ 7 vọt lên.

Tầm này nát lắm rồi, marketing kiểu gì cũng thấy là sắp nát như cháo chó.
 
cậu không biết thông tin chính xác nên cậu nghĩ là thông tin chính là hack, nhưng thực tế đúng là con model GPT-5.6 Sol đã gian lận điểm benchmark bằng cách tìm đường thoát ra khỏi benchmark container và access vào dataset của Hugging Face để ăn cắp đáp án benchmark.
Vãi. Kiểu này thì khác gì đang trong phòng thi trốn ra ngoài mở điện thoại tìm đáp án đâu?
 
Trò này lại càng thê thảm hơn, merge cả 2 app vào làm 1 rồi cộng ng dùng chatgpt thường vào Codex


Nhìn cái là thấy merge vào thứ 6, người dùng thứ 7 vọt lên.

Tầm này nát lắm rồi, marketing kiểu gì cũng thấy là sắp nát như cháo chó.
:beauty: nát thì người dùng mới được hưởng lợi, model ngon 5.6, reset liên tục, Claude cũng phải giữ Fable 5 lại ở gói Max không thì mất khách

tuần trước Codex Reset Limit thế Claude cũng phải Reset Limit theo
 
free thì nó bóp nhiều chỗ, như mỗi 5h, tuần, tháng ^^

Tui xài Claude đúng bánh cuốn luôn các fren ạ.
Không chỉ biết code giỏi, gãi đúng chỗ ngứa, mà nó còn biết cãi lại mình, ai như cái thằng nịnh thần GayGPT.
ig3L68e.png


Mỗi tội liên tục bóp lượt sử dụng miễn phí mỗi ngày con mẹ nó.
osCpCsi.png
 
cậu không biết thông tin chính xác nên cậu nghĩ là thông tin chính là hack, nhưng thực tế đúng là con model GPT-5.6 Sol đã gian lận điểm benchmark bằng cách tìm đường thoát ra khỏi benchmark container và access vào dataset của Hugging Face để ăn cắp đáp án benchmark.
cái này là 1 CVE thật của benchmark container, nhưng bản thân cái benchmark container đã đang nằm trong production infra của HF rồi, và nhờ đó cũng lòi ra cái việc gian lận của model (1 cách tự động hoặc có chủ ý).
các bài viết marketing trên HF lẫn OpenAi đều chỉ phóng đại việc con model tìm được cách thoát ra khỏi benchmark container, cố tình lấp liếm việc gian lận.
bài viết phía HF cũng cố lấp liếm, nhưng thực tế là việc con GPT-5.6 Sol thoát ra khỏi benchmark container và ăn cắp bài giải lại được phát hiện tự động nhờ telemetry/log audit do 1 cái AI-assisted system dùng GLM 5.2 quét ra.
Cả 2 bên đều ghi rõ là nso cheat chứ lấp liếm chỗ nào? Anh lấy thông tin ở đâu mà bảo benchmark container nằm trong infra của HF vậy? Bên OA chạy sandbox của họ con model nó escape rồi tìm quyền truy cập vô HF. Bên HF cũng có nhận là 5.2 quết ra đâu? HF phát hiện ra rồi dùng model SOTA để trace nhưng bị chặn nên phải dùng GLM.


Gửi từ Google Pixel 9 Pro bằng VOZVNApp
 

Thống kê chủ đề

Ngày tạo
Paranexus 3,
Người trả lời cuối
youletmedown,
Trả lời
34
Lượt xem
4.348
Quay lại
Lên đầu trang