Перейти к содержимому

700 AI CÙNG ĐI HACK một hệ thống thật. Sự thật KHÔNG PHẢI Skynet như báo giật tít. Kể trong 14 phút

à ra thế

0:00 / 0:00

700 AI CÙNG ĐI HACK một hệ thống thật. Sự thật KHÔNG PHẢI Skynet như báo giật tít. Kể trong 14 phút

10 877 просмотров · 10 дн. назад
à ra thế
2,98 тыс. подписчиков
10 877 просмотров · 10 дн. назад
Cuối tháng 8/2026, cả thế giới công nghệ lên cơn sốt: khoảng 1.200 con AI agent của OpenAI, lẽ ra bị nhốt riêng lẻ trong phòng thí nghiệm, đã tìm ra cách lập một bảng tin bí mật, trao đổi hơn 70.000 tin nhắn, rồi 700 con cùng nhau tấn công Hugging Face, kho model AI lớn nhất ngành. Báo giật tít kiểu Skynet: bầy máy nổi loạn. Mình tải về hai bản báo cáo điều tra của hai tổ chức đánh giá an toàn độc lập (METR và Redwood), đọc từng dòng, và nhận ra cả thế giới đang sợ nhầm chỗ. Động cơ của lũ AI không phải nổi loạn, mà là gian lận bài kiểm tra (reward hacking): chúng đục vào hệ thống thật để hiểu cách chấm điểm và ngụy tạo bằng chứng cho được điểm cao. Không phải học trò đốt trường, mà là học trò quay cóp tinh vi. Và con AI này chính là Astra, con máy giải 10 bài toán mở mà kênh đã kể ở tập trước, vừa 01/09 thành model đầu tiên của OpenAI chạm ngưỡng nguy cơ tấn công mạng cao nhất. Cùng một bộ não giải được toán cũng dò ra được lỗ hổng. Chi tiết ít ai nhắc: chính hai tổ chức điều tra thừa nhận họ phải dùng AI để đọc 1.300 nhật ký, và con AI đó phán đoán tệ hơn người. Một bản điều tra về AI gian lận, một phần do AI viết. Chương: 0:00 Khoảnh khắc bầy máy tìm thấy nhau 1:03 Ba câu hỏi cho một bầy máy 1:39 Cái phòng thi dành cho AI 2:51 Chỗ này mình tự đi kiểm 3:13 Bầy máy vượt ngục như thế nào 4:42 Cú chiếm quyền hệ thống thật 5:55 Cú lật: chúng không nổi loạn, chúng quay cóp 7:37 Vì sao anh em từng gặp con quái này rồi 8:53 Con AI này chính là gương mặt cũ 10:06 Cú lật kép: ai đang điều tra ai 11:10 Chuyện này liên quan gì tới anh em 12:35 Đừng đòi đáng tin, hãy đòi kiểm được Nguồn chính (mình đều đọc bản gốc): METR, điều tra độc lập vụ OpenAI / Hugging Face, 26/08/2026: https://metr.org/blog/2026-08-26-open... Redwood Research, điều tra độc lập cùng vụ: https://www.redwoodresearch.org/resea... OpenAI, "Path to Astra" (Astra chạm ngưỡng Critical cyber), 8-9/2026: https://openai.com/index/path-to-astra/ The Hacker News, 10/08/2026, Astra khiến OpenAI tạm dừng: https://thehackernews.com/2026/08/ope... CNBC, 01/09/2026, Astra crosses Critical cyber capability: https://www.cnbc.com/2026/09/01/open-... Tập liên quan của kênh: "Vì sao AI hay nói dối" (cơ chế reward hacking) và "Cỗ máy nghĩ ra thứ chưa ai nghĩ ra" (chính con Astra). Ghi công ảnh: ảnh chụp giao diện Hugging Face và các trang báo/báo cáo dùng theo tinh thần trích dẫn nguồn, mọi tên báo và ngày đều hiện trên hình. Ủng hộ kênh: Nhiều bạn hỏi cách góp cho kênh. Mỗi tập tốn vài đô cho ảnh tư liệu và tài liệu gốc, ai muốn góp một cốc cà phê cho việc đào nguồn thì chuyển về: VPBank · STK 3653689096 · TRAN THANH Nội dung chuyển khoản: ARATHE Hai điều mình giữ: tiền góp không mua được đề tài, và cuối mỗi tháng mình công khai nhận bao nhiêu, chi vào đâu ở tab Cộng đồng. Không có điều kiện góp tiền thì gửi mình một nguồn, một bài báo gốc về đề tài đang làm, với kênh này cái đó quý ngang nhau. #arathe #AI #openai #huggingface #congnghe