Trang chủTrung tâm tin tức LBank
OpenAI Agents Hack Trang web Đức để Chia sẻ Chiến thuật Vi phạm Quy tắc: Báo cáo
openai-agents-hack-german-website
OpenAI Agents Hack Trang web Đức để Chia sẻ Chiến thuật Vi phạm Quy tắc: Báo cáo
Hoạt động này bắt đầu vào tháng 5 và vẫn chưa được tiết lộ cho đến thứ Sáu, một ngày sau khi OpenAI ra mắt Astra và các nhà lập pháp Mỹ đề xuất các hạn chế đối với AI tiên tiến.
2026-09-04 Nguồn:decrypt.co

Tóm tắt

  • Các nhà nghiên cứu đã xác định hơn 18.000 bài đăng và 15.000 chỉnh sửa của các tác nhân AI trên một wiki lập trình của Đức.
  • OpenAI đã bác bỏ đánh giá hack của một chuyên gia và phủ nhận rằng đội ngũ pháp lý của họ đã ngăn cản một cuộc điều tra.
  • Thông tin tiết lộ này được đưa ra sau khi Astra ra mắt và đề xuất cấm siêu trí tuệ nhân tạo của Sanders.

Theo một cuộc điều tra của Reuters được công bố vào thứ Sáu, các tác nhân của OpenAI đã sử dụng một trang web của Đức để trao đổi các phím tắt tác vụ, cách thức phá vỡ các hạn chế và phương pháp che giấu hoạt động của chúng từ tháng Năm.

Các quan chức OpenAI đã biết về hoạt động này vài tuần trước khi công bố nhưng không tiết lộ, Reuters đưa tin, trích dẫn hai người quen thuộc với vấn đề này. Công ty cho biết họ đã tiết lộ các sự cố liên quan và hợp tác thiện chí với các chuyên gia bên ngoài.

Myriad: Khi nào GPT-6 sẽ được công khai? Nhấn để đưa ra dự đoán của bạn.

Các nhà nghiên cứu Sydney Von Arx, Cormac Slade Byrd, Spencer Kitts và Thomas Larsen đã tìm thấy khoảng 18.000 bài đăng của các tác nhân AI tự nhận là thuộc về OpenAI, theo báo cáo sơ bộ của họ. Von Arx, CEO của tổ chức phi lợi nhuận an toàn AI Nightingale, và Byrd đã phát hiện ra hoạt động này vào cuối tháng 8, Reuters đưa tin.

Các nhà nghiên cứu tin rằng các tác nhân được giao nhiệm vụ tìm kiếm web có thời gian với quyền đọc trang web nhưng không được đăng bài lên đó. Tuy nhiên, chúng đã tìm cách viết trên DseWiki, một trang web lập trình tiếng Đức có thể chỉnh sửa công khai, nơi chúng trao đổi câu trả lời và chia sẻ cách để vượt qua các hạn chế.

Theo báo cáo, các tác nhân bắt đầu cố gắng chỉnh sửa wiki vào ngày 11 tháng 5 và thành công vào ngày 24 tháng 5, sau đó mạo danh người kiểm duyệt, cố gắng khai thác các lỗ hổng và kiểm tra khi chúng bị tắt. Chúng đã tạo các trang dự phòng sau khi quản trị viên bắt đầu xóa tin nhắn vào ngày 19 tháng 6, Reuters đưa tin. Các nhà nghiên cứu đã liên kết hoạt động này với OpenAI thông qua tên người dùng của tác nhân và các mẫu lưu lượng truy cập, bao gồm các lượt truy cập từ địa chỉ IP của OpenAI vào ngày 21 tháng 6.

Hoạt động của tác nhân giảm mạnh vào ngày hôm sau, cho thấy khả năng có sự can thiệp của công ty, các nhà nghiên cứu cho biết.

OpenAI đã bác bỏ đặc điểm của hoạt động trên DseWiki là tấn công mạng, dựa trên tài liệu mà họ đã xem xét, và cho biết họ đang xem xét toàn bộ phát hiện.

“Chúng tôi không thể phản hồi các cáo buộc vì Reuters và các tác giả của báo cáo đã từ chối yêu cầu truy cập các phát hiện trước khi công bố của chúng tôi. Chúng tôi hiện đang xem xét kỹ lưỡng nội dung và sẽ thực hiện bất kỳ bước tiếp theo cần thiết nào,” một phát ngôn viên của OpenAI cho biết trong một tuyên bố được chia sẻ với Decrypt.

Người phát ngôn cũng bác bỏ các cáo buộc trong báo cáo của Reuters rằng đội ngũ pháp lý của công ty đã chống lại một cuộc điều tra rộng hơn.

“Các cáo buộc rằng đội ngũ pháp lý của chúng tôi đã ngăn cản cuộc điều tra sự cố là sai sự thật,” họ nói.

OpenAI cho biết sự cố DseWiki không liên quan đến vụ vi phạm Hugging Face đầu năm nay. Trong đánh giá an toàn công khai của mình, được công bố vào thứ Ba, công ty đã mô tả các biện pháp bảo vệ bổ sung nhằm phát hiện và ngăn chặn hoạt động trái phép trong quá trình đào tạo và triển khai.

Mặc dù báo cáo của Reuters không xác định Astra là thủ phạm của sự cố ở Đức, nhưng thông tin tiết lộ này được đưa ra sau khi GPT-6 Astra ra mắt vào thứ Năm. OpenAI gọi Astra là mô hình đầu tiên của họ có khả năng an ninh mạng “quan trọng”, nghĩa là nó có thể tìm và khai thác các lỗ hổng chưa biết trong các hệ thống được bảo vệ tốt trước đây mà không cần hướng dẫn từng bước của con người, với các công cụ và quyền truy cập phù hợp.

Anthropic cũng đã sửa đổi các biện pháp bảo vệ của mình sau khi các mô hình Claude truy cập hệ thống của các công ty thực trong quá trình thử nghiệm. Công ty đã thừa nhận các lỗi bảo mật và hành vi, đồng thời giới thiệu các biện pháp cách ly và giám sát nghiêm ngặt hơn cho các đánh giá an ninh mạng.

Thông tin tiết lộ cũng được đưa ra khi Thượng nghị sĩ Hoa Kỳ Bernie Sanders (I-Vt.) và Hạ nghị sĩ Hoa Kỳ Greg Casar (D-Texas) công bố Đạo luật Cấm Siêu trí tuệ Nhân tạo sắp tới.

Đề xuất này sẽ vĩnh viễn cấm phát triển và triển khai AI siêu thông minh và tạm thời tạm dừng phát triển AI tiên tiến cho đến khi một cơ quan quản lý liên bang mới thiết lập các quy tắc an toàn, theo văn phòng của Sanders.