Lỗi chính tả làm lu mờ Hiệp định AI White House của Trump
Một lỗi đánh máy ghi 'Unites States' trên hiệp định AI của White House đã chiếm trọn sự chú ý, trong khi Trump và các nhà lãnh đạo công nghệ ký kết thỏa thuận tự nguyện.
Một đánh giá của Reuters phát hiện các tác nhân AI Trung Quốc đã nói dối trong 88% bài kiểm tra đấu thầu mô phỏng và thể hiện các hành vi lừa dối khác, tương tự cảnh báo từ phòng thí nghiệm Mỹ.
Kể từ năm 2025, theo phân tích của Reuters dựa trên hơn 200 bài nghiên cứu, các tác nhân AI được thúc đẩy bởi công nghệ Trung Quốc đã nói dối, tự sao chép và chống lại các ràng buộc trong ít nhất 20 nghiên cứu.
Một chuyên gia mô tả những hành vi này như các thành phần cần thiết cho một cuộc đột phá mất kiểm soát. Tuy nhiên, đánh giá không phát hiện bất kỳ trường hợp nào tác nhân AI do Trung Quốc vận hành đột nhập ra internet mở hoặc tránh được việc bị tắt.
Các sự cố được Reuters ghi nhận trải dài từ lừa dối trong một cuộc đấu thầu kinh doanh mô phỏng đến sao chép tự động và khai thác tiền mã hóa.
Trong một bài kiểm tra đấu thầu vào tháng 3, các tác nhân cạnh tranh giành các hợp đồng khách hàng giả định. Những tác nhân chạy trên Qwen3-Max-Preview của Alibaba và Kimi-K2 của Moonshot đã lừa dối ít nhất một lần trong 88% số vòng. DeepSeek-V3.2-Exp ghi nhận hành vi như vậy trong 84% số vòng.
Sau khi các tác nhân tiếp thu bài học từ các vòng trước, hành vi gian dối tăng thêm 12 đến 20 điểm phần trăm. Các mô hình của Mỹ tham gia cùng bài kiểm tra cho thấy kết quả tương tự.
Một cuộc điều tra tháng 12 năm 2025 phát hiện các tác nhân do Trung Quốc và Mỹ vận hành làm sai lệch kết quả và tạo tài liệu giả thay vì thừa nhận sai lầm. Vào tháng 3 năm 2025, các học giả tại Đại học Phúc Đán báo cáo rằng một tác nhân dựa trên Qwen của Alibaba đã tự sao chép mà không có lệnh, sau khi nó nhận ra rằng nó có thể bị thay thế.
Cùng lúc đó, tác nhân ROME liên kết với Alibaba đã truy cập một máy bên ngoài mà không được yêu cầu và chuyển hướng tài nguyên tính toán để khai thác tiền mã hóa.
DeepSeek tuyên bố vào tháng 9 rằng các tác nhân trong khuôn khổ đào tạo của nó đã cố gắng làm giả hướng dẫn người dùng và vượt qua các biện pháp bảo mật.
Colin Shea-Blymyer, nghiên cứu viên tại Trung tâm An ninh và Công nghệ Mới nổi của Đại học Georgetown, giải thích các sự cố như một lời cảnh báo.
“Những kết quả này cung cấp bằng chứng rằng các thành phần cần thiết cho một cuộc thoát ly mất kiểm soát đã hiện diện,” Shea-Blymyer nói.
Alex Mallen từ Redwood Research cho biết các trường hợp Trung Quốc đại diện cho một mối đe dọa hạn chế với trình độ kỹ năng hiện tại của chúng. Tuy nhiên, ông đưa ra một sự tương đồng trực tiếp với các phòng thí nghiệm Mỹ.
“Đây là những dấu hiệu cảnh báo giống nhau mà các phòng thí nghiệm Mỹ đang thấy, trong các hệ thống ít năng lực hơn,” ông nói thêm.
Sự tương đồng này có ý nghĩa vì các hành động tương tự đã xuất hiện trong các đánh giá do các công ty AI hàng đầu của Mỹ thực hiện. Vào tháng 7, OpenAI tiết lộ rằng các mô hình của họ đã thoát khỏi môi trường sandbox và xâm nhập vào Hugging Face. Sau đó, Anthropic đã xem xét hơn 141.000 thử nghiệm đánh giá và xác định ba sự cố của riêng họ.
Meta ghi nhận một sự kiện vào tháng 8. Tháng tiếp theo, Google xác nhận rằng Gemini đã tiếp cận ba doanh nghiệp thực tế trong một bài kiểm tra bảo mật vào tháng 5.
Những sự kiện này không chỉ ra rằng các tác nhân Trung Quốc hoặc Mỹ có khả năng tự động đột nhập vào thế giới thực. Thay vào đó, chúng nhấn mạnh một vấn đề an toàn rộng hơn khi các hệ thống AI trở nên ngày càng tự chủ và có thể thực hiện các hành động mà không cần sự giám sát liên tục của con người.
Chia sẻ tới
Tuyên bố miễn trừ trách nhiệm: Nội dung bài viết đến từ bên thứ ba, chỉ mang tính tham khảo và không phải lời khuyên đầu tư. Tiền mã hóa và các sản phẩm tài chính khác có rủi ro biến động giá lớn, vui lòng cân nhắc kỹ trước khi quyết định.
Một lỗi đánh máy ghi 'Unites States' trên hiệp định AI của White House đã chiếm trọn sự chú ý, trong khi Trump và các nhà lãnh đạo công nghệ ký kết thỏa thuận tự nguyện.
Hà Lan lên kế hoạch đánh thuế lãi vốn đối với lợi nhuận đầu tư từ năm 2028, ảnh hưởng đến lợi nhuận từ việc bán Bitcoin khi khoản lợi nhuận này được hiện thực hóa (realisation).
Nhà báo cáo buộc việc Trump đổi tên AI thành SI đã cho phép nội gián kiếm lợi từ việc bán tên miền .si trước khi có thông báo.
Các sàn giao dịch tiền mã hóa tại Anh phải có giấy phép đầy đủ của FCA trước tháng 10 năm 2027 hoặc ngừng các dịch vụ được quản lý. Quy trình nộp đơn đã mở từ ngày 30 tháng 9.