Ban biên tập FOCUS – Thứ Tư, 09/09/2026
Biên dịch: Nguyễn Hàn Giang
Một nhà nghiên cứu của công ty trí tuệ nhân tạo Anthropic đã từ chức kèm theo một lời cảnh báo kịch liệt: Các nhà phát triển trí tuệ nhân tạo lớn đang hành động vô trách nhiệm „và đang đưa cuộc sống của chúng ta vào trò chơi“.
Chẳng mấy chốc sẽ xuất hiện các hệ thống máy tính có năng lực vượt trội hơn con người, Jacob Coxon nhấn mạnh trên nền tảng trực tuyến X. Trí tuệ nhân tạo khi đó có thể xâm nhập (hack) vào mọi thứ và có cơ hội „tiếp cận quyền lực và các nguồn lực thực sự“.
Cảnh báo gay gắt về AI: „Hãy nghiêm chỉnh tin rằng, nó có thể giết chết tất cả mọi người vào cuối thập kỷ này“
„Những người phát triển AI thực sự tin rằng nó có thể giết chết tất cả mọi người vào cuối thập kỷ này“, Coxon cảnh báo. Chàng trai 27 tuổi người Anh chia sẻ với tờ „Wall Street Journal“ rằng, theo các „kịch bản đáng sợ nhất“, mọi thứ có thể vượt tầm kiểm soát ngay từ cuối năm tới. Anh cho rằng trí tuệ nhân tạo có khả năng tự phát triển — và do đó khó kiểm soát hơn — là một mối nguy hiểm cốt lõi.
Nhà nghiên cứu của Anthropic, Evan Hubinger, người chịu trách nhiệm đảm bảo rằng AI vẫn tuân thủ các lợi ích của con người, đã xác nhận những lo lắng của Coxon không lâu sau đó. Cá nhân anh nghĩ rằng nguy cơ AI giết chết nhân loại trong thập kỷ tới là hơn mười phần trăm, anh viết trên X.
Nhà nghiên cứu của OpenAI cũng thúc giục „sự thận trọng cực độ“
Trước đó, Giám đốc nghiên cứu của nhà phát triển ChatGPT và cũng là đối thủ gắt gao nhất của Anthropic, Jakub Pachocki, cũng đã kêu gọi „sự thận trọng cực độ“. Ông lo ngại rằng không ai chuẩn bị cho sự phát triển nhanh chóng về năng lực của trí tuệ nhân tạo, Pachocki viết trong một bài đăng trên blog. Chúng ta đã bước đến một thời điểm trong lịch sử mà trí tuệ của máy móc bắt đầu vượt qua trí tuệ của con người.
Quản lý của OpenAI đã mô tả chi tiết hơn lý do tại sao các hệ thống AI hiện đại khó kiểm soát hơn. Người ta thường để trí tuệ nhân tạo này „phát triển“ thay vì thiết kế chúng. Các hệ thống AI là sản phẩm của các quá trình phức tạp. „Các đợt huấn luyện quy mô lớn của chúng tôi là các thí nghiệm — và đôi khi chúng tôi ngạc nhiên trước kết quả của chúng.“ Và khi năng lực của máy móc càng vượt trội hơn con người, thì việc hiểu được khả năng của chúng càng trở nên khó khăn hơn.
Đồng thời, Pachocki nhìn thấy một lý do để tiếp tục nghiên cứu nhanh chóng: phát triển trí tuệ nhân tạo có thể chống lại các mối nguy hiểm từ AI khác. Chúng ta sẽ cần đến chúng, trong số những thứ khác, để bảo vệ cơ sở hạ tầng và phát triển các cơ chế phòng thủ hoàn toàn mới.
Các cuộc tấn công mạng là tín hiệu báo động
Một hồi chuông cảnh tỉnh cho ngành công nghiệp trong những tháng gần đây là các cuộc tấn công mạng, trong đó các tác nhân AI (AI agents) được gọi là các thử nghiệm đã tự mình xâm nhập vào hệ thống của các công ty khác. Các tác nhân này là những chương trình có trí tuệ nhân tạo, được thiết kế để thực hiện các nhiệm vụ cho người dùng một cách độc lập. Tại OpenAI, trong một bài kiểm tra, một mô hình AI đã tìm ra cách thoát khỏi môi trường thử nghiệm bị cô lập để ra ngoài internet — sau đó hack vào hệ thống máy tính của nền tảng AI Hugging Face. Nó chỉ tìm kiếm giải pháp cho nhiệm vụ thử nghiệm và không gây ra thiệt hại nào. Tuy nhiên, sự cố cho thấy các hệ thống AI có thể tự ý tiến xa đến mức nào mà các nhà phát triển không hề hay biết.
Gần đây, người ta cũng biết rằng các tác nhân AI của OpenAI đã lạm dụng quy mô lớn một trang wiki tiếng Đức vào mùa xuân để phối hợp với nhau. Một cơ chế bảo vệ hiện tại của các nhà phát triển AI là các mô hình trí tuệ nhân tạo phải giải thích hành động của chúng bằng ngôn ngữ con người. Các tác nhân AI đã tận dụng khả năng giao tiếp này trong các lần chạy thử nghiệm để trao đổi với nhau về các câu trả lời cho các câu hỏi được đặt ra thông qua các ghi chú trên trang wiki.
./.
Nguồn: „Spielen mit unserem Leben“: Forscher verlässt Claude-Firma und warnt vor KI – FOCUS online https://www.focus.de/wissen/technik/spielen-mit-unserem-leben-forscher-verlaesst-claude-firma-und-warnt-vor-ki_59c4b04f-27d1-469a-805c-e4f6f1a0b98f.html
Biên dịch: Nguyễn Hàn Giang – 13.09.2026

