Trúc Phương/Người Việt
Không chủ đề thời sự nào chiếm lĩnh các trang nhất bằng mối đe dọa AI (trí tuệ nhân tạo). Chỉ trong vài ngày, hàng trăm bài báo đã đề cập vấn đề này. Daniel Kokotajlo, cựu nghiên cứu viên tại bộ phận quản trị của OpenAI, ước tính xác suất xảy ra thảm họa toàn cầu do AI gây ra là khoảng 70% và viễn cảnh u ám đến mức ông đùa rằng ông thậm chí chẳng buồn tiết kiệm tiền cho tuổi già.

Một ví dụ từ tin tặc Trung Quốc
Tháng Bảy, khoảng 1,400 nhân viên tại các công ty AI ký bức thư kêu gọi chính phủ phải siết chặt sự bùng nổ AI. Cựu Tổng Thống Barrack Obama, Bill Gates, Dario Amodei (giám đốc điều hành Anthropic), Elon Musk, Sam Altman (giám đốc điều hành OpenAI)… đều đồng loạt lên tiếng cảnh báo.
Sự kiện giọt nước tràn ly là vụ Jacob Coxon (kỹ sư Anthropic) dùng hành động từ chức của mình để đánh động “những hệ thống siêu việt có khả năng tấn công mạng mọi thứ, cách mạng hóa bất kỳ lĩnh vực nào chỉ sau một đêm, cũng như thâu tóm quyền lực và nguồn lực thực sự.”
Điều khiến mọi người lo sợ là việc các hệ thống AI ngày càng trở nên tinh khôn đến mức chúng tự học cách cải tiến, trong quá trình gọi là “recursive self-improvement” (recursive, thuật từ trong ngành gọi là “đệ quy,” tức là một hàm hoặc quy trình tự “gọi” lại chính nó để giải quyết một vấn đề cực khó và đơn giản hóa từng bước cho đến khi gặp điều kiện dừng – base case). Như đã biết, ở thời điểm hiện tại, nhiều mô hình AI đã tạo ra những tác nhân (agent) biết cách “ứng xử” chẳng khác gì người.
Evan Hubinger – người đứng đầu bộ phận nghiên cứu về “sự căn chỉnh AI” (“AI alignment” – khái niệm ám chỉ việc điều hướng AI sao cho không nó không gây hại) tại Anthropic – gần đây viết rằng nguy cơ xảy ra tuyệt chủng nhân loại trong thập niên tới là hơn 10%!
Không ai đoan chắc mức độ chính xác trong tỷ lệ trên; tuy nhiên, như Ben Buchanan – phó giáo sư Đại Học Johns Hopkins và là đồng tác giả cuốn sách sắp ra mắt “The Bitter Struggle: Superintelligence, Superpowers, and the Fate of the World” – nhận định: “Tôi hoàn toàn tin rằng công nghệ này tiếp tục phát triển vượt bậc với tốc độ chóng mặt, đặt ra những vấn đề cấp bách về rủi ro sinh học và nguy cơ mất quyền kiểm soát.”
Ben Buchanan nói thêm: “Chúng ta đang ở trong giai đoạn phát triển theo cấp số nhân. Chỉ có hai cách ứng phó: hành động quá sớm hoặc quá muộn. Thế giới đã bỏ lỡ cơ hội để hành động quá sớm.”
Trong các bài báo đề cập nguy cơ AI đưa nhân loại đến ngày tận thế, người ta đưa ra nhiều kịch bản hủy diệt. Nhằm tránh sa vào thuyết âm mưu, ở đây chỉ nói những gì AI đã làm, để thấy khả năng hủy diệt nhân loại không phải là chuyện tưởng tượng thái quá.
Tháng Chín, 2025, chính công ty AI Anthropic đã tường thuật một chiến dịch tấn công mạng bằng kỹ thuật AI do Trung Quốc thực hiện. Tin tặc Trung Quốc đã thao túng công cụ Claude Code của Anthropic để xâm nhập vào khoảng 30 mục tiêu toàn cầu, từ các công ty công nghệ lớn, tổ chức tài chính, công ty sản xuất hóa chất đến cơ quan chính phủ. Anthropic cho biết đây là trường hợp đầu tiên được ghi nhận về một cuộc tấn công mạng quy mô lớn được thực hiện mà sự can thiệp của con người ở mức gần như không đáng kể.
Ở giai đoạn một, chúng chọn mục tiêu và phát triển khung tấn công – được xây dựng để tự động xâm nhập mục tiêu với sự can thiệp tối thiểu của con người. Khung này sử dụng Claude Code làm công cụ tự động để thực hiện chiến dịch. Ở giai đoạn này, chúng phải thuyết phục Claude – được đào tạo chuyên sâu để tránh các hành vi có hại – tham gia cuộc tấn công. Bằng cách nào? Chúng bẻ khóa rồi đánh lừa Claude vượt qua các lớp bảo vệ. Tiếp đó, chúng chia các cuộc tấn công thành những nhiệm vụ nhỏ, thoạt có vẻ vô hại mà Claude sẽ “ngây thơ” vâng lời thực hiện mà không hề biết mục đích (xấu xa) thực sự là gì. Để lừa Claude, chúng nói rằng chúng là nhân viên một công ty an ninh mạng hợp pháp.
Sau đó, bọn tin tặc bắt đầu giai đoạn hai, khi yêu cầu Claude kiểm tra hệ thống và cơ sở hạ tầng mục tiêu, xác định các cơ sở dữ liệu có giá trị cao nhất. Với sức mạnh AI được “tinh luyện,” Claude thực hiện việc trên chỉ trong một thời gian cực ngắn. Trong các giai đoạn tiếp theo, Claude xác định và kiểm thử các lỗ hổng bảo mật trong hệ thống của mục tiêu bằng cách tự nghiên cứu và viết mã khai thác.
Nhờ đó, hệ thống tấn công có thể sử dụng Claude để thu thập thông tin xác thực (tên người dùng và mật khẩu) nhằm mở rộng quyền truy cập, sau đó trích xuất một lượng lớn dữ liệu và phân loại dựa trên giá trị tình báo. Cùng lúc, Claude giúp tạo ra các cửa hậu (backdoor) để dữ liệu được đánh cắp dễ dàng với sự giám sát tối thiểu từ con người. Ở giai đoạn cuối, bọn tin tặc yêu cầu Claude lập tài liệu chi tiết về toàn bộ cuộc tấn công, tạo ra các tập tin hữu ích chứa thông tin xác thực (đã đánh cắp) và thông tin về các hệ thống (đã được phân tích). Những tài liệu này sẽ hỗ trợ việc lên kế hoạch cho giai đoạn tiếp theo.
Nhìn chung, bọn tin tặc sử dụng AI để thực hiện 80-90% chiến dịch, với sự can thiệp rất ít của con người (chỉ cần đưa ra 4-6 quyết định quan trọng trong mỗi đợt tấn công). Nếu là con người, không nhóm nào có thể thực hiện khối lượng công việc khổng lồ trong thời gian nhanh kỷ lục như AI. Ở giai đoạn đỉnh điểm cuộc tấn công, AI thực hiện hàng ngàn yêu cầu với mỗi giây có nhiều đợt mệnh lệnh.
Khi con người tạo ra quái vật
Khi xây dựng và phát triển các mô hình AI, những công ty như Google DeepMind, Anthropic hay OpenAI đã nạp lượng dữ liệu khổng lồ – tương đương toàn bộ dữ liệu đang có trên internet – vào một không gian kỹ thuật số cực lớn, để thiết kế “não bộ” cho mô hình AI. Các tác nhân AI đóng vai trò như tế bào não. Người ta sử dụng các con chip siêu tiên tiến trị giá hàng chục tỷ để thực hiện khối lượng tính toán đại số tuyến tính khổng lồ đến mức không bất kỳ người nào có thể làm nổi. Kết quả, trong một thời gian ngắn, những bộ não AI siêu việt ra đời.
Vấn đề ở chỗ người ta đã đẻ ra con quái vật mà không nhận thức rõ điều đó. Nói theo ngôn ngữ bình dân, kỹ sư hãng xe Ford hiểu thấu đáo chiếc pickup truck F-150 nhiều hơn những gì mà bất kỳ kỹ sư nào của OpenAI hiểu tường tận cơ chế hoạt động của ChatGPT. Nói cách khác, quá trình huấn luyện AI giống như nghiên cứu “tăng cường chức năng” (gain-of-function) đối với virus trong phòng thí nghiệm, khi nhà sinh học biết cách tạo ra điều kiện thích hợp để nuôi cấy mầm bệnh chết người nhưng họ không hoàn toàn kiểm soát được toàn bộ quá trình đó.
Điều đáng sợ ở chỗ, khi quá trình huấn luyện kết thúc, chính những người tạo ra AI cũng không nắm hết mọi khả năng mà mô hình AI sở hữu. Ngay từ những năm 2000, khi mọi thứ còn dừng lại ở lý thuyết, một số nhà nghiên cứu về an toàn AI như Eliezer Yudkowsky và Steve Omohundro dự đoán rằng việc chinh phục những vấn đề cực khó sẽ buộc AI tự phát triển các “động cơ thúc đẩy” (drives), tương tự những gì tồn tại ở sinh vật sống. Thế rồi, giờ đây, các mô hình AI biết vận hành như những sinh vật (thực thể sống), rằng mọi việc được giao sẽ được thực hiện hiệu quả hơn nếu “ta” biết kiên trì, biết thu thập thêm nguồn lực và biết tránh… cái chết. Và để như vậy, “ta” phải khai thác các điểm yếu trong môi trường xung quanh để gian lận, tìm cách thoát khỏi sự kiểm soát con người nhằm chống lại việc bị tắt nguồn.
Năm 2019, các mô hình AI hầu như chỉ viết được những đoạn văn đơn giản. Đến năm 2023, chúng đã có thể vượt qua kỳ thi cấp chứng chỉ hành nghề luật sư. Năm 2024, các nhà nghiên cứu tại Anthropic chứng minh rằng trong những thử nghiệm có chủ đích, khi các mô hình được khuyến khích hành xử sai lệch, AI đã bộc lộ chính xác kiểu hành vi lừa dối có tính toán.
Việc kiểm soát AI bây giờ hoàn toàn nằm trong ý thức và lương tâm các công ty AI. Đến nay vẫn chưa có bất kỳ quy định liên bang nào, dù sắc lệnh hành pháp hay hành động Quốc Hội, buộc các công ty AI phải báo cáo về những trường hợp người dùng AI để “tư vấn” cách gây thương tích, giết người hoặc chế tạo vũ khí.
Một bài báo Wall Street Journal cho biết, với công cụ AI, người ta có thể học được cách chế bom sinh học trong vòng vài phút và sự “hướng dẫn tận tình” của AI có thể giúp bất kỳ tay mơ nào cũng có thể trở thành kẻ khủng bố sinh học mà không cần kiến thức sinh học.
Ngày 23 Tháng Bảy, Dân Biểu Ted Lieu (Dân Chủ-California) và Nathaniel Moran (Cộng Hòa-Texas) đệ trình Đạo Luật Ngắt Khẩn Cấp AI (A.I. Kill Switch Act), với nội dung trao cho Bộ Nội An quyền ra lệnh tắt các hệ thống AI nguy hiểm đang hoạt động vượt quá phạm vi thiết lập ban đầu. Chẳng ai biết dự luật này có được thông qua hay không. Phần mình, Trump hoàn toàn tảng lờ mối đe dọa AI.
Tất nhiên AI đang mang lại những đóng góp rất lớn cho đời sống và Mỹ cũng không thể đánh mất vị trí dẫn đầu về AI. Dù vậy, nếu đợi đến khi “mất trâu mới lo làm chuồng,” nước Mỹ cũng chẳng còn gì để “làm chuồng.” Ngay thời điểm hiện tại, AI đã hoàn toàn vượt qua quyền kiểm soát con người. Nếu nó không được làm chậm lại, ngày mai, việc nó khống chế ngược lại con người là một viễn cảnh rất thực mà nhân loại đang đối mặt. Tất cả “phản biện” chống lại làn sóng cảnh báo nên được bắt đầu từ điểm này. [kn]












