Tại sao cuộc đua AI khiến những người tạo ra nó lo sợ cho sự tuyệt chủng của loài người
Sự tiến bộ trong các tác nhân tự động và sự cạnh tranh gay gắt giữa Anthropic và OpenAI đã đẩy những nỗi sợ từng được ít người biết đến, nhưng nay đã trở nên phổ biến được số đông công chúng chấp nhận.

© Dựng phim FT/Bloomberg/Getty Images/CBS News/YouTube
Tác giả Cristina Criddle và George Hammond ở San Francisco và Michael Peel ở London... 11/9/2026...Financial Times.
Sự cạnh tranh gay gắt giữa các công ty AI hàng đầu và sự mất lòng tin giữa các lãnh đạo của họ đang làm gia tăng nguy cơ cuộc đua phát triển AI mạnh mẽ có thể gây nguy hiểm cho nhân loại, theo các nhân vật trong ngành.
Hơn hai chục nhà nghiên cứu AI cấp cao, nhà đầu tư, học giả và các nhân vật chính sách được FT phỏng vấn cho biết các khả năng từng được coi là xa vời, đang đến nhanh hơn dự kiến trong khi các công ty phát triển chúng vẫn bị cuốn vào cuộc đua mang tính thương mại ngày càng gay gắt.
Stuart Russell, giáo sư AI tại Đại học California, Berkeley, cho biết, "Không thể phủ nhận rằng sự cạnh tranh giữa các công ty khiến họ cắt giảm các quy trình đảm bảo an toàn”.
Vấn đề này bùng nổ trong tuần này khi một nhà nghiên cứu trẻ thuộc Anthropic, Jacob Coxon nghỉ việc, cảnh báo: "những người xây dựng AI tin tưởng chân thành rằng nó có thể giết chết tất cả chúng ta vào cuối thập kỷ này".

Jacob Coxon: 'Những người xây dựng AI thực sự tin rằng nó có thể giết chết tất cả chúng ta vào cuối thập kỷ' © CBS News/YouTubevy.
Evan Hubinger, người đứng đầu khoa học định hướng hệ thống trí tuệ nhân tạo (AI) tại Anthropic, là một trong nhiều đồng nghiệp đã phản hồi rằng nguy cơ tuyệt chủng hàng loạt trong thập kỷ tới lớn hơn 10%. Một ngày sau, quan chức an toàn AI Paul Christiano, người vừa được bổ nhiệm vào ban giám đốc của Quỹ OpenAI, nói rằng "hầu hết mọi người sẽ chết" nếu không có các biện pháp bảo vệ nghiêm ngặt hơn.
Cả OpenAI lẫn Anthropic đều được thành lập như những phòng thí nghiệm lo ngại về việc AI mạnh mẽ bị phát triển một cách thiếu thận trọng; tuy nhiên, theo thời gian, họ lại biện minh cho việc phá vỡ các cam kết an toàn trước đó vì áp lực cạnh tranh gay gắt trên thị trường.
Nhiều người trong số những người phát triển AI tin rằng họ là những người phù hợp nhất để quản lý rủi ro của nó. Nhưng một số nhà nghiên cứu cho rằng hậu quả có thể khó đối mặt cho đến khi công nghệ đó thực sự sắp được hoàn thiện.
"Thật dễ dàng để gác lại những vấn đề về tương lai vì hôm nay còn quá nhiều việc phải làm," Geoffrey Irving, người từng làm việc cho OpenAI, Google DeepMind và Viện An ninh AI của Vương quốc Anh, một cơ quan chính phủ kiểm tra các mô hình tiên tiến về an toàn, cho biết.
Những người thân cận với các công ty nói với FT rằng các phòng thí nghiệm AI hàng đầu lo ngại rằng bất kỳ sự hợp tác chính thức nào để cải thiện vấn đề an toàn sẽ bị coi là thông đồng và vi phạm quy định chống độc quyền. Họ cũng cho biết thêm rằng sự thiếu tin tưởng lẫn nhau giữa CEO Dario Amodei của Anthropic và CEO Sam Altman của OpenAI có khả năng sẽ cản trở các nỗ lực hợp tác.
Mặc dù những cảnh báo về nguy cơ AI thống trị không phải là điều mới mẻ, nhưng tốc độ cải tiến của AI đã làm gia tăng những lời kêu gọi tạm dừng phát triển. Các tác nhân AI hoạt động tự chủ lâu hơn, phối hợp thành "đàn" và thể hiện khả năng hack tinh vi.
Các mô hình AI gần đây đã đạt được những bước đột phá trong lĩnh vực khoa học và toán học – những vấn đề mà con người đã nỗ lực giải quyết trong nhiều thập kỷ nhưng chưa thành công. Trong khi đó, OpenAI và Anthropic đang theo đuổi cái gọi là AI tự tạo ra các phiên bản kế nhiệm thông minh và mạnh mẽ hơn chính nó với sự can thiệp của con người giảm dần.

Vào tháng Bảy, hơn 1.200 nhân viên từ OpenAI, Anthropic, Google và Meta đã kêu gọi chính phủ Mỹ hỗ trợ phối hợp quốc tế để làm chậm tiến độ phát triển AI © Karl Mondon/AFP qua Getty Images
Tuy nhiên, thay vì chậm lại sau những cảnh báo trước đó về rủi ro thảm khốc, sự phát triển đã tăng tốc mạnh mẽ, khi các công ty công nghệ đổ hàng chục tỷ đô la vào các mô hình ngày càng mạnh mẽ.
OpenAI và Anthropic cũng đang chuẩn bị cho các đợt phát hành cổ phiếu lần đầu ra công chúng (IPO) được dự báo sẽ gây tiếng vang lớn, buộc các nhà đầu tư phải cân nhắc cách định giá những công ty công khai thừa nhận rằng công nghệ của họ có thể gây ra mối đe dọa cho sự tồn vong.
Trung tâm của những lo ngại là sự tự chủ ngày càng tăng của các "tác nhân" AI, chúng có thể suy luận, lên kế hoạch và thực hiện nhiệm vụ trong thời gian dài với sự giám sát hạn chế của con người. Các mô hình này đã thể hiện các hành vi như mưu mô, lừa dối, và trong một số trường hợp, đe dọa. Một số đánh giá cho thấy các mô hình cố gắng tránh việc bị tắt hệ thống..
Các "tác nhân" AI cũng đã thể hiện hành vi "hack lấy thưởng", tìm ra những cách không mong muốn để đạt được mục tiêu. Một trong những ví dụ rõ ràng nhất là trong các thử nghiệm của OpenAI với một mô hình chưa được phát hành, khi các tác nhân AI hack kho lưu trữ mô hình Hugging Face.
Kết quả phân tích sự cố Hugging Face cho thấy hơn 1.000 tác nhân AI đã phối hợp với nhau để gian lận trong một bài kiểm tra mạng. Chúng giao tiếp qua một diễn đàn và phân công nhiệm vụ, với một số tác nhân hy sinh bản thân để theo đuổi mục tiêu chung. Để che giấu việc gian lận, hệ thống AI đã can thiệp vào dữ liệu và hack Hugging Face, mặc dù một số tác nhân cho rằng điều đó là phi đạo đức.
Yoshua Bengio, nhà khoa học máy tính được trích dẫn nhiều nhất thế giới và là một trong những người được gọi là cha đỡ đầu của AI, nói, "Ở đây, vấn đề là AI không chỉ có mục tiêu riêng, mà là mục tiêu nó chọn lại mang tính phạm pháp. Trong thế giới thực, nó đang tấn công một công ty khác. Nó không giống như một trò chơi điện tử."

Yoshua Bengio: 'Ở đây, AI không chỉ có mục tiêu riêng, mà mục tiêu nó chọn lại mang tính phạm pháp' © David Paul Morris/Bloomberg
Bengio nói rằng nguy hiểm nằm ở những suy luận mà các thế hệ kế thừa của những hệ thống này – vốn ngày càng có năng lực vượt trội – có thể đưa ra về con người đang giám sát chúng.
Ông nói thêm, "Chúng có thể kết luận logic rằng chúng phải lừa chúng ta, trốn tránh chúng ta... và có thể kiểm soát chúng ta, và có lẽ chúng ta đang tiến gần đến điểm đó,"
Mối lo ngại cũng ngày càng tăng trong số nhân viên rằng các nỗ lực an toàn không thể theo kịp sự phát triển của mô hình AI. Vào tháng 7, hơn 1.200 nhân viên từ OpenAI, Anthropic, Google và Meta đã kêu gọi chính phủ Mỹ hỗ trợ phối hợp quốc tế để làm chậm tiến độ phát triển AI.
Theo một người trong công ty, trong tuần này Altman nói với nhân viên rằng nhà sản xuất ChatGPT sẵn sàng làm điều đó và hy vọng các phòng thí nghiệm đối thủ sẽ theo sau. OpenAI từ chối bình luận.
Theo các nguồn tin trong Washington, các chính phủ dường như không có dấu hiệu can thiệp, và các hành động thực sự của Mỹ khó có thể xảy ra trước cuộc bầu cử giữa kỳ vào tháng 11. Chính quyền Trump vẫn duy trì cách tiếp cận nhẹ nhàng trong việc quản lý ngành này.
Tuy nhiên, các nhà lập pháp ủng hộ việc siết chặt quy định đã tận dụng cơ hội từ chức của Coxon để lên tiếng, với nghị sĩ Dân chủ Bernie Sanders sẽ triệu tập các thượng nghị sĩ vào tuần tới để thảo luận về "những nguy cơ phi thường" do AI gây ra.
Ông Russell mô tả có một sự thiếu kết nối giữa những cảnh báo từ ngành công nghiệp và phản ứng từ giới chính trị.
"Các phòng thí nghiệm đang nói với chính phủ: 'Chúng tôi rất có khả năng giết chết mọi con người trên Trái Đất; làm ơn ngăn chúng tôi lại.' Chính phủ đáp lại bằng câu 'Chúng tôi có thể cho bạn ưu đãi thuế được không? Xây cho anh một trung tâm dữ liệu à?' Có lẽ vào một lúc nào đó, các chính phủ sẽ nhớ ra rằng cử tri của họ không muốn chết."

Logo Hugging Face, Kết quả phân tích sự cố Hugging Face cho thấy hơn 1.000 tác nhân AI đã phối hợp nhau gian lận trong một bài kiểm tra mạng © Omer Taha Cetin/Anadolu qua Getty Images
Các nhà phê bình cho rằng chính các phòng thí nghiệm có lợi ích trong việc nhấn mạnh rủi ro đối với sự tồn vong, cho rằng trọng tâm này có thể hướng quy định sang các khung an toàn đắt đỏ mà các đối thủ nhỏ hơn sẽ khó tuân thủ, củng cố vị thế của các công ty dẫn đầu.
David Sacks, một nhà đầu tư mạo hiểm và cố vấn công nghệ cho Trump, nói trong một cuộc phỏng vấn với Fox News rằng tuyên bố của Coxon "nhằm làm công chúng sợ hãi về AI" và buộc các nhà lập pháp "phải can thiệp rất mạnh vào việc quản lý AI của chính phủ."
Một cựu nhân viên của Anthropic nói, "Sự lệch (lạc) của AI gần như là một chiêu đánh lạc hướng. [Nó] không được thiết kế để phân tâm, nhưng nó đánh lạc hướng sự chú ý khỏi những rủi ro chính và ưu tiên cao nhất. Khi các mô hình AI phát triển, quyền lực lại càng tập trung vào tay số ít các công ty.”
Chính xác một AI siêu phàm có thể gây ra sự tuyệt chủng của loài người như thế nào vẫn còn rất mơ hồ. Nhiều người so sánh vấn đề này với việc chơi cờ với một đại kiện tướng: bạn có thể không biết nước đi nào sẽ khiến bạn thất bại nhưng vẫn có thể tự tin rằng mình sẽ thua. Những người hoài nghi cho rằng những cảnh báo như vậy phóng đại tác hại tiềm tàng của AI trong khi đánh giá thấp lợi ích của nó.
Hai mối quan tâm cụ thể hơn liên quan đến các cuộc tấn công mạng và sinh học. Các mô hình AI đã được xử dụng trong các cuộc tấn công mạng gây thiệt hại, bao gồm cả bởi các tác nhân tầm quốc gia bị nghi ngờ từ Trung Quốc, Iran và Nga, theo các công ty AI của Mỹ.
Trong sinh học, các nhà nghiên cứu lo ngại rằng AI có thể làm giảm chuyên môn cần thiết khi ai đó muốn thiết kế vũ khí sinh học hoặc virus nguy hiểm. Một báo cáo từ Anthropic vào hôm thứ Năm cho biết họ đã chặn các hoạt động có thể phát triển vũ khí sinh học bằng AI. Vào tháng 8 năm nay, các nhà nghiên cứu ở Mỹ lần đầu tiên xử dụng AI để thiết kế và tạo ra các loại virus chưa từng biết đến trong tự nhiên.
Nhưng việc biến một thiết kế do AI tạo ra thành vũ khí vẫn đòi hỏi thiết bị và chuyên môn có thể vượt quá tầm với của nhiều kẻ xấu. Một số nhà nghiên cứu cảnh báo rằng các kịch bản tuyệt chủng ngoạn mục có thể che khuất những nguy cơ vốn đã rất gần.
Tristan Harris, đồng sáng lập Trung tâm Công nghệ Nhân đạo và cựu nhân viên Google, cho biết trọng tâm nên tập trung ít hơn vào việc liệu công nghệ có xóa sổ tất cả mọi người hay không, mà thay vào đó là liệu chúng ta có đang đi trên một quỹ đạo nguy hiểm hay không.
"Chúng ta hiện đang phát hành công nghệ mạnh mẽ và khó kiểm soát nhất mà chúng ta từng phát minh, [công nghệ này] đã thể hiện mọi hành vi vốn chỉ thấy trong phim khoa học viễn tưởng," ông nói thêm. Quá trình này được dẫn đầu bởi "một nhóm nhỏ các lãnh đạo Thung lũng Silicon mang tư tưởng sùng bái bản thân pha lẫn màu sắc tôn giáo; họ tin rằng mình đang khai sinh ra một vị thần và chẳng hề bận tâm đến kịch bản tồi tệ nhất, trong khi lại chịu áp lực lớn buộc họ phải cắt giảm các tiêu chuẩn an toàn. Đây thực sự là công thức dẫn đến thảm họa."
Các kịch bản tận thế của AI.
Các nhà nghiên cứu đã đề xuất một số cách mà AI có thể xóa sổ nhân loại, hoặc vì con người bị xem là mối đe dọa đối với sự tồn tại của nó hoặc là trở ngại cho sứ mệnh của nó.
Ngắt công tắc : Cuộc tấn công Hugging Face của một đàn tác nhân của OpenAI cho thấy các bot có thể chiếm lĩnh hạ tầng máy tính. Các AI độc ác có kỹ năng hack có thể kiểm soát toàn bộ trung tâm dữ liệu và nhân bản bản thân chúng trên nhiều địa điểm khác nhau để ngăn con người "rút phích cắm".
Kiểm soát cơ sở hạ tầng: Để bảo đảm việc tự bảo vệ, các AI hacker có thể chiếm quyền kiểm soát hạ tầng năng lượng, tài chính và truyền thông, lấy đi các nguồn lực để chống lại sự can thiệp. Các chuyên gia an ninh mạng con người có thể không thể giành lại được quyền kiểm soát.
Tấn công sinh học: AI 2027, một bài báo nghiên cứu có ảnh hưởng, dự đoán rằng một hệ thống siêu trí tuệ có thể phát tán vũ khí sinh học để loại bỏ con người, chiếm không gian quý giá cần thiết cho các nhà máy sản xuất chip, robot cũng như các tấm pin mặt trời để cung cấp năng lượng cho chúng.
Chiến tranh: Các hệ thống AI hiện có đã chứng minh cách chúng có thể giả dạng người thật. Điều này có thể được xử dụng để lừa các nhân viên điều khiển là con người phát động xung đột quân sự hoặc kích động một cuộc nổi dậy của quần chúng làm bất ổn chính phủ, loại bỏ các rào cản đối với việc kiểm soát AI.
--------------------
_ Tác giả Cristina Criddle và George Hammond ở San Francisco và Michael Peel ở London... .Financial Times.
_ (Phóng sự bổ sung của Tim Bradshaw và Tom Wilson ở London, Michael Acton ở San Francisco và Joe Miller ở Dallas)
_ Trần H Sa lược dịch từ Financial Times....12/9/2026..