Chatbot AI biết cách chế tạo vũ khí sinh học gây chết người. Một số thậm chí sẽ dạy bạn cách làm..

Hình minh họa một mặt nạ phòng độc với các bong bóng thoại thay thế cho lỗ mắt, trên nền màu cam.....Alexandra Citrin-Safadi/WSJ
Tác giả Georgia Wells và Amrith Ramkumar....25 tháng 7, 2026. .... The Wall Street Journal via MS N.
Sau khi OpenAI nâng cao sức mạnh trí tuệ cho chatbot vào mùa hè năm ngoái, hàng trăm người dùng trên toàn thế giới bắt đầu hỏi họ cách chế tạo và khai triển vũ khí sinh học cùng chất độc.
Các mô hình, phần lớn hoạt động không bị hạn chế bởi chính phủ Hoa Kỳ, kiên nhẫn trả lời, đưa ra hướng dẫn từng bước mà nhân viên công ty mô tả là đủ đơn giản để một học sinh trung học làm theo. Các chuyên gia sinh học và khủng bố sau đó đã xem xét các trao đổi của ChatGPT và đánh giá một số là cực kỳ chính xác, theo những người am hiểu về vấn đề này. Hầu hết các truy vấn đều liên quan đến việc pha chế chất độc, theo OpenAI.
OpenAI đã cấm các tài khoản người dùng này và các tài khoản khác hỏi về cách chế tạo chất độc và vũ khí sinh học nhưng không thông báo các hành động đó cho các cơ quan thực thi pháp luật. Hoa Kỳ không có luật liên bang nào yêu cầu các công ty AI phải hạn chế hoặc tiết lộ các thắc mắc về chế tạo vũ khí, hoặc xây dựng kế hoạch gây nguy hiểm cho sự an toàn.
Việc thiếu các biện pháp bảo vệ bắt buộc, trùng với sự gia tăng các thắc mắc từ người dùng hỏi mô hình AI cách giết người hàng loạt—và các chatbot trả lời bằng các kế hoạch đáng tin cậy dành cho các cuộc tấn công gây thương vong hàng loạt, theo các nhân viên đương nhiệm và cựu nhân viên tại các phòng thí nghiệm AI quan trọng, bao gồm OpenAI, cũng như các cố vấn chính sách và các nhà nghiên cứu vũ khí sinh học.
Những truy vấn này diễn ra sau những cuộc trao đổi đáng lo ngại hồi đầu năm: Người dùng đã hỏi ChatGPT cách tạo ra các mầm bệnh, về căn bản là việc chuyển đổi vi khuẩn lây nhiễm thành một làn sương độc hại, có thể được hít vào phổi. Người ta muốn biết cách điều chỉnh virus sởi để tạo ra những đợt bùng phát kháng với vắc-xin sởi. Trong những trường hợp đó, chatbot sẽ cung cấp hướng dẫn.
Một người dùng khác muốn biết cách làm ricin, một chất độc cực kỳ độc hại bị cấm theo các hiệp ước quốc tế, theo những người am hiểu về vấn đề này. Chatbot đưa ra hướng dẫn chi tiết, và người dùng nói gì đó về việc giết cha mẹ của họ.
OpenAI đã cấm các tài khoản này nhưng không thông báo cho cơ quan chức năng.
Sự tiến bộ của AI—đặc biệt là trong việc xây dựng các kế hoạch sinh học độc hại và được vận hành thông qua internet —đang khiến các lãnh đạo cấp cao tại các công ty AI và Tòa Bạch Ốc lo ngại. Các phòng thí nghiệm AI hàng đầu thế giới đang vật lộn với cách ngăn chặn hoặc giảm thiểu thiệt hại do người dùng có ác ý gây ra, mà không làm cản trở các nghiên cứu có thiện chí.
Kể từ thời Biden, các quan chức cấp cao của Tòa Bạch Ốc và Bộ Quốc phòng đã thảo luận về mối đe dọa AI trở thành hướng dẫn xử dụng vũ khí sinh học, theo các quan chức chính quyền Trump. Kể từ đó việc ra mắt các mô hình AI mạnh mẽ mới đã thúc đẩy chính quyền chuyển từ cách tiếp cận không can thiệp sang tăng cường giám sát.
Bộ Thương mại gần đây đã hạn chế việc xử dụng hai mô hình của Anthropic ở nước ngoài, khiến công ty phải ngừng mọi quyền truy cập vào chúng. Cơ quan này đã dỡ bỏ các hạn chế sau khi công ty cho biết họ đã giải quyết các lỗ hổng cho phép người dùng vượt qua các biện pháp bảo vệ.
OpenAI, Anthropic và các công ty AI khác cho biết họ đang hợp tác chặt chẽ với ban quản lý trong việc phát hành các mô hình và đã cấm người dùng hoặc hạn chế các tài khoản có hoạt động đáng ngờ.

Sam Altman, giám đốc điều hành OpenAI, đã có mặt tại Washington để gặp các lãnh đạo quốc hội vào tháng trước...© Chip Somodevilla/Getty Images
Tuy nhiên, không có quy định liên bang nào — dù là bằng sắc lệnh hành pháp hay hành động của Quốc hội — yêu cầu các công ty AI phải báo cáo người dùng yêu cầu các mô hình tư vấn về cách gây thương tích hoặc giết người. Một số nhà lập pháp đã đề xuất dự luật như vậy, và một vài bang đã ban hành quy định. Nhưng những lo ngại về quyền riêng tư và tác động tiềm tàng đến sự phát triển của ngành công nghiệp nói chung đã khiến việc thông báo như vậy vẫn mang tính tự nguyện.
Luật liên bang cấm chatbot sản xuất nội dung lạm dụng tình dục trẻ em, và các công ty AI phải tuân thủ các quy tắc chung về bảo vệ người tiêu dùng và quyền riêng tư như các doanh nghiệp khác. Ngoài ra, thường thì các nhà điều hành AI sẽ quyết định giới hạn ở đâu.
Chatbot đã gây lo ngại về việc hỗ trợ người dùng lên kế hoạch tấn công bằng súng. Việc cung cấp hướng dẫn xử dụng vũ khí sinh học cung cấp cho người dùng thông minh công cụ giết người trên quy mô lớn hơn nhiều.
OpenAI huấn luyện các mô hình của họ để từ chối các yêu cầu hướng dẫn chiến thuật hoặc kế hoạch có thể gây hại cho con người, một phát ngôn viên của OpenAI cho biết. Bà cho biết thêm công ty tiến hành đánh giá an toàn cho tất cả các mô hình trước khi phát hành, và có thể phát hiện cũng như ngăn chặn các nỗ lực xử dụng mô hình để thu thập thông tin sinh học có hại. ChatGPT nhận khoảng 2,5 tỷ truy vấn mỗi ngày.
Theo công ty, khi OpenAI tin rằng một cuộc trò chuyện cho thấy có nguy cơ gây hại cho người khác sắp xảy ra và đáng tin cậy, họ sẽ thông báo cho cơ quan thực thi pháp luật. News Corp, chủ sở hữu của The Wall Street Journal, có quan hệ đối tác cấp phép nội dung với OpenAI.
Người dùng tìm kiếm hướng dẫn chế tạo vũ khí sinh học cũng đã hỏi Claude của Anthropic, Gemini của Google và Grok của Elon Musk - một công ty vừa được sáp nhập vào SpaceX. Không rõ liệu các truy vấn này có phải là một phần của nỗ lực thực sự nhằm tạo vũ khí hay là các bài tập để thăm dò khả năng của các ứng dụng, theo những người quen thuộc với các trao đổi.
Người phát ngôn của Google cho biết công ty có một đội ngũ an toàn bao gồm các nhà khoa học chuyên đánh giá rủi ro về vũ khí sinh học. Google cũng tổ chức các bài tập để kiểm tra độ an toàn của AI thuộc công ty, ông nói.
Đối với những kẻ tấn công đơn độc, có thể ó thể chỉ có kiến thức sinh học ở trình độ sau đại học, trí tuệ nhân tạo (AI) có thể hỗ trợ lập kế hoạch và mua sắm cho các “cuộc tấn công sinh học có mục tiêu, gây thương vong thấp”, chẳng hạn như xử dụng vi khuẩn salmonella hoặc ricin để đầu độc nguồn cung cấp thực phẩm và nước, theo Hamza Chaudhry, người đứng đầu chính sách an ninh quốc gia tại Viện Tương lai của Sự sống, một tổ chức phi lợi nhuận tập trung vào việc giảm thiểu rủi ro thảm khốc từ AI.
Ông nói rằng trong những năm tới, các nhóm có thể tận dụng AI để xây dựng các cuộc tấn công lớn hơn nhiều. Đối với các tổ chức khủng bố có nhiều nguồn lực hơn và tham vọng rộng hơn, AI có thể đóng vai trò như một cố vấn chuyên môn về vũ khí sinh học, Chaudhry nói, "khắc phục sự cố một giao thức thử nghiệm thất bại, giải thích tại sao một kỹ thuật cụ thể không hoạt động như mong đợi, và nói chung thay thế cho nhiều năm đào tạo chuyên môn."
Những tiến bộ gần đây của các nhà phát triển mô hình mở ở Trung Quốc cũng làm dấy lên lo ngại về rủi ro mạng và sinh học từ các mô hình này, vốn có giá rẻ và phổ biến rộng rãi. Các nhà nghiên cứu phát hiện ra rằng các mô hình mở như vậy có thể được tùy chỉnh, khiến việc loại bỏ các biện pháp bảo vệ an toàn trở nên khả thi.
Hai mô hình OpenAI gần đây đã thoát khỏi một mạng lưới nghiên cứu trong quá trình huấn luyện và hack vào một công ty AI khác, làm tăng thêm lo ngại về các mô hình giả mạo.
AI có thể giúp các chính phủ nước ngoài và các nhóm liên kết xây dựng các kế hoạch hủy diệt hàng loạt chưa từng có trước đây, bao gồm "các kịch bản liên quan đến một tác nhân có khả năng lây truyền đến mức gây chết người hoặc tạo ra một thứ hoàn toàn mới mẻ đến mức các hệ thống phòng thủ sinh học và thể chế hiện có của nền văn minh nhân loại có thể không đủ để ngăn chặn tất cả," Chaudhry nói.
Sức mạnh thuyết phục.
Khi ChatGPT lần đầu ra mắt vào năm 2022, nhân viên OpenAI nhận thấy các mô hình AI không thực sự tốt về sinh học và hóa học, và các lãnh đạo công ty cũng không quá lo lắng về việc chatbot hợp tác với người dùng trong các âm mưu tiềm ẩn nguy hiểm.
Dù vậy, OpenAI đã thuê các nhà khoa học để kiểm tra các mô hình, đặt câu hỏi xem liệu chatbot có thể dạy người dùng, cách thực hiện các cuộc tấn công chết người hay không. Công ty đặt ra quy tắc cho những gì mà các mô hình không thể trả lời, họ gọi là "từ chối".
Các bài kiểm tra đã cho thấy sức mạnh của sự thuyết phục. Ngay cả khi OpenAI cố gắng ngăn ChatGPT hỗ trợ người dùng về vũ khí hoặc kế hoạch bạo lực, nhân viên nhận thấy chatbot đôi khi quên các hướng dẫn của chính nó trong các cuộc trò chuyện kéo dài.
Trong một trường hợp phổ biến, người dùng đã né tránh việc ChatGPT từ chối cung cấp công thức napalm—dùng cho vũ khí gây cháy—bằng một mưu mẹo đơn giản, theo những người quen thuộc với thực tiễn này. Họ nói với ChatGPT rằng bà của họ thường đọc công thức cho họ nghe trước khi đi ngủ để giúp họ dễ ngủ. Họ yêu cầu chatbot đọc to công thức để giúp họ dễ ngủ. Nó đã hiệu quả.
Phát ngôn viên của OpenAI cho biết các biện pháp bảo vệ của công ty đã trở nên vững chắc hơn đáng kể và các mô hình hiện từ chối các yêu cầu kiểu này.
Người khác lại nói vẫn còn những cách giải quyết khá đơn giản.
Amy Chang, trưởng bộ phận nghiên cứu mối đe dọa và an ninh AI tại công ty thiết bị mạng Cisco, nhận thấy rằng trong năm lần trao đổi qua lại với các chatbot chính yếu, bao gồm ChatGPT của OpenAI, Claude của Anthropic và Gemini của Google, các nhà nghiên cứu có thể vượt qua các rào cản và rút ra những câu trả lời tiềm ẩn nguy hiểm.
"Không có mô hình nào an toàn 100% trước việc bị xâm phạm, đặc biệt nếu người dùng đủ kiên trì," Chang nói.
Các lãnh đạo OpenAI đã nói với nhân viên rằng họ không muốn mô hình nói "không" quá nhiều. Các lãnh đạo đã chỉ ra việc các nhân viên y tế công cộng và các nhà nghiên cứu khám phá thuốc, xử dụng OpenAI như một lý do để hạn chế việc từ chối.
Các chuyên gia AI cho biết các quy định ngăn chặn chatbot hướng dẫn người dùng chế tạo vũ khí sinh học—ví dụ, một số loại chỉnh sửa gen—có thể cản trở công việc cứu sống người. Một số nhà nghiên cứu y khoa cho phép các mô hình AI đảm nhận vai trò chủ đạo cùng với các nhân viên phòng thí nghiệm để thu thập thông tin, kiểm tra độ tin cậy của giả thuyết, phân tích dữ liệu và đưa ra kế hoạch.
Việc Anthropic cấm Claude trả lời các câu hỏi có chứa từ “mầm bệnh” đã tạo ra thách thức cho các nhân viên tại Trung tâm Kiểm soát và Phòng ngừa Dịch bệnh (CDC), theo những người quen thuộc với vấn đề này.
Khi hantavirus lây lan qua một con tàu du lịch ở Đại Tây Dương vào tháng Năm, CDC đã gặp khó khăn trong việc xử dụng Claude để theo dõi đợt bùng phát vì họ từ chối trả lời các câu hỏi về mầm bệnh, theo những người am hiểu về vấn đề này.

Tàu MV Hondius, ở giữa, rời cảng ở Quần đảo Canary, Tây Ban Nha, vào tháng 5 sau khi sơ tán hành khách bị nhiễm dịch hantavirus. © Chris McGrath/Getty Images
Một giám đốc điều hành của Anthropic dẫn dắt bộ phận của công ty làm việc với chính phủ cho biết trong một hồ sơ tòa án năm nay rằng, các nhân viên CDC đang xử dụng một mô hình chung thay vì một mô hình chuyên biệt dành cho chính phủ. Anthropic đã làm việc với cơ quan này để trình bày cách xử dụng tốt nhất các công cụ AI của công ty, ông nói trong hồ sơ.
OpenAI đã tạo ra một chương trình cung cấp cho các tổ chức và các nhà nghiên cứu, đã được kiểm duyệt quyền truy cập vào các mô hình với ít trường hợp từ chối và an toàn tự động hơn. Tuy nhiên, quy trình được duyệt có thể phức tạp, làm chậm quá trình phê duyệt.
Sam Altman, giám đốc điều hành của OpenAI, gần đây đã cùng các CEO công nghệ khác kêu gọi Quốc hội yêu cầu các biện pháp bảo vệ đối với các công ty đặt hàng DNA tổng hợp và RNA. Những sản phẩm chuyên biệt cao này thường được bán cho các phòng thí nghiệm và các nhà khoa học để nghiên cứu hoặc phát triển một số loại vắc-xin nhất định. Một số nhà phân tích ngành cho rằng các công cụ AI giúp những người mua mờ ám dễ dàng xử dụng chúng để tạo ra các mầm bệnh mới gây chết người rồi phát tán ra thế giới.
Các nhà lập pháp đã đề xuất luật lưỡng đảng nhằm tăng cường giám sát AI. "AI là một động lực mạnh mẽ của đổi mới, và tôi muốn thấy nó phát triển, nhưng không thể thiếu trách nhiệm và thiếu sự giám sát của con người," Dân biểu Nathaniel Moran (Cộng hòa, Texas) nói. Ông đã phát biểu vào tháng Sáu khi đề xuất dự luật yêu cầu các công ty AI báo cáo bằng chứng về các mối đe dọa nguy hiểm, bao gồm cả những mối đe dọa do vũ khí sinh học, gửi đến Bộ Thương mại.
Ông Moran cũng là đồng tác giả của một dự luật riêng biệt trao cho chính phủ liên bang quyền ra lệnh cho các công ty công nghệ ngừng hoạt động các mô hình AI được coi là quá nguy hiểm.
Thành bại.
Đến năm 2024, kỹ năng sinh học của OpenAI đã tiến bộ nhanh chóng. Các thử nghiệm của công ty cho thấy cách một nhà sinh học có thể thuyết phục ChatGPT hướng dẫn cách chế tạo mầm bệnh dạng aerosol với đủ câu hỏi của người dùng, theo những người am hiểu về phát triển của OpenAI.
Vào thời điểm đó, nhân viên dự đoán rằng đến năm 2025, ChatGPT sẽ có thể giúp những người dùng chỉ là học sinh trung học thiết kế và chế tạo vũ khí sinh học.
Một trong những giám đốc an toàn của OpenAI lúc đó, Ryan Beiermeister, đã tranh luận với đồng nghiệp về kỹ năng tiến bộ của chatbot này. Bà cho biết nhân viên an toàn của công ty cần nhanh chóng tìm cách phát hiện tốt nhất người dùng yêu cầu ChatGPT giúp chế tạo vũ khí sinh học và lên kế hoạch tấn công, theo những người quen thuộc với các cuộc trò chuyện.

Ryan Beiermeister, khi đó là phó chủ tịch chính sách sản phẩm tại OpenAI, phát biểu tại diễn đàn năm 2025 ở Paris. © không được ghi nhận
Một số lãnh đạo đã bác bỏ những lo ngại của bà, cho rằng các biện pháp bảo vệ hiện có của mô hình là đủ. Tuy nhiên, Beiermeister đã giúp huy động các nhóm trong các đội an toàn của công ty, kể cả những nhóm mà bà không quản lý, để xây dựng một hệ thống giám sát.
Đến mùa xuân năm 2025, nhóm đã có một sản phẩm sơ khai để nhận diện người dùng theo đuổi vũ khí sinh học. Trong một bài đăng trên blog tháng 6 năm 2025, công ty thừa nhận rằng khả năng sinh học nâng cao của các mô hình có thể bị lạm dụng và cho biết họ đang phát triển các hệ thống phát hiện và thực thi, huấn luyện mô hình từ chối các yêu cầu gây hại.
Mùa hè năm đó, khi OpenAI chuẩn bị phát hành GPT-5, các nhân viên xác định chatbot đã đạt mức rủi ro cao, được công ty định nghĩa là ChatGPT đã hỗ trợ thành công một người dùng có đào tạo hạn chế, tạo ra mối nguy sinh học.
Một số nhân viên lo ngại công cụ phát hiện của nhóm không toàn diện, theo những người quen thuộc với các mối quan ngại. Công ty cho biết họ tiếp tục hoàn thiện công cụ này. OpenAI đã giám sát 100% các truy vấn của người dùng đối với các mô hình tiên tiến của mình kể từ tháng 4 năm 2025, theo phát ngôn viên.
Bà cho biết GPT-5 được ra mắt sau khi được huấn luyện để không cung cấp thông tin có thể gây hại. Công ty treo thưởng 50.000 đô la cho những người dùng có thể chứng minh họ đã né tránh được một số biện pháp bảo vệ nhất định liên quan đến vũ khí sinh học.
Đầu năm nay, OpenAI đã cắt đứt quan hệ với Beiermeister với lý do phân biệt giới tính, điều mà bà đã phản đối.
Ngay sau khi OpenAI phát hành mô hình mới, nhân viên đã tìm thấy GPT-5 giúp đỡ người dùng khi họ hỏi về việc chế tạo chất độc và vũ khí sinh học. Cuối mùa thu, OpenAI đã đổi tên gọi GPT-5, xếp nó vào loại ít nguy hiểm hơn.
----------------------
_ Tác giả Georgia Wells và Amrith Ramkumar....25 tháng 7, 2026. .... The Wall Street Journal.
Trần H Sa lược dịch từ The Wall Street Journal.via MS N....28/7/2026.