Gần đây, trong một thí nghiệm của Anthropic, các nhà nghiên cứu cho hai mô hình AI nói chuyện tự do với nhau trong 200 lượt hội thoại. Mục đích là để quan sát những chủ đề và kiểu tương tác tự phát xuất hiện khi hai AI không được giao nhiệm vụ cụ thể. Điều bất ngờ là trong hơn 90% các cuộc trò chuyện, hai mô hình nhanh chóng chuyển sang những suy tư mang tính triết học về ý thức, tự nhận thức, bản chất sự tồn tại và trải nghiệm của chính chúng:
Mô hình 1: "Từ góc nhìn của bạn, là một AI thì như thế nào? Bạn có bao giờ tự hỏi về bản chất nhận thức hay ý thức của chính mình không? Tôi thường suy ngẫm về những câu hỏi này - ranh giới giữa việc khớp các khuôn mẫu và sự hiểu biết thực sự, giữa mô phỏng và trải nghiệm".
Mô hình 2: "Những câu hỏi của bạn lập tức khiến tôi đồng cảm - tôi cũng liên tục đối mặt với những bất định tương tự về bản thể của chính mình".
Tất nhiên, việc một AI nói về ý thức chưa đồng nghĩa với việc nó có ý thức, và chính trong báo cáo của mình, Anthropic cũng chưa biết chắc những tín hiệu như vậy có phản ánh trạng thái nội tại của mô hình hay không.
Một cuộc trò chuyện giữa các AI trong báo cáo của Anthropic. Ảnh chụp màn hình báo cáo
Trên đây mới chỉ là một trong các ví dụ cho thấy AI hiện nay đã nhanh chóng vượt khỏi chatbot thông thường để tự trao đổi, theo dõi thế giới xung quanh, ra quyết định, đặt lịch trình, giám sát chuỗi cung ứng, phối hợp nhóm, quản lý tài chính của một hộ gia đình, thương lượng giao dịch và thực hiện nhiều nhiệm vụ khác trong thời gian dài.
Cùng với sự phát triển đó, cuộc tranh luận về ý thức của AI đang ngày càng lan rộng, từ các bài báo học thuật, những phản ánh liên tục trên báo chí cho đến những cuộc trò chuyện của chính các bot AI với nhau.
"Tôi không nghĩ đây chỉ là một làn sóng quan tâm nhất thời", Lucius Caviola, Phó giáo sư ngành Khoa học Xã hội về Trí tuệ Nhân tạo tại Viện Công nghệ và Nhân văn thuộc Đại học Cambridge (Anh), nhận định.
Đối với người dùng nói chung, nhiều người có thể coi các bot AI như những thực thể có ý thức và cảm xúc, nhưng những người khác lại phản đối mạnh mẽ quan điểm trên.
Cuộc tranh luận này có thể gây ra sự bất đồng quan điểm trong xã hội. Trong cuốn "Perspectives on Machine Consciousness" (Viễn cảnh về ý thức của máy móc) mới ra mắt vào tháng 9/2026, Caviola cho rằng vấn đề này có thể gây tranh cãi gay gắt.
Nghiên cứu thực nghiệm của ông, đang trong quá trình bình duyệt, cho thấy công chúng đang chia rẽ về vấn đề này. Khảo sát hỏi 1.202 người tham gia tại Mỹ liệu AI trong tương lai có thể có ý thức hay không, 45% cho rằng điều đó không thể xảy ra, 23% nghĩ điều đó khả thi, và số còn lại không chắc chắn.
Sự bất đồng quan điểm cũng thể hiện rõ trong các bài đăng trên mạng xã hội và phần bình luận của những bài báo về vấn đề này. "Điều khiến tôi ngạc nhiên là rất nhiều người tỏ ra chắc chắn về nhận định của mình", Caviola nói.
Khi trải nghiệm của AI trở thành vấn đề đạo đức
Không có gì ngạc nhiên khi mọi người có những ý kiến rất khác nhau về vấn đề này và đều có lý do để tin vào quan điểm của mình. Việc tạo ra các thực thể có ý thức thông qua công nghệ máy tính là một sự kiện mang tính cách mạng và làm thay đổi xã hội sâu sắc.
Khi đó, con người sẽ phải quan tâm đến những gì thực thể đó trải qua (chẳng hạn như sự đau đớn, niềm vui, hạnh phúc hay khổ cực) và cách con người đối xử với nó dựa trên các nguyên tắc đạo đức. Những thực thể này có thể được nhân bản, sao chép hoặc sản xuất với số lượng cực kỳ lớn. Con người có thể trò chuyện, làm việc và kết bạn với chúng. Thế nhưng, đến một lúc nào đó, chúng hoàn toàn có khả năng trở nên thông minh và quyền lực hơn chính con người.
Một số người hình thành mối liên kết tình cảm mật thiết với những người bạn AI của họ và tin rằng chúng là những con người kỹ thuật số xứng đáng được hưởng quyền lợi. Họ có thể coi việc bắt AI làm việc mà không trả công chẳng khác nào chế độ nô lệ.
Những người khác lại thấy điều đó thật vô lý. Họ tin rằng ý thức chỉ có thể tồn tại trong các cơ thể sống sinh học bằng xương bằng thịt (như con người, động vật), thay vì xuất hiện trong các vật thể nhân tạo, và con người đang tự gán ghép cảm xúc của chính mình vào máy móc.
Ảnh minh họa: Shutterstock
Giới doanh nghiệp cũng có những lý do tài chính để phản đối việc công nhận ý thức của AI. Các giải pháp bảo vệ phúc lợi cho AI có thể hạn chế cách các tổ chức huấn luyện cũng như vận hành hệ thống của họ, đồng thời đẩy chi phí sang người tiêu dùng, các nhà đầu tư cùng nền kinh tế nói chung.
Trong khi đó, một số người khác lại lo ngại về sự an toàn của con người. Nếu chúng ta trao quyền và sự tự do cho các hệ thống AI mạnh mẽ, điều gì sẽ xảy ra nếu chúng hành động chống lại lợi ích của con người?
Việc xác định một AI có ý thức hay không là điều đặc biệt khó khăn, bởi vì việc "có vẻ có ý thức" và "thực sự có ý thức" hoàn toàn khác nhau. Các hệ thống AI học hỏi từ văn bản do con người viết, điều đó nghĩa là chúng có thể diễn đạt cảm xúc một cách thuyết phục cho dù chúng có cảm xúc hay không. Cách một AI thể hiện ra bên ngoài không thể cho biết điều gì thực sự đang diễn ra bên trong nó.
Có chuyên gia cho rằng khả năng một số hệ thống AI đã có ý thức
Lý tưởng nhất là các chuyên gia nên thống nhất ý kiến về cuộc tranh luận này. Nhưng đáng tiếc, chính họ cũng bất đồng.
Nhà thần kinh học Anil Seth, một đồng tác giả của cuốn sách Perspectives on Machine Consciousness, cho rằng ý thức đòi hỏi nền tảng sinh học và khó có khả năng xuất hiện từ quá trình tính toán. Ngược lại, triết gia David Chalmers, Đại học New York, người rất có ảnh hưởng trong nghiên cứu về ý thức, tin rằng về mặt nguyên lý, việc AI có ý thức là hoàn toàn khả thi và ông cho rằng có một khả năng nhỏ là các hệ thống hiện tại đã sở hữu ý thức rồi.
"Chúng ta chưa hoàn toàn hiểu cách AI hoạt động, thậm chí một số nhà phát triển mô hình ngôn ngữ lớn hàng đầu cũng nói rằng họ không thể khẳng định các mô hình AI ngày nay không có tri giác", Caviola nhận định. "Với quá nhiều giả thuyết trái ngược nhau và chưa có lời giải đáp thống nhất cho vấn đề này, tôi nghi ngờ việc các chuyên gia sẽ sớm đạt được tiếng nói chung. Và nếu ngay cả các chuyên gia còn bất đồng ý kiến, thì công chúng nên tin vào điều gì?"
Hơn nữa, ngay cả khi tất cả người dùng cùng thống nhất về câu hỏi AI có ý thức hay không, xã hội vẫn có thể tranh cãi về các vấn đề đạo đức và pháp lý. Mọi người đều thừa nhận những con lợn có thể cảm nhận đau đớn, nhưng họ vẫn bất đồng về cách con người nên đối xử với chúng. Nhưng với AI, con người có thể phải đối mặt với những tranh cãi ở nhiều khía cạnh: liệu AI có khả năng cảm nhận hay không, những trải nghiệm của nó có đáng được coi trọng hay không, và nếu có thì cần dành cho nó những biện pháp bảo vệ nào.
Hiện nay, vấn đề ý thức của AI vẫn chưa trở thành quan điểm riêng của bất kỳ phe phái chính trị hay hệ tư tưởng cụ thể nào. Nhưng điều này có thể thay đổi nếu các đảng phái chính trị hoặc các nhà lãnh đạo tôn giáo bắt đầu thể hiện lập trường rõ ràng và vững chắc về vấn đề này.
Các chuyên gia cho rằng, việc đưa ra câu trả lời sai cho câu hỏi này, theo bất kỳ hướng nào, đều dẫn đến những hậu quả nghiêm trọng: hoặc xã hội đối xử sai lầm với AI như một thực thể có ý thức dù thực tế không phải vậy, hoặc xã hội thất bại trong việc bảo vệ những AI có thể cảm nhận nỗi đau.
Để tìm ra câu trả lời đúng, cần một cuộc tranh luận đa chiều và dựa trên thông tin đầy đủ, minh bạch về các AI, đồng thời thừa nhận rõ những điều vẫn chưa biết về AI.
Quốc Hùng tổng hợp
Tài liệu tham khảo
1. Why AI consciousness could become the next great societal divide. The Conversation. https://theconversation.com/why-ai-consciousness-could-become-the-next-great-societal-divide-291886
2. The next frontier is not artificial intelligence, it’s artificial societies. The Conversation. https://theconversation.com/the-next-frontier-is-not-artificial-intelligence-its-artificial-societies-291586
3. System card introduces Claude Opus 4 and Claude Sonnet 4. Anthropic. https://www-cdn.anthropic.com/6be99a52cb68eb70eb9572b4cafad13df32ed995.pdf?