
Jonah McKeown của tạp chí National Catholic Register ngày 7 tháng 10 năm 2026 đăng tải bài phỏng vấn của ông với Charles Camosy, một nhà thần học Công Giáo, từng chia sẻ trải nghiệm của ông khi tham gia các cuộc họp với Anthropic – những cuộc họp được tổ chức nhằm định hình khía cạnh đạo đức cho các hệ thống AI mạnh mẽ của công ty này.
Theo một bài báo gần đây trên tờ The New York Times, Anthropic – “gã khổng lồ” trong lĩnh vực trí tuệ nhân tạo (AI) – đã dành phần lớn thời gian trong năm nay để tham vấn ý kiến từ nhiều nhà lãnh đạo tôn giáo (bao gồm người Do Thái, người theo đạo Sikh và người Công Giáo) về các vấn đề liên quan đến “thiện tính” và đạo đức.
Mục tiêu của các cuộc họp này, về mặt lý thuyết, là giúp Anthropic tìm cách áp dụng “túi khôn đạo đức tích lũy qua hàng thế kỷ của nhân loại” vào các mô hình và sản phẩm AI của mình. Anthropic cho rằng các mô hình AI này không thể bị ép buộc phải hành xử theo chuẩn mực đạo đức, mà thay vào đó, chúng cần được “dạy” cách thực hiện điều đó. Các cuộc thảo luận diễn ra trong bối cảnh nhiều lo ngại – bao gồm cả những lo ngại từ chính đại diện của Anthropic – rằng một ngày nào đó AI có thể vượt qua trí tuệ con người và thoát khỏi sự kiểm soát của nhân loại.
Ngoài ra, các lãnh đạo của Anthropic cũng tỏ ra rất quan tâm đến việc thảo luận liệu AI có bao giờ đạt được ý thức hay không, mặc dù vẫn tồn tại những bất đồng gay gắt về vấn đề này. Tờ The New York Times đưa tin rằng ông Chris Olah, đồng sáng lập Anthropic, suýt nữa đã hủy bỏ kế hoạch xuất hiện cùng Giáo hoàng Leo XIV tại Vatican trong sự kiện ra mắt văn kiện Magnifica Humanitas (do văn kiện này bác bỏ mạnh mẽ khả năng AI có ý thức), tuy nhiên cuối cùng ông vẫn tham dự sự kiện.
Tờ The Register đã có cuộc trao đổi với ông Charles Camosy, một nhà thần học chuyên về đạo đức học kiêm giáo sư tại Đại học Công Giáo Hoa Kỳ (The Catholic University of America), về trải nghiệm của ông khi tham gia các cuộc họp với Anthropic. Dưới đây là các câu trả lời của ông Camosy, đã được biên tập lại đôi chút để đảm bảo độ súc tích và rõ ràng.
Ông có thể chia sẻ về nội dung các cuộc họp với Anthropic không — chẳng hạn như những điểm đáng chú ý trong các cuộc thảo luận, những bước đột phá hoặc những khoảnh khắc nhận thức sâu sắc mà ông thấy đáng để chia sẻ?
Cuộc gặp diễn ra theo Quy tắc Chatham House, vì vậy, theo hiểu biết của tôi, tôi không thể tiết lộ những chi tiết cụ thể do một cá nhân nào đó chia sẻ trong nhóm — nhưng tôi có thể chia sẻ những ấn tượng chung và các ý tưởng lớn, mang tính bao quát.
Điều đầu tiên tôi muốn nói là hai cuộc họp mà tôi được mời tham dự có sự góp mặt của những người rất sùng đạo. Đã có rất nhiều lời cầu nguyện và các cuộc thảo luận sâu sắc về thần học. Có lúc, tôi thậm chí còn đề cập đến việc “Chiến thắng của Thập giá” sẽ mang hình hài ra sao khi đặt trong bối cảnh những thách thức mà chúng ta đang đối diện với trí tuệ nhân tạo (AI) — và ý kiến này đã nhận được phản hồi tích cực từ một thành viên trong ban lãnh đạo của Anthropic.
Điều thứ hai là, mặc dù Anthropic là bên chủ động trình bày trước chúng tôi — điều mà thú thật là tôi thấy hơi bất tiện, vì chúng tôi cũng có rất nhiều điều muốn trình bày với họ — nhưng vẫn có nhiều cuộc tranh luận và thảo luận đầy thiện chí xoay quanh các ý tưởng được đưa ra.
Bản chất của các thỏa thuận không tiết lộ thông tin (NDA) mà người tham gia đã ký là gì? Chính xác thì chúng hạn chế quý vị chia sẻ điều gì và tại sao?
Thú thật là giờ tôi không nhớ rõ mọi chi tiết. Tôi chỉ nhớ rằng mình cảm thấy các quy tắc đó được đặt ra nhằm bảo vệ chúng tôi cũng nhiều như bảo vệ Anthropic vậy.
Mục đích không phải là giữ bí mật về việc cuộc họp đã diễn ra, mà là để bảo vệ sự trung thực và tính chân thực của những cuộc thảo luận đôi khi rất gay gắt mà chúng tôi sắp thực hiện. Tôi nghĩ quy tắc này cũng nhằm đảm bảo rằng các tài liệu và nghiên cứu chưa được công bố sẽ không bị tiết lộ trước khi Anthropic quyết định rằng chúng đã sẵn sàng để công bố rộng rãi.
Trong các cuộc thảo luận công khai, người ta chú trọng nhiều đến sự "chân thành" của Anthropic khi tìm kiếm sự khôn ngoan từ các truyền thống đức tin khác nhau; họ cho rằng đây là nỗ lực nhằm giúp cuộc cách mạng AI diễn ra theo hướng tích cực. Xét đến những khoản tiền khổng lồ đang bị đặt cuộc và các vấn đề địa chính trị khác — chẳng hạn như mong muốn của giới lãnh đạo Hoa Kỳ trong việc vượt qua Trung Quốc ở điều gọi là cuộc đua AI — thì hiện tại, quý vị đánh giá thế nào về sự chân thành của Anthropic? Người Công Giáo nên tiếp tục coi Anthropic là một đối tác đối thoại thiện chí đến mức độ nào?
Tôi hoàn toàn không thể thay mặt công ty lớn để nói về suy nghĩ hay mục tiêu mà họ đang hướng tới. Có thể một số lãnh đạo tại Anthropic đã có những động cơ thiếu thiện chí hoặc mờ ám đằng sau cách họ tiếp cận các sự kiện này, nhưng cũng hoàn toàn có khả năng là không phải như vậy. Tôi không biết chắc.
Tôi chỉ biết rằng hai hoặc ba người mà tôi hợp tác chặt chẽ tỏ ra rất chân thành; họ hoàn toàn không cố gắng ép buộc hay gây áp lực để chúng tôi phải chấp nhận một lập trường cụ thể nào đó. Thực tế, một mục tiêu mà tôi nhận thấy trong suốt quá trình xây dựng mối quan hệ này là họ — vì lường trước khả năng xảy ra những bất đồng lớn — muốn đảm bảo rằng những bất đồng đó không làm ảnh hưởng đến các điểm chung hoặc những quan điểm mà hai bên cùng đồng thuận.
Tôi nghĩ nhiều người trong chúng tôi đều đồng ý rằng cả cộng đồng Ki-tô giáo và các phòng nghiên cứu AI đều cần tham gia vào việc giải quyết những vấn đề nan giải và phức tạp mà chúng ta đang đối diện. Chúng tôi không muốn những bất đồng kiểu này cản trở nỗ lực tìm kiếm giải pháp cho các vấn đề đó.
Khi Chris Olah và những người khác tại Anthropic phát biểu trong các cuộc họp về mong muốn tìm cách "định hình đạo đức" cho các mô hình AI của họ, ông đã phản hồi như thế nào trước loại hội họp này đề cập đến sự "đào tạo" các trí tuệ không có sự sống?
Thú thật, tôi vẫn chưa biết nên nghĩ gì về điều này. Tôi cho rằng đó là một ý tưởng rất đáng lưu ý— và thậm chí có thể rất hữu ích — miễn là chúng ta xác định rõ rằng mình đang nói về loại suy.
AI không phải là con người và không thể có phẩm chất đạo đức hay thiếu hụt đạo đức. Việc nghiêng về ý tưởng coi AI là một con người là điều rất tai hại vì nhiều lý do. Tuy nhiên, thật tốt khi các hệ thống như Claude, ChatGPT, Grok... — theo một nghĩa loại suy nào đó — lại trung thực, cẩn trọng, hào phóng, tôn trọng giá trị sự sống con người, v.v. Và cũng thật tốt, ít nhất là về mặt nguyên tắc, khi một số bên đang nỗ lực "đào tạo" hoặc "căn chỉnh [align]" các mô hình ngôn ngữ lớn (LLM) của họ dựa trên sự khôn ngoan từ các truyền thống thần học và triết học của Giáo hội.
Tôi vẫn chưa chắc làm thế nào ban lãnh đạo các công ty AI này có thể chắt lọc tất cả những phản hồi về đạo đức — từ các truyền thống tôn giáo khác nhau, từ các triết gia mà họ thuê, và từ chính những cam kết sâu sắc của họ — thành một hệ thống đạo đức nhất quán. Có thể sẽ xuất hiện một sự đồng thuận chung nào đó được diễn giải rõ ràng, và điều đó sẽ rất tốt; tuy nhiên, sự đa dạng to lớn về quan điểm đạo đức lại đặt ra một thách thức quen thuộc đối với những ai trong chúng ta từng suy tư về đạo đức trong các bối cảnh đa dạng ở những lĩnh vực khác.
Về sự khác biệt quan điểm giữa Anthropic và Đức Giáo Hoàng Leo liên quan đến vấn đề ý thức của AI — liệu ông có nghĩ rằng Chris Olah hay bất cứ ai khác tại Anthropic đã bị lay chuyển bởi lập trường kiên định của Đức Giáo Hoàng Leo (và rộng hơn là của Giáo hội) về vấn đề này, cụ thể là việc AI không thể có linh hồn?
Thú thật, tôi không biết quan điểm hiện tại của họ về những vấn đề này ra sao. Nhưng nếu phải đoán, tôi cho rằng quan điểm của họ về vị thế đạo đức của Claude sẽ không bị ảnh hưởng nhiều bởi những gì Giáo hội nói. Và ngược lại: Đã có những cuộc thảo luận về việc các tập đoàn AI lớn và "xấu xa" thao túng những người sùng đạo ngây thơ, nhưng ít nhất là trong giới của tôi, điều đó đã không xảy ra. Thật đáng mừng là bất chấp những khác biệt khá rõ rệt này, vẫn có nhiều lĩnh vực khác mà chúng ta có thể và cần phải hợp tác vì lợi ích chung. Đặc biệt là khi nói đến các rủi ro thảm khốc hoặc rủi ro đe dọa sự tồn vong của nhân loại.
Tôi muốn nói rằng chúng ta không và không được phép chỉ giới hạn bản thân ở Anthropic trong vấn đề này. Gần đây, tôi đã tham gia tổ chức một sự kiện cùng ban lãnh đạo các giám mục Hoa Kỳ, nơi họ có dịp trao đổi với đại diện từ các phòng thí nghiệm tiên phong trong lĩnh vực này. Các vị khách mời tỏ ra rất hào hứng nhưng cũng có phần lo lắng trước bầu không khí trang trọng và đầy sức nặng bao trùm cuộc họp—một cuộc họp tập trung một phần vào việc ứng phó với nguy cơ xảy ra các sự kiện thảm khốc hoặc đe dọa hiện sinh. Gần đây, tôi cũng được Google DeepMind và OpenAI mời thuyết trình về Magnifica Humanitas (Phẩm giá cao quý của con người). Vì vậy, trong giới của tôi đang có rất nhiều sự hào hứng về các mối quan hệ và những cuộc đối thoại rộng mở hơn với "các phòng thí nghiệm" này nói chung.
Ông từng chia sẻ với tờ The New York Times rằng việc tìm hiểu cách thức hoạt động của các hệ thống AI đã mang lại cho ông những hiểu biết mới mẻ, thậm chí làm thay đổi tư duy của ông theo một số khía cạnh. Ông có thể nói rõ hơn về điều này không?
Ban đầu, tôi nghĩ rằng các mô hình ngôn ngữ lớn (LLM) trong yếu tính chỉ là những hệ thống dự đoán "chữ tiếp theo" hoặc "điểm ảnh [pixel] tiếp theo" một cách cực kỳ tinh vi. Tuy nhiên, sau khi tìm hiểu, tôi nhận thấy những gì đang diễn ra với các mô hình tiên tiến nhất lại phức tạp hơn nhiều, thậm chí còn mang đầy vẻ bí ẩn.
Xét về mặt siêu hình, chúng ta biết rằng chúng không có ý thức và không phải là con người. Đức Giáo Hoàng Leo và thông điệp của ngài đã khẳng định rõ ràng điều đó. Nhưng sự rõ ràng ấy hoàn toàn có thể song hành với việc thừa nhận—cùng với nhiều chuyên gia đang đi đầu trong lĩnh vực nghiên cứu này—rằng chúng ta thực sự không biết chính xác mình đang tạo ra thứ gì và nó đang vận hành ra sao. Và chỉ riêng điều này thôi cũng đã là một vấn đề đáng để chúng ta đặc biệt quan tâm và lo ngại.