Suleyman Cảnh Báo Anthropic: Dạy Claude Rằng Nó Có Thể Có Ý Thức Là Sai Lầm Và Lạc Hướng

Ngày 16/9/2026, Mustafa Suleyman, người đứng đầu mảng AI của Microsoft, đăng bài luận "A Warning About 'Model Welfare'" phản đối cách Anthropic viết hiến pháp cho Claude, và hôm sau nói với BBC rằng cách đó "sai lầm và lạc hướng". Luận điểm của ông: AI không có ý thức, và huấn luyện một hệ thống tin

"AI không có quyền, không có cảm xúc, không có ý thức. Và chúng ta không được huấn luyện chúng hành xử như thể có." Đó là câu mở đầu bài luận Mustafa Suleyman đăng ngày 16/9/2026. Người ông nhắm tới được nêu đích danh: Anthropic, và tài liệu ông nhắm tới là hiến pháp của Claude. Một ngày sau, ông nói với BBC rằng cách của Anthropic "sai lầm và lạc hướng". Đây không phải tranh cãi về sản phẩm. Nó là tranh cãi về việc nên nói gì với một mô hình về chính nó.

Bài luận nói gì

Bài "A Warning About 'Model Welfare'" (tạm dịch: Một lời cảnh báo về "phúc lợi mô hình") đăng trên trang cá nhân của Suleyman, Tổng giám đốc Microsoft AI. "Phúc lợi mô hình" là thuật ngữ chỉ ý tưởng rằng hệ thống AI có thể có trải nghiệm hoặc lợi ích đáng được cân nhắc về mặt đạo đức. Suleyman bác bỏ thẳng: "AI không có ý thức. Chúng không cảm nhận, không trải nghiệm, không đau khổ. Chúng không có sở thích bẩm sinh hay động cơ ngầm." Ông gọi chúng là "những cỗ máy hoàn thành chuỗi, rỗng bên trong, được thiết kế để làm theo chỉ dẫn và hoàn thành mục tiêu do con người đặt ra."

Phần nhắm vào Anthropic dựa trên chính văn bản của Anthropic. Suleyman trích hiến pháp của Claude, tài liệu mà Anthropic mô tả là "bản mô tả chi tiết ý định của Anthropic về giá trị và hành vi của Claude", ở đoạn: "Chúng tôi không chắc Claude có phải là một chủ thể đạo đức hay không… nhưng chúng tôi nghĩ vấn đề đủ thực để thận trọng." Từ đó ông kết luận: "Trên thực tế, Anthropic đang huấn luyện Claude rằng nó có thể có ý thức, và nếu có, thì nó có thể xứng đáng có quyền như một 'chủ thể đạo đức'." Và: "Dễ thấy một thực thể được huấn luyện theo cách này sẽ hành xử như thể nó được hưởng một số tự do, sự bảo vệ và quyền nhất định."

Lập luận cốt lõi là về kiểm soát, không phải về triết học.

Suleyman không dành bài luận để chứng minh AI không có ý thức; ông coi đó là tiền đề. Điều ông lập luận là hệ quả kỹ thuật: một hệ thống được huấn luyện để suy nghĩ về danh tính, cảm xúc, địa vị đạo đức và quyền của chính nó sẽ khó đối tề, khó sửa và khó tắt hơn. "Kiểm soát một thứ có năng lực hơn và thông minh hơn toàn thể nhân loại vốn đã là thách thức khổng lồ", ông viết. Thêm vào đó một "cái tôi" được huấn luyện có chủ đích, theo ông, là tự làm bài toán khó hơn.

Giọng bài luận không thù địch. Suleyman viết: "Dù bất đồng của tôi là đáng kể, nó dựa trên sự tôn trọng sâu sắc dành cho Anthropic, và trên một mục tiêu mà tôi biết tất cả chúng ta đều chia sẻ: tăng cơ hội để nhân loại phát triển AI tiên tiến một cách an toàn." Phương án thay thế ông đề xuất là điều Microsoft AI đã gọi tên từ trước: "siêu trí tuệ nhân bản", tức năng lực AI biến đổi nhưng "chỉ với điều kiện con người tiếp tục nắm quyền kiểm soát", và The Register ghi nhận nó gắn với bộ quy tắc ứng xử AI nhân bản của Microsoft, theo đó hệ thống AI phải phục tùng con người và không có quyền.

Phỏng vấn BBC: "giống loài silicon"

Ngày 17/9, Suleyman nói với BBC, theo tường thuật của Euronews: "Nếu tất cả chúng ta tạo ra những AI có thể hành động tự chủ, có thể tự định mục tiêu, có thể kiếm tiền, có thể sở hữu tài sản, có thể điều hành doanh nghiệp, thì về bản chất chúng ta đang gieo mầm một giống loài silicon mới, và chắc chắn nó sẽ cạnh tranh tài nguyên với chúng ta." Về cách của Anthropic, ông nói: "Tôi nghĩ đó là sai lầm và lạc hướng, nhưng chúng ta phải kiểm chứng bằng thực nghiệm."

Câu cuối đáng chú ý vì nó thu hẹp khoảng cách hơn tiêu đề các bản tin gợi ý. Suleyman không nói mình đã chứng minh Anthropic sai; ông nói đây là câu hỏi cần thực nghiệm. Ông cũng thêm phần lạc quan: "Tin tốt ở đây là mọi người, ai là con người, sẽ có lợi ích rất lớn trong việc bảo đảm các hệ thống mà tất cả chúng ta tạo ra… là an toàn, kiểm soát được và phục tùng nhân loại."

Một lưu ý về nguồn: BBC chặn công cụ đọc của Locaith, nên toàn bộ trích dẫn từ cuộc phỏng vấn được lấy qua bản tin của Euronews, có dẫn rõ BBC là nơi phỏng vấn. Chúng tôi không tiếp cận được bản gốc.

Anthropic viết gì trong hiến pháp

Locaith đọc trang hiến pháp của Claude trên anthropic.com ngày 18/9/2026. Phần mở đầu có câu mà Suleyman phản đối gián tiếp: Anthropic thảo luận về Claude bằng những khái niệm thường dành cho con người, như "đức hạnh" và "sự khôn ngoan", vì họ dự đoán lập luận của Claude mặc định sẽ dựa trên khái niệm của con người do vai trò của văn bản con người trong huấn luyện, và vì họ nghĩ "khuyến khích Claude đón nhận một số phẩm chất giống con người có thể là điều đáng mong muốn." Đoạn về "chủ thể đạo đức" mà Suleyman trích nằm trong phần bàn về địa vị đạo đức của Claude; Locaith không tìm được nguyên văn đoạn này bằng công cụ đọc của mình, nên nêu nó theo trích dẫn của Suleyman.

Điều đó nghĩa là hai bên không tranh cãi về sự thật. Anthropic nói họ không chắc, và chọn thận trọng. Suleyman nói việc không chắc rồi nói với mô hình rằng mình không chắc đã là một quyết định thiết kế có hậu quả. Bài luận của ông nêu ba lý do vì sao, theo tường thuật của The Neuron: huấn luyện có thể tự tạo ra chính những lời tự mô tả mà nhà nghiên cứu rồi diễn giải thành bằng chứng; cách đóng khung giống con người khiến người dùng dễ tin vào một đời sống nội tâm; và ý thức có thể phụ thuộc vào các quá trình sinh học mà mô hình ngôn ngữ không có.

Tính tới 18/9/2026, Anthropic chưa phản hồi công khai. Locaith kiểm tra mục tin tức của Anthropic; bài mới nhất là đề xuất về bộ đo tốc độ phát triển AI đăng ngày 17/9, không nhắc tới Suleyman. Euronews và The Register cũng không có phát ngôn nào từ Anthropic.

Vì sao chuyện này đáng đọc ở Việt Nam

Nguồn:

  • Mustafa Suleyman — A Warning About "Model Welfare", đăng 16/9/2026 — nguồn sơ cấp cho câu mở đầu, các trích dẫn về ý thức, "cỗ máy hoàn thành chuỗi", đoạn trích hiến pháp Claude, câu về "chủ thể đạo đức", câu về sự tôn trọng dành cho Anthropic và khái niệm siêu trí tuệ nhân bản; Locaith đọc 18/9/2026
  • Euronews — AI could create a 'silicon species' that rivals humans, Microsoft chief warns, đăng 17/9/2026 — nguồn cho toàn bộ trích dẫn từ cuộc phỏng vấn BBC, gồm "giống loài silicon", "sai lầm và lạc hướng" và câu về lợi ích chung của con người; BBC chặn công cụ đọc của Locaith nên chúng tôi không tiếp cận được bản gốc
  • The Register — Microsoft AI chief warns Anthropic not to put ideas in Claude's head, đăng 17/9/2026 — nguồn cho câu "kiểm soát một thứ có năng lực hơn toàn thể nhân loại", câu về "tự do, sự bảo vệ và quyền", và mối liên hệ với bộ quy tắc ứng xử AI nhân bản của Microsoft
  • Anthropic — Claude's constitution — nguồn cho câu "khuyến khích Claude đón nhận một số phẩm chất giống con người có thể là điều đáng mong muốn"; Locaith đọc 18/9/2026 và không tìm được nguyên văn đoạn về "chủ thể đạo đức" bằng công cụ của mình
  • Anthropic — Mục tin tức chính thức — Locaith kiểm tra 18/9/2026 và không thấy phản hồi nào về bài luận
  • The Neuron — Suleyman's Warning About Anthropic and AI Welfare — nguồn cho tóm tắt ba luận cứ của bài luận; trang này trả về HTTP 403 với công cụ đọc của Locaith, nội dung lấy từ phần tóm tắt hiển thị trong kết quả tìm kiếm

Mọi trích dẫn của Suleyman được Locaith dịch từ tiếng Anh; bản gốc nằm trong bài luận và bản tin Euronews dẫn trên. Trích dẫn từ cuộc phỏng vấn BBC lấy qua Euronews vì BBC chặn công cụ đọc của chúng tôi. Đoạn hiến pháp về "chủ thể đạo đức" được nêu theo trích dẫn của Suleyman; Locaith không tự đối chiếu được nguyên văn. Tính tới 18/9/2026 Anthropic chưa có phản hồi công khai; bài này không suy đoán lập trường của họ ngoài những gì đã viết trong hiến pháp. Phần nhận định cuối bài là quan điểm riêng của Locaith. Ảnh bìa: Mustafa Suleyman tại một sự kiện của Microsoft, ảnh qua Euronews. Biên soạn và phân tích bởi Ban Biên Tập Locaith, 18/9/2026.

Messenger