An Anthropic safety researcher, Evan Hubinger, warns that AI could pose an existential threat, saying he personally believes there is more than a 10% chance AI could kill all humans within the next decade. Another Anthropic researcher, Jacob Cocksedge, resigned, accusing AI labs of racing toward superintelligence without adequate safeguards. Hubinger says current AI models pose a low risk, but he worries about future systems that could improve themselves and become hard for humans to control. The host turns to Washington Post AI reporter Garrett Devink to ask whether these headlines are overblown or contain some truth. Devink notes that concern about AI becoming smarter than us is not new in the industry. He adds that the warnings are consequential because Anthropic is a leading AI company making the most powerful AI right now.
Một nhà nghiên cứu an toàn của Anthropic, Evan Hubinger, cảnh báo rằng AI có thể là mối đe dọa hiện hữu, nói rằng cá nhân ông tin có hơn 10% khả năng AI có thể giết chết tất cả loài người trong thập kỷ tới. Một nhà nghiên cứu khác của Anthropic, Jacob Cocksedge, đã từ chức, cáo buộc các phòng thí nghiệm AI đang chạy đua tới siêu trí tuệ mà không có biện pháp bảo vệ đầy đủ. Hubinger nói các mô hình AI hiện tại gây rủi ro thấp, nhưng ông lo ngại về các hệ thống tương lai có thể tự cải thiện và trở nên khó kiểm soát đối với con người. Người dẫn chương trình chuyển sang phóng viên AI của Washington Post, Garrett Devink, để hỏi liệu những tiêu đề này có bị thổi phồng hay có phần sự thật. Devink lưu ý rằng mối lo ngại về việc AI trở nên thông minh hơn chúng ta không phải là mới trong ngành. Ông nói thêm rằng những cảnh báo này có hệ quả quan trọng vì Anthropic là một công ty AI hàng đầu đang tạo ra AI mạnh mẽ nhất hiện nay.
An Anthropic researcher warns artificial intelligence could pose an existential threat to humanity.
Một nhà nghiên cứu của Anthropic cảnh báo trí tuệ nhân tạo có thể là mối đe dọa hiện hữu đối với nhân loại.
Anthropic safety researcher Evan Hubinger says he personally believes there's more than a 10% chance that AI could kill all humans within the next decade.
Nhà nghiên cứu an toàn của Anthropic, Evan Hubinger, nói rằng cá nhân ông tin có hơn 10% khả năng AI có thể giết chết toàn bộ loài người trong thập kỷ tới.
This warning comes after another Anthropic researcher, Jacob Cocksedge, resigned accusing AI labs of racing towards superintelligence
Cảnh báo này được đưa ra sau khi một nhà nghiên cứu khác của Anthropic, Jacob Cocksedge, từ chức với cáo buộc các phòng thí nghiệm AI đang chạy đua hướng tới siêu trí tuệ
without adequate safeguards.
Mà không có biện pháp bảo vệ đầy đủ.
Mr.
Ông
Hubinger says current AI models pose a low risk, but he is concerned about the future systems that could improve themselves and then become pretty difficult for humans to control.
Hubinger nói rằng các mô hình AI hiện tại chỉ gây rủi ro thấp, nhưng ông lo ngại về các hệ thống trong tương lai có thể tự cải thiện và sau đó trở nên khá khó kiểm soát đối với con người.
Live now to Washington Post AI reporter Garrett Devink.
Đang phát trực tiếp với phóng viên AI của Washington Post, Garrett Devink.
Garrett, okay.
Garrett, được thôi.
A lot of people hearing these headlines, they're wondering if they're overblown or if there perhaps could be some truth to them.
Nhiều người khi nghe những tiêu đề này đang tự hỏi liệu chúng có bị thổi phồng hay có thể có chút sự thật nào đó.
What say you?
Anh nghĩ sao?
- Yeah, I mean it's it's something that a lot of people in the AI industry have been talking about for a long time.
- Ừ, ý tôi là đây là điều mà rất nhiều người trong ngành AI đã nói đến từ lâu.
I mean it's not necessarily a new thing for people who know a lot about AI to be concerned about it getting to a point where it's smarter than us and therefore being hard to control.
Ý tôi là việc những người hiểu biết nhiều về AI lo ngại nó đạt đến mức thông minh hơn chúng ta và do đó khó kiểm soát không hẳn là điều mới mẻ.
I think it's definitely consequential because obviously Anthropic is the leading AI company.
Tôi nghĩ điều này chắc chắn có ý nghĩa quan trọng vì rõ ràng Anthropic là công ty AI hàng đầu.
They are the ones making the most consequential and most powerful AI right now.
Họ là những người hiện đang tạo ra AI có sức ảnh hưởng và mạnh mẽ nhất.
And I think you're starting to see that tension where people inside these companies think, "Okay, well, we're working on it.
Và tôi nghĩ anh bắt đầu thấy căng thẳng đó khi những người bên trong các công ty này nghĩ: "Được rồi, chúng ta đang làm việc đó.
We're going to try to make sure that it doesn't cause harm, but we're not sure we're capable of that and even though a lot of these people stand to make millions and millions of
Chúng ta sẽ cố gắng đảm bảo nó không gây hại, nhưng chúng ta không chắc mình có khả năng làm được điều đó, và dù nhiều người trong số này có thể kiếm được hàng triệu hàng triệu