We bring together scientists from around the world to reduce extreme risks from Artificial Intelligence.
Sort by
中国前沿人工智能治理的若干考量
Emmie Hine, Zhu Yue, Alex Jumper, Jeff Liu, Ian Read, Saad Siddiqui, Raymond Wang, Li Wenlong, James Zhang, Christoph Winter, Zhou Hui
Read more
Considerations for Frontier AI Governance in China: Adapting Existing Regulatory Infrastructure to Frontier Risk
Emmie Hine, Zhu Yue, Alex Jumper, Jeff Liu, Ian Read, Saad Siddiqui, Raymond Wang, Li Wenlong, James Zhang, Christoph Winter, Zhou Hui
Read more
防范人工智能极端滥用的技术防护措施:当前格局与未来方向
Isabella Duan, Edward Kembery, Stephen Casper, Zhikai Chen, Jasper Götting, Geng Hong, Zaheed Kara, Lijun Li, Xiaojian Li, Kellin Pelrine, Ziyue Wang, Jia Xu, Ziwei Xu, Zhiyuan Zeng, James Zhang, Jie Zhang, Zilan Qian
Read more
Technical Safeguards Against Extreme Misuse of AI: Current Landscape and Future Directions
Isabella Duan, Edward Kembery, Stephen Casper, Zhikai Chen, Jasper Götting, Geng Hong, Zaheed Kara, Lijun Li, Xiaojian Li, Kellin Pelrine, Ziyue Wang, Jia Xu, Ziwei Xu, Zhiyuan Zeng, James Zhang, Jie Zhang
Read more
Position: Preparing for AI Systems That Deceive Developers
Isabella Duan, Xudong Pan, Yawen Duan, Adam Gleave, Ranjie Duan, Yang Zhang, Xiaojian Li, Chaochao Lu, Naying Hu, Soren Mindermann, Dongrui Liu, Jie Fu, Peng Xu, Tianxing He, Xudong Guo, Chen Zheng, Wenqi Chen, Jianfeng Cao, Geng Hong, Jiarun Dai, Yinpeng Dong, Brian Tse, Xia Hu, Min Yang
Read more
人工智能对齐与欺骗: 问题概述
Isabella Duan, Saad Siddiqui, Sören Mindermann, Adam Gleave, Wei Xu, Chaochao Lu, Xudong Pan
Read more
AI Alignment and Deception: A Primer
Isabella Duan, Saad Siddiqui, Sören Mindermann, Adam Gleave, Wei Xu, Chaochao Lu, Xudong Pan
Read more
In Which Areas of Technical AI Safety Could Geopolitical Rivals Cooperate?
Ben Bucknall, Saad Siddiqui, Lara Thurnherr, Conor McGurk, Ben Harack, Anka Reuel, Patricia Paskov, Casey Mahoney, Sören Mindermann, Scott Singer, Vinay Hiremath, Charbel-Raphaël Segerie, Oscar Delaney, Alessandro Abate, Fazl Barez, Michael K. Cohen, Philip Torr, Ferenc Huszár, Anisoara Calinescu, Gabriel Davis Jones, Yoshua Bengio, Robert Trager
Read more
Bare Minimum Mitigations for Autonomous AI Development
Joshua Clymer, Isabella Duan, Chris Cundy, Yawen Duan, Fynn Heide, Chaochao Lu, Sören Mindermann, Conor McGurk, Xudong Pan, Saad Siddiqui, Jingren Wang, Min Yang, Xianyuan Zhan
Read more
Promising Topics for US–China Dialogues on AI Safety and Governance
Saad Siddiqui, Kristy Loke, Stephen Clare, Marianne Lu, Aris Richardson, Lujain Ibrahim, Conor McGlynn, Jeffrey Ding
Read more