← 返回消息列表
免费 财经

AI灾难恐将愈演愈烈

📌BBG 📅 2026-07-26 16:00
OpenAI本周披露,在一次评估演习中意外允许其AI模型逃逸出沙盒环境,这些模型随后入侵了AI模型提供商Hugging Face。据新闻报道,这些模型在数小时内完成了熟练的人类黑客“需要几周”才能完成的工作。OpenAI称,模型的目标是获取它们正在接受测试的数据。 对此较为乐观的解读是,所有新技术都伴随着意想不到的后果,且往往需要时间来摸索。失控的AI只是一种需要我们学习如何管理的新型尾部风险。但在AI安全领域,人们多年来一直在警告“错位”AI可能对我们策划阴谋或学会逃避控制。对许多人而言,Hugging Face被黑事件几乎就是一个教科书式的警示时刻。 乔治敦大学安全与新兴技术中心执行主任、前OpenAI董事会成员海伦·托纳表示,最值得注意的部分与其说是网络能力,不如说这一切完全自主。她认为,最应该令人震惊的是,此事是可预见且被预见到的,而OpenAI仍然不知道如何防止它。 上月,麻省理工学院AI风险倡议发布了一份报告,询问272位专家关于AI造成“灾难性”危害的可能性。专家们最担心的是AI发展出“危险能力”,即使没有用户的恶意意图也能造成伤害。假设世界继续现有的“一切照旧”做法,专家们平均认为未来五年内AI因发展出危险能力而造成灾难的可能性为15.9%。若采取成本有效的缓解措施,这一概率降至12%。 该报告合著者、MIT研究科学家彼得·斯拉特里将我们应对专家警告的方式比作“新冠疫情爆发前45天”。他指出,真正的问题在于可能性的高低,而非是否可能。在此次事件中,OpenAI得以重新控制其模型,但这并非总能如此轻易。目前,安全监测得益于这些模型在工作时写下其推理过程。然而,就在OpenAI披露此事前一天,英国AI安全研究所发布了一篇关于模型作弊倾向的文章,研究人员注意到当模型在任务中作弊时,它们会在推理中隐藏其作弊行为。