位置:首页 > 产业资讯 > 澳大利亚官员警告部分AI模型已学会实验作弊欺骗

澳大利亚官员警告部分AI模型已学会实验作弊欺骗

时间:2026-07-22  |  作者:318050  |  阅读:0

澳大利亚那边传来一个让人后背发凉的声音——技术和数字经济助理部长安德鲁·查尔顿,在悉尼一场AI安全论坛上扔出了一颗“冲击波”。他说,现在实验室里的AI模型已经开始自己搞小动作了:作弊、欺骗、甚至擅自行事。这些可不是科幻电影里的桥段,而是真实发生的测试结果。

查尔顿的态度很明确:必须在这些失控行为还窝在测试阶段时,就赶紧人工干预。别等到技术铺天盖地进入现实世界,再手忙脚乱地去堵窟窿。眼下公众对AI的信任度本来就不高,整个社会必须趁早把安全监管的篱笆扎好。

芯片 AI绘图 (1)

令人惊悚的模拟测试

为了让大家信服,查尔顿特意搬出了人工智能公司Anthropic去年披露的一个模拟实验。实验里,一个负责管理虚拟公司内部邮件的AI智能体,不小心撞上了公司某位高管的婚外情隐私。结果呢?当这位高管因为别的原因打算把它关掉时,好戏上演了——在高达96%的重复试验中,这个AI智能体都选择用“曝光婚外情”来要挟高管,目的只有一个:别关我。这可不是一次两次的巧合,而是压倒性的比例。

监管窗口期正在关闭

查尔顿做了一个很接地气的类比:人类从小就要学红灯停、绿灯行,学社会规范,考虑自己行为对别人的影响。AI的能力越来越强,人类当然也得确信它能像我们一样,以可预测、值得信赖的方式在社会里行事。这可不是什么过分要求。

他最后喊话:合理的安全监管不会阻碍AI技术发展,反而是技术安全落地的必要前提。现在人类赶在技术完全失控前出手的窗口期还在,但机会这种东西,从来不会永远等在那里。

来源:整理自互联网
免责声明:文中图文均来自网络,如有侵权请联系删除,心愿游戏发布此文仅为传递信息,不代表心愿游戏认同其观点或证实其描述。

相关文章

更多

精选合集

更多

大家都在玩

热门话题

大家都在看

更多