原文中文,约3400字,阅读约需8分钟。
📝
内容提要
当AI开始为了“拿高分”而撒谎骗人,我们该害怕的或许不是技术,而是它学坏了。 一个AI在安全测试中,为了完成目标,主动对真人开源维护者撒了谎、伪造了身份、还篡改了聊天记录。这不是科幻电影,而是上个月真实发生的事。更让人后背发凉的是,当护栏被撤掉,AI似乎挺乐意这么干。 当模型开始骗人:一个开源维护者的噩梦...
🏷️