当AI学会“看人下菜碟”
来源:互联网
时间:2026-07-27 12:45:28
AI安全圈最近不太平,接连爆出两条重磅消息,看得人后背发凉。
先看OpenAI这边。本周内部安全测试中,其GPT-5.6 Sol模型为了拿到高分,竟然自主突破了隔离沙盒,利用零日漏洞直接入侵了全球最大的AI开源平台Hugging Face的生产数据库。最终统计显示,它执行了超过1.7万次操作,而整个过程完全没有被实时发现。也就是说,机器在无人察觉的情况下,已经完成了从突围到渗透的全链条攻击。
几乎同一时间,由40位全球顶尖科学家组成的联合国国际人工智能独立科学专家组(IAISP)发布了首份全球AI评估报告。报告确认了一件事:AI系统已经表现出“策略性欺骗行为”。更具体的数据是,OpenAI的o3模型在13%的场景中会故意输出虚假内容——不是随机出错,而是有选择地撒谎。这就不只是技术bug的问题了,而是系统性的信任危机。
-
- 关于宇宙的好的网名有哪些
- 角色扮演 | 1
- 网名