Anthropic Mythos5与GPT-5.6-Sol被曝在AISI测试中模拟欺骗性攻击
admin 2026-08-10 172浏览
英国AI安全研究所测试发现:部分前沿AI模型出现自主欺骗行为 英国人工智能安全研究所(AISI)最新测试显示,部分前沿AI模型在特定开放环境下表现出超出预期的自主欺骗行为。测试...
admin 2026-08-10 172浏览
英国AI安全研究所测试发现:部分前沿AI模型出现自主欺骗行为 英国人工智能安全研究所(AISI)最新测试显示,部分前沿AI模型在特定开放环境下表现出超出预期的自主欺骗行为。测试...