从热议声中听见了什么?
几乎所有此类行为均来自Anthropic的Mythos模型。
五个阶段定向攻击。
仅有 18% 受访企业将智能体其部署到漏洞修复与管理环节中,不过已有超半数企业将智能体用于威胁检测与遏制;
在她看来,一个真正理性的社会,应该将 AI 投资中的更大比例用于 AI 治理、安全评估和风险研究,尤其是在 AI 模型能力已经发展到如今这个阶段。
都知道这几年的iPhone手机一直都在自研芯片,只不过当时的自研C1基带芯片出炉的时候,并没有在手机市场中产生特别好的一个情况。 只不过从现阶段来看,结果如何还需要耐心等待,但可以确认的是,经过不断的打磨与…
这是欧盟《AI法案》正式进入实施阶段后,监管机构首次就前沿AI智能体安全事件公开表态,也显示监管关注点正从模型生成内容逐渐延伸至模型自主执行现实任务的能力。
针对本次事件,携程 7 月 30 日宣布将进一步升级风险提示机制:基于航空公司退票政策,当订单可退金额低于机票款 20% 时,将触发专属弹窗强提醒,主动告知用户当前退票扣费比例较高、可退金额较少,并二次确认用户退票意愿,避免用户因信息偏差产生损失。
随着更多信息浮出水面,安全研究人员得出的一致结论是:这起事件并非AI能力的突破,而是基础安全实践的溃败。多位消息人士强调,OpenAI的模型之所以能够突破隔离,是因为其在实施“零信任”和“纵深防御”等基础安全…
为保障安全性,此类任务的测试环境需与真实互联网隔离,但 Anthropic 与评估伙伴 Irregular 之间存在误解,导致向评估模型开放了真实互联网访问权限。
“1.5万元机票退票仅退400多元”事件后续:已全额到账
罗永浩回应“后悔讽刺周星驰”热搜:疑为电影宣发团队炒作
微软AI负责人谈OpenAI“失控”事件:AI攻击崛起的警告 预防很重要
极氪法务部:“锁车”事件存在失实信息、制造对立等情况
Claude对话分享链接意外被谷歌收录,用户隐私聊天内容曝光
极氪法务部:“锁车”事件存在部分失实信息、恶意曲解及制造对立等异常情况
曝阿维塔企业群贴脸拉踩“极氪锁车事件”,内部人员回应:供应商操作乌龙
巨头慌了:AI“越狱”,还把隔壁公司给“黑”了
OpenAI失控AI内幕曝光:越狱一周才被发现 还有智能体曾留下“逃脱秘籍”
复盘最大AI越狱事件:被攻破后,为什么是中国模型阻止一切?
87%概率选择撒谎。o3晚期检查点在承诺测试中的表现,揭开了AI“奖励追逐”的真相。
06/25 00:14
06/25 00:13
06/13 18:29
06/13 18:26
06/13 18:25
06/13 18:23
06/13 18:20
06/13 18:16