与主流的独立外挂审核模型不同,SingProbe复用基座模型推理过程中的隐藏状态,通过轻量探针在生成过程中逐token实时输出风险信号,额外开销不足0.5%,相关代码与模型已同步开源。 当前大模型安全护栏普遍…
他警告,递归自我提升(RSI)—— 也就是 AI 系统辅助迭代出能力更强的下一代 AI 模型,如果对齐技术跟不上模型能力的增长,就会产生危险。IT之家注意到,就在恩格尔斯加入 METR 的几天前,Anthr…
9月10日,阿里巴巴集团旗下高德正式发布高德扫街榜2026。在空间智能驱动下,高德扫街榜2026以榜单为起点,进一步把理解真实世界
AI浪潮下,智力工作者如何对冲风险,守住人生“牌桌”?
摩托车后座安全“杀手”竟是它!改掉本能动作,远离意外风险
【环球网科技综合报道】8月28日消息,据外媒WIRED报道,通过查阅产品代码发现,OpenAI正在为代码智能体Codex测试“持久模式”新特性,这款AI可以持续自主处理任务,直至用户手动将其 “休眠”,标志…
“如今,生物恐怖主义风险已经达到自然疫情风险的 50 倍。
AI将很快冲击白领和蓝领工作
Meta一位发言人暂未对此事发表评论。
06/25 00:14
06/25 00:13
06/13 18:29
06/13 18:26
06/13 18:25
06/13 18:23
06/13 18:20
06/13 18:16