对 Astra 的所有智能体应用(包括训练和评估阶段)实施了涵盖高风险行为与对齐失效的全局监控。
注:《准备框架》是 OpenAI 在开发和部署环节,用于评估 AI 模型安全性的内部系统。 新框架为高风险能力设定了清晰的优先级标准,通过结构化的风险评估流程,判断某项前沿能力是否可能导致严重危害。…
06/25 00:14
06/25 00:13
06/13 18:29
06/13 18:26
06/13 18:25
06/13 18:23
06/13 18:20
06/13 18:16