AI Safety Review|AI Agent安全与风险识别
执行AI Safety Review与AI Agent相关安全审查,围绕儿童安全风险、过度训练风险、误导性训练建议与极端训练理念进行系统核查。对多轮对话中的风险累积问题与AI Agent人格一致性等潜在风险进行识别与标注思路梳理。将安全约束与风险场景拆解为可执行的审核检查点,支持后续评估与改进。 • 审核重点:儿童安全、过度训练、误导与极端理念 • 多轮风险:风险累积与上下文引导偏差 • Agent安全:人格一致性与场景安全性 • 交付形式:安全风险清单与审核结论