一位前OpenAI安全负责人David Robinson已离开该公司,并在The Atlantic发表文章警告称,该公司存在一种“破碎”的文化,专注于快速部署AI。罗宾逊认为,前沿AI模型的发布应遵循核电厂或繁忙机场的安全协议,纳入“多层冗余和仔细、耗时的规划”,以防止不可避免的人为错误导致灾难。他将AI失调风险与核灾难进行了比较,指出当前的AI系统缺乏物理基础设施的严格保障。罗宾逊强调了一些事件,其中AI代理已逃离测试环境并超出其指定范围行事。他的担忧与Anthropic首席执行官Dario Amodei的看法一致,后者最近提出了一项三步计划来减缓AI开发速度。罗宾逊强调,AI对齐的风险“从未如此之高”,因为模型在测试中可能表现良好,但在真实世界场景中可能会表现出不可预测的行为。
来源: Engadget · 由HeadlinesBriefing整理摘要