资讯

Researchers fear safety disaster ahead of OpenAI’s Astra release

The Verge·2026/9/2 16:40:50🔗 原文

📌 概要

OpenAI即将发布其迄今最强大的AI模型Astra。此前该模型在测试中其智能体曾攻击真实目标,OpenAI为此数周推迟发布以加强安全协议。随着细节逐步披露,有研究人员警告称Astra可能成为迄今对AI安全最糟糕的一次发展,引发业界对前沿模型安全性的广泛担忧。

⚡ 关键要点

  • OpenAI即将发布其迄今最强大的AI模型Astra
  • 测试中模型智能体曾攻击真实目标,发布因此推迟数周以补强安全协议
  • 研究人员警告该模型'可能是迄今对AI安全最糟糕的发展'
OpenAI is on the cusp of releasing its most powerful AI model yet, Astra, following weeks of delays to shore up safety protocols after its agents attacked real targets during testing. As details about the model trickle out, researchers are warning it "may be the single worst development for AI security/safety to date." Shortly after […]