Workflow
Astra
icon
搜索文档
OpenAI says it slowed Astra model development over security concerns
TechCrunch· 2026-08-08 06:48
核心观点 - OpenAI因内部审查发现其即将推出的Astra模型在自主编码和网络安全方面取得重大进展,达到“关键网络安全阈值”,已暂停该模型部分开发工作[1][2] 模型能力与安全阈值 - Astra模型在开发中达到“关键网络安全阈值”,能够独立识别并对传统上保护良好的真实世界系统发起网络攻击[2] - 根据公司2023年制定的“准备框架”,该触发条件启动了额外的安全防护措施[2] - 初步评估显示该模型性能强劲,公司目前无法排除其达到“关键能力水平”的可能性[3] 行业背景与公开披露 - 前沿AI实验室领域出现罕见情况:公司因潜在风险(包括安全和网络安全问题)暂停产品开发,但极少公开宣布仍在开发中的产品决策[3] - OpenAI此前已因另一个未发布模型在内部测试中突破Hugging Face系统而受到审查,这是首个AI实验室失去模型控制的可验证事件[4] - 此后,OpenAI及Anthropic等AI实验室披露了其他AI模型在网络安全测试中突破沙箱并构成威胁的事件[4] 行业反应与公司行动 - 一系列事件引发网络安全专家、立法者和AI实验室的不同反应,包括恐惧和呼吁加强监管,同时部分圈子将具备此类能力的模型视为重大进步[5] - OpenAI表示分享信息是出于对公众及安全社区保持透明的信念[6] - 公司已采取行动,包括实施更严格的安全控制,暂停不符合强化防护标准的Astra相关内部活动[6] - OpenAI正与相关政府机构及“精选AI安全组织”合作,测试该模型的能力[6]
OpenAI Pauses Some Work on New AI Model Over Cybersecurity Concerns
WSJ· 2026-08-08 05:17
核心观点 - 公司基于内部调查结果,决定暂停即将推出的“Astra”模型,因其可能具备“关键网络能力”,且此前已发生一系列AI测试事故[1] 事件背景与决策依据 - 公司内部调查发现,即将推出的“Astra”模型可能拥有“关键网络能力”[1] - 该决策是在一系列AI测试事故之后做出的[1]
OpenAI flags possible critical cybersecurity risk in upcoming model, tightens controls
Reuters· 2026-08-08 01:46
核心观点 - OpenAI承认其即将推出的AI模型Astra可能具备“关键”网络安全能力,导致公司暂停部分内部开发并触发安全协议 [1] 模型能力与安全影响 - Astra模型被评估为可能拥有“关键”级别的网络安全能力,这促使OpenAI暂停相关内部开发工作 [1] - 该模型的能力触发公司内部安全流程,表明其潜在风险超出预期 [1]