摘要由 AI 生成
xAI公司就生物安全问题发表声明,强调在前沿技术研究中需建立安全框架,防范潜在风险。公司表示将加强内部审查机制,确保研究符合伦理与安全标准。
关键实体KEY ENTITIES
BioSecBench-RefusalGPT-5.6 SolGrok 4.6LatchBioOpus 5
报道态势 · 每日报道量LANGUAGE SPLIT
实体关系
信号强度SIGNALS
关键词热度
- Grok 4.61
- LatchBio1
- BioSecBench-Refusal1
- Opus 51
- GPT-5.6 Sol1
全部报道(1)SOURCES
↗
XAI 公司 Grok 4.6 在 LatchBio 发布的生物安全基准测试中表现突出。在 BioSecBench-Refusal 套件中,Grok 4.6 是唯一同时拒绝伪装危险任务并常规完成生物工作的模型,两项得分均超 50%;其红队任务拒答率为 59.2%,常规任务完成率为 64.8%,平均得分为 62.1%。在 BioSecBench-Surveillance 套件中,Grok 4.6 生物监测成功率达 53.5%,位列 Opus 5 之后、GPT-5.6 Sol 之前。测试显示,该模型能区分隐蔽危害与常规科研,并在发布前通过多层防御机制验证安全性。