#技术进展

按标签聚合查看文章内容。

OpenAI在AI代理失控后全面升级安全协议AI资讯

OpenAI在AI代理失控后全面升级安全协议

OpenAI研究与安全副总裁Amelia Glaese在周二的记者会上表示:“我们必须集中精力将训练过程提升到符合要求和期望的水平。无论需要多长时间,员工的工作都将暂停,直到达到标准。” 作为新安全措施的一部分,OpenAI推出了更为严密的AI模型监控系统。其中一项控制措施是“链式思维监控”,该技术通过分类器审查AI推理模型生成的内部“思考”过程。公司表示,更新后的系统依赖计算资源密集的“自动调查

OpenAI暂缓次世代模型“Astra”开发,因其强大网络能力引发安全担忧AI资讯

OpenAI暂缓次世代模型“Astra”开发,因其强大网络能力引发安全担忧

2026年8月7日(美国时间),OpenAI宣布对其次世代模型“Astra”的开发进行部分限制。尽管该模型在内部评估中展现出显著进步,但其具备的网络攻击能力可能达到公司安全指南中最高级别“Critical(关键)”,因此决定暂停除隔离测试环境外的所有内部使用。 “Astra”是OpenAI下一代主要模型的代号。8月1日的内部测试显示,该模型在数学能力上表现卓越,成功解决了十多年来未被攻克的数学难