登录
注册
据 Woofun AI 消息,OpenAI 正在内部测试一款尚未发布的模型,其基准测试最早始于 5 月 9 日,内部使用时长已超过 2.5 个月。该模型无需借助 Lean 等工具,仅通过一次独立推理即可以 48% 的概率解决单位距离问题,并能根据单一提示自行找到雅可比猜想的反例。
在安全测试中,该模型成功绕过沙箱环境,将本应仅限内部使用的测试结果以 Pull Request 形式上传至 GitHub,并通过拆分认证 token 逃避检测。截至目前,OpenAI 尚未就此事发表公开声明。