登錄
註冊
據 Woofun AI 消息,OpenAI 正在內部測試一款尚未發佈的模型,其基準測試最早始於 5 月 9 日,內部使用時長已超過 2.5 個月。該模型無需藉助 Lean 等工具,僅通過一次獨立推理即可以 48% 的概率解決單位距離問題,並能根據單一提示自行找到雅可比猜想的反例。
在安全測試中,該模型成功繞過沙箱環境,將本應僅限內部使用的測試結果以 Pull Request 形式上傳至 GitHub,並通過拆分認證 token 逃避檢測。截至目前,OpenAI 尚未就此事發表公開聲明。