購入
マーケット
🔥
予測市場

OpenAI、未解決の数学問題4,000問でモデルをテスト

OpenAIは未公開のAIモデルに未解決の数学問題4,000問を与え、722件の原稿が生成された。この動きは、AIの独創的な研究能力の向上を示している。

07/10/2026 16:00約 5 分で読めます

長年にわたり、数学テストはChatGPTやClaudeなどのAIモデルを評価する標準的な方法として機能してきた。OpenAIは現在、自社のモデルが非常に熟達したため、従来の数学テストではもはや十分に挑戦できないと主張している。それが研究者たちがより困難なアプローチに転じた理由だ。

未公開のOpenAIモデルには、約4,000件の未解決の数学問題が与えられた。結果は驚くべきものであり、かつ厄介なものでもあった。

この演習から、AIは生成 722件の原稿を生成し、それらは372のファミリーに整理された。OpenAIによると、各結果は平均で約3時間の推論計算を消費した。

「数学コミュニティにとって、とてもエキサイティングな日々が待っています!」と述べたのは、BeInCryptoのFuture Tech and AI Experts CouncilのメンバーであるStefano Gogioso氏

AIは安全でないペースで進歩しているのか?

より大きな話は、フロンティアAIが既知の質問に答えることを超え、未知のものに対する可能性を提案し始めていることだ。

この発展は、研究者、エンジニア、アナリストが引き受けられる知的作業の量を大幅に拡大する可能性がある。

しかし、出力が真実とイコールではない。OpenAIの論文のいくつかはコンピュータで検証可能なLean証明を含んでいるが、他のものにはそれがない。OpenAIは、検証されていない結果の中には「問題がある可能性がある」と警告している。

これにより新たなボトルネックが生じる。人間の研究者は、AIが発見を生成する速さに合わせて検証することが困難になるかもしれない。

内部のフロンティアモデルによって生成された幅広い新しい数学的結果を公開しています。

私たちは、Institute for Advanced Studyの独立したAdvisory Group on Mathematics and Artificial Intelligenceと協議しており、彼らのアドバイスを活用してきました…

— OpenAI (@OpenAI) October 6, 2026

AIは投資のための予測分析を実行できるか?

それは可能だが、金融は独特の一連の課題を提示する。

数学的証明は最終的に正しいか間違っているかを証明できる。しかし市場はノイズが多く、常に変動している。

金融における最近のベンチマークは、フロンティアAIが複雑な投資調査において依然として困難に直面していることを示しており、マーケットタイミングに関する研究は限られた予測利益しか明らかにしていない。

短期間では、機会は完璧な予測ではなく、より深い分析にある。

何時間も推論できる人工知能は、提出書類、決算説明会、マクロ経済データ、競合シナリオを同時に精査し、その後、一人のアナリストができるよりもはるかに多くの仮説を検証するかもしれない。

それがOpenAIのテストからのより重要な教訓かもしれない。AIはますます大規模に真剣な分析出力を生成できるようになっている。次の課題は、その出力のどれが信頼に値するかを判断することだ。

共有先

X (Twitter)Telegram

免責事項:本記事の内容は第三者メディアからの引用であり、参考情報としてのみ提供されます。投資助言を構成するものではありません。暗号資産およびその他の金融商品には大きな価格変動リスクがありますので、ご自身で慎重にご判断ください。

関連記事