従来の先端AIはハッキングに注力していたが、新モデルでは数学で新記録を連発
これで十分だろうか。それとも、もっと聞きたいだろうか。
この新しいモデルを投入した結果、分野をまたいで数学の新記録が次々に生まれたのは間違いなさそうだ。この重要な研究分野の最前線の勢力図も、大きく塗り替えられた。
注目したいのは、これまでのOpenAIのモデルが、ハッキングやサイバーセキュリティの作業に重点を置いていたことだ。AnthropicのAIモデルであるMythosやFableとなれば、なおさらである。ところが今回のモデルは、どうやら数学が得意らしい。
AIの能力試験で人間を圧倒し続けるLLM、勢いは数学にも及ぶ
もう1つ、考えてみたいことがある。AIの性能を測るテストでは、LLMがここ数カ月、事実上、人間を圧倒し続けてきた。専門家が出題した難問をそろえた「人類最後の試験」(Humanity's Last Exam、HLE)しかり、AIの能力を評価する非営利の研究機関METRの評価しかり、抽象的な推論力をパズル形式で測るARC-AGIの問題集しかりで、ほかにも例は多い。今回の成果も、AIがすでにどれほど強力になっているかを示す大きな流れの、最新の一例にすぎない。
水や空気の動きを表す方程式で9月に成果、10月はさらに大きな前進か
別の角度から説明してみよう。
OpenAIは米国時間9月8日、同社のモデルが、有名な「ナビエ–ストークス」方程式をめぐるミレニアム懸賞問題(前述のリーマン予想を含む、懸賞金のかかった数学の7つの難問)の1つを解いたと発表していた。「ナビエ–ストークス」方程式は、水や空気などの流体がどのように動くかを表す方程式で、流体の速度、圧力、密度、粘性を結びつけている。OpenAIの説明からすると、今回の成果を出したのも、このときと同じ社内モデルとみられる。
どうやら10月6日の発表は、ナビエ–ストークス方程式の件をさらに上回るらしい。
OpenAIで研究経験を持つ人物が評価、「ナビエ–ストークス」方程式の解決5件分
ウィル・デピューという人物のXへの投稿が目に留まった。デピューはOpenAIで研究に携わった経験があり、同社の動画生成AI「Sora」の開発にも加わった。投稿は、今回の数学の新たな成果を「ナビエ–ストークス」方程式の解決5件分のようなもの」と評している。
近年の数学的進展を並べた一覧、81%は成し遂げられたばかり
デピューはさらに、近年の数学の主要な成果を網羅したリストも投稿し、リストに並ぶ成果の実に81%が、成し遂げられたばかりのものだと示唆している。ある意味、驚くべき数字である。
とにかく、これは今すぐ伝えておきたかった。大ニュースだからだ。地震にたとえるなら、最大級の揺れに当たる。続報を待ってほしい。


