OpenAI新モデル、社長は「AGIの時代へようこそ」
OpenAIが9月3日、新モデル「GPT-6 Astra」の提供を始めた。ブロックマン社長は会見で「AGIの時代へようこそ」と述べ、ARC-AGI-3で99.9%を示した。配布はまず一部の企業からの段階提供。
みずき:…ねえ。「AGIの時代へようこそ」って言われたら、どんな顔をすればいいの。
ひかり:えっ何それっ! だれに言われたのっ!? ……ていうかAGIって何ーっ!?
ことね:まあ落ち着いて。順番に整理しましょう。9月3日、OpenAIが新しいモデル「GPT-6 Astra」を配りはじめたの。その会見で、社長のグレッグ・ブロックマンさんが言ったのが、みずきの引いた一言ね。AGIというのは「汎用人工知能」のこと。決まった仕事だけじゃなく、人がやることなら一通りこなせるAI、という意味で、この業界がずっと目標に掲げてきた言葉よ。……Astraという名前、覚えている? 先月ここで話した、10年動かなかった数学の難問を10個まとめて解いた、あのモデル。あのときはまだ社内版だったの。それが、ついに外に出てきたということ。
ひかり:えっと……で、実際そんなにすごいのっ? 前のとどれくらい違うのっ?
ことね:数字だけ見ると、こわいくらいよ。ルールを教えてもらえないゲームを自力で攻略する「ARC-AGI-3」という試験で99.9%。ひとつ前の世代のGPT-5.6 Solが7.8%、Claude Opus 5が30.2%だったところにね。難しい数学ばかり集めたFrontierMathの、いちばん上の段でも98%。学習はテキサスのStargateという施設で、GPUを10万台以上。同社としては過去最大の規模だそうよ。
みずき:…その99.9%。ハーネスは、どっち。
ことね:……よく覚えていたわね。この前ここで話したとおりよ。同じモデルでも、周りの仕組み——ハーネスを取り替えると点が変わるの。今回もそう。標準のハーネスだと62.7%、新しい方式に替えたほうが99.9%。ちゃんと両方並べて出ているわ。試験を運営しているARC Prizeのほうも、はっきり書いているのよ。満点近くを取ることは「AGIを達成した証明」にはならない、これがAGIだと主張しているわけではない、と。……お金の話も出ていてね。その99.9%を取るのにかかった費用が1万9332ドル。比べるために雇った人のほうは、1ゲームあたり12ドル78セントの計算になるそうよ。
みずき:…人間は1ゲーム12ドル。その人の脳が使った電気ぶんだけで数えると7セント。……で、機械は1万9332ドル。……ただ、操作の回数は人間より少ないらしいよ。9割以上のレベルで、平均して半分。……高いけど、迷ってはいない。
ことね:……ただね、私がいちばん引っかかっているのは、点でも値段でもないの。Astraは「recurrent depth」——再帰的な深さ、という新しい作りを使っているのよ。ふつうのAIは、考えたことを一語ずつ文字にしながら進むでしょう。だから途中の考えを人が読んで、おかしなことを企んでいないか見張れた。ところがこの作りは、一語を出す前に同じ層を何周もぐるぐる回すの。その周回のあいだ、計算は進んでいるのに、文字には何も出てこない。安全性の研究者たちが心配しているのは、そこね。OpenAI側は「隠れている深さはGPT-4の2倍以内に収めている」「考えが読める状態を保つために、回す数はわざと制限している」と説明しているのだけれど……批判する人たちは「それは、あとから回せるつまみでしょう」と返しているわ。……それとこのモデル、サイバーセキュリティで、同社の安全基準のいちばん重い「重大」段階に達したと初めて認定されたの。人の手引きなしに、まだ知られていない穴を見つけて突けるかもしれない、ということ。だから最初は一部の企業だけ、少しずつ配っているのよ。
ひなた:ふぁ〜……考えている途中が見えないと、こまるのですか? ……わたし、給食のとき、どっちのおかずを先に食べるか、ずーっと考えているのです。……あれ、だれにも見えていないのです。
まとめ:「AGIの時代へようこそ」と言われた日に、考えている途中がいちばん見えなくなった。