AIブームが続くなか、依然として焦点となっているのは、企業がモデルの生の知能を、どのように測定可能なビジネス価値へと変えられるかという問いだ。新浪財経によると、OpenAIが未公開の新モデルは最近、数学とコンピューターサイエンスの難問を数百問解くという飛躍を遂げた。一方、同社は資金調達について協議し、300億ドル規模のIPOを準備していると報じられた。

サンフランシスコのウォーターフロントにある会場、Midwayで開かれたカンファレンスで、ModalはScott Wuに基調講演を依頼した。Wuは、個々のタスクではなく成果に注力する「バーチャル従業員」で未来があふれるだろうと語った。また、業界の進歩は、十分な数のデータセンターやメモリ、サンドボックス環境が確保できるかどうかにかかっていると述べた。

Wu氏は、AIMEが転機になったと指摘し、高度なAIモデルは、自身がかつて出場したハイレベルな数学コンテストで人間の参加者を上回るほどの実力をつけていたと述べた。OpenAIの元研究者で、現在はTypeSafe AIの責任者を務めるDiogo Almeida氏は、「自動化はどこへ行ったのか」と問いかけた。

Almeida氏は、現在の大規模言語モデルは人間のフィードバックに基づく強化学習で最適化され、アシスタントとしてはうまく機能するものの、監督なしでは自動化タスクを完遂できないと述べた。AnthropicのClaude Codeのプロダクト責任者であるCat Wu氏は、同社は反復作業の特定に注力していると語った。一方、他のソフトウェア業界のリーダーたちは、自動化の取り組みの多くは依然として部分的な完了にとどまり、最後の20%は人間が仕上げる必要があると述べた。