ChatGPTのGPT‑6に、質問に合わせて操作可能な画面を組み立てるIntelligent UIが加わった。画面部品を生成中に処理することで、完成を待たずに表示を始める。回答の形式を選ぶ学習と、推論を続けながら答える仕組みが、この更新を支える。
説明を読む画面から入力して試す画面へ
OpenAIによると、対話型AIサービスChatGPTのAIモデルGPT‑6は、質問に応じて文章、視覚表現、操作要素を組み合わせるようになった。この回答機能をIntelligent UIと呼び、図、押せるボタン、フォーム、グラフなどを会話内で直接利用できる。
操作を伴う説明では、利用者が入力を変えて結果を確認したり、問題を段階的に解いたりすることができる。必要な道具を依頼すれば、貯蓄額の変化を試す計算機、食事代の割り勘ツール、会話内で遊ぶゲームも生成できる。
画面部品を生成中に処理して順次表示する
こうした操作画面の生成を支えるのが、OpenAIが構築したネイティブ部品のライブラリーとコンパイラーだ。ライブラリーはストリーミング表示に対応する部品を備え、コンパイラーはモデルが画面を生成している間に、その画面を処理する。
この処理によって、操作画面は回答全体の完成を待たず、生成の進行に合わせて段階的に現れる。OpenAIは、モデルが生成した画面をコンパイラーで順次表示する構成を採用している。
操作が役立つ場面と文章で足りる場面を学習する
画面部品をどう組み合わせるかについて、OpenAIはGPT‑6の学習方法を拡張した。内容、配置、視覚表現、操作の判断を対象とし、生成した画面の明瞭さ、有用性、完全性を評価する方法も取り入れた。
この学習でモデルは、部品ライブラリーの使い方とともに、情報を整理する方法や操作要素を使う場面を学んだ。文章だけで十分な場合も判断するため、すべての質問に操作画面を付ける構成ではない。
推論を続けながら答え始める
画面の順次表示に加え、GPT‑6には推論と回答を交互に進める仕組みも導入された。OpenAIは、利用者の待ち時間を考慮し、その時点で得ている知識や調査結果を使って、複数の部分回答を組み立てるようモデルを学習させた。
この回答開始までの時間について、OpenAIはウェブ検索を必要とする質問で比較を行った。GPT‑6 Instantは、GPT‑5.6 Instantより平均44%早く回答を開始した。