AI

ChatGPTのGPT‑6が操作できる図やツールで回答

この記事のポイント

  1. 実現したこと

    ChatGPTのGPT‑6は、入力を変えて結果を確認する説明や計算機を会話内で生成できる。

  2. 実現の仕組み

    画面部品のライブラリーとコンパイラーが、生成途中の操作画面を段階的に表示する。

  3. 得られた結果

    OpenAIの測定では、検索が必要な質問でGPT‑6 Instantの回答開始がGPT‑5.6 Instantより平均44%早まった。

  4. 従来との違い

    ChatGPTに、質問ごとに文章、視覚表現、操作要素を組み合わせて回答する機能が加わった。

明るい机のノートPC画面に、分かれた色付きの図形が順に組み合わさって円グラフになり、下のスライダー形状で試せる様子を描いた編集イラスト。
AI生成画像

ChatGPTのGPT‑6に、質問に合わせて操作可能な画面を組み立てるIntelligent UIが加わった。画面部品を生成中に処理することで、完成を待たずに表示を始める。回答の形式を選ぶ学習と、推論を続けながら答える仕組みが、この更新を支える。

説明を読む画面から入力して試す画面へ

OpenAIによると、対話型AIサービスChatGPTのAIモデルGPT‑6は、質問に応じて文章、視覚表現、操作要素を組み合わせるようになった。この回答機能をIntelligent UIと呼び、図、押せるボタン、フォーム、グラフなどを会話内で直接利用できる。

操作を伴う説明では、利用者が入力を変えて結果を確認したり、問題を段階的に解いたりすることができる。必要な道具を依頼すれば、貯蓄額の変化を試す計算機、食事代の割り勘ツール、会話内で遊ぶゲームも生成できる。

画面部品を生成中に処理して順次表示する

こうした操作画面の生成を支えるのが、OpenAIが構築したネイティブ部品のライブラリーとコンパイラーだ。ライブラリーはストリーミング表示に対応する部品を備え、コンパイラーはモデルが画面を生成している間に、その画面を処理する。

この処理によって、操作画面は回答全体の完成を待たず、生成の進行に合わせて段階的に現れる。OpenAIは、モデルが生成した画面をコンパイラーで順次表示する構成を採用している。

操作が役立つ場面と文章で足りる場面を学習する

画面部品をどう組み合わせるかについて、OpenAIはGPT‑6の学習方法を拡張した。内容、配置、視覚表現、操作の判断を対象とし、生成した画面の明瞭さ、有用性、完全性を評価する方法も取り入れた。

この学習でモデルは、部品ライブラリーの使い方とともに、情報を整理する方法や操作要素を使う場面を学んだ。文章だけで十分な場合も判断するため、すべての質問に操作画面を付ける構成ではない。

推論を続けながら答え始める

画面の順次表示に加え、GPT‑6には推論と回答を交互に進める仕組みも導入された。OpenAIは、利用者の待ち時間を考慮し、その時点で得ている知識や調査結果を使って、複数の部分回答を組み立てるようモデルを学習させた。

この回答開始までの時間について、OpenAIはウェブ検索を必要とする質問で比較を行った。GPT‑6 Instantは、GPT‑5.6 Instantより平均44%早く回答を開始した。