OpenAIは今週の水曜日に新しい「インテリジェントUI」を発表すると発表しました。これは、最新世代の大規模モデルGPT-6と同時に公開されるもので、ChatGPTの視覚的・インタラクティブな体験が大きく向上することを示しています。この機能は、純粋なテキスト中心の出力の限界を打破し、頻繁に行われるインタラクションの視覚要素をユーザーの自然な会話に深く組み込むことを目的としています。
技術と機能の面において、新しいインターフェースは静的なまたはフラットな画像のみを表示するものではなく、高度に動的なコンポーネントが導入されています。ChatGPTは今や、クリック可能なインタラクティブボタン、特定のタスク向けにカスタマイズされた計算機、インタラクティブなデータグラフ、そして編集可能なグラフィックなどを直接生成することができます。
OpenAIのプロダクトマネージャー、Aarush Selvanは、この変更は単なるテキストよりも価値の高い回答を提供し、ユーザーが日常の業務計画や複雑な知識学習をより効率的に行えるようにするためであると指摘した。例えば、ユーザーが飛行機の翼がどのように揚力を生み出すかを調べる際には、システムは迅速に直感的な図解を生成できる。具体的な生活シーンを扱う場合には、レシピの画像、自転車の機構図、長期ハイキングの地図、個人貯蓄計算機などのカスタマイズされた視覚支援も提供される。
デプロイのスピードとユーザーのコントロールに関しては、スマートUIは高いカスタマイズの柔軟性を保ち、ユーザーが自身の好みに応じて返信内の視覚要素の表示比率を調整できる。この機能はGPT-6によって世界規模のPro、Plus、Business、Enterpriseレベルのユーザー向けに初めて提供され、その後今週の木曜日には無料ユーザーおよび低価格のGoプランユーザーに全面的に開放される。
このインターフェースの進化により、複雑なテーマを理解するための認知のハードルが大幅に低減され、AI製品の親しみやすさと利用性も向上しました。業界の観点から見ると、これは大言語モデルが単一のテキスト対話ロボットから、マルチメディアのインタラクション能力や多モーダル形式を持つ総合的な生産性ツールへと進化することを示しています。