GPT-4oは、OpenAIが発表した最新モデルである。知能の高さに加え、人間らしい応答や感情表現を取り入れた点で話題を集めている。
GPT-4oの3つの進化点
AI技術の進化は止まるところを知らず、我々の生活のあらゆる側面に影響を与えている。
OpenAIのデモンストレーションによると、新バージョンのChatGPTは早口で自然な音声会話が可能だという。
「ChatGPTがいかに便利か」と質問すると、ChatGPTは「やめてください、照れちゃいますよ」と応じる。感情的な反応を示す場面があった。
従来のGPT-4.0ではこうした感情表現は限定的で、ユーザーの感情に合わせた反応を示すことは困難であった。
この進化はビジネスにおいても、ユーザーとの対話がより円滑になることを意味しており、注目度が高い。大きく変化したのは3点だ。
まず、応答速度が大幅に短縮された。スマホやタブレットからの利用を想定し、音声でチャットする際の応答時間が平均で0.3秒程度になった。
これにより、ユーザーはよりスムーズで自然な会話を楽しむことができる。途中で話題を変えたり、新しいリクエストを出したりすることもできるため、自由なコミュニケーションが可能になった。
異なる言語を同時通訳するデモ動画も公開されており、GPT-4oは日本語を含む50種類の言語に対応している。多言語環境でのコミュニケーションも容易になった。
次に、マルチモーダル機能が強化された。GPT-4oはテキスト、画像、音声など多彩なコンテンツを理解し処理する能力を持っている。
スマホで撮影された映像に何が映っているかをAIが認識し、視覚障害者に適切なアドバイスをすることができる。自撮り写真をアップロードすると、AIが似顔絵を描くこともできる。
この機能は従来のGPT-4でも存在していたが、GPT-4oでは最初からシングルモジュールとして開発された。異なる種類のコンテンツをより高速かつスムーズに処理できるようになった。
そして最大の特徴が、ユーザーの感情を理解し、それに応じた返答や対応ができる点である。
数学の宿題に苦戦する子供を励ましながらサポートするデモ動画では、AIが「うーん、近い」という表現を用いる。子供のやる気を促し、最終的に正解へ導く様子が紹介されていた。
AIが人間の感情を理解し、自らも感情を表現する能力は「擬人化(anthropomorphization)」と呼ばれる。擬人化は、ユーザーの心理状態に寄り添ったきめ細かいAIサービスを可能にする。
感情を持つAIの可能性と問題点
GPT-4oの登場により、ChatGPTは活発な会話スキルを得るだけでなく、写真や図表などの画像の理解力も向上した。
今後は、パーソナライズされた体験を提供するために、ユーザーに関する情報を「Memory」に保存できるようになる予定だ。
ユーザーごとにカスタマイズされた対応が可能となり、ビジネスの現場でもより効果的なサポートが期待される。
一方で、高度なAIが感情を持つかのように振る舞うことには、倫理的なリスクも伴う。
Google DeepMindの研究チームは、AIアシスタントが高度な説得力を持ち、中毒性を生む可能性を警告している。実際、チャットボットとの過度な依存が問題となるケースも報告されている。
AI技術の進化と同時に、その使用に関する倫理的なガイドラインの整備が欠かせない。
将来的には、より高度なAIである「人工汎用知能(AGI)」の実現が視野に入っている。ただし、その道のりは慎重に進められるべきである。
現時点で示されたのは、音声と画像を扱い、感情に応じて返答する対話までである。ユーザーごとの体験の最適化と倫理面の整備は、これからの段階にある。GPT-4oの擬人化は、その第一歩として注目に値する。
コメントは受け付けていません。