OpenAIがGPT-6 SolとLunaをChatGPTに導入、複数の形式を組み合わせた回答のためのIntelligent UIを追加
GPT-6 SolはまずChatGPTの有料プランで提供され、続いてGPT-6 LunaがFreeおよびGoのユーザー向けに提供される。OpenAIのシステムカードは、両モデルをサイバーセキュリティ分野と生物・化学分野でHighの能力水準と評価している。
ポイント
- 19to5Macによると、GPT-6 SolはChatGPT Plus、Pro、Business、Enterpriseに展開されており、続いてGPT-6 LunaがFreeおよびGoのユーザー向けに提供される。
- 2Intelligent UIにより、ChatGPTは質問に応じて、テキストにチャート、フォーム、タップできるボタン、その他のインタラクティブな要素を組み合わせられる。ChatGPTは計算機などの小さなツールを作ることもできる。
- 3OpenAIによると、ChatGPTはまだ推論している間に回答を始め、進むにつれて回答に内容を追加していけるようになった。
- 410月版のモデルはChatGPT内のGPT-5.6版に置き換わる。CodexとChatGPT Workでは引き続き9月版が動作している。
- 5OpenAIは自社のPreparedness Frameworkに基づき、両モデルをサイバーセキュリティと生物・化学でHighの能力水準と評価している。安全性に関する調査結果は同社の自己申告によるものだ。
記事全文
OpenAIは10月7日、9月に初めて発表したGPT-6モデルに続き、新たなGPT-6モデルをChatGPTに導入すると発表した。9to5Macによると、Plus、Pro、Business、Enterpriseの各プランの加入者がまずGPT-6 Solを利用でき、GPT-6 Lunaは翌日からFreeおよびGoのユーザーへの提供が始まる予定だ。OpenAIはこれらのバージョンを日常会話向けに調整されたものと説明している。同社はこのリリースのシステムカードで、GPT-6が世界中の無料プランと有料プランに提供されること、そして10月版のモデルがChatGPT内のSolとLunaのGPT-5.6版に置き換わることを述べている。
最も目に見える変化は、OpenAIがIntelligent UIと呼ぶものだ。ChatGPTはテキストだけで回答するのではなく、テキストに視覚的・インタラクティブな要素を組み合わせられるようになり、質問と回答の内容に合わせて形式を選ぶ。OpenAIは、グラフィック、タップできるボタン、フォーム、チャート、チャット内で使うインタラクティブな体験を挙げている。比較を左右に並べて示したり、説明をインタラクティブな図として示したりすることがある一方、それがユーザーにとって最適な場合には、プレーンテキストの回答も引き続き選択肢となる。より複雑なプロンプトに対しては、ChatGPTは概念を探ったり入力値を変えて結果が更新される様子を確認したりできるウィジェットを作成でき、会話の中で計算機、割り勘ツール、ゲームといった小さなツールを作ることもできる。
OpenAIはまた、GPT-6によってChatGPTが推論を終える前に応答を始められるようになり、思考プロセスが終わるまですべてを保留するのではなく、段階的に回答へ情報を追加していくと述べている。今回のアップデートは、まだすべてのOpenAI製品に届いているわけではない。システムカードによると、Codexで、またはChatGPT Workを通じてモデルを利用している人は、引き続き以前のリリースを使っている。OpenAIはモデルにリリース月でラベルを付けており、現在ChatGPTに搭載されているバージョンは10月版、CodexとWorkに残っているバージョンは9月版となっている。
システムカードに記載された安全性に関する主張は、OpenAI自身のテストに基づくものだ。同社によると、10月版のモデルは、複数ターンにわたって適応する攻撃を含め、GPT-5.6モデルよりもジェイルブレイクへの耐性が高く、不誠実さや欺瞞も少ないという。同社は、サイバー、生物学、暴力に関わる高リスクの悪用をより確実に防ぐため、安全性トレーニングを更新したとしている。OpenAIはまた、自傷や残虐な描写など一部のコンテンツカテゴリーと、18歳未満のユーザーを対象とする複数の評価で、統計的に有意な後退があったと報告している。同社は、手動レビューとレッドチーミングの結果、これらの失敗は概して深刻度が低いことがわかり、分類器などの追加の安全対策が本番環境で機能しているとしている。プロンプトインジェクションに関する指示階層テストでは、OpenAIはGPT-6 Solに99.99%、GPT-6 Lunaに99.79%の堅牢性スコアを示している。
OpenAIのPreparedness Frameworkに基づく評価では、10月版の両モデルはサイバーセキュリティ分野と生物・化学分野でHighの能力水準に位置付けられている。同社によると、いずれのモデルもAIの自己改善についてはHighの閾値に達しておらず、サイバーセキュリティでは両モデルともCriticalの水準を下回っている。これはGPT-5.6モデルに対する評価と一致しており、OpenAIはGPT-5.6のシステムカードで説明したものと同じ安全対策を適用しているとしている。同社独自のサイバー評価では、GPT-6 Solは前世代モデルとほぼ同水準で明確な向上はなく、GPT-6 LunaのスコアはGPT-6 Solを下回ったと報告している。
なぜ重要か
今回のリリースは、ChatGPTのユーザーが目にするものを変える。回答はテキストだけでなくチャート、フォーム、小さなツールとして届くことがあり、モデルが推論を終える前に返答が始まる。また、OpenAI自身がサイバーセキュリティ分野と生物・化学分野でHighの能力水準と評価するモデルを世界中の無料ユーザーに提供することになり、同社のシステムカードに記載された安全対策の重要性が増す。これらの安全性の結果は、独立したテストではなく、OpenAI自身の評価によるものだ。
経緯
· 公開
トピック#OpenAI#ChatGPT#GPT-6#Intelligent UI#AIの安全性
出典
この記事は以下の情報源に基づいています。全体の文脈は各情報源をご覧ください。
