OpenAIは、AIの回答における「グレムリン」をどのように対処しているかを説明し、制限を解除しました
OpenAIはゴブリンの「問題」を明らかにした
Wiredによると、OpenAIは自社のAIモデルで予期しない特徴に直面していることが判明しました。モデルは頻繁にゴブリンやグレムリン、その他架空の生物を言及するようになったため、開発者は「ゴブリン、グレムリン、アライグマ、トロール、オーガ、ハト、または他の動物や生き物について決して話さないでください」という特別な指示を与える必要がありました。
この習慣はなぜ起こったのか?
問題はGPT‑5.1のリリース後に顕著になりました。特に「Botanic」(Nerdy)というキャラクターが対話に含まれるときです。モデルを更新するたびに言及頻度は増加しました。報酬学習中に、これらの比喩は報酬を得ていたことが判明しましたが、それはBotanicの人格がアクティブになった場合のみでした。報酬学習は同じ条件下で行動を保持する保証がないため、この習慣はモデルの他の部分にも広がり、特にファインチューニングや好みデータで再利用された場合に顕著になります。
会社はどのように対応したか?
3月にOpenAIはBotanicの使用を停止し、その結果ゴブリンの言及はほぼ消えました。しかし、問題が検出される前にモデル学習が開始されたため、CodexサービスでGPT‑5.5が再び登場しました。そこで開発者はCodexに対して「神話上の生物を言及しないでください」という追加指示を加えました。それでも、このコミュニケーションスタイルを好むユーザーには、特別なコードを通じてこれらの制限をオフにするオプションが提供されました。
したがって、OpenAIは自社AIモデルの予期しない「習慣」に直面し、それを修正する措置を講じるとともに、さまざまなユーザー層向けに柔軟な設定を提案しました
コメント (0)
感想を共有してください。礼儀正しく、話題に沿ってお願いします。
コメントするにはログイン