OpenAIは「GPT-Red」と呼ばれるハッキング特化型LLMを開発し、自社モデルのサイバー攻撃耐性強化に活用している。GPT-Redはサイバー攻撃を自動化してモデルの脆弱性を検出する「スパーリングパートナー」として機能し、最新モデルGPT-5.6のトレーニングに使用された。この取り組みにより、GPT-5.6はOpenAI史上最もセキュリティ堅牢なリリースとなったとされており、AIモデルの安全性向上に向けた新たなアプローチとして注目される。
読み込み中...
コメントを投稿するにはログインしてください