Anthropicが、Amazon・Microsoft・Googleなどと共同で、AIジェイルブレイクの危険度を測る『CJS』スケールを公開し、Fable 5専用の新しいバグ報奨金プログラムも開始。ライバル企業が安全性という土俵で手を組み始めた背景をやさしく解説します。
Trend Microが公開したSockpuppetingジェイルブレイク手法がChatGPT、Claude、Gemini含む11のLLMを突破。AIセキュリティの現状と今後の課題を解説。