AI×経営戦略
LLM安全機構の残存信号、脱獄攻撃を検知
大規模言語モデルへの「脱獄攻撃」が成功した場合でも、モデル内部に安全性の活性化信号が残存することが判明した。訓練不要の検知手法への応用が期待され、企業のAIガバナンス態勢を大きく変える可能性がある。

全セクション横断 4 件
大規模言語モデルへの「脱獄攻撃」が成功した場合でも、モデル内部に安全性の活性化信号が残存することが判明した。訓練不要の検知手法への応用が期待され、企業のAIガバナンス態勢を大きく変える可能性がある。

米研究者らがLLMの内部状態を制御し、将来情報への依存(先読みバイアス)を抑制する手法を開発した。金融・製造・小売など予測精度がKPIに直結する業界で、AIモデルの実用性を大幅に高める可能性がある。

米研究者らが臨界パーコレーション理論を応用した合成データセットを開発した。ニューラルネットワークの解釈性評価の精度が高まることで、金融・医療・製造業における説明可能なAI導入が加速する可能性がある。

米ジョンズ・ホプキンス大学らの研究チームが、ラベルなしで物体の構成部位を自動発見するAIアーキテクチャ「RATS」を発表した。製造業の外観検査や医療画像診断など、部位単位の精密な解析が求められる産業領域への応用が期待される。
