AI×医療
眼底画像AI品質評価、画素単位で精度向上
ウィーン医科大学らの研究グループが眼底画像の品質を画素レベルで評価する初のベンチマーク「FunPiQ」を発表した。大規模眼科スクリーニングの精度と説明可能性を高め、医療AIの実用化を加速させる可能性がある。

全セクション横断 4 件
ウィーン医科大学らの研究グループが眼底画像の品質を画素レベルで評価する初のベンチマーク「FunPiQ」を発表した。大規模眼科スクリーニングの精度と説明可能性を高め、医療AIの実用化を加速させる可能性がある。

米研究チームが8万5000件超のCTスキャンを用いた大規模ベンチマーク「BenchX」を開発し、最先端のがん検出AIが若年・女性・アフリカ系患者など希少サブグループで精度が著しく低下することを実証した。医療AI導入を検討する医療機関や保険会社にとって、リスク管理の根拠となりうる知見である。

機械学習モデルが実運用環境で予測精度を失う「概念ドリフト」の検知手法を体系的に評価した研究が発表された。金融・製造・マーケティング各分野でAI投資対効果の維持に直結する知見として注目される。

LLMベースのAIエージェントに組み込まれるスキル機能を狙い、悪意ある命令を画像内に隠蔽する攻撃手法が実証された。既存のセキュリティスキャナーでは検出が困難であり、企業のAI活用基盤に新たなリスクが浮上している。
