X線画像を読むAIチャットボット、誤診にもかかわらず高い確信度を示す
THE DECODER
RadLE 2.0ベンチマークで、多くのAIモデルが誤った診断を高い確信度で出力することが判明。人間の放射線科医もAIの誤りを見抜けず、医療AIの信頼性に疑問を投げかける。
Content keyword · Issue
AIの挙動を制御し、誤作動や重大な被害を防ぐための安全性をめぐる論点。
News · Page 3
AI安全に関するニュースを、新しい順に確認できます。
Nature Technology
AIエージェントが参照するデータセットに細工が施されると、正しい情報を扱っているように見えても判断や実行を誤る。エージェント運用ではモデル性能だけでなく、入力データの改ざん検知と出所管理が必要になる。
PsyPost
AIモデルは、選択肢の提示方法を少し変えるだけで人間より大きく判断を変えた。AIの回答をそのまま意思決定に使うと、入力設計による誘導を見落としやすい。
Axios
AI駆動のフォレンジック調査企業が、今年のホワイトハウス記者団ディナーでの暗殺未遂事件のFBI捜査にそのプラットフォームが活用されたと発表。AIによる証拠分析が実際の犯罪捜査で重要な役割を果たした事例として注目される。