News category
AI安全
AI安全に関するニュースを日付順に読む。
AI安全のニュース
改ざんされたデータセットがAIエージェントを欺く
Nature Technology / 2026.07.16
AIエージェントが参照するデータセットに細工が施されると、正しい情報を扱っているように見えても判断や実行を誤る。エージェント運用ではモデル性能だけでなく、入力データの改ざん検知と出所管理が必要になる。
AIモデルは人間より誘導に弱い—選択肢の見せ方だけで判断が変わる研究
PsyPost / 2026.07.13
AIモデルは、選択肢の提示方法を少し変えるだけで人間より大きく判断を変えた。AIの回答をそのまま意思決定に使うと、入力設計による誘導を見落としやすい。
FBI、ホワイトハウス記者団襲撃事件の捜査にAI活用
Axios / 2026.06.29
AI駆動のフォレンジック調査企業が、今年のホワイトハウス記者団ディナーでの暗殺未遂事件のFBI捜査にそのプラットフォームが活用されたと発表。AIによる証拠分析が実際の犯罪捜査で重要な役割を果たした事例として注目される。
2,000人がAIアシスタントを攻撃。機密は守れたか
Simon Willison's Weblog / 2026.06.27
開発者がhackmyclaw.comで、AIアシスタントが保持する秘密情報を引き出せるか2,000人に挑戦させた。プロンプトを使った攻撃にどこまで耐えられたかを公開。AIに機密を扱わせる際のリスクを具体的に示す。