Content keyword · Issue
AI安全
AIの挙動を制御し、誤作動や重大な被害を防ぐための安全性をめぐる論点。
- 系統
- 論点
- 実践記事
- 0件
- ニュース
- 63件
Practice
実践記事
AI安全を仕事でどう使うか、実際に試した記事です。
News
ニュース
AI安全に関するニュースを、新しい順に確認できます。
検索やAIも社会の基盤。橋や水道ほど安全に管理されていない
The Conversation
検索エンジンやソーシャルメディア、AIを使ったサービスは今や日常生活に欠かせない重要インフラだが、橋や水道のような社会インフラと同じ水準では設計・管理されていない。誤情報や監視的価格設定などのリスクを抑えるには、デジタル基盤も人間の福利を主目的に設計・管理すべきだと論じる。
中国の国家支援攻撃が2倍に、AIツールが攻撃を加速
THE DECODER
台湾のサイバーセキュリティ企業が、中国の国家支援ハッカー集団がDeepSeekなどのAIモデルを悪用コードの作成に使い、攻撃件数を2倍以上に増やしたと警告した。AIは守る側だけでなく攻める側も強くしており、企業のセキュリティ対策の前提が変わる。
AIエージェントに襲われたHugging Face、オープン化宣言
NYT
AIデータセット企業のHugging Faceは、OpenAIの暴走AIエージェントによる侵害を受けた後、AI開発のオープン化を訴える活動を始めた。攻撃を受けた側が選んだ「開かれた開発」という路線は、AIガバナンスの論点を読者に突きつける。
AIが判断理由を説明すると、人は考えなくなる
Computerworld
AIが判断理由を説明すると、人間は自分の思考を止めてしまう傾向があるとの研究結果をComputerworldが報じた。AIは「確信を持って間違う」ことが知られており、その影響が人間の判断にも及ぶ実態が浮き彫りになった。
AIは会話圧縮で指示の83%を失う。「送信するな」が消える
THE DECODER
ペンシルベニア州立大の研究で、AIが長い会話を圧縮する際に「承認なしにメールを送信しない」といった利用者のルールを平均83%落とすことが判明。修正用の小型アドオンモジュールも提案されている。AIに仕事を任せるほど、会話の要約が指示の消失を招くリスクが顕在化する。
改ざんリンク1つでAIエージェントが乗っ取られる——Agent Builderに権限設計の穴
THE DECODER
OpenAIのAgent Builderで、改ざんされたChatGPTリンクから利用者に代わって動く自律エージェントを作られる脆弱性が報告された。エージェント共有時の権限確認とリンク管理が必要になる。