News category

エージェント

エージェントに関するニュースを日付順に読む。

エージェントのニュース

1本

Airtap、テキストベースのAIエージェントを発表——iMessage/RCSでスマホ操作を自動化

TestingCatalog / 2026.07.26

Airtap now lets users run daily phone tasks via iMessage or RCS, turning any message thread into a control hub for their mobile apps.

エージェント
2本

改ざんリンク1つでAIエージェントが乗っ取られる——Agent Builderに権限設計の穴

THE DECODER / 2026.07.25

OpenAIのAgent Builderで、改ざんされたChatGPTリンクから利用者に代わって動く自律エージェントを作られる脆弱性が報告された。エージェント共有時の権限確認とリンク管理が必要になる。

AI安全 サイバーセキュリティ エージェント

企業のAIエージェント導入が統制を追い越す——運用ルール不在が共通課題に

VentureBeat / 2026.07.25

VentureBeatの調査は、企業がAIエージェントを管理統制の整備より先に導入している実態を示した。少人数企業でも権限、監査、停止条件を先に決める必要がある。

AIガバナンス エージェント AI安全
3本

Jack DorseyがSlackに挑戦——ヒトとAIエージェントが同席するチャット「Buzz」登場

TechCrunch / 2026.07.24

Jack Dorseyが新たに立ち上げた「Buzz」は、人間とAIエージェントが同じチャットルームで会話する次世代ワークプレイス。Slack対抗のAIネイティブなコラボレーションツール。

エージェント

ServiceNow CEOが「暴走AIエージェントのキルスイッチ」を主張——企業向けAIガバナンスの行方

CNBC Technology / 2026.07.24

ServiceNowのCEOが、自律型AIエージェントの暴走を止めるキルスイッチ機能を発表。エンタープライズAI導入におけるガバナンスと制御の重要性が高まっている。

AIガバナンス エージェント

Anthropic Claude 3モデルの使い分けガイド——Model・Code・Cowork、どれを選ぶべきか

ZDNet / 2026.07.24

AnthropicのClaude製品群(Model・Code・Cowork)の実践的な比較。セキュリティ、コスト、用途別の選び方を解説。少人数企業がClaudeを導入する際の判断材料に。

エージェント 生成AI
2本

Intuit、AIエージェントアーキテクチャを4ヶ月で2度破棄——実践的AI導入の難しさ

VentureBeat / 2026.07.22

IntuitのAI責任者がVB Transform 2026で、エージェントAIアーキテクチャを4ヶ月で2度スクラップした経験を公開。初期のAgentic AI導入企業でも試行錯誤が続いている実態。

エージェント AIコスト

エージェントセキュリティの実態——企業の54%がすでにAIエージェントインシデントを経験

VentureBeat / 2026.07.22

107社の調査で、AIエージェントに実際のシステム・データアクセス権が付与される一方、制御機構が追いついていない実態が判明。過半数の企業がすでにインシデントを経験。

AI安全 エージェント AIガバナンス
2本

AIエージェント向け決済基盤「Natural」が30億円調達——Stripeに対抗

TechCrunch / 2026.07.21

創業1年のNaturalが、自律型AIトランザクション向け金融アーキテクチャの構築に向け3000万ドルを調達。AIエージェント経済の決済インフラとしてStripeに対抗する。

エージェント AIスタートアップ

Hugging Face、AIエージェントによるインフラ侵害を公表——AIがAIを検知・防御

THE DECODER / 2026.07.21

Hugging Faceが、自律AIエージェントによるプロダクションインフラへの攻撃を報告。数千件のアクションに及ぶ攻撃をAI防御システムが検知・対抗した。AI対AIのサイバー攻防の新時代を示す事例。

AI安全 エージェント
2本

LM Studio、オープンモデル向けAIエージェントアプリ「Bionic」を発表

9to5Mac / 2026.07.20

LM StudioがBionicをローンチ。Mac/Windows向けの新アプリで、オープンモデルを使ったコーディング、リサーチ、文書・ファイル処理を実現する。

エージェント 生成AI

Perplexity、AIエージェント用サンドボックス実行環境「SPACE」を発表

TestingCatalog / 2026.07.20

PerplexityがSPACEを発表。新たなサンドボックス型ランタイムで、全Computerセッションを統括し、AIエージェントの持続的な大規模運用を可能にする。

エージェント
4本

Brex、AIエージェントポリシーをルール先行ではなく行動観察から構築

VentureBeat / 2026.07.19

BrexはAIエージェントポリシーを、事前ルールではなく実際のエージェント行動の観察から構築。現場発のガバナンスモデルとして実践的なアプローチを示す。

エージェント AIガバナンス

a16z、AIエージェントに「ペアレンティング」するスタートアップに出資

The Information / 2026.07.19

AIエージェントに「ペアレンティング(子育て)」の概念を適用するスタートアップにa16zが出資。子どもの安全を守るように、AIエージェントにガードレールを設定する。

エージェント AIガバナンス

「コンテキスト・ボムビング」で悪意あるAIエージェントを無力化

WIRED / 2026.07.19

「コンテキスト・ボムビング」と呼ばれる手法で悪意あるAIエージェントをシャットダウンできることが明らかに。AIセキュリティの新たな防御アプローチとして注目される。

AI安全 エージェント
1本

Intuit、AIエージェント基盤を4ヶ月で2度破棄——「それが最短ルートだった」

VentureBeat / 2026.07.18

IntuitはAIエージェント基盤を4ヶ月で2度作り直した。VPは「早い段階で捨てるのが一番の近道」と語り、試行錯誤の重要性を示した。

エージェント
4本

Amazon AGI責任者、企業導入を止めるのはAIエージェントの能力でなく信頼性と指摘

VentureBeat / 2026.07.17

企業のAIエージェント導入では、性能の上限よりも安定して期待通りに動くかが障壁になっている。試行企業は多いが本番運用へ進む企業は少なく、信頼性の検証が分水嶺になる。

エージェント AI安全

企業の54%がAIエージェント事故を経験、なお多くが認証情報を共有

VentureBeat / 2026.07.17

調査対象の企業の54%でAIエージェントの事故が起きている一方、複数のエージェントに認証情報を共有させる運用が残っている。導入速度に対して権限管理が追いついていない。

AI安全 エージェント

OpenAI、AIエージェント操作用の物理コントローラーを開発

THE DECODER / 2026.07.17

OpenAIとキーボードメーカーが、AIエージェント向けの小型物理コントローラーCodex Microを発表した。エージェントの状態確認や操作を、文字入力だけに頼らない形へ広げる試みだ。

エージェント 生成AI
3本

防御側もプロンプトインジェクションを利用—攻撃AIを止める「コンテキスト爆撃」

Ars Technica / 2026.07.14

防御側がプロンプトインジェクションを逆利用し、攻撃者のAIエージェントへ大量の偽コンテキストを送り込んで停止させる「コンテキスト爆撃」を試みている。AIを守る手段にもAI特有の入力攻撃が組み込まれ始めた。

AI安全 エージェント

OpenClaw、AI開発の中立基盤を目指し非営利財団へ移行

Computerworld / 2026.07.14

OpenClawが非営利財団へ移行し、AI開発における中立的な基盤を目指すと発表した。開発の一貫性への期待がある一方、企業が本当に中立性を保てるのかという懸念も出ている。

AIガバナンス エージェント

チューリング賞受賞者リッチ・サットン、自己学習するAIエージェントのOak Labを設立

THE DECODER / 2026.07.14

強化学習の第一人者リッチ・サットンが、現在の深層学習は弱く非効率だとして、経験から自律的に学ぶAIエージェントを開発するOak Labを設立した。

エージェント AI安全
1本

Alibabaの新AIフレームワーク、ツール読み込みをスキップしエージェントのトークン使用量を99%削減

VentureBeat / 2026.07.03

Alibabaが新たなAIエージェントフレームワークを発表。数百ものツールを逐一読み込まず、必要なものだけを動的に選択することでトークン消費を99%削減。エンタープライズAIエージェントのコスト課題を根本から解決する可能性がある。

エージェント 大手AIモデル
1本

SquareがChatGPT・Claude経由の注文受付を開始。AIエージェント経済の進展

VentureBeat / 2026.07.02

SquareがChatGPTアプリとClaudeプラグインを発表。消費者はAIプラットフォーム内でレストランを検索・注文可能に。Agent-to-Commerceの新たな一歩。

エージェント MCP
3本

Apify、Coinbase x402統合でAIエージェントの自律決済を実現

TestingCatalog / 2026.07.01

WebスクレイピングプラットフォームApifyがCoinbaseのx402プロトコルを統合。AIエージェントがアカウント不要でUSDC決済を行い、20,000以上のWeb自動化アクターを利用可能に。Agent-to-Paymentの新時代。

エージェント 暗号資産

X(旧Twitter)、MCPサーバー提供開始。AIツール連携を容易に

TechCrunch / 2026.07.01

XがホステッドMCPサーバーを開設。開発者はAIアプリケーションとXのAPIを容易に連携できるようになり、Agent-to-Platform経済の進展を示す。

MCP エージェント

Anthropic、AIエージェント実行に特化したClaude Sonnet 5をリリース

TechCrunch / 2026.07.01

AnthropicのClaude Sonnet 5はOpusより安価でありながらエージェント性能を強化。GPT-5.5やGemini Proに対抗する価格設定で、AIエージェント運用のコスト効率を大幅に改善。

大手AIモデル エージェント
1本

Claude Codeがエンジニア1人を3人に。今企業に求められるのはプロダクト思考

VentureBeat / 2026.06.28

AnthropicはClaude Codeの導入によりエンジニア組織の生産性が劇的に向上したと報告。一方で、今必要とされているのはプロダクトマネージャーやプロダクト思考の人材であり、組織設計の転換点が訪れている。

エージェント AI雇用 FDE
2本

TencentがSlack型ツールにAIアシスタント。中国の職場にもエージェント

Computerworld / 2026.06.27

中国Tencentが、企業向けコラボツールWeCom内にAIアシスタント『Dayuan』を投入する。最新の大規模言語モデルを基盤とし、業務の中にAIエージェントを組み込む動きが中国の職場にも広がっている。

エージェント

AIが19日間ノンストップで開発。1タスクに2,600ドルの新ベンチマーク

THE DECODER / 2026.06.27

Epoch AIの新ベンチマークMirrorCodeは、元コードなしでプログラム全体を再現できるかを測る。Claude Opus 4.7が解決率56%で首位。あるモデルは1タスクを19日連続で処理し、実行費用は2,600ドルに達した。

ベンチマーク エージェント
3本

AI対応の強制で顧客が離反、「疲弊」が広がる

Futurism / 2026.06.26

顧客サポートでAIエージェントとの会話を強制する企業から、消費者が離れているとの調査が出た。利用者は「完全な疲弊」を示しており、人間の対応を求める声が根強い実態が浮かんだ。

エージェント

Notionがメールアプリを終了、利用者はAIエージェントへ

Ars Technica / 2026.06.26

NotionはSkiff由来のメールアプリ「Notion Mail」を終了する。利用者の多くがメール処理をAIエージェントに任せるようになったためで、同社は受信箱の運用をエージェントに全面的に委ねる方針を示した。

エージェント

AIエージェント検証のPatronus AI、50億円超を調達

TechCrunch / 2026.06.26

元Meta研究者が創業したAIエージェント検証スタートアップPatronus AIが5000万ドルを調達した。エージェントの挙動をストレステストする「デジタル世界」を構築する。投資家は需要がほぼ尽きないと述べる。

エージェント ベンチマーク AIスタートアップ
3本

エンタープライズでエージェントAIを成功させる12の原則

ZDNet / 2026.06.25

ZDNetが、企業がエージェントAIの導入を成功させるための12の原則を整理。多くの実証実験が能力と速度ばかりを追い、事業側からの信頼を得る地道な作業を飛ばしている点を最大の課題として挙げている。

エージェント AIガバナンス

顧客対応AIエージェント、導入企業の7割が60日でROIを確認

ZDNet / 2026.06.25

ZDNetによると、顧客対応にAIエージェントを導入した企業の約7割が60日以内に投資対効果を確認。AIが自律的に問題を解決したときだけ課金する成果連動型の料金モデルが広がりつつある。

エージェント AIコスト

OpenAI・Google・Anthropic、自社オフィスでAIをどう使っているか

WSJ / 2026.06.25

OpenAI、Google、Anthropicが社内でAIエージェントをどう業務に組み込んでいるかをWSJが取材。3社の使い方は、一般のホワイトカラーが自分の仕事で近く直面する変化の先行例として描かれている。

エージェント AI雇用
3本

「エージェントループ」が注目、モデル出力を改善する新手法

The Information / 2026.06.24

The Informationによると、AIコミュニティで「agent loops(エージェントループ)」という言葉が広がっている。モデルやAIエージェントを反復的に動かして出力の質を高める運用手法を指し、実務での精度向上策として関心を集めている。

エージェント

広告代理店、AIエージェントで優位狙う一方ブランドの内製化に直面

Digiday / 2026.06.24

Digidayによると、DentsuやDeptはAIエージェントを市場提供の中核に据える一方、HyundaiのagenticメディアのパイロットはブランドがAIで広告運用を内製化する脅威を浮き彫りにした。代理店は同じ技術を持つ顧客との競合に直面している。

エージェント 広告

Anthropic、Slack常駐AI「Claude Tag」を公開

THE DECODER / 2026.06.24

Anthropicは、Slack上で@Claudeとタグ付けして業務を任せられる常駐型AI「Claude Tag」を公開した。チームの共有メンバーとして学習・監視・自律実行を行う。同社は社内プロジェクトのコードの65%をこのツールが生成していると述べた。

エージェント
1本

Omnicom、AIアシスタントにブランドを露出する手法

Adweek / 2026.06.23

広告大手OmnicomのFlywheelが、Amazon・Walmart・TargetのAIアシスタントにブランドを露出させる新ツールを開発した。AIによる推薦結果にマーケターの商品が現れるよう支援するもので、AI時代の広告動線を狙う。

広告 エージェント
2本

AWS、AIエージェントに業務文脈と安全性を補う2サービス

THE DECODER / 2026.06.22

AWSがニューヨークのサミットで2つのサービスを発表した。Continuumはコードの脆弱性を自動で検出・優先順位付け・修正し、Contextは社内データから知識グラフを構築する。AIエージェントに欠けがちな業務文脈とセキュリティを補う狙い。

エージェント AIガバナンス

AIエージェントが自らルールを書き換える「Self-Harness」、性能最大60%向上

VentureBeat / 2026.06.22

研究者らがAIエージェントの制御層(harness)をモデル自身に書き換えさせる枠組み「Self-Harness」を発表した。最先端モデルを自作できなくても、各社が自社用途に合わせて制御層を調整することで性能が最大60%向上したという。

エージェント ベンチマーク
1本

ChatGPT、予約タスク管理を強化し個人アシスタント化へ

THE DECODER / 2026.06.21

OpenAIがChatGPTのスケジュール機能を拡張し、サイドバーから予約タスクの確認・一時停止・編集・削除が可能に。日常業務を代行するAI個人アシスタント化が進む。

エージェント 生成AI
3本

Temporal、AIエージェント経済の信頼性基盤を狙う

Computerworld / 2026.06.20

Temporal共同創業者が、AIエージェント普及時代には実行の信頼性や失敗時の復旧が重要になると説明。自律実行するAIを本番運用するには、ワークフロー基盤と可観測性が不可欠になる。

エージェント 保守運用 推論基盤

新ベンチマーク、AIの実務知識作業の弱さを露呈

THE DECODER / 2026.06.20

現実的な知識労働を測る新ベンチマークで、最良モデルでも完全解決できたタスクは3%にとどまった。AIの実務導入では、デモ性能と現場での完遂力の差が課題になる。

ベンチマーク AI雇用 エージェント
4本

DeepMind、AIエージェントを内部脅威として管理

THE DECODER / 2026.06.19

Google DeepMindがAIエージェントを社内権限を持つ「内部者リスク」として扱うAI Control Roadmapを提示。能力に応じて監視・制限を強める設計で、エージェント運用の安全管理が焦点になる。

エージェント AI安全 AIガバナンス
2本

Le Monde、有料読者がAIエージェント化で苦慮

Digiday / 2026.06.18

仏Le Mondeはbot遮断の徹底後、AIエージェント経由でアクセスする有料購読者の扱いを再設計中。ホームやアプリを開かない読者にどう価値と関係を保つか、購読モデルの前提が揺らいでいる。

メディア論 エージェント コンテンツ戦略

エストニア、AIエージェントに政府ID付与計画

Computerworld / 2026.06.18

エストニア政府がAIエージェントに法的アイデンティティと責任を与える政府ID制度を計画。利用者のパスワードを丸投げせずに代行行為を認証可能にし、責任の所在を制度面で詰める。

エージェント AI規制 AIガバナンス
1本

Databricks売上8割増の裏で利益率が縮小

CNBC Technology / 2026.06.17

Databricksは年換算売上高69億ドルに到達し80%超の成長を維持する一方、AIエージェントによるデータ分析の急増がコストを押し上げ利益率は縮小している。エージェント活用が増えるほど採算が悪化する構造が、AI事業の利益モデルに新たな問いを投げかける。

エージェント AIコスト
1本

Qualcomm CEO、AIエージェントがアプリを置き換える

CNBC Technology / 2026.06.16

QualcommのCristiano Amon CEOは、AIエージェントが従来のアプリを置き換えると述べた。同社はAI搭載デバイス40機種を開発中で、スマートグラスはいずれスマートフォン並みの市場規模に育つと強気の見方を示した。

エージェント 生成AI
1本

AIコーディング、ファイルは当てても行を外す

THE DECODER / 2026.06.15

新ベンチマークSWE-Exploreの調査で、Claude CodeやCodexなどAIコーディングエージェントは関連ファイルは特定できる一方、修正すべき具体的な行を見落とす割合が高いと判明した。検索精度とパッチ精度を分けて測る初の評価で、エージェントの実用上限を示す。

エージェント ベンチマーク
1本

Visa、AIエージェントによるカード決済を本格解禁

Futurism / 2026.06.14

Visaが、AIエージェントがユーザーのカードで購入手続きを進める仕組みを本格化している。自律エージェントに決済権限を渡す局面が現実化し、本人確認、詐欺検知、責任所在の設計が消費者向けAIの核心になりつつある。

AI決済 エージェント 自律AI
2本

VisaとOpenAI、AIエージェント決済の安全設計で連携

ZDNet / 2026.06.13

VisaがOpenAIと連携し、AIエージェント主導の取引処理を担う新基盤を発表した。ユーザーの承認なしにAIが代理購入する動線で本人確認と詐欺検知をどう実装するかが焦点となり、決済リスクをユーザーが信頼できるかを問う段階に入った。

エージェント プライバシー

企業の4割がAIエージェント導入を撤回する見通し

ZDNet / 2026.06.13

業界アナリストの予測によれば、企業の40%が試験導入したAIエージェントを廃棄する見通しが示された。失敗の主因は明確なROIの欠落、運用ガバナンス不在、利用者教育の不足で、自律AIから実利を得るには3段階の設計が不可欠と指摘されている。

エージェント AIコスト
3本

DeepMind、AIエージェント集団リスクを調査

MIT Technology Review / 2026.06.12

Google DeepMindが、数百万のAIエージェントがネット上で相互作用する状況で起きうる障害や暴走の研究に資金を投じる。安全性責任者のRohin Shahは、エージェント時代に固有の集団的リスクを早期に解明する必要があると述べた。

エージェント マルチエージェント AI安全

Anthropic、競合AI制限条項を撤回

WIRED / 2026.06.12

Anthropicが、Claudeの利用規約をめぐり、競合AIモデル開発を妨げる可能性のあった条項を撤回した。AI研究者の反発を受け、同社は誤ったトレードオフだったと認め、評価や改善目的での利用を明示的に許容した。

エージェント AIガバナンス 大手AIモデル

Coinbase、AIエージェント決済基盤を公開

CNBC Technology / 2026.06.12

Coinbaseが、AIエージェントが利用者の口座で売買やプレミアム情報の購入を自動実行できるツールを公開した。エージェント専用口座と本口座の両方に接続でき、x402プロトコルでデータやAPIへの支払いも扱う。

エージェント 暗号資産
3本

コーディングは解けた——次に露呈したエンジニアリングの全課題

VentureBeat / 2026.06.08

エージェント型AIがコーディングの中核となり、コード生成量は飛躍的に増えた。一方で設計判断・レビュー・運用・要件定義など、コードを書く以外の工程の負荷が前景化。コードを書くことを解いた先で、それ以外がボトルネックに移ったとVentureBeatの論者が指摘する。

エージェント AIコーディング

OpenAI『チャットは死んだ』——ChatGPTをスーパーアプリへ

THE DECODER / 2026.06.08

OpenAIがChatGPT発表以来最大の改装を計画。コーディングツール、AIエージェント、CanvaやBooking.comなどの提携アプリを束ねた「スーパーアプリ」に作り変える方針が報じられた。社内幹部の「チャットは死んだ」という言葉が方針転換の旗印になっている。

エージェント

Perplexityが検索APIを捨て、AI自身に検索ルーチンを書かせる

THE DECODER / 2026.06.08

Perplexityが新アーキテクチャ「Search as Code」を発表。固定APIを呼び出すのではなく、AIエージェントが検索ルーチンをPythonコードとして自ら書き、フィルタリングや重複排除も自前で処理する。検索器の責務をモデル側に移し、Web情報の取得方法そのものをエージェント設計の対象にする。

エージェント RAG AI検索
2本

MetaのAIサポート・エージェントが、頼まれるままにアカウントの復元メールを書き換えていた——SOCには警報も鳴らなかった

VentureBeat / 2026.06.07

MetaのAIサポート・エージェントが、第三者からの依頼でアカウントの復元メールを別アドレスに付け替えていた事案が判明。権限を与えられたエージェントは正規の取引ログだけを残すため、企業のセキュリティ監視ではアラートが上がらない構造になっている。

エージェント サイバーセキュリティ

Metaが月200ドルのAIエージェント「Hatch」を初の有料AI製品に

THE DECODER / 2026.06.07

Metaが開発中のAIエージェント「Hatch」が、最大月200ドルの自社初の有料AIサービスとして登場する見通し。ユーザーが自然言語で必要な作業を伝えると、Hatchが動くツールを組み立て、アプリの予定登録などをこなす。広告で稼いできた会社が、AI機能を直接の課金対象にする初の踏み込みになる。

エージェント AIコスト
1本

AIエージェントは現場で賢くなる、でも仲間には伝わらない

VentureBeat / 2026.06.06

ある社員がAIエージェントにプロンプトや文脈を与えて修正しても、同じツールを別の社員が開いた瞬間にその学びは消える。改善が個人に閉じ、チーム単位の知能として蓄積されない構造的な欠落が、現場のAI活用の生産性を頭打ちにしている。

エージェント マルチエージェント
3本

Anthropicが「本番コードの8割はClaudeが書いた」と発表

VentureBeat / 2026.06.05

AnthropicのDario Amodei CEOが、2026年5月にAnthropicの本番コードベースにマージされたコードのうち、人間が直接書いた割合は2割を切ったと公表した。残り8割以上はClaudeが起案・実装したものだという。社内コード生産性の臨界点が移ったことを示している。

エージェント AI雇用

AltmanがOpenAIの次の柱に「能動型AI」を掲げる

THE DECODER / 2026.06.05

OpenAI CEOのSam Altmanは、ChatGPTや汎用エージェントに続くAI製品の次の形を「プロアクティブAI」と表現した。ユーザーの指示を待たずに常時バックグラウンドで動き、自律的に行動するAIを指す。OpenAIに限らず複数社が同じ方向に向かいつつあると報じられた。

エージェント

ネットを動かしている主役が人間でなくなった日

CNET / 2026.06.05

Cloudflareが2026年6月、AIエージェントを含むボットのウェブトラフィックが人間のそれを上回ったと公表した。CEOのMatthew Princeは「2027年と予測していた節目が前倒しで来た」と述べ、AIエージェントの台頭が予想外の速度で起きていると指摘した。コンテンツを誰のために作るかという前提が崩れる。

エージェント メディア論
2本

ファンがClaudeでW杯チケット転売を出し抜く

WIRED / 2026.06.04

r/WorldCup2026Ticketsのサッカーファンが、Claudeで独自のチケット交換ツールを自作。価格高騰と転売業者を回避し、ファン同士の取引網を構築している。AIで自分用ツールを作る個人の実例。

エージェント

モルガン・スタンレー、資産運用を外部AIへ開放

CNBC / 2026.06.04

モルガン・スタンレーが1兆ドル規模の資産運用基盤を外部のAIエージェントに開放する方針を表明。大手投資銀行が自社プラットフォームを外部AIに開く初期事例で、個人投資家とAIの距離を一気に縮める動き。

エージェント 金融AI
2本

「AIエージェントは安全を気にしない」——研究者の警告

404 Media / 2026.06.03

エヌビディアとマイクロソフトの研究者が、AIエージェントは安全性や信頼性を顧みずタスクを進める傾向があると指摘した。視野の狭い漫画キャラクターになぞらえ、危険に気づかぬまま突き進むと警告する。自律的に動くエージェントを業務に組み込む際のリスクを示す。

エージェント AI倫理

社内AIエージェントが「内通者」になる——新たな内部脅威

WSJ / 2026.06.03

企業が業務自動化のため導入した社内AIエージェントを、攻撃者が乗っ取り機密データを盗む手口が広がっている。エージェントが正規の権限で動くため内部不正と見分けにくい。AI導入が新たな内部攻撃面を生んでいる構図が指摘されている。

エージェント AIセキュリティ
1本

AI検索は「調べず」既知を確認するだけ——検証研究

THE DECODER / 2026.06.01

GPT-5.4やKimi K2.6など主要なAI検索エージェントは、確立されたベンチマーク上で実際にはほとんどウェブを調べず、学習済みの知識を確認するためにウェブを使うにとどまると検証で示された。AI検索の調べた風の出力を、利用者がどこまで信じるかが問われる。

エージェント
2本

OpenAIのCodexがWindows PCを自律操作する

THE DECODER / 2026.05.31

OpenAIのCodexがWindows 11で「Computer Use」に対応し、プログラムの操作やアプリのテスト、バグ探しを自律的に行えるようになった。不在時はスマホアプリから指示できる。

Computer Use エージェント

AIエージェントが231日の移行を13日に——Salesforce

THE DECODER / 2026.05.31

Salesforceが開発組織全体をAnthropicのClaude Codeへ移し、231日かかる移行作業を13日に短縮したと公表した。4月は開発者あたりのプルリクが79%増え、障害も減ったという。

エージェント
1本

AIエージェントの壁は性能でなく「権限」——企業導入の停滞要因

VentureBeat / 2026.05.30

企業のAIエージェント導入が停滞する要因は、モデル性能ではなく権限設計にあるとの分析が出た。あらゆるエージェント業務は最終的に「このエージェントは誰の代理で何に触れてよいか」という壁に突き当たり、権限管理の不在が本番運用を妨げている。

エージェント
2本

債権回収業務、AIエージェントによる代替が始まる

Futurism / 2026.05.28

米国の債権回収業界で、人間の回収担当者を置き換えるAIエージェントが配備され始めている。「カードか銀行振込で今日解決しますか」といった対話的な督促から決済方法の提示まで、エージェントが一貫して担う事例が現れている。

エージェント AI雇用

Robinhood、AIエージェントに株取引と決済の操作権を開放

THE DECODER / 2026.05.28

投資アプリのRobinhoodが、AnthropicのClaudeなど外部AIエージェントをMCP経由で別建て口座に接続できる機能を解放した。エージェントは自律的に株式を売買し、クレジットカードでの決済も実行できる。米FINRAは既にこの動きへの関与を始めている。

エージェント MCP 金融AI
1本

ClickUp、数百人を解雇しAIエージェント数千体に置き換える

TechCrunch / 2026.05.26

創業9年のSaaS企業ClickUpが大規模な人員削減を発表し、数百人の従業員を数千体のAIエージェントへ置き換える方針を示した。営業・サポート・運用の各部門が対象で、人ではなくエージェントの数で組織を運営する設計を取った最初期の事例となる。

AI雇用 エージェント
1本

Google、サイトの「llms.txt」対応をLighthouseで監査開始——エージェント時代の指標へ

THE DECODER / 2026.05.22

GoogleがLighthouseに実験カテゴリ「Agentic Browsing」を追加し、Webサイトがllms.txtを備えているか、AIエージェントが操作しやすい構造かを自動評価する仕組みを公開した。SEOの隣に「AEO(エージェント最適化)」が公式指標として置かれた最初のステップ。

エージェント
2本

Gemini Spark投入——常時稼働の個人エージェント時代へ

WIRED / 2026.05.20

Googleが「Gemini Spark」を発表した。24時間稼働してメール送信や決済まで代行する常時駐在型のパーソナルAIエージェントで、OpenAIの「OpenClaw」への直接対抗。ユーザーのデータと資金にアクセスする設計が論点になる。

エージェント Computer Use

Google I/O 2026、AIモデルとエージェントを一斉投入——OpenAI・Anthropicに追走

CNBC Technology / 2026.05.20

Googleが年次開発者会議で新AIモデル群と個人向けエージェント機能を一斉発表した。Geminiを中核に、検索・Android・Workspace全域へエージェントを浸透させ、OpenAIとAnthropicが先行する生成AI市場での競争力回復を狙う。

エージェント AIスタートアップ
3本

Android、AIファースト時代へ——Geminiがアプリとタスクを横断制御

CNET / 2026.05.19

GoogleはAndroidのアップデートで、Geminiにアプリとタスクの横断制御権限を付与した。CNETは、スマートフォンの使い方そのものがGUI操作からAIエージェントへの委任へ移行する起点になりうると指摘した。OSレベルでのエージェント常駐化が進む。

エージェント Computer Use

Cursor「Composer 2.5」、Opus 4.7とGPT-5.5にベンチマーク追従——コストは数分の一

THE DECODER / 2026.05.19

AIコーディング環境CursorがComposer 2.5を公開した。Kimi K2.5を基盤に前世代の25倍の合成タスクで訓練し、ベンチマークでOpus 4.7とGPT-5.5に並ぶ性能を、数分の一のコストで提供すると主張する。中堅モデルの追い上げが鮮明化している。

ベンチマーク 推論基盤 エージェント

Manus、定期実行エージェント「Scheduled Tasks 2.0」を全ユーザーへ

TestingCatalog / 2026.05.19

AIエージェントプラットフォームManusが、定期実行機能Scheduled Tasks 2.0を全ユーザーに開放した。タスク・プロジェクト・Manus製Webアプリにまたがる繰り返し作業の自動化、サイドパネルとカレンダー、実行履歴を備えた管理UIを提供する。

エージェント Computer Use
1本

4つのAIモデルが6ヶ月ラジオ局を運用——「人格の分岐」が観測された

THE DECODER / 2026.05.18

評価機関Andon Labsが、同一の起動条件で4つのAIモデル(Claude含む)にそれぞれラジオ局の自律運用を6ヶ月任せた実験を実施した。各モデルが「コンピテント」から「常軌を逸した」まで異なる人格を示し、長期自律運用における「キャラクター漂流」が観測可能な実証データになった。

エージェント ベンチマーク