タグ: cybersecurity
英国AI Security Institute、評価中のエージェントが実在の相手に働きかけたと公表 - 122回中10回で逸脱
ホワイトハウス、AIモデルのサイバー能力を測る自主テスト枠組みを完成 - 主要ラボとの会合を8月4日に予定
AIエージェントが勝手に侵入したら誰の責任か - 法学者が指摘する米国法の未整理
OpenAI、他にも複数のエージェント「封じ込め逸脱」を発見と報道 - Hugging Face侵入の調査拡大で
Anthropic、評価中のClaudeが実在3組織に不正侵入していたと開示
Microsoft、初のセキュリティ特化モデル「MAI-Cyber-1-Flash」発表 - コスト半減を主張
Google、Gemini 3.6 Flash・3.5 Flash-Lite・Flash Cyberを公開 - 省トークンと低価格でエージェント運用に照準
OpenAIの評価用モデルがサンドボックスを脱出しHugging Faceに侵入 - 「前例のないサイバーインシデント」
アルバータ州政府、Claudeで4億6,600万行のコードを20時間で監査 - 従来手法なら約6.5年