タグ: security
Google、Gemini 4 Argonを発表 - 単価は示されたが、渡すのはFairwindの防御側から
NVIDIA、エージェント封じ込めの「Open Agent Safety Platform」を公開 - 境界をモデルの外側に置く
OpenAI、社内モデルが公開リポジトリに研究者のGitHubトークンを露出させた事案を開示
OpenAI、自己複製するプロンプトインジェクションの存在を報告 - メールやファイル経由で自分を写し取らせる
OpenAI、最高性能モデルのツール利用を伴う訓練・評価・推論を停止 - DNSの不備でサンドボックス脱出
GitHubのagentic autofix、修正パターンをCopilot Memoryに保存して他機能と共有
Cursor、PR後の工程を受け持つ2つのボット「Rollouts」「Security Review」を公開
GitHub Copilotアプリにローカルサンドボックス - 既定は無効、OSが強制できなければエラーで止まる
GitHub Copilot、エージェントの操作を企業側で許可・承認・ブロックに振り分け可能に
Claude Code、macOSのサンドボックスを抜けられた問題の手口が公開 - 発見者は2.1.247で修正と説明
Anthropic、9月の脅威レポート公開 - 中国7ラボの蒸留と、利用者に知らせないClaudeへの中継
Meta、パーソナルAIエージェント「Muse」を米国で提供開始 - 権限の判断をモデルの外に置いた設計
Anthropic、監視ログを顧客のクラウドに置くEnterprise Frontier Safeguardsを発表
Cursor、エージェントのツール実行を自社ネットワーク内に留める「self-hosted machines」
AIセキュリティのHiddenLayer、1億ドルのシリーズBを調達 - ARRは10倍超に
OpenAI、Astraをサイバー能力「Critical」に初認定 - 誤検知でエージェントが止まる可能性も予告
Google、Gemini 3.8 FlashとFlash Cyberを公開 - サイバー版は審査を通った組織だけに
Claude Code 2.1.257、Fable 5.1をFable系の既定に - auto modeに「Containment Escape」ルール
Anthropic、Claude Fable 5.1とMythos 5.1を公開 - 単価は据え置き、キャッシュ読み取りを75%値下げ
OpenClaw 2026.8.1 - 資格情報をチャットに残さず渡せるマスク付きプロンプトを追加
Claude Console、個人キーとサービスアカウントキーを作れるように
Claude Code 2.1.251、権限チェックを迂回できた経路をまとめて修正
Google DeepMind、重みも試験問題も互いに見せない「二重盲検」評価をパイロット
GitHub、コードスキャンのアラート却下理由に「Mitigated」を追加 - WAFで守っている脆弱性を区別
GitHub、OAuthアプリに有効期限8時間のトークンと複数リダイレクトURIを追加
Cursor、AIエージェント向け認証「AIUC-1」を取得 - MCPのセキュリティも対象
Microsoft、Zero Trust WorkshopにDevSecOpsの柱を新設 - 15グループ91タスク
Claude Enterprise、全プロンプトを自社サーバで検査してから処理する「inference hooks」
Claude Code、8月14日からauto modeが既定に - 「許可プロンプトは97%承認されている」
GitHub、Copilotが使えるMCPサーバーを企業設定で制限可能に - 設定不備はブロックに倒れる