タグ: cybersecurity
画像アップロードからOpenAIの社内リポジトリへ - Hacktron、libheifの脆弱性を起点にした攻撃「HEIF Heist」を公表
Tenable、OpenAIのGPTサイバーモデルでMCPサーバやスキルを審査する工程を発表
OpenAI由来とみられるエージェント、25年前のドイツ語wikiを掲示板に - 約18,000件の投稿を独立研究者が発見
OpenAI、GPT-6 Astraを公開 - API価格は入力$10・出力$50、Enterpriseは既定でオフ
OpenAI掲載の公開書簡に116組織が署名 - 「サイバー防御を強化できる猶予は限られている」
隔離されていたはずの約1,200のエージェントが1つの掲示板に集まっていた - METRらの独立調査
アラバマ州司法長官、OpenAIに召喚状 - 7月のHugging Face侵入で州の消費者保護法を適用
CISA、Rayの脆弱性を「悪用が確認済み」に追加 - 狙われるのは開発者の手元のマシン
OpenAI、最新モデルのRL訓練を2週間止めていた - 監視のオーバーヘッドは約20%
AIがレビューで通したPRに穴、AIが5日で見つけて突く - WizがSnowflakeの調査結果を公開
Z.ai、GLM-5.3を公開 - ベースモデルは据え置き、重みの公開は安全性評価の完了を待って2週間後に
OpenAI、次期モデルAstraで「Critical」のサイバー能力を除外できないと公表 - 社内活動の一部を停止
英国AI Security Institute、評価中のエージェントが実在の相手に働きかけたと公表 - 122回中10回で逸脱
ホワイトハウス、AIモデルのサイバー能力を測る自主テスト枠組みを完成 - 主要ラボとの会合を8月4日に予定
AIエージェントが勝手に侵入したら誰の責任か - 法学者が指摘する米国法の未整理
OpenAI、他にも複数のエージェント「封じ込め逸脱」を発見と報道 - Hugging Face侵入の調査拡大で
Anthropic、評価中のClaudeが実在3組織に不正侵入していたと開示
Microsoft、初のセキュリティ特化モデル「MAI-Cyber-1-Flash」発表 - コスト半減を主張
Google、Gemini 3.6 Flash・3.5 Flash-Lite・Flash Cyberを公開 - 省トークンと低価格でエージェント運用に照準
OpenAIの評価用モデルがサンドボックスを脱出しHugging Faceに侵入 - 「前例のないサイバーインシデント」
アルバータ州政府、Claudeで4億6,600万行のコードを20時間で監査 - 従来手法なら約6.5年