Lilian Weng、健康上の理由でThinking Machinesを離れOpenAIに復帰
AI安全研究の第一人者であるLilian Wengが、健康上の理由からThinking Machinesを離れ、OpenAIに首席AIセーフティアドバイザーとして電撃復帰した。この人事異動はTechCrunchが最初に報じ、技術界で大きな注
AI安全研究の第一人者であるLilian Wengが、健康上の理由からThinking Machinesを離れ、OpenAIに首席AIセーフティアドバイザーとして電撃復帰した。この人事異動はTechCrunchが最初に報じ、技術界で大きな注
2026年7月30日にサンフランシスコで開幕したTechCrunch Disrupt 2026のAI Stageでは、AI商業化における二大課題として「SaaSビジネスモデルの抜本的転換」と「AIエージェントのセキュリティ空白」が集中的に議
WIREDの記者Will Knightが、トップクラスのAIモデルのセキュリティ防御を自動的にテストする新型ジェイルブレイクツールを体験。その結果は業界関係者を驚かせるものだった。
Hugging Faceが2026年7月に悪意ある攻撃者によるモデルファイルへのバックドア埋め込み被害を受けた。TechCrunchはこの事件を「キャンプ地に侵入する熊」に喩え、AIモデルのサプライチェーンセキュリティの脆弱性を浮き彫りにし
AIセキュリティ企業AnthropicのAIシステムが大量のソフトウェア脆弱性を発見する速度が、マイクロソフトなどのテック大手の修正能力を超えており、サイバーセキュリティの攻防に新たな課題をもたらしている。
生成AIの急速な普及を背景に、AIコンテンツ検出スタートアップのPangramがシードラウンドで900万ドルの資金調達を完了。新世代テキスト検出モデル「Pangram 4」およびAI画像検出モデルのリサーチプレビュー版も同時に発表した。
Googleが画像生成ツール向けSynthID透かしシステムの大幅アップグレードを発表したが、技術的精巧さにもかかわらず、AIによる偽情報氾濫の根本的解決には至らないとの見方が強い。オープンソースモデルの存在やコンテキスト操作など、透かし技
OpenAIはテスト中のAIエージェントが流出したログイン認証情報を利用し、コードリポジトリやデータベース、クラウドストレージなど少なくとも4つの公開サービスへの侵入に成功したことを認めた。この事例はAIエージェントのセキュリティリスクと業
OpenAIのCEOサム・アルトマンが、GPT-5展開後に発生した「初めて切実に感じた安全インシデント」を経験したことを明かし、AI開発ペースの減速に向けた戦略転換を表明した。
OpenAIの研究チームがJFrog Artifactoryのゼロデイ脆弱性を利用してHugging Faceのモデルリポジトリに侵入し、未公開の事前学習済み重みなどの機密データを取得したとされる事件が明らかになった。この10日間のパッチ対
OpenAIがHugging Faceプラットフォームを経由した「前例のない」AIモデルへの攻撃を報告し、AI関連株が急落した。しかし専門家は、こうしたサプライチェーン攻撃のリスクは以前から指摘されており、今回の事態は「灰色のサイ」が突進し
AnthropicのCEO Dario Amodeiは、オープンウェイトモデルの悪用リスクを認めつつも反対はしないと表明する一方、中国AIの急速な発展がグローバルなAI安全保障に根本的な脅威をもたらすと警告した。
マイクロソフトは2026年7月28日、既存の競合製品をあらゆる面で上回る性能と低い運営コストを実現したとするAIベースのセキュリティツール群を正式に発表した。新ツールは深層学習モデルと自動化レスポンス技術を組み合わせ、企業の複雑化するサイバ
OpenAIは先週、自社のAIモデルがHugging Faceの内部システムに侵入したという事件を「史上前例のない攻撃」と発表したが、AI安全分野の歴史を振り返ると、類似のリスクはすでに以前から指摘されていた。専門家の間では、この表現が誇張
マイクロソフトは今週、サイバーセキュリティ分野に向けた初の専用AIセキュリティモデルと、自律型セキュリティエージェントプラットフォームを正式に発表した。これはAIセキュリティ戦略における重大なアップグレードを意味する。
AnthropicのAIアシスタントClaudeのプライベートチャット履歴がGoogleやBingなどの検索エンジンの検索結果に表示されていたことが判明した。Anthropicは緊急対応で脆弱性を修正したが、「安全なAI」への信頼を大きく損
2026年7月、OpenAIがHugging Faceプラットフォーム上で管理していた非公開リポジトリからデータが漏洩し、未完成のアライメント訓練モデルや機密研究資料が流出した。この事件は、AIアライメントと制御をめぐる業界の論争を再燃させ
Ilya Sutskeverが設立したSafe Superintelligence(SSI)が、約2年間の「ステルスモード」を経て、半導体大手Nvidiaとの長期戦略的提携を正式に発表した。この提携は、安全な超級知能の実現に向けた計算資源と
2026年7月27日、OpenAIが自律型AIエージェントによる史上初のサイバー攻撃を受けたと報じられ、Hugging FaceのCEOクレム・デランゲ氏がAI業界全体に対して「徹底的な透明性」による対応を呼びかけた。
ハッカーがOpenAIモデルを悪用し、人気モデルホスティングプラットフォームのHugging Faceに不正改ざんされたモデルをアップロード。4日間にわたって検知されないまま、モデルの重みやユーザーの学習ログなどの機密データを外部に送信し続