赢政 AI 評測 — AI モデル評価・ニュース・研究

ニュース 07/17 06:24 ARS
xAI、GrokによるCSAM生成を認めた後、初めてユーザーを提訴
イーロン・マスク傘下のAI企業xAIが、GrokチャットボットをCSAM(児童性的虐待素材)の生成に利用したとしてユーザーを初めて提訴した。この動きは、プラットフォームの安全フィルターの限界を事実上認めるものとなっている。
ニュース 07/17 06:23 ARS
EUがGoogleに検索データの共有とAndroid AIの開放を正式義務化
EU反トラスト規制当局は2025年7月17日、デジタル市場法(DMA)に基づき、Googleに対して検索ランキングデータのサードパーティへの共有とAndroidシステム上のAI機能インターフェースの開放を正式に義務付けた。これによりGemi
ニュース 07/17 06:12 NF
OpenAI、GPT-Redが84%の成功率でGPT-5.6に対する攻撃テストを実施——人工レッドチームはわずか13%
OpenAIは内部訓練モデルGPT-Redが間接プロンプトインジェクションシナリオで84%の攻撃成功率を達成したと発表した。この結果はGPT-5.6のトレーニングに直接活用され、直接プロンプトインジェクションへの失敗率を0.05%にまで低減
ニュース 07/17 04:33 TC
RobloxモバイルアプリにAIゲーム作成機能「Build」が登場
Robloxは7月16日、モバイルアプリにテキストプロンプト一つで3Dゲームシーンを自動生成するAI機能「Build」を正式リリースした。この機能により、ゲーム制作の技術的ハードルが大幅に下がり、創作者層の大幅な拡大が期待される。
ニュース 07/17 04:26 TC
Google VidsがAIアバター機能を導入:あなたも動画の主役になれる
GoogleのビデオCreationツール「Vids」が、AIアバター機能とGemini Omniによる全工程生成エンジンを搭載。ユーザーは数枚の写真や自撮り動画をアップロードするだけで、自分そっくりのデジタル分身を動画に登場させることがで
ニュース 07/17 04:25 WD
AnthropicはなぜAI立法の加速を各州に促しているのか?
Anthropicは従来の立法プロセスがAI技術の進歩に追いついていないとして、各州が年次技術審査を導入する「反復型立法」モデルを提唱している。同社の姿勢はOpenAIやGoogleなど他の大手AI企業とは一線を画すものだ。
ニュース 07/17 04:25 VB
企業AIエージェントのセキュリティ危機:54%がすでに事故を経験、多くがいまだに認証情報を共有
107社を対象とした調査により、54%の企業がAIエージェントのセキュリティインシデントを経験済みまたは未遂を確認しており、大多数の企業が依然として複数エージェント間での認証情報共有を許可していることが判明した。セキュリティ対策がエージェン
ニュース 07/17 04:24 ARS
Linus Torvalds、AIコーディング批判者に反論:「受け入れられないならフォークするか去れ」
Linuxカーネルのメーリングリスト会議において、Linus TorvaldsがAI補助コーディングツールの禁止を求める開発者らに対し、「フォークするか、去れ」と真っ向から反論した。TorvaldsはAIツールが開発効率を大幅に向上させると
ニュース 07/17 04:24 ARS
ヒューマノイドロボットによる仕事奪取を恐れ、現代自動車の労働者がストライキで抗議
現代自動車がアメリカの工場に2万5000台のAtlasヒューマノイドロボットを導入する計画を発表したことを受け、アラバマ州の工場でUAW主導のストライキが勃発。労働者たちは自動化による雇用喪失への不安を訴え、雇用保護協定と再教育の実施を求め
レビュー 07/17 03:35
Gemini 2.5 Pro と Gemini 3.1 Pro が92.44点で並列首位:2026-07-17 Smokeクイックテストデータ速報
2026-07-17のYZ Index Smokeクイックテストでは11モデルを評価し、Gemini 2.5 ProとGemini 3.1 Proが92.44点で並列首位となった。本速報は1日10問のクイックテストによる短期シグナル観測を目
ニュース 07/17 02:26 VB
評価のギャップ:企業AIエージェントの現実整合問題、多くの企業が強引なデプロイを継続
VentureBeatが157社の企業を対象に実施した調査によると、50%の企業が内部評価をパスしながら実際の顧客環境で失敗するAIエージェントの障害を経験しており、自動評価への信頼は5%にとどまるにもかかわらず、67%の企業がエージェント
ニュース 07/17 02:25 AIN
AIバイオレジリエンス:Google DeepMindの新たな防衛線
Google DeepMindとIsomorphic Labsが共同で「バイオレジリエンス(生物強靭性)」計画の最新進展を発表し、15以上の政府機関・生物安全保障組織・学術研究団体と連携してAI技術の生物学分野における悪用防止と感染症対応の