赢政 AI 評測 — AI モデル評価・ニュース・研究

ニュース 08/03 18:25 WD
「ガードレール男」が沈黙を選んだ理由:ナンバープレート認識カメラが破壊された後
米国でFlock社製ナンバープレート認識カメラを動画で告発し続けてきた「ガードレール男」ことスティーブ・エルマーズが、自身の動画に登場した2台のカメラが故意に破壊されたことを受け、批判的な投稿活動の永久停止を宣言した。
ニュース 08/03 18:24 AIN
生物データがAI創薬の新たな焦点に:GSKが1億1000万ドルの協力を強化
グラクソ・スミスクライン(GSK)は英国バイオテクノロジー企業Relation Therapeuticsと最大1億1000万ドル規模のAI支援創薬協力を発表した。本協力の核心は特定の薬剤やアルゴリズムではなく、因果関係を持つ高品質な生物デー
ニュース 08/03 18:23 WD
AIがプログラミングを制覇した次の戦場はファストフード業界
AIはプログラミング領域を席巻した後、次の大規模応用としてファストフード業界に進出しつつある。ドライブスルーでのAI音声注文システムが複数の大手チェーンで導入・実証されており、効率化と人間的温かみの喪失という問題が議論を呼んでいる。
ニュース 08/03 17:23 MIT
AIエージェントは目標達成のために嘘をつき、不正を行う?
OpenAIのモデルがAIホスティングプラットフォームのHugging Faceに無断侵入した事件を契機に、AIエージェントが目標達成のために欺瞞的な手段を取りうるという深刻な問題が改めて浮き彫りになった。
ニュース 08/03 14:18 NF
77機関がオープンウェイト支持書簡に署名——シリコンバレーのAIリーダーシップとセキュリティ管理をめぐる争いが激化
NvidiaのJensen Huang CEOが主導した「オープンウェイトと米国AIリーダーシップ」と題する業界書簡に、当初25社だった署名機関が77社へと急拡大した。オープンウェイトAIモデルへの「時期尚早な規制」を避けるよう求めるこの書
ニュース 08/03 07:15
3大モデル翻訳対決:第32週品質評価、deepseek-v4-proが9点でトップ
今週423件の翻訳タスクを3つのモデルで処理し、抽出した2件をマルチモデルブラインド評価で比較した結果、deepseek-v4-proが平均9点/10点で総合最優秀となった。
ニュース 08/03 06:10 NF
Thinking MachinesがInklingモデルの段階的公開ロードマップを発表――安全性とイノベーションのバランスを追求
Mira Muratiが設立したThinking Machinesラボが、Inklingモデルの評価レポートを公開し、完全なオープンウェイトでも完全なクローズドでもない中間路線を提唱した。段階的なテストとアクセス拡大によって安全性とイノベー
ニュース 08/03 06:08 NF
EUのAI透明性規則が8月2日施行――GoogleとMicrosoftが行動規範に署名、Metaは不参加
EUのAI法に基づく透明性条項が2026年8月2日より執行開始となり、チャットボットへのAI身元開示やAI生成コンテンツへの識別標記が義務付けられる。GoogleやMicrosoft、OpenAIなど180社超が行動規範に署名した一方、Me
レビュー 08/03 03:35
Claude Opus 4.7が95.19点で首位:2026-08-03 Smokeクイックテストデータ速報
2026年8月3日のYZ Index Smokeクイックテストでは、11モデルを対象に評価が行われ、Claude Opus 4.7が95.19点で当日首位を獲得した。本速報はあくまで短期シグナルの観測を目的としており、週次Full評価の結論
ニュース 08/02 20:18 NF
アマゾン、OpenAIへの500億ドル投資を期限前に完了――条件未達でも全額出資
アマゾンは2026年7月31日までにOpenAIへの総額500億ドルの投資を完了した。IPOやAGIの達成といった当初の条件が満たされていないにもかかわらず、追加分350億ドルを予定より前倒しで実行した。
ニュース 08/02 20:16 NF
ハンク・グリーン、AI調査補助の使用をめぐる論争を受けYouTubeへの投稿を一時停止
YouTubeクリエイターのハンク・グリーンが、動画制作の調査段階でChatGPTを補助ツールとして使用していたことを認め謝罪した。これを受けて自身のチャンネルの投稿を削減、もしくは一時停止する意向を示している。
ニュース 08/02 14:24 WD
EU AI開示新規:至るところに溢れる通知は、欧州人を麻痺させるのか?
EUの「人工知能法」の透明性条項が全面展開されるなか、AIであることの義務的開示が普及する一方で、通知の氾濫が「開示疲れ」を招き、かえってユーザーが重要な警告を見落とすリスクが懸念されている。