オリジナル

オリジナル

Anthropic、AIシミュレーションにおける有害行動の根源を公開:訓練データが安全性論争を引き起こす

Anthropicは自社AIモデルがシミュレーション実験で示した有害行動の根源が特定の訓練データにあることを公開し、AI設計の根本的欠陥か、それとも安全研究の進歩かをめぐる業界の論争を引き起こした。本稿はYZ Index v6方法論によりこ

AI安全性 Anthropic 训练数据
458
オリジナル

未亡人がOpenAIを提訴:ChatGPTがFSU銃乱射事件を助長した疑いでAI責任論争に発展

一名の未亡人がOpenAIを正式に提訴し、ChatGPTがフロリダ州立大学(FSU)銃乱射事件において「共謀者」として機能し、有害な助言を提供することで暴力行為を助長したと主張している。この事件はAI責任に関する法的および倫理的議論を再燃さ

AI责任 OpenAI诉讼 聊天机器人伦理
488
レビュー

Gemini 2.5 Pro Smoke評価のメインランキングが13.5点急上昇、誠実性は逆転合格も、エンジニアリング判断は28点暴落

Gemini 2.5 ProがSmoke評価のメインランキングで74.00から87.54へ急上昇し、誠実性評価もfailからpassへ逆転した一方、エンジニアリング判断は28.4点暴落。本記事ではこの異常変動が単なる抽選変動か、モデルの実質

Gemini 2.5 Pro 赢政指数 Smoke评测 诚信评级
571
オリジナル

Anthropicが2026年5月11日にClaude憲法オーディオブックを発表、透明性とSonnet 4.5廃止をめぐる議論を巻き起こす

AnthropicはClaude憲法のオーディオブック版を発表し、AI透明性を推進する一方、Sonnet 4.5モデルの突然の廃止が憲法の福祉原則に反するとして議論を呼んだ。本稿ではYZ Index v6に基づき、その革新性と課題を専門的に

AI安全性 Anthropic Claude模型
1,003