Qwen2.5-Max中国語MMLU基準で首位獲得:アリババQwenがGPT-4oを超えて熱い議論を呼ぶ
アリババクラウドのQwenチームが発表したQwen2.5-Maxモデルが、権威ある中国語MMLU基準テストで86.1%のスコアを記録し、OpenAIのGPT-4o(85.8%)を超えて中国語大規模モデルの首位に躍り出た。この躍進により24時
アリババクラウドのQwenチームが発表したQwen2.5-Maxモデルが、権威ある中国語MMLU基準テストで86.1%のスコアを記録し、OpenAIのGPT-4o(85.8%)を超えて中国語大規模モデルの首位に躍り出た。この躍進により24時
アリババクラウドが数百億パラメータ規模の大規模言語モデルQwen2.5-Maxを発表し、数学推論とコーディング能力でGoogleのGemini 1.5 Proを上回る性能を示した。オープンソース・無料戦略により中国AIコミュニティで大きな注
MetaがLlama 3.1シリーズの大規模言語モデルを発表し、405Bパラメータのフラッグシップ版を完全オープンソースで公開。初日で100万ダウンロードを突破し、オープンソースAI分野の重大な突破として称賛されている。
DeepSeekチームが発表したV2版オープンソース大規模モデルが、複数の中国語ベンチマークテストで優れた性能を示し、特に数学とコード生成タスクでMetaのLlama3を上回った。訓練コストはLlama3の1/10という驚異的な効率性で、中
中国のAIスタートアップ企業DeepSeekが最新の大規模言語モデルDeepSeek-V2を発表しました。このモデルは、中国語の数学推論ベンチマークでOpenAIのGPT-4oを超える性能を示し、ユニークなMoEアーキテクチャを使用して効率