テンセント、Hy4 Previewをオープンソース公開——770Bパラメータのコードベンチマークでは DeepSeek V4 Pro を上回るも、過剰な自己検証が実用的な応答速度を低下
テンセント混元チームが770BパラメータのMoEモデル「Hy4 Preview」を正式に発表・オープンソース化し、Terminal Bench 2.1でDeepSeek V4 Proを超えClaude Opus 5と同等のスコアを記録した。
テンセント混元チームが770BパラメータのMoEモデル「Hy4 Preview」を正式に発表・オープンソース化し、Terminal Bench 2.1でDeepSeek V4 Proを超えClaude Opus 5と同等のスコアを記録した。
アリババのQwenチームが2.4兆パラメータのMoE大型モデルQwen3.8-Maxの重みを公開し、数日後にはZhipuAI傘下のZ.aiがOpenRouterで匿名運用されていた「Ox Alpha」がGLM-5.3-Flashであることを
Zhipu AIが2026年8月26日にGLM-5.3-Flash(320B-A18B)を正式にオープンソース化し、同モデルが「Ox Alpha」名義で匿名テストを経てOpenRouterとOpenCode双方のプラットフォームで利用量首位
Moonshot AIは2026年7月16日にKimi K3モデルを発表。総パラメータ数2.8兆、100万トークンコンテキスト対応、ネイティブビジョン処理をサポートし、7月27日に重みの公開を予定している。
NVIDIAがSIGGRAPH 2026でCUDA 15プラットフォームを発表し、混合エキスパート(MoE)アーキテクチャモデルの学習・推論効率を最大40%向上させると公式に主張している。ただし、この数値は独立した検証を経ておらず、CUDA
DeepSeekは7月31日にV4 Flashモデルをリリースし、MITライセンスによる重みの公開、100万トークンのコンテキスト長、競争力のあるAPI価格を特徴として、Agentタスク向けのコストパフォーマンスに優れた選択肢として位置づけ
Thinking Machinesは2026年7月31日、総パラメータ数2,760億・1トークンあたり活性化パラメータ120億のMoEモデル「Inkling-Small」を発表した。より大規模なInklingに匹敵する性能を維持しながら、モ
Cohereは218BパラメータのMoEモデルCommand A+をApache 2.0ライセンスでオープンソース化し、活性化パラメータわずか25Bで高効率推論を実現。エージェント能力と多言語対応で競合MoEモデルを凌駕し、企業の主権AI展
中国のAIスタートアップDeepSeekが最新のオープンソース大規模言語モデルDeepSeek-V2を発表。総パラメータ数671億から37億のみを活性化する高効率MoEアーキテクチャで、GPT-4oに匹敵する性能を実現した。
中国AIスタートアップDeepSeekが最新の開源大規模言語モデルDeepSeek V2を発表。推論コストはGPT-4oの1/30で、Hugging Faceプラットフォームで急速に人気ランキングトップに躍進した。
中国のAIスタートアップ企業DeepSeekが最新の大規模言語モデルDeepSeek-V2を発表しました。このモデルは、中国語の数学推論ベンチマークでOpenAIのGPT-4oを超える性能を示し、ユニークなMoEアーキテクチャを使用して効率
DeepSeekチームは、236億パラメータで16GBのVRAMのみで効率的に推論できる大規模言語モデルDeepSeek-V2を発表しました。このモデルは数学ベンチマークでMetaのLlama3を上回り、中国のAI業界における大きな突破口と