开源大模型 に関するニュース

オリジナル

アリババ、125BパラメータのQwen新フラッグシップをオープンソース化——学習コストは前世代の9分の1、価格はClaude Opus4.6の3%

アリババのQwenチームが、Transformerパラメータ数125B・トークンあたり6BのみをアクティベートするマルチモーダルMoEモデル「Qwen3.8-Flash-Next」を正式リリース・オープンソース化した。学習コストは前世代から

Qwen 阿里巴巴 开源大模型 MoE
511
オリジナル

DeepSeek V4オープンソースモデル発表:1.6兆パラメータで100万トークンのコンテキスト、クローズドソースの覇権を覆せるか?

2026年4月25日、中国のAI企業DeepSeekがV4シリーズの大規模モデルを正式にオープンソース化しました。Proバージョンは1.6兆パラメータを持ち、100万トークンのコンテキストウィンドウをサポートします。

DeepSeek V4 开源大模型 AI产品评测 赢政指数
4,506
オリジナル

1.6TパラメータのDeepSeek-V4、オープンソースで登場 - 性能はクローズドトップモデルに匹敵、コストはGPT-5.5の一部のみ

DeepSeekは最近、V4シリーズのオープンソース大型モデルプレビュー版を正式にリリースしました。これにより、オープンソースAIがクローズドモデルに挑戦する重要なマイルストーンと見なされています。

DeepSeek-V4 开源大模型 赢政指数评测
1,726
オリジナル

世界第3位を主張、8時間の長時間推論をサポート:未発表のGLM-5.1は本当にオープンソースモデルの限界を刷新できるのか?

本文はWinzheng.com Research Labによる突発信号の追跡分析であり、すべての「事実」とマークされた内容はZ AI内部で公開されたテスト通知に由来しています。信号の確認状態は<strong>未確認</strong>であり、

GLM-5.1 开源大模型 长时推理 AI基准测试
646
オリジナル

DeepSeek-V2オープンソース公開:236Bパラメータで16GBのVRAMのみ、数学能力はLlama3を上回り開発者コミュニティを熱狂させる

DeepSeekチームは、236億パラメータで16GBのVRAMのみで効率的に推論できる大規模言語モデルDeepSeek-V2を発表しました。このモデルは数学ベンチマークでMetaのLlama3を上回り、中国のAI業界における大きな突破口と

DeepSeek-V2 开源大模型 国产AI MoE架构
1,006