ワークステーション1枚のGPUで753Bパラメータモデルを動作——FreeTokenがローカル推論のパラメータ上限を突破
カリフォルニア大学バークレー校とテキサス大学オースティン校の研究者が開発したFreeTokenは、単一ワークステーションGPUで7,530億パラメータのGLM-5.2を動作させることを実現し、個人マシン上でのフロンティアモデルのローカル推論
カリフォルニア大学バークレー校とテキサス大学オースティン校の研究者が開発したFreeTokenは、単一ワークステーションGPUで7,530億パラメータのGLM-5.2を動作させることを実現し、個人マシン上でのフロンティアモデルのローカル推論
Metaが初のエッジデバイス向け視覚マルチモーダルモデルLlama 3.2(1B/3B)を発表し、オープンソースコミュニティで大反響を呼び、AIのクラウドからデバイスへの大規模移行を示す。
Meta AIチームがLlama 3.2シリーズモデルを正式リリースし、1Bと3Bパラメータの軽量マルチモーダルモデルがエッジデバイス向けに最適化され、画像理解や視覚的質問応答などの機能をサポート。オープンソース特性により、AIのクラウドか
Meta AIはLlama 3.2シリーズのビジョンモデルをオープンソースとして公開しました。これは、Llamaシリーズが初めて大規模なビジョン機能を導入し、エッジデバイスでの効率的な動作を可能にするものです。