AI研修 大企業実務者向け / 第1章: 生成AIの進化とオムニモーダル・物理AIの全体像
Gemma 4:オンデバイス・オムニ
無料公開レッスン / 読了目安 2 分
機密情報の漏洩を防ぐため、外部のクラウドAPIにデータを送信せず、社内のオンプレミス環境や社員のPC内で安全にAIを動かす「ローカル推論」が注目されています。Google DeepMindが公開したオープンオムニモデル「Gemma 4」ファミリーは、このローカルおよびハイブリッド展開の核となるモデルです。
Gemma 4は、端末上で動作する軽量な「E2B」「E4B」から、サーバー向けの「26B A4B(混合専門家 MoE構造)」や「31B(Dense構造)」までを同一ファミリーで提供します。コンテキストウィンドウも最大128K〜256Kトークンへと拡張され、日本語を含むマルチモーダルタスクに幅広く対応します。
特に26B A4Bモデルは、総パラメータ数25.2Bでありながら、推論の各ステップでアクティブになるのは3.8BパラメータのみというMoE特性を持ち、4Bクラスの小型モデルと同等の超高速デコードが可能です。さらに、12B Unifiedモデルのようにエンコーダーを排してlinear layerで画像を直接LLMの埋め込み空間へ射影する、極めてシンプルな「統一型アーキテクチャ」も実装されています。Thinking Modeによる高度な論理推論や、ネイティブなシステムプロンプト対応により、エッジ環境で高度な自律エージェントを動かすのに最適な構造となっています。
関連動画
【衝撃】Googleの最新AI「Gemma 4」が○○を破壊する!? #AI #Google #Gemma4【ずんだもん&四国めたん解説】
無料で機密保持も完璧。オフラインで動くGoogle最新AI『Gemma 4』をビジネスで使う最強のメリット&カンタンな導入方法を解説!