[KongchangAI]
ModelGemma 4 31B

Gemma 4

Gemma 4是Google发布的开源大语言模型系列,参数规模为310亿(31B)。该模型基于Transformer架构,支持文本理解、生成与多步推理等任务,面向研究者和开发者开放权重,可用于本地部署与下游任务微调。作为Gemma系列的迭代版本,其设计目标是在保持较低资源需求的同时提供较强的通用语言处理能力。

Core Facts

Timeline (last 90 days)

Oct 8

EmbeddingGemma 2与Gemma 4组合可以构建一个完全在本地运行的问答系统,其中EmbeddingGemma 2负责检索,Gemma 4负责作答

Unverified50%
Oct 8

谷歌强调EmbeddingGemma 2在离线、隐私优先的RAG场景中适用,尤其是与Gemma 4搭配使用时

Unverified50%
Oct 7

Google发布Embedding Gemma 2,是其首个面向端侧的原生多模态开放嵌入模型,仅7.4亿参数,采用Apache 2.0许可证开放权重,可在同一共享空间理解文本、代码、图像、音频和视频

Partially Verified75%
Oct 7

编排器采用双模型协作机制:Gemma 2B 负责意图路由,Gemma 4 负责复杂任务和最终答案合成

Unverified50%
Oct 6

EmbeddingGemma 2 基于 Gemma 4 架构构建,采用 Apache 2.0 许可证发布

Unverified50%
Oct 6

EmbeddingGemma 2 基于 Gemma 4 构建并共享其文本分词器和音频编码器,可在统一流水线中以更低总内存占用同时运行两个模型

Unverified50%
Oct 6

EmbeddingGemma 2 是谷歌基于 Gemma 4 架构打造的多模态嵌入模型,能够将文本、图像、音频和视频编码到共享的 768 维向量空间中

Partially Verified75%
Oct 4

Gemma 4 在 Apple Silicon 上现在会为每张图片自动选择最佳分辨率以保留更多细节

Unverified50%
Oct 3

LTX-2.5用一张图生成10秒720P视频只需6.8秒,用扩散视频解码器替换传统VAE,支持多镜头原生生成,文本编码器采用Gemma 4的2B版本,支持4K HDR和RAW工作流

Unverified50%
Sep 30

Jeff项目将Qwen3.5和Gemma 4两款基础模型分别蒸馏、微调成0.8B和2B参数的决策模型

Unverified50%

25 more timeline events

All Facts (20)

Verified

Gemma 4的26B MOE模型采用混合专家架构,拥有260亿总参数但任意时刻仅约40亿参数处于激活状态

80%
Verified

Gemma 4采用Apache 2.0许可证,允许完全的商业自由使用

75%
Verified

Gemma 4的1B/2B模型量化后仅需4GB显存即可运行

65%
Unverified

全部四种Gemma 4模型都支持文本和图片输入,Edge模型(E2B和E4B)还额外支持音频输入

90%
Unverified

Gemma 4支持完全离线状态下的图像文字提取(OCR),采用视觉-语言多模态架构

90%
Unverified

Gemma 4大模型上下文窗口可达256,000 Token

90%
Unverified

所有Gemma 4模型原生支持多模态(文本、图像、最多30秒音频输入),上下文窗口为128K Token,支持超过40种语言

85%
Unverified

Gemma 4引入了多模态能力,Qwen3支持超长上下文,DeepSeek采用MoE(混合专家)架构

85%
Unverified

使用Gemma 4系列模型验证了模型权重与Harness状态的联合学习效果,发现单独的监督微调和离线强化学习预热都不能让模型取得里程碑进展,只有联合学习循环才能产生持续提升

85%
Unverified

Gemma 4的1B/2B模型自带语音识别功能

80%
Unverified

Google在Gemma 4中实际应用了MTP技术

80%
Unverified

Gemma 4使用滑动窗口注意力(SWA)架构,该架构在处理数千行混淆JavaScript时导致模型遗忘早先读入的关键上下文

80%
Partially Verified

EmbeddingGemma 2 是谷歌基于 Gemma 4 架构打造的多模态嵌入模型,能够将文本、图像、音频和视频编码到共享的 768 维向量空间中

75%
Unverified

使用Gemma 4 2B版本本地运行Codex时,处理速度大约每秒30到40个Token

75%
Partially Verified

Google发布Embedding Gemma 2,是其首个面向端侧的原生多模态开放嵌入模型,仅7.4亿参数,采用Apache 2.0许可证开放权重,可在同一共享空间理解文本、代码、图像、音频和视频

75%
Unverified

谷歌强调EmbeddingGemma 2在离线、隐私优先的RAG场景中适用,尤其是与Gemma 4搭配使用时

50%
Unverified

EmbeddingGemma 2与Gemma 4组合可以构建一个完全在本地运行的问答系统,其中EmbeddingGemma 2负责检索,Gemma 4负责作答

50%
Unverified

编排器采用双模型协作机制:Gemma 2B 负责意图路由,Gemma 4 负责复杂任务和最终答案合成

50%
Unverified

EmbeddingGemma 2 基于 Gemma 4 架构构建,采用 Apache 2.0 许可证发布

50%
Unverified

EmbeddingGemma 2 基于 Gemma 4 构建并共享其文本分词器和音频编码器,可在统一流水线中以更低总内存占用同时运行两个模型

50%

Source Articles