Gemma 4
Gemma 4是Google发布的开源大语言模型系列,参数规模为310亿(31B)。该模型基于Transformer架构,支持文本理解、生成与多步推理等任务,面向研究者和开发者开放权重,可用于本地部署与下游任务微调。作为Gemma系列的迭代版本,其设计目标是在保持较低资源需求的同时提供较强的通用语言处理能力。
Core Facts
Timeline (last 90 days)
EmbeddingGemma 2与Gemma 4组合可以构建一个完全在本地运行的问答系统,其中EmbeddingGemma 2负责检索,Gemma 4负责作答
谷歌强调EmbeddingGemma 2在离线、隐私优先的RAG场景中适用,尤其是与Gemma 4搭配使用时
Google发布Embedding Gemma 2,是其首个面向端侧的原生多模态开放嵌入模型,仅7.4亿参数,采用Apache 2.0许可证开放权重,可在同一共享空间理解文本、代码、图像、音频和视频
编排器采用双模型协作机制:Gemma 2B 负责意图路由,Gemma 4 负责复杂任务和最终答案合成
EmbeddingGemma 2 基于 Gemma 4 架构构建,采用 Apache 2.0 许可证发布
EmbeddingGemma 2 基于 Gemma 4 构建并共享其文本分词器和音频编码器,可在统一流水线中以更低总内存占用同时运行两个模型
EmbeddingGemma 2 是谷歌基于 Gemma 4 架构打造的多模态嵌入模型,能够将文本、图像、音频和视频编码到共享的 768 维向量空间中
Gemma 4 在 Apple Silicon 上现在会为每张图片自动选择最佳分辨率以保留更多细节
LTX-2.5用一张图生成10秒720P视频只需6.8秒,用扩散视频解码器替换传统VAE,支持多镜头原生生成,文本编码器采用Gemma 4的2B版本,支持4K HDR和RAW工作流
Jeff项目将Qwen3.5和Gemma 4两款基础模型分别蒸馏、微调成0.8B和2B参数的决策模型
25 more timeline events
All Facts (20)
Gemma 4的26B MOE模型采用混合专家架构,拥有260亿总参数但任意时刻仅约40亿参数处于激活状态
80%VerifiedGemma 4采用Apache 2.0许可证,允许完全的商业自由使用
75%VerifiedGemma 4的1B/2B模型量化后仅需4GB显存即可运行
65%Unverified全部四种Gemma 4模型都支持文本和图片输入,Edge模型(E2B和E4B)还额外支持音频输入
90%UnverifiedGemma 4支持完全离线状态下的图像文字提取(OCR),采用视觉-语言多模态架构
90%UnverifiedGemma 4大模型上下文窗口可达256,000 Token
90%Unverified所有Gemma 4模型原生支持多模态(文本、图像、最多30秒音频输入),上下文窗口为128K Token,支持超过40种语言
85%UnverifiedGemma 4引入了多模态能力,Qwen3支持超长上下文,DeepSeek采用MoE(混合专家)架构
85%Unverified使用Gemma 4系列模型验证了模型权重与Harness状态的联合学习效果,发现单独的监督微调和离线强化学习预热都不能让模型取得里程碑进展,只有联合学习循环才能产生持续提升
85%UnverifiedGemma 4的1B/2B模型自带语音识别功能
80%UnverifiedGoogle在Gemma 4中实际应用了MTP技术
80%UnverifiedGemma 4使用滑动窗口注意力(SWA)架构,该架构在处理数千行混淆JavaScript时导致模型遗忘早先读入的关键上下文
80%Partially VerifiedEmbeddingGemma 2 是谷歌基于 Gemma 4 架构打造的多模态嵌入模型,能够将文本、图像、音频和视频编码到共享的 768 维向量空间中
75%Unverified使用Gemma 4 2B版本本地运行Codex时,处理速度大约每秒30到40个Token
75%Partially VerifiedGoogle发布Embedding Gemma 2,是其首个面向端侧的原生多模态开放嵌入模型,仅7.4亿参数,采用Apache 2.0许可证开放权重,可在同一共享空间理解文本、代码、图像、音频和视频
75%Unverified谷歌强调EmbeddingGemma 2在离线、隐私优先的RAG场景中适用,尤其是与Gemma 4搭配使用时
50%UnverifiedEmbeddingGemma 2与Gemma 4组合可以构建一个完全在本地运行的问答系统,其中EmbeddingGemma 2负责检索,Gemma 4负责作答
50%Unverified编排器采用双模型协作机制:Gemma 2B 负责意图路由,Gemma 4 负责复杂任务和最终答案合成
50%UnverifiedEmbeddingGemma 2 基于 Gemma 4 架构构建,采用 Apache 2.0 许可证发布
50%UnverifiedEmbeddingGemma 2 基于 Gemma 4 构建并共享其文本分词器和音频编码器,可在统一流水线中以更低总内存占用同时运行两个模型
50%