待验证90% 置信事实时间未知
全部四种Gemma 4模型都支持文本和图片输入,Edge模型(E2B和E4B)还额外支持音频输入
1
来源数
90%
置信度
长期有效
时效性
2026/6/1
首次发现
来源
Gemma 4深度体验:谷歌顶级AI免费离线运行实测
bilibili声译看世界
涉及实体
相关事实
待验证所有Gemma 4模型原生支持多模态(文本、图像、最多30秒音频输入),上下文窗口为128K Token,支持超过40种语言73% 相似待验证主流嵌入模型如all-MiniLM-L6-v2、BGE系列、E5系列通常基于BERT架构,将文本编码为384至1536维的稠密浮点向量66% 相似待验证该工作流引入千问三(Qwen)VL 8B文本模型和图像视觉编码模型,作为将日常语言描述自动转换为Ideogram 4结构化提示词的转换层64% 相似已验证Ideogram系列模型以文字生成能力著称,Ideogram 4在英文短句、标题、品牌Slogan、海报文案等场景下的成功率明显更高59% 相似已验证CLIP、T5等文本编码器负责将自然语言转化为模型可理解的向量表示,是决定提示词遵从度的关键模块59% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/23874API
curl https://kongchang.com/api/v1/knowledge/claims/23874MCP
get_claim(id=23874)