Unverified90% confidenceFactTime unknown
全部四种Gemma 4模型都支持文本和图片输入,Edge模型(E2B和E4B)还额外支持音频输入
1
Sources
90%
Confidence
Long-term
Relevance
6/1/2026
First Seen
Sources
Gemma 4深度体验:谷歌顶级AI免费离线运行实测
bilibili声译看世界
Related Entities
Related Claims
Unverified所有Gemma 4模型原生支持多模态(文本、图像、最多30秒音频输入),上下文窗口为128K Token,支持超过40种语言73% similarUnverified主流嵌入模型如all-MiniLM-L6-v2、BGE系列、E5系列通常基于BERT架构,将文本编码为384至1536维的稠密浮点向量66% similarUnverified该工作流引入千问三(Qwen)VL 8B文本模型和图像视觉编码模型,作为将日常语言描述自动转换为Ideogram 4结构化提示词的转换层64% similarVerifiedIdeogram系列模型以文字生成能力著称,Ideogram 4在英文短句、标题、品牌Slogan、海报文案等场景下的成功率明显更高59% similarVerifiedCLIP、T5等文本编码器负责将自然语言转化为模型可理解的向量表示,是决定提示词遵从度的关键模块59% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/23874API
curl https://kongchang.com/api/v1/knowledge/claims/23874MCP
get_claim(id=23874)