Unverified50% confidenceFactExact time
EmbeddingGemma 2能够在同一个模型中处理文本、代码、图像、视频和音频等多种类型的任务
1
Sources
50%
Confidence
Long-term
Relevance
10/8/2026
First Seen
Sources
Related Entities
Related Claims
Partially VerifiedEmbeddingGemma2除了文字和图片外还支持音频和视频,把不同模态内容都转换成768维向量76% similarUnverifiedHarness + ModelStack 组合能在本机跑通文生图、图生视频、文转语音、去背景、图片放大等十余项 AI 应用68% similarVerified多模态大模型能够同时处理图像、视频帧与文本,并在这些模态之间建立语义关联68% similarUnverified现代模型不再只处理文本,而是同时支持图像、音频、视频等多模态输入66% similarUnverified多模态(Multimodal)指模型能够同时理解和生成文本、图像、音频、视频等多种类型的信息66% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/988486API
curl https://kongchang.com/api/v1/knowledge/claims/988486MCP
get_claim(id=988486)