[KongchangAI]
Unverified50% confidenceFactExact time

多模态LLM的核心架构通常由视觉编码器(如CLIP或ViT)、跨模态对齐层和语言解码器三部分组成

1
Sources
50%
Confidence
Long-term
Relevance
7/17/2026
First Seen

Sources

Related Claims

Cite This Claim

Stable URI
https://kongchang.com/claim/542706
API
curl https://kongchang.com/api/v1/knowledge/claims/542706
MCP
get_claim(id=542706)