Unverified50% confidenceFactExact time
Meta推出了具备视觉能力的Llama 3.2 Vision系列,包含11B和90B参数版本,可直接输入图像进行多模态文档理解
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
7/11/2026
First Seen
Valid until: 10/9/2026
Sources
发票分析AI落地实战:模型选型与架构设计避坑指南
redditr/ollama7/10/2026
Related Claims
UnverifiedMeta发布多模态推理模型MuSpark 1.1,具备100万Token上下文窗口,可接受文本、图像、视频、PDF和音频输入68% similarUnverifiedMeta近日宣布为Meta Ray-Ban Display智能眼镜推出虚拟手写(Virtual Writing)功能,正式向所有用户开放64% similarUnverifiedSeedream 5.0 Pro支持图像输入,可从单张参考图生成角色三视图63% similarUnverifiedSeedream系列是字节跳动推出的图像生成模型63% similarUnverifiedMeta Ray-Ban和Apple Vision Pro等AR设备可将虚拟角色叠加投影至现实空间62% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/486072API
curl https://kongchang.com/api/v1/knowledge/claims/486072MCP
get_claim(id=486072)