Unverified50% confidenceFactExact time
Embedding 模型对结构化符号(如货币格式、编码字符串、ID序列)缺乏特殊理解,只是把这些内容当作普通 token 序列处理
1
Sources
50%
Confidence
Long-term
Relevance
9/11/2026
First Seen
Sources
Related Entities
Related Claims
Unverifiednomic-embed-text是一个开源的Embedding模型,支持8192 token的长上下文输入63% similarUnverified语言模型生成 token 本质上是内存带宽受限任务而非纯算力受限63% similarUnverified自回归解码具有串行特性,每个Token的生成依赖前一个Token,难以并行60% similarUnverifiedToken是大模型计费的基本单位,本质上是文本被分割后的最小语义片段60% similarUnverified主流Embedding模型(如BGE、text-embedding系列)通常基于BERT架构的编码器(Encoder-only),通过对比学习让语义相近的句子在向量空间中靠拢;而GPT类生成模型基于解码器(Decoder-only)60% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/905006API
curl https://kongchang.com/api/v1/knowledge/claims/905006MCP
get_claim(id=905006)