Unverified60% confidenceFactTime unknown
OpenAI 使用 tiktoken 分词算法,Google 使用 SentencePiece 分词算法
2
Sources
60%
Confidence
Long-term
Relevance
6/1/2026
First Seen
Sources
One API:统一管理30+大模型的开源API网关部署教程与详解
githubsongquanpeng
Related Entities
Related Claims
Unverified现代 LLM 使用子词分词算法,最常见的包括 OpenAI 提出的 BPE 和 Google 提出的 SentencePiece82% similarUnverified不同模型使用不同的分词算法,如 OpenAI 的 tiktoken、Google 的 SentencePiece,导致同一段文字在不同模型中消耗的 token 数量可能相差 10%-30%75% similarUnverifiedOpenAI使用BPE(Byte Pair Encoding)算法进行分词,Google的SentencePiece采用与语言无关的分词方法直接在原始文本上训练74% similarUnverified现代大语言模型普遍采用BPE算法变体构建分词器,OpenAI的tiktoken、Google的SentencePiece和HuggingFace的Tokenizers库是三大主流实现71% similarUnverifiedOpenAI 使用基于字节对编码(BPE)的 tiktoken 分词器将文本切分为 Token68% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/34785API
curl https://kongchang.com/api/v1/knowledge/claims/34785MCP
get_claim(id=34785)