待验证50% 置信事实精确时间
CRN v2 约有 3400 万可训练参数,相当于 46.5 亿参数文本模块的 0.73%
1
来源数
50%
置信度
长期有效
时效性
2026/9/16
首次发现
来源
涉及实体
相关事实
待验证训练7B参数模型的全参数微调通常需要至少4张A100(80G)显卡,而LoRA使单张RTX 4090(24G)完成7B量级模型微调成为可能63% 相似待验证Qwen3系列训练数据据称超过36万亿token,覆盖代码、数学、科学和多语言文本61% 相似待验证LoRA使可训练参数量通常仅为全参微调的0.1%-1%,可在单张RTX 3090/4090(显存24GB)上微调7B乃至13B级别的模型60% 相似待验证该模型训练分词器得到的词表大小为326659% 相似待验证作者推算Mythos Preview训练消耗算力约为5e26-1e27 FLOPs,是GPT-4训练算力(约2×10^25 FLOPs)的25到50倍59% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/924659API
curl https://kongchang.com/api/v1/knowledge/claims/924659MCP
get_claim(id=924659)