Unverified50% confidenceBenchmarkTime unknown
claude-code-local 宣称支持 Qwen 3.5 122B(约 65 tokens/秒)、Llama 3.3 70B 和 Gemma 4 31B 等模型
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
9/12/2026
First Seen
Valid until: 12/11/2026
Sources
Claude Code 本地化运行:Apple Silicon 上的全离线 AI 编程方案
githubnicedreamzapp
Related Entities
Related Claims
UnverifiedQwen3 在训练时支持长达 128K tokens 的上下文72% similarUnverified早期LLaMA-2仅支持4K token上下文,而DeepSeek-V3、Qwen2.5等新一代模型已将上下文扩展至128K甚至更长71% similarUnverifiedQwen 4B 和 7B 版本在 8GB 显存的 RTX 3060 等入门级显卡上即可流畅运行71% similarUnverifiedGemma 3 12B官方支持的上下文长度为128K token,但在Ollama中默认num_ctx仅为204870% similarUnverifiedQwen3原版模型支持256K上下文,本地部署受显存限制只能跑到128K70% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/917423API
curl https://kongchang.com/api/v1/knowledge/claims/917423MCP
get_claim(id=917423)