[控场AI]

#MoE架构

共 8 篇相关文章

8GB显存本地跑大模型:低配玩家的模型选择指南
·4 分钟

8GB显存本地跑大模型:低配玩家的模型选择指南

8GB显存加16GB内存能否流畅运行本地大模型?本文从r/LocalLLaMA社区热帖出发,解析低配硬件下的模型选择、QAT量化技术与MoE架构,为入门级本地AI玩家提供实用参考。

阅读全文 →
Aleph Alpha开源Kolibri:78B参数MoE模型深度解析
·4 分钟

Aleph Alpha开源Kolibri:78B参数MoE模型深度解析

Aleph Alpha发布开源模型Kolibri,采用Apache 2.0许可,78B总参数、3B激活参数的MoE架构,支持100万token上下文和英德双语。本文解析其架构优势、vLLM部署方式及适用场景。

阅读全文 →
Step 3.7 Flash:198B稀疏MoE多模态模型深度解析
科技前沿
·7 分钟

Step 3.7 Flash:198B稀疏MoE多模态模型深度解析

深度解析StepFun AI发布的Step 3.7 Flash,一款198B参数稀疏MoE视觉语言模型,支持256K上下文与三级推理,在多模态理解、AI编程和Agent工具编排方面表现顶尖,已获SGLang首日支持。

阅读全文 →
LFM2.5-8B-A1B:1.5B激活参数实现4倍体量效果的MoE模型
科技前沿
·6 分钟

LFM2.5-8B-A1B:1.5B激活参数实现4倍体量效果的MoE模型

Liquid AI发布LFM2.5-8B-A1B模型,采用MoE架构,8B总参数仅激活1.5B,在工具调用场景中媲美6B级模型表现。支持128K上下文、本地部署、多语言,SGLang即时支持。

阅读全文 →
Kimi K2.5全量开源:1T参数MoE架构+Agent集群能力深度解析
科技前沿
·6 分钟

Kimi K2.5全量开源:1T参数MoE架构+Agent集群能力深度解析

深度解析月之暗面Kimi K2.5全量开源大模型:1T参数MoE混合专家架构、视觉编程截图转代码、百Agent并行集群能力,在AI编程和多模态理解赛道登顶开源榜首,为开发者提供媲美GPT-4O的免费开源方案。

阅读全文 →
小米MiMo V2.5 Pro深度实测:代码、3D、SVG生成能力全面评测
产品体验
·8 分钟

小米MiMo V2.5 Pro深度实测:代码、3D、SVG生成能力全面评测

深度实测小米MiMo V2.5 Pro开源大模型,1.2万亿参数MoE架构,覆盖macOS克隆、前端UI、Three.js 3D场景、SVG图形生成等实际任务,对比GPT-5.4、Claude Opus 4.6、DeepSeek V4,附详细测试结果与成本分析。

阅读全文 →