共 155 篇相关文章

腾讯正式开源混元3(Hunyuan V3),295B MoE架构、21B激活参数,官方宣称超越DeepSeek-V4-Pro。支持FP8量化、vLLM/SGLang部署,但256K上下文与不支持多模态成为核心短板。本文深度解析其架构特性、横向对比与实际部署方案。

腾讯混元HY3正式版正式开源,API定价低至1元/百万tokens输入,在Agent、推理、编码及长上下文领域显著提升,以Apache 2.0协议发布。同日美团开源万亿参数模型LongCat 2.0,首个在5万张国产算力卡上完成推理的万亿模型。

华为OpenPangu 2.0 Flash横向评测:92B总参数MoE开源模型,指令遵循全场第一(95.9分),数学推理和Agent能力出色,但SWE-Bench工程代码仅63.1分垫底。本文对比千问3.6、DeepSeek V4、MiniMax M2等主流模型,帮你判断盘古2.0是否适合你的业务场景。

同一款国产AI,在Hacker News等海外社区获得盛赞,在国内平台却饱受批评。本文深度拆解用户身份、产品形态、定位认知三重错位,揭示这场评价割裂背后的真正原因。

华为开源模型盘古2.0 Flash参加大模型高考评测,92B MoE架构获得613分,排名第33。本文深度解析其稳定性隐患、不到一元的超低推理成本,以及作文双模型交叉打分机制,帮助企业评估国产开源大模型选型价值。

OpenAI顶配模型将集成至Codex编程环境,在Cerebras晶圆级芯片上实现750 Token/秒推理速度。本文深度解析MoE架构原理、订阅体系调整动向,以及腾讯混元、Longcat 2.0等开源模型的同步突破,帮助开发者把握AI编程工具的选择策略。

通过引入验证循环(verification loop)工程化推理框架,DeepSeek在复杂任务上的有效通过率可提升约4倍,追平Claude Opus表现,而成本仅为其七分之一。本文深入解析验证循环原理、推理时计算扩展趋势及其对AI开发者的实际启示。

在16GB M4 Mac Mini上实测Ornith 9B本地编码模型:LM Studio部署、塔防游戏实战对比35B,深度解析小模型精度瓶颈与本地化AI编码的务实选型建议。

没有ChatGPT账号也能用Codex?本文手把手教你通过Codex++管理工具,将DeepSeek配置为Codex底层模型,绕开账号与网络限制,低成本开启AI编程之旅。

深度分析AI聚合平台声称免费使用GPT、DeepSeek、Gemini等顶级模型的真相,揭示免费背后的数据风险与商业逻辑,并提供OpenRouter、Poe等正规替代方案推荐。

详解如何利用魔搭社区MCP广场结合Dify平台,通过问题分类器和多Agent分支架构,零代码搭建集饮食推荐、算法刷题、新闻资讯、出行规划于一体的AI智能体工作流,含完整配置步骤与效果验证。

实测对比DeepSeek与Claude在文案写作、商业分析等场景的表现差异,深入分析API定价80倍价差背后的性价比真相,以及数据隐私、自托管方案等关键决策因素。

详解如何用4块二手RTX 3090 SXM4显卡搭建本地AI推理服务器,通过Llama.cpp和Unsloth IQ量化方案运行GLM-5.2开源模型,实测Token生成速度、GPU利用率及代码生成质量。

深度解析Qwen3.6两款社区衍生模型:27B扩展至34B 80层提升推理与蒸馏能力,35B MoE压缩至14B实现8GB显卡本地部署。涵盖REAP剪枝策略、MoE专家冗余现象及选择建议。

实测对比GLM5.2与GPT5.5的前端开发能力,GLM5.2在页面审美和精致度上略胜一筹,但推理速度慢、API可用性不足成为最大短板。深度分析国产大模型在前端开发领域的真实竞争力。

Minimax平台每月仅需40美元即可获得350亿token推理量,每百万token成本约1.14美元,远低于主流AI服务定价。本文对比分析Minimax与Fable的定价差异、适用场景及选择建议,帮助开发者找到最具性价比的AI推理方案。

深度解析月之暗面Kimi K2.7 Code编程大模型,涵盖MoE架构细节、性能基准测试、API定价对比、6倍速高速版及与Claude、GPT的竞争格局分析,帮助开发者评估是否值得采用。

深度实测Kimi K2.7 Code开源编程模型,涵盖3D游戏开发、前端设计、STL解析等6大场景。万亿参数MoE架构,Token效率提升30%,价格仅为闭源模型1/12.5,详解其真实表现与不足。