共 63 篇相关文章

QuantaMind是一款免费开源的本地AI Agent可靠性测试工具,采用pass^k评分与确定性评分机制,支持多步序列测试与故障注入,覆盖Ollama、llama.cpp、vLLM等主流部署方案,帮助团队在上线前发现隐藏的序列级失败风险。

开发者将腾讯Hunyuan3D模型移植至Apple MLX框架,M4 Max实测形状生成仅需20秒、峰值内存5.6GB,量化后甚至可在iPhone运行。Modelr开源应用支持实时流式可视化,是首个专为Apple Silicon打造的本地图生3D桌面工具。

在16GB内存M4 Mac mini上实测Ornith 1.0 9B开源模型的智能体编程能力。塔防游戏任务对比9B与35B模型,揭示小参数模型在代码生成精度上的本质局限,以及本地AI编程工具的真实边界。
修复三个Bug让Qwen3.5-122B在Mac Studio稳定运行的实践解析
一位开发者通过修复三个关键Bug,成功将Qwen3.5-122B大模型部署为Mac Studio日常主力。本文深入分析内存管理、推理稳定性与量化精度三大技术难点,探讨本地大模型部署的现实价值与社区启示。

苹果芯片部门高管公开解析Mac Mini在AI开发者中需求激增的原因:统一内存架构突破显存瓶颈、优异能效比支持长时间本地部署,结合苹果端侧AI战略,Mac Mini正成为本地大模型推理的热门选择。

Unsloth v0.1.481-beta正式发布,新增DeepSeek-V4-Flash完整支持、NVFP4/FP8/imatrix GGUF多格式量化导出,GRPO训练提速1.3倍,MoE训练加速3-5倍,Studio升级为OpenAI兼容API服务系统,覆盖微调、导出、推理全链路。

在16GB M4 Mac Mini上实测Ornith 9B本地编码模型:LM Studio部署、塔防游戏实战对比35B,深度解析小模型精度瓶颈与本地化AI编码的务实选型建议。

XiaoWu是一款完全本地运行的AI语音输入法,基于本地大语言模型实现高精准语音识别、智能标点添加和极简交互设计。无需联网,保护隐私,支持一键安装,适合高频文字输入场景。

深入解析Anthropic动态工作流的核心机制、与单Agent和Sub-Agent模式的区别,以及通过决策树判断何时该用、何时不该用,避免无效烧Token。

详解Claude Code本地化部署的核心架构与三种主流方案(LM Studio、Ollama、vLLM),涵盖环境变量配置、协议转换、硬件选型与模型推荐,助你零成本运行AI编程智能体。

详解本地部署大模型的5种主流方案:LlamaCPP、Ollama、LM Studio、vLLM/SGLang、MLX-LM,涵盖从个人开发到生产环境的完整选型指南,助你实现数据不出本地的AI私有化部署。

Google发布Gemma 4 12B开放权重模型,12B参数量级可在笔记本电脑本地运行。本文解析其性能优势、本地部署价值及开源生态竞争格局,助开发者快速上手评估。

彭博社披露苹果高管在库克缺席下召开秘密会议,坦承AI领域落后。面对OpenAI、Google等对手的狂飙突进,苹果如何应对隐私路线约束与端侧算力限制?WWDC 2025或将揭晓反击方案。

KeyType是一款基于MIT协议的macOS系统级AI文本补全工具,支持本地LLM推理和自选模型。覆盖浏览器、备忘录、邮件等所有输入框,按Tab即可补全,数据完全不出本机,是Cotypist的免费开源替代方案。
教程攻略深度解析Google Gemma 4开源模型系列,涵盖31B、26B MOE、14B/12B三档模型红黑榜评测,提供Windows/Linux/Mac部署方案及MS-Swift微调实战教程,助你精准选型构建本地Agent工作流。
教程攻略实测DeepSeek V4 Flash开启MTP推测解码后的性能表现:代码生成场景提速约20%,文本生成提升有限。详解内存开销、准确性差异、Q4与Q3量化对比,以及通过Inference应用和OpenAI兼容API的完整部署教程。
教程攻略深入解析npcpy开源框架的四层架构设计、多智能体协同机制、知识图谱生命周期管理以及工程部署方案,帮助开发者用软件工程思维构建稳定可控的AI Agent系统。
产品体验实测对比Mac本地运行Qwen3.6-27B的4种方案,包括GGUF、MLX Diflash和MTP-LX。MTP-LX 4bit方案以43.6 tok/s速度领先,编码、写作、推理质量均可圈可点,附安装配置指南。
教程攻略深入解析OpenAI Codex插件系统的核心架构(Skills、Apps、MCP Server),详解四种安装方式,并通过macOS应用开发实战案例,展示Codex插件如何提升AI编程效率。
科技前沿本周AI重磅动态汇总:OpenAI下一代基座模型Spud(GPT 6)2026年春季发布,Anthropic开发长驻型AI代理Conway,Cursor 3为AI代理重构IDE,DeepSeek V4首次在华为芯片原生训练,通义千问3.6与Gemma 4开源模型双雄并立。