共 204 篇相关文章

Gemini桌面版在Mac上出现布局散乱、界面错位问题?本文分析可能原因,提供从重启应用、清除缓存到检查显示设置的完整排查步骤,帮助你快速恢复正常使用体验。

omlx是一款专为Apple Silicon优化的开源LLM推理服务器,支持连续批处理、SSD缓存和macOS菜单栏管理。本文深入解析其核心技术亮点、适用场景及与Ollama等工具的差异化竞争优势。

实测llama.cpp图形化启动器Linux版,对比手动编译与Snap两种安装方式的优劣,涵盖启动命令差异、已知Bug及与Ollama和LM Studio的定位区别,助你快速在Linux上部署本地大模型。

详细实测Buzz Shared Compute共享算力功能,基于MeshLM开源项目实现社区成员间点对点借用闲置电脑运行AI Agent,无需API密钥,附完整配置教程及避坑指南。


Clamshell是一款Mac生产力工具,解决合上MacBook盖子后任务中断的痛点。无需外接显示器、无需sudo权限,让编译、下载和AI Agent任务在合盖状态下持续运行。

Supercut是一款主打隐私保护的本地化AI视频编辑器,所有处理在设备端完成,支持自然语言剪辑指令、屏幕录制自动缩放、自动字幕等40款工具,免费起步无需账户,适合注重数据安全的创作者。

Attyn 是一款 macOS 嵌入式AI工具,支持原地改写文本、实时语音转文字、屏幕内容问答和可视化解释四大功能,无需切换应用即可调用AI能力,支持自带API密钥和本地模型运行。

Modly是一款开源桌面应用,支持本地GPU运行AI模型,将图像自动生成3D模型。无需云端API,数据隐私有保障,适合游戏开发者、3D打印爱好者和产品设计师使用。

英伟达推出Nemotron系列开源MoE模型,采用混合专家架构实现稀疏激活,可在笔记本电脑或DGX Spark本地高效运行。本文解析MoE架构原理、本地部署优势及Nemotron从轻量本地到云端Ultra的分层策略。

Meta开源Muse-Glimmer-30B稠密模型,专为Agent场景设计,支持工具调用与多模态理解。采用Apache协议,部分指标超越Qwen-3 27B,本文详解其性能表现、硬件需求与部署方案。

解析开发者对Ollama Cloud上线Qwen3-Max的强烈需求,探讨本地推理工具向云端延伸的趋势、中国大模型全球化进程,以及开发者使用Qwen3-Max的实用部署路径。

Nearfield是一款开源Mac应用,可将两台Apple Studio Display的扬声器合并为立体声输出,支持统一音量控制、声道互换和应用级音频路由,免费释放已有硬件的音频潜能。

Unsloth Desktop是一款开源桌面应用,支持Mac/Windows/Linux三平台,集成本地模型训练与推理功能,提供2倍训练加速、70%显存节省,支持GGUF、MLX等格式及Claude Code连接,是本地AI开发的一站式平台。

深入探讨如何在macOS虚拟机环境中利用Apple Silicon统一内存架构加速llama.cpp推理,涵盖Metal后端配置、内存分配、量化格式选择等优化策略,帮助开发者在虚拟化环境中实现接近裸机的LLM推理性能。

深度解析Meta Muse Glimmer开源编程模型,30B参数规模支持本地运行,开放权重保障数据隐私。详解其技术定位、适用场景、部署要求及与Code Llama、DeepSeek Coder等竞品的对比分析。

Jetson Xavier NX运行YOLOv11+TensorRT时帧率随目标数量从27FPS骤降至8FPS,深入分析后处理瓶颈成因,提供向量化计算、ByteTrack升级、流水线架构三大优化方案。

Ante是一款完全离线运行的单文件编程AI智能体,无需网络连接和API密钥即可使用。本文深度解析其零依赖部署、隐私保护、成本可控等核心优势,以及离线编程助手的技术脉络与实用价值。