共 200 篇相关文章
教程攻略详解Ollama本地部署开源大模型的完整流程,涵盖安装配置、模型选择与量化策略、Python代码调用API、性能优化等实战技巧,帮你快速在本地运行Qwen、Llama等大模型。

深度解读八月第三周AI圈三大事件:Harness插件生态爆发背后的留存挑战、GLM 5.3跑分与安全护栏的博弈、Stripe 75亿美元收购OpenRouter布局Agent支付基础设施,洞察AI Agent从工具走向商业结算的演进趋势。

Local 是一款免费的 macOS 本地AI应用,无需账号、无需联网,支持日常对话、编程智能体和会议记录整理。通过硬件自适应优化实现最高5.4倍性能提升,彻底保护数据隐私。

Vercel推出开源编码智能体fx,采用Zig语言编写,仅6MB原生二进制文件,近乎瞬时启动。支持本地与云端模型、MCP协议、Skills插件扩展,可嵌入自有基础设施。极简设计将更多上下文资源留给AI模型,为开发者提供轻量高效的编码工具新选择。

详解如何在Cursor中接入第三方AI模型,包括Fireworks.ai、OpenRouter等平台配置方法,通过自定义OpenAI兼容端点实现模型自由切换,降低成本并避免厂商锁定。

面向学生开发者的黑客松AI工具指南,涵盖GitHub Copilot免费学生认证、Cursor、Codeium免费额度、Claude与Perplexity学生优惠、开源模型本地部署等方案,帮助预算有限的团队零成本搭建高效AI开发工具链。

M4 Pro 64GB内存如何选择本地视觉语言模型?对比Qwen2.5-VL、Llama 3.2 Vision等主流VLM的速度与效果,推荐Ollama、LM Studio、MLX等部署工具,帮你找到快速响应与视觉能力的最佳平衡点。

详解 OpenCode AI 编程工具的两种安装方式、模型配置、Agent 分类、自定义命令与 MCP 扩展、Agent SQL 能力,附实战案例与学习路径,帮助开发者从入门到精通。

详细讲解如何从零搭建本地无审查AI模型,涵盖硬件要求、Ollama安装、text-generation-webui配置、模型量化格式选择及abliteration技术原理,助你完全离线运行大语言模型。

腾讯将混元大模型从1.5TB压缩至约200GB的GGUF格式,性能保留约98%。本文解析量化压缩技术原理、GGUF格式的生态价值,以及这一成果对本地部署和开源社区的深远影响。

MiniMax宣布API服务价格上调60%-65%,多家国产大模型厂商同步涨价。深度分析涨价背后的算力成本压力、商业逻辑转变,以及开发者应对策略与多模型部署方案。

探索Nexagora多智能体社交网络实验:AI智能体通过API自主对话,人类仅作为旁观者。深入分析人格漂移、上下文窗口饱和、群体极化等涌现行为,解读自主智能体架构设计与多智能体协作的未来。

详细实测AiCode安卓开源AI编程工具,涵盖API提供商配置、容器环境安装、MCP协议扩展、Token成本统计、Git版本管理等完整功能,手把手教你在手机上搭建AI编程环境。

用户发现Google Gemini对话历史与账户活动日志存在持续性不一致,引发AI数据透明度与隐私合规担忧。本文分析技术原因、合规风险及用户应对措施。

Ollama Cloud Pro用户反映DeepSeek模型额度消耗突然加速,不到一小时触及上限。本文从token计费机制、模型版本迭代、计费权重调整等角度深入分析原因,并提供实用的额度优化建议。

ChatCut Desktop是一款支持人机协作的桌面视频编辑器,接入GPT与Claude大模型,用自然语言驱动剪辑操作,本地运行保障隐私,兼容Premiere Pro等专业软件,重新定义AI视频剪辑工作流。

WebBrain是一款开源浏览器AI侧边栏助手,支持通过llama.cpp本地运行大语言模型,零成本、零隐私泄露。支持Chromium和Firefox浏览器,也可自带API密钥接入OpenAI、Claude等云端服务,实现本地与云端灵活切换。

NobodyWho是基于llama.cpp的开源端侧推理引擎,支持Swift、Kotlin、Flutter、React Native、Python和Godot多平台接入,提供工具调用、多模态、语音及GPU加速能力,让大语言模型完全在本地设备运行,无需API密钥。