共 388 篇相关文章
产品体验Meta发布Llama 3.3 70B开源模型,仅70B参数却媲美405B性能。经过13道逻辑推理、数学计算、编程题全面测试,通过12题表现惊艳,重塑开源模型格局。
科技前沿NVIDIA与Google DeepMind联合展示Gemma 4开源模型在DGX Spark桌面平台上的视觉翻译、长上下文问答和实时代码生成能力,解读开源AI与边缘算力融合的产业趋势及开发者实际启示。
教程攻略深度解析Google Gemma 4模型在NVIDIA DGX Spark上的部署方案。涵盖DGX Spark硬件架构、Gemma 4技术亮点、本地AI部署优势及开发者实践指南,助你掌握桌面级AI超算的最新玩法。
产品体验
产品体验
产品体验深入解析Unsloth这款GitHub 6万+星标的开源大模型训练工具,支持Gemma 4、Qwen3、DeepSeek等主流模型的本地微调与推理,通过LoRA/QLoRA技术大幅降低显存需求,助力开发者在消费级显卡上高效训练大模型。

深度实测Free Claude Code(FCC)开源项目,通过中间代理层将Claude Code请求路由到免费或廉价模型。详解安装配置、分级路由原理、真实编码效果,以及哪些人适合用它省钱。

Bolnee-Chat 是一款自托管的企业网站聊天机器人工具,支持私有部署,确保数据主权与合规。本文分析其核心优势、应用场景及项目成熟度,帮助企业评估是否适合采用自托管聊天机器人方案。

面向学生开发者的黑客松AI工具指南,涵盖GitHub Copilot免费学生认证、Cursor、Codeium免费额度、Claude与Perplexity学生优惠、开源模型本地部署等方案,帮助预算有限的团队零成本搭建高效AI开发工具链。

腾讯发布Hy4 Preview开源大模型,采用MoE架构,总参数770B,激活参数49B,支持100万token上下文窗口。主打长程智能体任务,具备代码自测试与自修复闭环能力,覆盖编程开发、游戏开发和复杂文档分析三大场景。

深度解析一个从零构建现代大语言模型的开源项目,每行代码附带注释并用通俗语言讲解Transformer架构、自注意力机制、RoPE位置编码等核心概念,为AI学习者提供清晰的入门路径。

MiniMax宣布API服务价格上调60%-65%,多家国产大模型厂商同步涨价。深度分析涨价背后的算力成本压力、商业逻辑转变,以及开发者应对策略与多模型部署方案。

OpenAI宣布因Cursor被SpaceX收购,将于11月12日终止模型供应。本文深入分析断供原因、对开发者的影响,以及多模型策略等应对方案。

开发者在Mac Studio上实测运行Qwen 27B大模型,详解统一内存架构优势、量化策略选择、tokens/s实际表现,以及本地部署大模型的成本与隐私考量。

Ornith AI 发布 Ornith 1.5 系列三款开源模型,涵盖 9B 稠密模型、35B-A3B MoE 架构和 397B 旗舰模型,同步提供 GGUF 量化版本支持本地部署,覆盖从消费级显卡到研究机构的多层次需求。

在 Mac Studio 上本地部署 Qwen3 27B 与 DeepSeek V4 Flash,通过天气看板、塔防游戏、类 Excel 表格三个前端编程任务实测对比,看哪个开源大模型在 Agentic Coding 场景下表现更强。

开发者将Ollama羊驼吉祥物制作成可交互网页版本,用户可在浏览器中实时互动。本文解析项目背后的前端交互技术、品牌吉祥物设计价值及开源社区二次创作文化。

阿里通义千问Qwen3.8 27B在Artificial Analysis评测中获得52分,凭借27B参数量逼近旗舰大模型水平。本文解析其性能表现、本地部署优势及对开源模型竞争格局的深远影响。