[控场AI]

#大模型

共 290 篇相关文章

Bonsai 2 27B:9倍压缩下的近无损模型探索
·4 分钟

Bonsai 2 27B:9倍压缩下的近无损模型探索

Bonsai 2 27B 声称在近无损前提下将 27B 大模型压缩至原体积的九分之一。本文解析其压缩技术路径、社区反应与实际部署价值,并给出验证建议。

阅读全文 →
本地部署大模型完全教程:Ollama+Qwen 隐私免费方案
·5 分钟

本地部署大模型完全教程:Ollama+Qwen 隐私免费方案

手把手教你在本地免费部署大模型:通过 Ollama 运行引擎加载 Qwen 通义千问开源模型,搭配图形客户端实现类豆包体验,数据不外泄、零费用,附完整安装步骤与硬件建议。

阅读全文 →
GLM自建推理基础设施:大模型部署的关键一步
·3 分钟

GLM自建推理基础设施:大模型部署的关键一步

GLM自建推理基础设施引发技术社区关注。本文解析大模型推理基础设施的重要性、成本考量与工程挑战,探讨自主可控推理层对大模型产业化的战略意义。

阅读全文 →
从Function Calling到MCP:搞懂AI智能体开发的底层逻辑
·6 分钟

从Function Calling到MCP:搞懂AI智能体开发的底层逻辑

本文从Function Calling讲起,系统梳理MCP、AI智能体(Agent)与A2A的底层逻辑,详解函数调用的五步工作流程、主流大模型的支持情况,以及Function Calling与智能体在规划和记忆上的关键区别,适合零基础入门AI智能体开发。

阅读全文 →
LangChain 入门:大模型 Agent 开发的核心基础框架
·7 分钟

LangChain 入门:大模型 Agent 开发的核心基础框架

本文解析 LangChain 作为大模型 Agent 开发核心框架的定位与价值,厘清「调用 API 不等于大模型开发」的误区,梳理 LangChain、LangGraph 到多智能体协作的学习路径,并拆解大模型开发的岗位分层与就业方向。

阅读全文 →
AI大模型训练的隐秘角落:你的高价值对话可能正被"改写复用"
·4 分钟

AI大模型训练的隐秘角落:你的高价值对话可能正被"改写复用"

一则来自大型AI实验室内部的传闻称,消费级AI工具的用户数据正通过合成数据方式被用于模型训练,即使在ZDR零保留和不训练承诺下,派生改写数据仍可能被使用。本文解析这一数据训练实践及其对专业用户的隐私启示。

阅读全文 →
小米Mimo 2.6公开实时后训练看板,AI训练透明化引热议
·3 分钟

小米Mimo 2.6公开实时后训练看板,AI训练透明化引热议

小米将Mimo 2.6模型的后训练过程通过实时看板公开展示,在Hacker News引发热议。本文解析这一AI训练透明化尝试的意义、社区争议与潜在行业影响。

阅读全文 →
警惕"GPT-6 Astra免费使用"骗局:这类视频的套路与风险
·4 分钟

警惕"GPT-6 Astra免费使用"骗局:这类视频的套路与风险

网传"GPT-6 Astra国内免费使用教程"声称一个站点畅用GPT、Gemini等顶级模型。本文拆解其夸大宣传话术与潜在风险,并给出安全使用主流AI模型的建议。

阅读全文 →
低精度FlashAttention-4:Blackwell上的端到端块级缩放注意力
·5 分钟

低精度FlashAttention-4:Blackwell上的端到端块级缩放注意力

低精度FlashAttention-4(FA4 MX8)将MXFP8块级缩放扩展到注意力的前向与反向传播,在Blackwell架构上实现前向2.85 PF/s、反向2 PF/s的性能,为大模型高效训练与推理提供新路径。

阅读全文 →
AI Agent零基础入门:从大模型认知到智能体开发全景图
·8 分钟

AI Agent零基础入门:从大模型认知到智能体开发全景图

AI Agent零基础入门教程:从人工智能、机器学习、深度学习到Transformer与大模型的技术脉络,再到提示词、RAG、MCP、LangChain等Agent开发四阶段学习路线,帮助你系统掌握智能体开发核心技能。

阅读全文 →
AI Agent开发岗求职指南:达标就敢冲的四条硬标准
·5 分钟

AI Agent开发岗求职指南:达标就敢冲的四条硬标准

AI Agent开发岗秋招求职指南:拆解项目能跑、问题能查、方案能讲、面试能扛四条硬标准,涵盖Python基础、Agent核心机制、业务落地项目与工程细节,助你达标就敢冲。

阅读全文 →
AI Agent智能体入门:大脑、记忆与工具三要素详解
·7 分钟

AI Agent智能体入门:大脑、记忆与工具三要素详解

从零理解AI Agent智能体:详解大脑、记忆、工具三大核心组件,梳理大模型从原生模型、提示工程、RAG到Agent的四阶段演进,帮你搞懂Agent到底解决了什么问题以及为何值得学习。

阅读全文 →
三个月从零入门深度学习:一份高效AI自学路线图
·4 分钟

三个月从零入门深度学习:一份高效AI自学路线图

一份三个月从零入门深度学习的AI自学路线图:Python与数学一周、机器学习一周,随后聚焦计算机视觉、自然语言处理和数据挖掘,以大模型和应用就业为导向的高效学习规划。

阅读全文 →
本地大模型选型指南:Qwen与DeepSeek怎么选?
·5 分钟

本地大模型选型指南:Qwen与DeepSeek怎么选?

本地大模型选型极简指南:Qwen与DeepSeek如何选择、7B/14B参数与Q4量化含义、按显存对号入座下载合适尺寸,以及LM Studio、Cherry Studio等零代码部署工具推荐,助你断网也能流畅跑本地AI。

阅读全文 →
Spring AI 大模型零基础教程解析:从原理到企业实战的学习路径
·5 分钟

Spring AI 大模型零基础教程解析:从原理到企业实战的学习路径

解析 B 站热门 Spring AI 大模型零基础教程的课程结构,从大模型核心原理、Transformer 架构到 RAG、私有化部署、模型微调与企业实战项目,帮助入门开发者判断学习路径与实际价值。

阅读全文 →
AI Agent开发实战:LangChain+MCP+RAG技术栈全解析
·6 分钟

AI Agent开发实战:LangChain+MCP+RAG技术栈全解析

深度解析AI Agent开发技术栈,涵盖LangChain、LangGraph、MCP工具接入与RAG知识库。通过智能体自主创建Vue项目的实战案例,讲解感知-决策-行动的智能体运行原理与工程化落地方法,面向程序员的Agent转型学习路径。

阅读全文 →
Agent开发工程师:AI时代最难招的高薪新岗位如何入行
·4 分钟

Agent开发工程师:AI时代最难招的高薪新岗位如何入行

Agent开发工程师成为AI时代最难招的高薪新岗位,大厂争抢、薪资翻倍。本文解析这一岗位的真实工作内容、稀缺原因,以及从提示词工程到RAG、Agent工作流的四步入行路径。

阅读全文 →
本地模型别乱下:用llmfit先筛后测的完整流程
·7 分钟

本地模型别乱下:用llmfit先筛后测的完整流程

本地大模型选型难?llmfit(LMF8)1.1.15 版把盲选变成先筛后测:读取硬件、按真实任务筛出三个候选、反向规划硬件缺口、再用真实代码任务实测速度与准确率。附与 Ollama、LM Studio 的配合建议。

阅读全文 →