[控场AI]

#大模型微调

共 25 篇相关文章

Together AI升级微调服务:新增模型、实时监控与精细化控制
·4 分钟

Together AI升级微调服务:新增模型、实时监控与精细化控制

Together AI全面升级Fine-Tuning微调平台,新增开源权重模型、Expert LoRA、早停机制、实时实验追踪、分词数据集预览与预检验证,并下调精选模型训练价格,帮助开发者更高效、可控地定制大模型。

阅读全文 →
微调如何重塑大模型内部机制:表征变化与因果重要性的解耦研究
·4 分钟

微调如何重塑大模型内部机制:表征变化与因果重要性的解耦研究

一篇 arXiv 研究揭示大语言模型微调如何重塑内部机制:表征变化最剧烈的层与真正起因果作用的关键组件并不重合,且跨任务组件重叠不等于性能迁移,甚至可能导致相互干扰。

阅读全文 →
Unsloth 重磅更新:多用户账户、全新 Docker 与 FP8 扩散推理
·6 分钟

Unsloth 重磅更新:多用户账户、全新 Docker 与 FP8 扩散推理

Unsloth 发布 v0.1.810-beta,带来全新 Docker 镜像、多用户账户隔离、FP8/INT8 扩散推理 2 倍加速、AMD RDNA 与 ARM64 Windows 支持,以及 GRPO 和训练的多项改进。

阅读全文 →
双非零基础转行AI应用开发工程师,需要哪三项硬实力?
·5 分钟

双非零基础转行AI应用开发工程师,需要哪三项硬实力?

双非零基础想转行AI应用开发工程师需要哪些能力?本文梳理大模型微调实操、LangChain框架开发、模型推理与工程化部署三项核心硬实力,并给出从基础到就业方向的学习路径参考。

阅读全文 →
Oumi:一站式开源大模型微调、评估与部署框架
·3 分钟

Oumi:一站式开源大模型微调、评估与部署框架

Oumi 是一个开源大模型全流程框架,支持对 Gemma、Qwen、gpt-oss、DeepSeek-R1 等主流开源 LLM 与 VLM 进行微调、评估和部署,帮助开发者用统一工具链降低模型工程化门槛。

阅读全文 →
Qwen3-27B微调实录:让大模型说出真正的"人话"
·3 分钟

Qwen3-27B微调实录:让大模型说出真正的"人话"

开发者基于 Qwen3.8-27B 微调出 Humanlike-Chat 模型,用 12.5 万条真人对话数据训练 rank-256 LoRA,让大模型摆脱"AI助手腔"、说出更自然的人话。本文解析其训练细节、实际效果与能力权衡。

阅读全文 →
Agent Tuning:训练具备Agent能力的大模型完整指南
教程攻略
·8 分钟

Agent Tuning:训练具备Agent能力的大模型完整指南

深入解析Agent Tuning的原理与实践,包括为什么需要Agent训练、从Prompt到RAG到Agent的技术演进、研发流程与成本评估,帮助中小模型获得顶级Agent能力实现私有化部署。

阅读全文 →
大模型训练全流程解析:预训练、SFT微调与偏好对齐通俗详解
深度解读
·9 分钟

大模型训练全流程解析:预训练、SFT微调与偏好对齐通俗详解

详解大模型训练三大核心阶段:预训练、有监督微调(SFT)、偏好对齐(DPO/PPO),涵盖LoRA、模型蒸馏量化剪枝等关键技术,帮助开发者理解从Base Model到Chat Model的完整流程。

阅读全文 →
大模型工程师必备技能:应用开发与微调训练完整指南
教程攻略
·3 分钟

大模型工程师必备技能:应用开发与微调训练完整指南

系统梳理大模型工程师核心技能体系,涵盖RAG、Agent应用开发及SFT、RLHF微调训练两大方向,为Java后端、AI算法工程师及零基础转行者提供清晰的学习路径规划。

阅读全文 →
Qwen3-0.6B微调入门:大模型基础概念与微调方法论详解
教程攻略
·5 分钟

Qwen3-0.6B微调入门:大模型基础概念与微调方法论详解

从大模型三大核心特征讲起,系统梳理Qwen3-0.6B微调所需的基础知识,包括大模型与应用软件的区别、国内外主流模型对比、微调价值分析,以及从原理到实操的完整学习路径。

阅读全文 →
4-bit QLoRA微调LLaMA 3实战:消费级GPU训练80亿参数大模型指南
教程攻略
·10 分钟

4-bit QLoRA微调LLaMA 3实战:消费级GPU训练80亿参数大模型指南

详解如何使用QLoRA和Unsloth框架在消费级GPU上微调LLaMA 3 8B大模型。涵盖4-bit量化、LoRA低秩适配、Alpaca数据格式、训练流水线搭建到模型部署的完整流程,RTX 3090即可运行。

阅读全文 →
Unsloth:显存优化80%,本地微调大模型的最佳开源工具
产品体验
·7 分钟

Unsloth:显存优化80%,本地微调大模型的最佳开源工具

Unsloth是GitHub 63K+ Star的开源大模型训练工具,支持Gemma 4、Qwen 3、DeepSeek等主流模型。通过显存优化降低50%-80%显存占用,让RTX 4090也能微调7B模型,提供Web UI一键训练。

阅读全文 →
Unsloth教程:本地微调大模型省显存提速5倍
教程攻略
·6 分钟

Unsloth教程:本地微调大模型省显存提速5倍

详解Unsloth开源工具如何通过LoRA优化和Web UI界面,让消费级显卡也能高效微调Gemma 4、Qwen3、DeepSeek等主流大模型,训练速度提升2-5倍,显存降低50%-70%。

阅读全文 →
Unsloth教程:本地微调大模型速度提升数倍,显存节省60%
教程攻略
·7 分钟

Unsloth教程:本地微调大模型速度提升数倍,显存节省60%

Unsloth是GitHub 63K星标的开源大模型微调工具,支持Gemma 4、Qwen3、DeepSeek等模型。通过底层内核优化实现训练加速数倍、显存大幅降低,消费级GPU即可完成微调,提供Web UI图形界面,适合个人开发者和企业私有化部署。

阅读全文 →
Cube Studio:腾讯开源一站式AI平台,MLOps全流程深度解析
产品体验
·8 分钟

Cube Studio:腾讯开源一站式AI平台,MLOps全流程深度解析

深度解析腾讯音乐开源的Cube Studio云原生AI平台,涵盖Notebook开发、Pipeline编排、分布式训练、大模型微调、推理部署及国产化适配等核心能力,助力企业快速构建MLOps全流程基础设施。

阅读全文 →
Unsloth教程:本地微调大模型省显存加速训练指南
教程攻略
·7 分钟

Unsloth教程:本地微调大模型省显存加速训练指南

详解Unsloth开源工具如何在本地高效微调大模型,支持Gemma 4、Qwen3、DeepSeek等主流模型,通过LoRA优化显著降低显存占用,提供Web UI界面降低训练门槛,适合个人开发者和中小团队使用。

阅读全文 →
Unsloth:本地微调大模型的高效开源工具
产品体验
·5 分钟

Unsloth:本地微调大模型的高效开源工具

Unsloth是GitHub上超63000星的开源项目,提供Web UI界面支持本地训练和微调Gemma 4、Qwen3、DeepSeek等主流大模型,大幅降低硬件门槛和技术难度,适合个人开发者和企业私有化部署。

阅读全文 →
Unsloth:本地训练开源大模型的利器
产品体验
·2 分钟

Unsloth:本地训练开源大模型的利器

阅读全文 →