[控场AI]

#模型微调

共 18 篇相关文章

Qwen3.8-27B拟人化模型2.0:会聊天也会调用工具
·7 分钟

Qwen3.8-27B拟人化模型2.0:会聊天也会调用工具

Qwen3.8-27B-Humanlike-Chat 2.0 发布,在保留拟人化语气的同时新增工具调用与更强指令遵循。本文解析其双教师在线策略蒸馏训练法、Benchmark 数据与拟人化测试结果。

阅读全文 →
Unsloth Desktop 重磅更新:命令面板上线,4-bit 微调显存直降45%
·7 分钟

Unsloth Desktop 重磅更新:命令面板上线,4-bit 微调显存直降45%

Unsloth Desktop v0.1.902-beta 发布:新增命令面板、可分享运行设置,4-bit 预量化检查点保持打包训练让显存最高降低45%,Laya 决策提速4.1倍,涵盖 NVFP4、INT4、MXFP4 及跨平台支持。

阅读全文 →
Unsloth Desktop v0.1.901 发布:命令面板、4倍加速与低显存训练
·7 分钟

Unsloth Desktop v0.1.901 发布:命令面板、4倍加速与低显存训练

Unsloth Desktop v0.1.901-beta 发布,带来命令面板、可分享运行配置、Laya 决策 4.1 倍提速,以及 NVFP4/INT4/MXFP4 检查点低显存 LoRA 训练,大幅降低本地大模型微调门槛。

阅读全文 →
微调NVIDIA Nemotron适配沙特阿拉伯方言:低资源语言的落地路径
·4 分钟

微调NVIDIA Nemotron适配沙特阿拉伯方言:低资源语言的落地路径

NVIDIA分享如何微调Nemotron语音模型以识别沙特阿拉伯方言,并提炼出一套可迁移到其他低资源语言的通用路径,为全球语音AI本地化提供参考范例。

阅读全文 →
单卡在家微调:Jev风格决策模型的实测表现
·4 分钟

单卡在家微调:Jev风格决策模型的实测表现

一个独立项目用单张GPU在家微调Qwen3.5和Gemma 4,打造0.8B与2B决策模型,响应延迟仅22-28毫秒。本文解析其实测数据、复现方法及基准测试与真实场景的差距。

阅读全文 →
LessThink-Qwen3-4B:把推理Token砍掉44%
·5 分钟

LessThink-Qwen3-4B:把推理Token砍掉44%

Reddit 开发者发布 LessThink-Qwen3-4B,通过后训练让 Qwen3-4B 的推理 token 减少 44%,在保持知识与回答风格的同时压缩思考开销,全程单卡完成。本文解读其思路、价值与需要打问号的地方。

阅读全文 →
微调LLM还需要人类可读文本吗?DASA给出否定答案
·5 分钟

微调LLM还需要人类可读文本吗?DASA给出否定答案

arXiv新论文提出DASA方法,通过激活梯度反馈优化连续合成嵌入用于LLM微调,无需人类可读文本。在Llama和Qwen共6个模型上,性能追平并超越自然语言数据,较GRADMM提速3.6-4.9倍。

阅读全文 →
LangSmith Fine-Tuning 上线:一条 CLI 打通微调全流程
·4 分钟

LangSmith Fine-Tuning 上线:一条 CLI 打通微调全流程

LangChain 发布 LangSmith Fine-Tuning 与 smithtune 工具,Fireworks 成为首批训练合作伙伴。开发者可通过一条 CLI 完成从 LangSmith traces 到托管 SFT、评估、部署的完整微调闭环,无需自建训练基础设施。

阅读全文 →
模型微调如何降低90%成本:拥有产品核心智能
·4 分钟

模型微调如何降低90%成本:拥有产品核心智能

针对客户依赖的核心任务,模型训练可将成本削减最高90%。本文解析为何等待下一个大模型救不了产品,以及「拥有产品核心智能」背后的成本与战略逻辑。

阅读全文 →
Unsloth新版发布:Qwen-Image-2.1图像生成与自定义Agent Skills
·6 分钟

Unsloth新版发布:Qwen-Image-2.1图像生成与自定义Agent Skills

Unsloth 发布 v0.1.812-beta,新增 Qwen-Image-2.1 图像生成与编辑支持、自定义 Agent Skills,推理速度翻倍至 60 FPS,并改进训练稳定性与 Linux/ARM64 部署体验。

阅读全文 →
Unsloth v0.1.811发布:Docker多用户与AMD ROCm支持全解析
·6 分钟

Unsloth v0.1.811发布:Docker多用户与AMD ROCm支持全解析

Unsloth v0.1.811-beta 正式发布,带来全新 Docker 镜像、多用户账户隔离、AMD RDNA1/2 ROCm 支持及 FP8/INT8 扩散推理提速。本文解析这款开源大模型微调工具的核心更新与实际价值。

阅读全文 →
Swift Qwen3.8 27B 破10万下载:高效思考如何砍掉58%的Token
·5 分钟

Swift Qwen3.8 27B 破10万下载:高效思考如何砍掉58%的Token

开源模型 Swift Qwen3.8 27B 下载量破10万,登顶 HuggingFace 微调榜。通过惩罚「过度思考」实现 token 减少58.3%、速度提升1.95倍且不损失精度,是小型高效 LLM 的典型案例。

阅读全文 →
离谱的开源模型命名:从Qwen魔改版看社区乱象
·5 分钟

离谱的开源模型命名:从Qwen魔改版看社区乱象

一个离谱的开源模型名字Qwen3.8-27B-TURBO-Fable-Cold-Fusion在Reddit走红,本文拆解这串缝合怪命名,剖析开源微调模型命名失控的现象与背后的社区生态问题。

阅读全文 →
Gemma 4全面解析:Apache 2.0开源的Agent圣体
教程攻略
·5 分钟

Gemma 4全面解析:Apache 2.0开源的Agent圣体

深度解析Google Gemma 4开源模型系列,涵盖31B、26B MOE、14B/12B三档模型红黑榜评测,提供Windows/Linux/Mac部署方案及MS-Swift微调实战教程,助你精准选型构建本地Agent工作流。

阅读全文 →
Shopify Agent冷启动实战:零对话数据训练生产级AI的三步法
教程攻略
·9 分钟

Shopify Agent冷启动实战:零对话数据训练生产级AI的三步法

Shopify公开生产级AI Agent冷启动方案:零真实对话数据下,从已有业务流程倒推训练样本,微调Qwen-32B实现速度提升2.2倍、成本降低60%。详解三步数据构造法、Tool Call链路设计及企业AI落地启发。

阅读全文 →
川虎ChatGPT:15K Star开源多模型聊天界面全面解析
产品体验
·9 分钟

川虎ChatGPT:15K Star开源多模型聊天界面全面解析

深度解析川虎ChatGPT(ChuanhuChatGPT)开源项目,涵盖多模型统一接入、Agent智能体、文件问答RAG、GPT微调、联网搜索等核心功能,对比同类工具优劣势,助你快速搭建私有AI助手。

阅读全文 →
Unsloth:免费本地训练大模型神器,6万星开源项目详解
产品体验
·7 分钟

Unsloth:免费本地训练大模型神器,6万星开源项目详解

Unsloth是GitHub上6.3万星的开源大模型本地训练工具,支持Gemma 4、Qwen 3、DeepSeek等主流模型微调,提供Web UI图形界面,大幅降低LLM微调门槛。本文详解其核心功能、技术优势与适用场景。

阅读全文 →
Unsloth:本地训练开源大模型的高效工具,6万星标的秘密
产品体验
·11 分钟

Unsloth:本地训练开源大模型的高效工具,6万星标的秘密

深入解析Unsloth这款GitHub 6万+星标的开源大模型训练工具,支持Gemma 4、Qwen3、DeepSeek等主流模型的本地微调与推理,通过LoRA/QLoRA技术大幅降低显存需求,助力开发者在消费级显卡上高效训练大模型。

阅读全文 →