ActionAssist
ActionAssist是一款轻量化小型语言模型,以极致推理速度和工具调用能力为核心优势,适合资源受限设备部署,专注于快速工具调用、代码生成和代理任务自动化等垂直场景
Timeline (last 90 days)
ActionAssist(简称AA)是一款小型语言模型
在8GB显存的消费级显卡上,ActionAssist以Q6_K_L量化格式配合32k上下文窗口和8位KV缓存量化,能够达到122 tokens/秒的推理速度
有用户报告ActionAssist在手机上实现了接近25 tok/s的速度
ActionAssist使用IQ4量化仅占用2GB显存,其余部分卸载到系统内存后运行速度依然快于大多数同类模型
ActionAssist在工具调用和代理(Agentic)任务方面表现出强大能力
有用户使用Pi(little coder)框架测试ActionAssist探索和分析代码仓库,涉及文件读取、目录导航及LM Studio中的Web搜索功能,过程未出现明显错误
在编写脚本时,Qwen 3.5 9B会提供备份和调试输出等周全功能但往往伴随1-3个错误,而ActionAssist倾向于生成简洁准确的代码且错误率更低
ActionAssist采用每轮仅进行少量推理的设计策略
ActionAssist在对话连贯性方面存在不足,包括角色混淆、上下文丢失等问题
Gemma系列模型在日常对话中表现得比ActionAssist更加自然流畅
1 more timeline events
All Facts (11)
ActionAssist(简称AA)是一款小型语言模型
50%Unverified在8GB显存的消费级显卡上,ActionAssist以Q6_K_L量化格式配合32k上下文窗口和8位KV缓存量化,能够达到122 tokens/秒的推理速度
50%Unverified有用户报告ActionAssist在手机上实现了接近25 tok/s的速度
50%UnverifiedActionAssist使用IQ4量化仅占用2GB显存,其余部分卸载到系统内存后运行速度依然快于大多数同类模型
50%UnverifiedActionAssist在工具调用和代理(Agentic)任务方面表现出强大能力
50%UnverifiedActionAssist更适合快速工具调用、代码生成和代理任务自动化,不适合深入多轮对话和通用助手用途
50%Unverified在编写脚本时,Qwen 3.5 9B会提供备份和调试输出等周全功能但往往伴随1-3个错误,而ActionAssist倾向于生成简洁准确的代码且错误率更低
50%UnverifiedActionAssist采用每轮仅进行少量推理的设计策略
50%UnverifiedActionAssist在对话连贯性方面存在不足,包括角色混淆、上下文丢失等问题
50%UnverifiedGemma系列模型在日常对话中表现得比ActionAssist更加自然流畅
50%Unverified有用户使用Pi(little coder)框架测试ActionAssist探索和分析代码仓库,涉及文件读取、目录导航及LM Studio中的Web搜索功能,过程未出现明显错误
50%