Expired60% confidenceFactTime unknown
Qwen-7B、LLaMA-2-7B等开源模型经过Agent Tuning后在工具调用准确率上可以达到GPT-3.5甚至接近GPT-4的水平
1
Sources
60%
Confidence
Medium-term (~90 days)
Relevance
6/3/2026
First Seen
Valid until: 9/1/2026(expired)
Sources
Agent Tuning:训练具备Agent能力的大模型完整指南
bilibili大模型A
Related Entities
Related Claims
UnverifiedLlama 3.1(Meta)、Mistral 7B/8x7B、Qwen2.5-Coder(阿里云)等开源模型在代码和配置生成任务上达到接近 GPT-4 的实用水平80% similarUnverified在文档摘要基准测试上,Qwen2.5-32B-Instruct和Llama-3.1-70B的量化版本已能达到GPT-4早期版本85%-92%的表现水平80% similarUnverifiedQwen2.5-Coder 在 HumanEval 等代码生成基准上展现出接近 GPT-4o 的表现,其7B版本量化后可在普通笔记本上运行78% similarUnverifiedQwen2.5-27B是阿里云通义实验室发布的270亿参数开源模型,在MMLU、HumanEval、GSM8K等基准上接近GPT-4早期版本水平77% similarUnverifiedLlama 3提供了8B和70B两个版本,在英文通用任务上的表现已经接近GPT-4级别的闭源模型77% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/40492API
curl https://kongchang.com/api/v1/knowledge/claims/40492MCP
get_claim(id=40492)