模型LLaMA系列 / LLaMA大语言模型
LLaMA
Meta开源的大语言模型系列,模型权重公开,是Meta AI技术栈的底层基础之一
时间轴 (近 90 天)
6月3日
Qwen-7B、LLaMA-2-7B等开源模型经过Agent Tuning后在工具调用准确率上可以达到GPT-3.5甚至接近GPT-4的水平
待验证60%
6月3日
与LangChain形成竞争和互补关系的框架包括LlamaIndex、Semantic Kernel(微软推出)和Haystack(deepset开发)
待验证85%
6月3日
阿里云百炼平台集成了阿里自研的通义千问(Qwen)系列模型以及第三方开源模型如DeepSeek、Llama等
部分验证65%
6月3日
Meta的Llama系列在开源多模态领域持续发力
待验证80%
6月3日
Ollama本身完全免费且开源
已验证75%
6月3日
Ollama提供标准API接口,支持Python、Java、Rust等多种编程语言调用
已验证70%
6月3日
Meta的LLaMA系列、Mistral AI的Mistral/Mixtral系列、阿里的Qwen系列、DeepSeek系列等都提供了从1B到数百B不等参数规模的开源版本
已验证65%
6月3日
Ollama默认提供的模型多为4-bit量化版本(Q4_0或Q4_K_M格式)
待验证85%
6月3日
Ollama能够在模型超出显存容量时自动将部分模型层卸载到内存中由CPU处理(offloading技术)
已验证65%
6月3日
Ollama将CUDA、cuDNN等底层依赖封装在内部,用户无需手动配置GPU环境
待验证90%
还有 40 条时间轴事件