[控场AI]
模型LLaMA系列 / LLaMA大语言模型

LLaMA

Meta开源的大语言模型系列,模型权重公开,是Meta AI技术栈的底层基础之一

时间轴 (近 90 天)

6月3日

Qwen-7B、LLaMA-2-7B等开源模型经过Agent Tuning后在工具调用准确率上可以达到GPT-3.5甚至接近GPT-4的水平

待验证60%
6月3日

与LangChain形成竞争和互补关系的框架包括LlamaIndex、Semantic Kernel(微软推出)和Haystack(deepset开发)

待验证85%
6月3日

阿里云百炼平台集成了阿里自研的通义千问(Qwen)系列模型以及第三方开源模型如DeepSeek、Llama等

部分验证65%
6月3日

Meta的Llama系列在开源多模态领域持续发力

待验证80%
6月3日

Ollama本身完全免费且开源

已验证75%
6月3日

Ollama提供标准API接口,支持Python、Java、Rust等多种编程语言调用

已验证70%
6月3日

Meta的LLaMA系列、Mistral AI的Mistral/Mixtral系列、阿里的Qwen系列、DeepSeek系列等都提供了从1B到数百B不等参数规模的开源版本

已验证65%
6月3日

Ollama默认提供的模型多为4-bit量化版本(Q4_0或Q4_K_M格式)

待验证85%
6月3日

Ollama能够在模型超出显存容量时自动将部分模型层卸载到内存中由CPU处理(offloading技术)

已验证65%
6月3日

Ollama将CUDA、cuDNN等底层依赖封装在内部,用户无需手动配置GPU环境

待验证90%

还有 40 条时间轴事件

来源文章