产品介绍
Llama 是 Meta(Facebook 母公司)推出的开源大语言模型系列,也是当前全球开源社区最活跃的基座模型之一。自 2023 年 Llama 1 以研究用途有限开源、2023 年 Llama 2 放宽商业授权以来,Llama 迅速成为无数 AI 应用、微调模型和私有化部署方案的默认选择。2024 年的 Llama 3.1 进一步将旗舰模型参数推到 405B,并把上下文窗口扩展到 128K;2025 年的 Llama 4 则在多模态理解、推理规划和 Agent 能力上大幅升级。
定价完全免费开源。Meta 将 Llama 模型权重公开发布,开发者可以下载后在本地、私有云或边缘设备上运行。Llama 3.x 采用 Llama 3 Community License,对大多数商业应用非常友好,但月活超过 7 亿的大型平台需要向 Meta 申请特殊许可。云厂商(AWS、Azure、Google Cloud、阿里云等)也提供托管 API,按调用量计费。
生态位上,Llama 是开源大模型的「默认选项」:生态工具最全、社区微调模型最多、企业落地案例最丰富。与 Qwen 相比,Llama 的英文能力更强、海外社区资源更多;与 GPT-4、Claude 等闭源模型相比,Llama 更适合需要数据不出域、成本控制严格或需要深度定制的场景。如果你要搭建一个可私有化部署、可长期迭代的大模型底座,Llama 是绕不开的候选。
注意:Llama 的中文能力虽然通过社区微调已经不错,但原生版本仍弱于 Qwen 等中文优化模型;大参数版本(70B/405B)需要专业 GPU 集群,本地部署前需做好硬件和量化方案评估。
模型迭代时间线
| 时间 | 版本/模型 | 要点 |
|---|---|---|
| 2023-02 | Llama 1 | Meta 首次公开大语言模型权重(研究用途) |
| 2023-07 | Llama 2 | 放宽商业授权,7B/13B/70B 三尺寸 |
| 2024-04 | Llama 3 | 新一代训练数据与架构,8B/70B 首发 |
| 2024-07 | Llama 3.1 | 发布 405B 旗舰,上下文 128K |
| 2025-04 | Llama 4 | 多模态、推理与 Agent 能力升级 |
第四代模型,多模态与推理能力显著增强
发布 405B 旗舰模型,上下文扩展至 128K
首个广泛商用的 Llama 开源版本




