Meta 人工智能博客把日期写在 2023 年 7 月 18 日。标题是 Meta and Microsoft Introduce the Next Generation of Llama。要点就几条:Llama 2 对研究和商业使用免费;提供预训练权重和起步代码,也有对话微调版;微软是优先合作方,当天进入 Azure AI 模型目录,并针对 Windows 本地运行做了优化;AWS、Hugging Face 等渠道同步可取。
同一天的研究摘要把规模写成 70 亿到 700 亿参数的一组模型,对话微调版叫 Llama 2-Chat。社区许可证第一行写着 Llama 2 Version Release Date: July 18, 2023。这不是「某个人在论坛丢了个种子链接」,是公司自己把权重和许可条款一起公开。
许可并非无条件公共领域。常见限制包括:月活超过一定规模的服务要向 Meta 申请额外许可,条款以当时许可证文本为准。Llama 1 更早,主要面向研究,商用门槛更高。7 月 18 日这件事的窄含义是:一条能在自己机器或云上跑的开源家族,第一次被公司按商业友好的条款放下。
不要把「开源」读成训练数据也全部公开。公开的是权重、起步代码和论文里写到的方法。数据配比、清洗规则仍以论文和模型卡为准。Llama 1 更早主要给研究用;Llama 3 是 2024 年的下一族,不要和 7 月 18 日混在一起。
这一天之后,很多本地部署教程默认从 7B 或 13B 起步。那是社区用法,不是 Meta 博客里的承诺。能核对的是博文日期、许可证第一行,以及「研究与商用免费、但仍受条款约束」这句。
