定位与三种风格
论文标题就说明了它的野心——为代码打造的开放基础模型家族。官方给出三种风格:基础版面向通用代码生成,Python 特化版只聚焦一门语言,指令版面向跟随指令的任务;论文口径每种风格提供 7B、13B、34B 与 70B 四档(仓库的尺寸表也列到了 70B)。论文于 2023 年 8 月 24 日首次提交、2024 年 1 月 31 日修订到第三版,摘要里的自我评价是「在开放模型中于多项代码基准上达到当时领先水平」——这句话应作为论文当时的口径理解,而非当下的对比结论。
开源代码基础模型 · 权重按社区许可免费申请(需接受条款);无官方托管接口。
Code LlamaCode Llama 是基于 Llama 2 的代码模型家族,提供基础版、Python 特化版与指令版三种风格,论文口径覆盖 7B、13B、34B、70B 四档;按 16K 序列训练、输入到 100K 仍有改善,并支持基于上下文的填充补全。

深度介绍
论文标题就说明了它的野心——为代码打造的开放基础模型家族。官方给出三种风格:基础版面向通用代码生成,Python 特化版只聚焦一门语言,指令版面向跟随指令的任务;论文口径每种风格提供 7B、13B、34B 与 70B 四档(仓库的尺寸表也列到了 70B)。论文于 2023 年 8 月 24 日首次提交、2024 年 1 月 31 日修订到第三版,摘要里的自我评价是「在开放模型中于多项代码基准上达到当时领先水平」——这句话应作为论文当时的口径理解,而非当下的对比结论。
官方说明写得很直白:在 Llama 2 基础上、用更高的代码采样比例继续微调得到。所有档位按 16K token 的序列训练,但在最长 100K 的输入上仍能看到提升——「按 16K 训练、到 100K 可用」这组数字是它长上下文能力的原始口径。能力面上,论文列出三项:开放模型中的代码基准领先、支持基于上下文的填充补全、以及面向编程任务的零样本指令跟随。填充能力覆盖基础版与指令版的部分档位(论文口径为 7B、13B、70B 支持)。
仓库的尺寸表可以直接当采购参考:7B 约 12.55 GB、13B 24 GB、34B 63 GB、70B 131 GB;推理时的模型并行值分别是 1、2、4、8 卡。README 另有一条实操细节:除 70B 的 Python 与指令版外,其余模型都支持最长 100,000 token 的序列,且缓存按你设置的最大序列长度与批大小预分配——所以参数要按自己的硬件调,而不是照抄示例。本地跑法是克隆仓库、装依赖、再用自带的示例脚本起推理。
权重不直接挂着下载。官方流程是:到 Meta 的模型下载页接受许可,请求批准后收到一封含签名链接的邮件,再用仓库里的下载脚本拉取。README 特意提醒了两个坑:链接 24 小时与一定下载次数后过期,看到 403 就重新申请一次;复制链接时别用浏览器的「复制链接地址」,要看清链接前缀才没拿错。在模型平台上,对应的模型卡也是人工审核门控——核验时 70B 指令版的卡片页可以正常打开,但下载需要先申请。
仓库的许可文件只有一句指引:去看 Llama 的社区许可。该协议是厂商自拟的社区许可(2023 年 7 月 18 日版本),条款里既有授予使用的部分,也有约束条件——例如规定在月活超过 7 亿的再分发场景下须与官方另行达成协议,具体以协议原文为准。README 还补了一句容易被忽略的提醒:模型生成的输出可能受第三方许可(包括开源许可)约束——用它产出的代码,版权归属要自己核。这类许可与纯开源许可的差别,采购前值得逐条读一遍。
官方说明对微调版本施加了与基础模型一致的大量安全缓解,并把训练、架构与参数、评测、负责任使用与安全的细节都放进了研究论文,让核查者可以直接对照原文。输出可能涉及第三方许可的提醒也被写进了 README 的开头段落,而不是塞在脚注。对要在生产环境里使用它的团队,这两处官方披露是做合规评估时的第一手材料。
本页最重要的状态信息是:代码仓库当前已归档(只读,不再接受新的议题与合并请求),核验时约 16,251 星标;模型线自论文修订后未再更新,模型卡的门控与下载量也显示它已远离活跃使用。写作时点到为止的结论是——这是一条 2023 年的代码模型线,今天更适合当历史基线与对照样本:评测评分、代码补全能力、许可模板都可以拿它做参照,但选新的主力模型时应当与更新的代码模型一起比较。把状态写清楚,比给一个过时的型号背书更有价值。
README 单列了一节讲提问方式:基础版与 Python 特化版没有做指令微调,提问要按「期望得到提示词的自然延续」来写——也就是补全式用法,而不是对话式。指令版才适合直接下任务。这个差别在实际使用里很关键:拿基础版当聊天模型用会得到续写而不是回答,看起来像坏了,其实是用法不对。另附一句官方提醒:代码生成的输出可能受第三方许可约束,商用前的版权核查不能省。
产品特点
基础版、Python 特化版与指令版,各自配 7B 到 70B 的尺寸表与模型并行值,尺寸从 12.55 GB 到 131 GB 都有官方数字。要按硬件选档、按任务选风格,这套组合表是现成的选型依据。
按 16K 序列训练却在 100K 输入上仍有提升,再配上基于上下文的填充补全——这套「补全式生成」能力是这条线在代码场景的立身之本,也是后来者反复对标的历史口径。
接受许可、收签名链接、脚本下载、24 小时过期、403 就重申——README 把每一步的坑都标了出来;模型平台侧同样是人工审核门控。合规与工程两条线各走各的,责任边界明确。
代码仓库处于归档只读状态、模型线未再更新,页面把这些写在显著位置并把它定位为历史基线。对一条 2023 年的型号,如实标注状态比含糊推荐更负责——选新模型时拿它对照即可。
最近动态
核验时代码仓库标记为归档(只读)、约 16,251 星标,许可文件仍指向 Llama 2 社区许可原文;模型平台侧各模型卡仍为人工审核门控,70B 与 34B 指令版卡片可正常访问、下载需申请。另需记录:Meta 的研究发布页与权重下载页在本机脚本与抓取下均返回 400(疑似拒绝非浏览器请求),因此本页入口改用论文与代码仓库,Meta 页面可在浏览器中自行访问。
模型平台侧的 70B 指令版模型卡创建于 2024 年 3 月 13 日,与论文第三版(2024 年 1 月 31 日修订)时间相近,补齐了四档尺寸中最大的一档。这之后该模型线没有再发布新版本,70B 卡片也因此成为这条线最后一条公开的模型记录。
论文于 2023 年 8 月 24 日首次提交,公开了训练方式、架构与参数、多组代码基准评测、负责任使用与安全章节;同批 README 记载了 7B 至 34B 权重的发布与下载流程、模型尺寸与并行建议,以及填充与指令两类用法说明。这次发布奠定了这条线此后所有引用与对照的原始口径。
Code Llama 是基于 Llama 2 的开源代码模型家族,论文标题即「为代码打造的开放基础模型」。官方给出三种风格:基础版、Python 特化版与指令版,论文口径每种提供 7B、13B、34B 与 70B 四档;论文 2023 年 8 月 24 日提交、2024 年 1 月 31 日修订到第三版,自我评价是在开放模型中于多项代码基准上达到当时领先水平——这是论文当时的口径,不是当下对比。 训练上它是在 Llama 2 上用更高代码采样比例继续微调;所有档位按 16K 序列训练、在最长 100K 输入上仍见提升;能力面列了三项:开放模型中的代码基准领先、基于上下文的填充补全(论文口径 7B、13B、70B 的基础与指令版支持)、面向编程任务的零样本指令跟随。运行开销有官方数字:尺寸 7B 约 12.55 GB、13B 24 GB、34B 63 GB、70B 131 GB,模型并行值 1/2/4/8;README 还提醒除 70B 的 Python 与指令版外都支持到 100K 序列、缓存按最大序列长度与批大小预分配。 获取流程是「接受许可换签名链接」:到 Meta 下载页接受许可、邮件收到签名链接、用下载脚本拉取;链接 24 小时与次数过期,遇 403 重新申请,README 连「复制链接地址可能拿错」都提醒了。模型平台侧同样是人工审核门控,70B 与 34B 指令版卡片可访问但需先申请。许可方面,仓库指向 Llama 2 社区许可——厂商自拟的社区许可(2023 年 7 月 18 日版),含接受义务,并规定在月活超过 7 亿的再分发场景下须与官方另行达成协议,且 README 提醒模型输出可能受第三方许可约束,商用前要自行核查。 安全上,官方称对微调版本施加了与基础模型一致的大量安全缓解,并把训练、架构、评测与负责任使用的细节留在论文里供核查。状态是本页最需要说清的部分:代码仓库已归档(只读、不再接受议题与合并请求),核验时约 16,251 星标,模型线自论文修订后未再更新,模型卡门控与低下载量也表明它已远离活跃使用。因此合理定位是 2023 年代码模型的历史基线与对照样本——评测口径、补全能力、许可模板都值得拿它参照,但选新主力时必须与更新的代码模型同台比较。用法上最后一点提醒:基础版与 Python 特化版未做指令微调,提问应按自然延续的补全式写法,指令版才适合直接下任务。
核验信息
本页事实来自官方渠道:仓库 README(三种风格与论文口径档位、Llama 2 高代码采样微调、16K 训练与 100K 输入改善、填充能力、尺寸表与模型并行值、70B 特例与缓存预分配说明、接受许可换签名链接与 24 小时过期与 403 重申、基础版与指令版提问差异、输出可能受第三方许可约束、安全缓解与论文指引、许可指引),研究论文(标题与提交及修订日期、四档尺寸、填充与零样本指令与开放模型领先水平的原文口径),模型平台模型卡与组织页(人工审核门控、70B 指令版卡片创建于 2024-03-13 及访问状态),代码仓库状态(归档只读、约 16,251 星标)与 Llama 2 社区许可原文。Meta 研究发布页与权重下载页在核验环境返回 400,未列为入口,已在正文与登记中说明。状态核验于 2026 年 9 月 22 日。
Code Llama介绍页面对您是否有帮助?