当前位置：首页 > 文章列表 > 科技周边 > 人工智能 > Stability AI开源3B代码生成模型：可补全，还能Debug

Stability AI开源3B代码生成模型：可补全，还能Debug

来源：51CTO.COM 2024-04-11 08:54:11 0浏览收藏

一分耕耘，一分收获！既然打开了这篇文章《Stability AI开源3B代码生成模型：可补全，还能Debug》，就坚持看下去吧！文中内容包含等等知识点...希望你能在阅读本文后，能真真实实学到知识或者帮你解决心中的疑惑，也欢迎大佬或者新人朋友们多留言评论，多给建议！谢谢！

本周一，Stability AI 开源了小体量预训练模型 Stable Code Instruct 3B。

Stable Code Instruct 3B 是建立在 Stable Code 3B 基础上的指令调整编码语言模型（Code LM）。通过提供自然语言提示，该模型可应用于多种任务，包括代码生成、数学问题以及其他与软件工程相关的任务。

Stability AI声称，他们的模型在规模为3B时表现出了最先进的性能，优于CodeLlama的7B Instruct等更大规模的模型，在软件工程相关任务中，甚至与StarChat的15B模型性能相当。

Stability AI开源3B代码生成模型：可补全，还能Debug

模型：https://huggingface.co/stabilityai/stable-code-instruct-3b
HuggingFace 试用：https://huggingface.co/spaces/stabilityai/stable-code-instruct-3b
Stable Code 技术报告：https://static1.squarespace.com/static/6213c340453c3f502425776e/t/6601c5713150412edcd56f8e/1711392114564/Stable_Code_TechReport_release.pdf

Stable Code Instruct 3B已经升级了代码补全功能，并且支持自然语言交互，旨在提高编程和软件开发任务的效率和直观性。实验结果显示，这个模型在各种编码相关任务中表现优异，超过了Codellama 7B Instruct和DeepSeek-Coder Instruct 1.3B等竞争对手模型。

方法介绍

Stable Code 建立在 Stable LM 3B 的基础上。Stable Code 是一个因果纯解码器 transformer，类似于 LLaMA 架构，与 LLaMA 的主要区别如下：

位置嵌入，旋转位置嵌入应用于头嵌入维度的前 25%，以提高吞吐量；
标准化，带有学得偏差项的 LayerNorm；
偏差，除了键、查询和值投影的偏差，Stable Code 从前馈网络和多头自注意力层中删除了所有偏差项。

Stability AI开源3B代码生成模型：可补全，还能Debug

下表给出了预训练语料库数据集的采样权重、 epoch、类别等信息。

Stability AI开源3B代码生成模型：可补全，还能Debug

根据 Stack Overflow 2023 开发者调查报告，Stable Code Instruct 3B 重点关注 Python、Javascript、Java、C、C++ 和 Go 等语言，这些语言对于各种开发人员来说是最流行和最有影响力的。虽然这些语言被选为训练的重点，但该模型还针对其他广泛采用的语言（例如 SQL、PHP 和 Rust）进行了训练。

Stability AI开源3B代码生成模型：可补全，还能Debug

即使对于最初未包含在训练集中的语言（例如 Lua），Stable Code Instruct 3B 也能提供强大的测试性能。这种熟练程度可能源于其对底层编码原理的理解，以及利用编码任务固有的可预测性，在不同编程环境中适应概念的能力。

Stable Code Instruct 3B 不仅精通代码生成，还精通 FIM（Fill in the Middle）任务、数据库查询、代码翻译、解释和创建。其指令调整使其能够理解并按照细致入微的指令采取行动，促进除简单代码完成之外的广泛编码任务，包括数学理解、逻辑推理和围绕软件开发处理复杂的技术描述。