新闻中心
Stability AI开源3B代码生成模型:可补全,还能Debug
本周一,Stability AI 开源了小体量预训练模型 Stable Code Instruct 3B。
Stable Code Instruct 3B 是建立在 Stable Code 3B 基础上的指令调整编码语言模型(Code LM)。通过提供自然语言提示,该模型可应用于多种任务,包括代码生成、数学问题以及其他与软件工程相关的任务。
Stability AI声称,他们的模型在规模为3B时表现出了最先进的性能,优于CodeLlama的7B Instruct等更大规模的模型,在软件工程相关任务中,甚至与StarChat的15B模型性能相当。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜
- 模型:https://huggingface.co/stabilityai/stable-code-instruct-3b
- HuggingFace 试用:https://huggingface.co/spaces/stabilityai/stable-code-instruct-3b
- Stable Code 技术报告:https://static1.squarespace.com/static/6213c340453c3f502425776e/t/6601c5713150412edcd56f8e/1711392114564/Stable_Code_TechReport_release.pdf
Stable Code Instruct 3
B已经升级了代码补全功能,并且支持自然语言交互,旨在提高编程和软件开发任务的效率和直观性。实验结果显示,这个模型在各种编码相关任务中表现优异,超过了Codellama 7B Instruct和DeepSeek-Coder Instruct 1.3B等竞争对手模型。
方法介绍
Stable Code 建立在 Stable LM 3B 的基础上。Stable Code 是一个因果纯解码器 transformer,类似于 LLaMA 架构,与 LLaMA 的主要区别如下:
- 位置嵌入,旋转位置嵌入应用于头嵌入维度的前 25%,以提高吞吐量;
- 标准化,带有学得偏差项的 LayerNorm;
- 偏差,除了键、查询和值投影的偏差,Stable Code 从前馈网络和多头自注意力层中删除了所有偏差项。

下表给出了预训练语料库数据集的采样权重、 epoch、类别等信息。


根据 Stack Overflow 2025 开发者调查报告,Stable Code Instruct 3B 重点关注 Python、J*ascript、J*a、C、C++ 和 Go 等语言,这些语言对于各种开发人员来说是最流行和最有影响力的。虽然这些语言被选为训练的重点,但该模型还针对其他广泛采用的语言(例如 SQL、PHP 和 Rust)进行了训练。

即使对于最初未包含在训练集中的语言(例如 Lua),Stable Code Instruct 3B 也能提供强大的测试性能。这种熟练程度可能源于其对底层编码原理的理解,以及利用编码任务固有的可预测性,在不同编程环境中适应概念的能力。
Stable Code Instruct 3B 不仅精通代码生成,还精通 FIM(Fill in the Middle)任务、数据库查询、代码翻译、解释和创建。其指令调整使其能够理解并按照细致入微的指令采取行动,促进除简单代码完成之外的广泛编码任务,包括数学理解、逻辑推理和围绕软件开发处理复杂的技术描述。
性能评估
与 Codellama 7B Instruct 和 DeepSeek-Coder Instruct 1.3B 等领先模型相比,Stable Code Instruct 3B 在一系列编码任务中展现出卓越的性能。

研究团队还在 Multi-PL 基准上比较了三种模型。尽管参数量较少,但 Stable Code Instruct 3B 在所有语言上的表现均明显优于 CodeLlama Instruct。

下表 8 展示了几种模型在 FIM 任务上的性能:

实验测试表明,Stable Code Instruct 3B 在代码完成准确性、对自然语言指令的理解以及跨不同编程语言的能力方面可与其他模型媲美甚至超越。

Stable Code Instruct 3B 的参数规模和低硬件要求使其可供广泛的受众使用,使开发人员能够更高效地工作。值得一提的是,Stable Code Instruct 3B 现在可以通过 Stability AI 会员资格用于商业目的。
以上就是Stability AI开源3B代码生成模型:可补全,还能Debug的详细内容,更多请关注其它相关文章!
# 应用于
# 北海建设工程信息网站
# 菏泽网站关键词排名优化
# 兰州网站推广文案公司
# 淮南关键词自然排名
# 淘宝网站内推广怎么做
# 淘宝seo如何定价
# 宁波seo引流推广公司
# 浠水推广代运营网站
# 优化网站排名差异
# 小米营销推广策划总结
# 下表
# 开发人员
# 模型
# 使其
# 基础上
# 出了
# 自然语言
# 软件工程
# 还能
# llama
# deepseek
# overflow
# 开源
# ai
相关栏目:
【
行业资讯67740 】
【
技术百科0 】
【
网络运营39195 】
相关推荐:
linux如何跳回命令行界面
宝马x5仪表盘上边有power是什么意思
typescript为什么现在才火
怎么在项目中使用typescript
typescript中如何定义json
哪些编程软件需要typescript
typescript是做什么用的
夸克文字口令是什么意思
苹果16有哪些bug
单身聊天app有哪些软件 2025最靠谱的单身交友软件推荐
typescript如何做项目
nosql数据库的应用场景有哪些
如何查看硬盘是固态硬盘
j*a如何运行curl命令行
linux如何调出命令行
固态硬盘如何打开软件
数组和J*A怎么打
1tb等于多少mb
虚拟机服务器如何关机命令
typescript学会要多久
跑分是什么意思
如何ping测试命令
显示器power接口是什么意思
5g手机怎么没视频通话功能
尼桑越野车中控前power是什么意思
苹果16系统有哪些问题
苹果16自带配件有哪些
锤子手机怎么不出5g
复制 命令如何撤销
春运抢票极速版怎么抢票
bc是什么意思
如何寻找和修复无法在 AI 中找到文件的问题
vivo手机nfc功能是什么意思
单片机.lib文件怎么打开
如何知道固态硬盘
如何清理固态硬盘
ready是什么意思
苹果手机16系统有哪些
j*a怎么用json数组
arp命令如何使用
高市盈率是什么意思
如何查看邮件域名解析
系统如何装进固态硬盘
什么叫typescript
主板如何禁用固态硬盘
m*en repository的作用是什么
企业征信不好如何恢复 企业征信不好怎么恢复步骤
js怎么设置typescript
单片机软件keil怎么运行
爱奇艺中下载的视频怎么在PPT中播放操作方法


2024-03-28
浏览次数:次
返回列表