返回模型目录
代码文本生成

Qwen2.5-Coder-1.5B-Instruct

适合代码生成、代码解释与修复的轻量指令模型。

最后核实:

https://huggingface.co/Qwen/Qwen2.5-Coder-1.5B-Instruct

特点与限制

主要特点

  • 28层稠密Transformer
  • 代码生成、推理和修复
  • 32768 token上下文

使用边界

  • 此1.5B型号卡声明的上下文为32768,不沿用其他尺寸的长上下文宣传。
  • 生成代码需审查与测试;本站未执行模型。

模型信息

家族与版本
Qwen Coder / 2.5
输入与输出
文本 → 文本
公开参数规模
1.54B(以以下来源口径为准)
激活 / 有效参数
未提供 / 未提供
参数口径
官方总参数1.54B,非嵌入参数1.31B;1.5B为型号命名,不将非嵌入参数当成激活或有效参数。 参数来源
原生上下文
32,768 tokens
扩展上下文
未提供
语言声明
en(模型卡语言标签);语言支持不代表对应语言的评测水平。
权重许可
Apache-2.0
代码许可
未核实
训练资料
官方系列报告披露训练扩展至5.5万亿token,包含源码、文本与代码关联以及合成数据;未公开完整数据清单。

能力依据

模型变体:指令版;家族与版本:Qwen Coder / 2.5

代码 仅官方依据

HumanEval+66.5%官方报告 · code
LiveCodeBench6.1%官方报告 · code
查看评估与来源收起补充信息

官方技术报告对该精确Instruct型号报告HumanEval+ 66.5%与LiveCodeBench Pass@1 6.1%。这显示其在短程序功能正确性和竞赛题生成上有直接基准证据,但不代表代码仓库级修改或本地部署质量。

已有依据支持
  • 官方报告提供该精确Instruct型号的HumanEval+和LiveCodeBench成绩。
证据限制
  • LiveCodeBench只覆盖竞赛题,不能替代真实仓库任务。
  • 报告未披露完整采样与运行配置,本站未复现。
  • 不应将这些分数与Qwen系列不同题目期或不同提示结果直接排名。

HumanEval+ · 66.5%官方报告 · Qwen Team

score · 越高越好 · code · 摘要引用

展开评测条件与来源
模型标识 / 修订
Qwen/Qwen2.5-Coder-1.5B-Instruct / 未提供
思考模式
不适用
量化 / 运行时
未提供 / 未提供
数据集 / 划分
HumanEval+ / 未提供
基准 / 报告版本
EvalPlus(Qwen技术报告Table 16)
Few-shot / 输出上限
未提供 / 未提供 tokens
提示模板 / 设置
未提供;Qwen2.5-Coder技术报告Table 16中精确Instruct型号 Qwen2.5-Coder-1.5B-Instruct 的HumanEval+成绩为66.5;报告没有披露该型号的提示、采样、输出预算或生成环境,本站未复现。
评测日期 / 核实日期
未提供 / 2026-10-02
来源
https://arxiv.org/html/2409.12186v3
来源使用说明
引用来源;许可:未提供;仅引用Qwen官方技术报告中的少量成绩事实并保留出处链接;不复制报告表格或图像。 查看说明
比较状态
不可比:官方报告没有披露可复现比较所需的模型revision及完整采样、提示和输出设置;原样记录成绩,不与配置不明的结果直接排名。

LiveCodeBench · 6.1%官方报告 · Qwen Team

pass@1 · 越高越好 · code · 摘要引用

展开评测条件与来源
模型标识 / 修订
Qwen/Qwen2.5-Coder-1.5B-Instruct / 未提供
思考模式
不适用
量化 / 运行时
未提供 / 未提供
数据集 / 划分
LiveCodeBench / 未提供
基准 / 报告版本
题目期 2024.07–2024.09
Few-shot / 输出上限
未提供 / 未提供 tokens
提示模板 / 设置
未提供;Qwen2.5-Coder技术报告Table 16列出 Qwen2.5-Coder-1.5B-Instruct LiveCodeBench Pass@1=6.1%;正文说明采用 2024.07–2024.09 题目。具体提示、采样和输出长度未完整披露,本站未复现。
评测日期 / 核实日期
未提供 / 2026-10-02
来源
https://arxiv.org/html/2409.12186v3
来源使用说明
引用来源;许可:未提供;仅引用Qwen官方技术报告中的少量成绩事实并保留出处链接;不复制报告表格或图像。 查看说明
比较状态
不可比:官方报告没有披露可复现比较所需的模型revision及完整采样、提示和输出设置;原样记录成绩,不与配置不明的结果直接排名。

文本生成 证据不足

暂无可靠公开成绩

查看评估与来源收起补充信息

官方资料确认Qwen2.5-Coder-1.5B-Instruct为代码指令型号,但未找到可机器核实的该精确型号通用文本基准成绩;系列技术报告的数值表覆盖Base结果,不能移植到Instruct版本。

已有依据支持
  • 官方型号卡确认此版本经过指令微调,可直接按对话模板使用。
证据限制
  • 没有确认到精确Instruct型号的通用语言成绩;同尺寸Base结果不适用。
  • 本站未复现通用问答或写作能力。

暂无该用途的公开评测成绩;不能从其他用途或缺失值推断能力。

运行条件与获取

Transformers

系统支持未提供 · Safetensors · 未指定量化

官方支持;本站尚未进行推理验证。

硬件:未核实。本站未实测;内存、显存和速度取决于运行时、精度、输入长度与硬件,不将参数量或文件大小换算为资源保证。

内存:未核实;显存:未核实。

依赖:transformers>=4.37.0(官方建议最新版)、torch、accelerate。

STEP 01 按官方示例准备环境

打开部署来源链接,按官方安装章节配置依赖;依赖与模型版本需保持匹配。

STEP 02 加载指定模型

按同页推理示例加载此模型并处理对应输入;本站未下载权重或执行模型,需在目标设备验证。

查看官方模型资料