Qwen2.5-Coder-1.5B-Instruct
适合代码生成、代码解释与修复的轻量指令模型。
最后核实:
https://huggingface.co/Qwen/Qwen2.5-Coder-1.5B-Instruct特点与限制
主要特点
- 28层稠密Transformer
- 代码生成、推理和修复
- 32768 token上下文
使用边界
- 此1.5B型号卡声明的上下文为32768,不沿用其他尺寸的长上下文宣传。
- 生成代码需审查与测试;本站未执行模型。
模型信息
- 家族与版本
- Qwen Coder / 2.5
- 输入与输出
- 文本 → 文本
- 公开参数规模
- 1.54B(以以下来源口径为准)
- 激活 / 有效参数
- 未提供 / 未提供
- 参数口径
- 官方总参数1.54B,非嵌入参数1.31B;1.5B为型号命名,不将非嵌入参数当成激活或有效参数。 参数来源
- 原生上下文
- 32,768 tokens
- 扩展上下文
- 未提供
- 语言声明
- en(模型卡语言标签);语言支持不代表对应语言的评测水平。
- 权重许可
- Apache-2.0
- 代码许可
- 未核实
- 训练资料
- 官方系列报告披露训练扩展至5.5万亿token,包含源码、文本与代码关联以及合成数据;未公开完整数据清单。
能力依据
模型变体:指令版;家族与版本:Qwen Coder / 2.5
代码 仅官方依据
HumanEval+66.5%官方报告 · codeLiveCodeBench6.1%官方报告 · code查看评估与来源收起补充信息
代码 仅官方依据
HumanEval+66.5%官方报告 · code
LiveCodeBench6.1%官方报告 · code
官方技术报告对该精确Instruct型号报告HumanEval+ 66.5%与LiveCodeBench Pass@1 6.1%。这显示其在短程序功能正确性和竞赛题生成上有直接基准证据,但不代表代码仓库级修改或本地部署质量。
已有依据支持
- 官方报告提供该精确Instruct型号的HumanEval+和LiveCodeBench成绩。
证据限制
- LiveCodeBench只覆盖竞赛题,不能替代真实仓库任务。
- 报告未披露完整采样与运行配置,本站未复现。
- 不应将这些分数与Qwen系列不同题目期或不同提示结果直接排名。
HumanEval+ · 66.5%官方报告 · Qwen Team
展开评测条件与来源
- 模型标识 / 修订
- Qwen/Qwen2.5-Coder-1.5B-Instruct / 未提供
- 思考模式
- 不适用
- 量化 / 运行时
- 未提供 / 未提供
- 数据集 / 划分
- HumanEval+ / 未提供
- 基准 / 报告版本
- EvalPlus(Qwen技术报告Table 16)
- Few-shot / 输出上限
- 未提供 / 未提供 tokens
- 提示模板 / 设置
- 未提供;Qwen2.5-Coder技术报告Table 16中精确Instruct型号 Qwen2.5-Coder-1.5B-Instruct 的HumanEval+成绩为66.5;报告没有披露该型号的提示、采样、输出预算或生成环境,本站未复现。
- 评测日期 / 核实日期
- 未提供 / 2026-10-02
- 来源
- https://arxiv.org/html/2409.12186v3
- 来源使用说明
- 引用来源;许可:未提供;仅引用Qwen官方技术报告中的少量成绩事实并保留出处链接;不复制报告表格或图像。 查看说明
- 比较状态
- 不可比:官方报告没有披露可复现比较所需的模型revision及完整采样、提示和输出设置;原样记录成绩,不与配置不明的结果直接排名。
LiveCodeBench · 6.1%官方报告 · Qwen Team
展开评测条件与来源
- 模型标识 / 修订
- Qwen/Qwen2.5-Coder-1.5B-Instruct / 未提供
- 思考模式
- 不适用
- 量化 / 运行时
- 未提供 / 未提供
- 数据集 / 划分
- LiveCodeBench / 未提供
- 基准 / 报告版本
- 题目期 2024.07–2024.09
- Few-shot / 输出上限
- 未提供 / 未提供 tokens
- 提示模板 / 设置
- 未提供;Qwen2.5-Coder技术报告Table 16列出 Qwen2.5-Coder-1.5B-Instruct LiveCodeBench Pass@1=6.1%;正文说明采用 2024.07–2024.09 题目。具体提示、采样和输出长度未完整披露,本站未复现。
- 评测日期 / 核实日期
- 未提供 / 2026-10-02
- 来源
- https://arxiv.org/html/2409.12186v3
- 来源使用说明
- 引用来源;许可:未提供;仅引用Qwen官方技术报告中的少量成绩事实并保留出处链接;不复制报告表格或图像。 查看说明
- 比较状态
- 不可比:官方报告没有披露可复现比较所需的模型revision及完整采样、提示和输出设置;原样记录成绩,不与配置不明的结果直接排名。
文本生成 证据不足
暂无可靠公开成绩
查看评估与来源收起补充信息
文本生成 证据不足
暂无可靠公开成绩
官方资料确认Qwen2.5-Coder-1.5B-Instruct为代码指令型号,但未找到可机器核实的该精确型号通用文本基准成绩;系列技术报告的数值表覆盖Base结果,不能移植到Instruct版本。
已有依据支持
- 官方型号卡确认此版本经过指令微调,可直接按对话模板使用。
证据限制
- 没有确认到精确Instruct型号的通用语言成绩;同尺寸Base结果不适用。
- 本站未复现通用问答或写作能力。
暂无该用途的公开评测成绩;不能从其他用途或缺失值推断能力。
运行条件与获取
Transformers
系统支持未提供 · Safetensors · 未指定量化
官方支持;本站尚未进行推理验证。
硬件:未核实。本站未实测;内存、显存和速度取决于运行时、精度、输入长度与硬件,不将参数量或文件大小换算为资源保证。
内存:未核实;显存:未核实。
依赖:transformers>=4.37.0(官方建议最新版)、torch、accelerate。
STEP 01 按官方示例准备环境
打开部署来源链接,按官方安装章节配置依赖;依赖与模型版本需保持匹配。
STEP 02 加载指定模型
按同页推理示例加载此模型并处理对应输入;本站未下载权重或执行模型,需在目标设备验证。