Qwen2.5-Coder-3B-Instruct
面向代码生成、解释和修复的3B级指令模型,使用Qwen Research License。
最后核实:
https://huggingface.co/Qwen/Qwen2.5-Coder-3B-Instruct特点与限制
主要特点
- 官方标注3.09B总参数
- 代码生成、推理与修复
- Transformers官方加载示例
使用边界
- Qwen Research License限非商业使用;商业用途须另行申请,不能标注为Apache。
- Hub语言metadata不是完整能力清单。
- 本站未复现评测或设备表现。
模型信息
- 家族与版本
- Qwen2.5-Coder / 2.5
- 输入与输出
- 文本 → 文本
- 公开参数规模
- 3.09B(以以下来源口径为准)
- 激活 / 有效参数
- 未提供 / 未提供
- 参数口径
- 官方卡标注总参数3.09B、非嵌入参数2.77B;不将系列32B评测套用于此版本。 参数来源
- 原生上下文
- 32,768 tokens
- 扩展上下文
- 未提供
- 语言声明
- 英语(Hub卡片metadata);语言支持不代表对应语言的评测水平。
- 权重许可
- Qwen Research License
- 代码许可
- 未核实
- 训练资料
- 模型卡提供代码与文本训练概述,没有完整逐样本训练集清单。
能力依据
模型变体:指令版;家族与版本:Qwen2.5-Coder / 2.5
文本生成 仅官方依据
MMLU-Pro35.2%官方报告 · en查看评估与来源收起补充信息
文本生成 仅官方依据
MMLU-Pro35.2%官方报告 · en
官方报告Table 20列出该精确Instruct型号的MMLU-Pro成绩35.2%。这是知识问答基准结果,不能外推为中文写作、开放式对话或事实可靠性。
已有依据支持
- 官方报告提供该精确Instruct型号的通用知识基准成绩。
证据限制
- 单个英文知识基准不能代表其他文本任务。
- 提示、shot和生成设置没有完整披露,本站未复现。
MMLU-Pro · 35.2%官方报告 · Qwen Team
展开评测条件与来源
- 模型标识 / 修订
- Qwen/Qwen2.5-Coder-3B-Instruct / 未提供
- 思考模式
- 不适用
- 量化 / 运行时
- 未提供 / 未提供
- 数据集 / 划分
- MMLU-Pro / 未提供
- 基准 / 报告版本
- Qwen2.5-Coder技术报告Table 20
- Few-shot / 输出上限
- 未提供 / 未提供 tokens
- 提示模板 / 设置
- 未提供;官方报告Table 20的精确Instruct型号 Qwen2.5-Coder-3B-Instruct MMLU-Pro成绩为35.2;提示、shot、采样和输出长度未完整披露。
- 评测日期 / 核实日期
- 未提供 / 2026-10-02
- 来源
- https://arxiv.org/html/2409.12186v3
- 来源使用说明
- 引用来源;许可:未提供;仅引用Qwen官方技术报告中的少量成绩事实并保留出处链接;不复制报告表格或图像。 查看说明
- 比较状态
- 不可比:官方报告没有披露可复现比较所需的模型revision及完整采样、提示和输出设置;原样记录成绩,不与配置不明的结果直接排名。
代码 仅官方依据
HumanEval+80.5%官方报告 · codeLiveCodeBench10.8%官方报告 · code查看评估与来源收起补充信息
代码 仅官方依据
HumanEval+80.5%官方报告 · code
LiveCodeBench10.8%官方报告 · code
官方技术报告对该精确Instruct型号报告HumanEval+ 80.5%与LiveCodeBench Pass@1 10.8%。这显示其在短程序功能正确性和竞赛题生成上有直接基准证据,但不代表代码仓库级修改或本地部署质量。
已有依据支持
- 官方报告提供该精确Instruct型号的HumanEval+和LiveCodeBench成绩。
证据限制
- LiveCodeBench只覆盖竞赛题,不能替代真实仓库任务。
- 报告未披露完整采样与运行配置,本站未复现。
- 不应将这些分数与Qwen系列不同题目期或不同提示结果直接排名。
HumanEval+ · 80.5%官方报告 · Qwen Team
展开评测条件与来源
- 模型标识 / 修订
- Qwen/Qwen2.5-Coder-3B-Instruct / 未提供
- 思考模式
- 不适用
- 量化 / 运行时
- 未提供 / 未提供
- 数据集 / 划分
- HumanEval+ / 未提供
- 基准 / 报告版本
- EvalPlus(Qwen技术报告Table 16)
- Few-shot / 输出上限
- 未提供 / 未提供 tokens
- 提示模板 / 设置
- 未提供;Qwen2.5-Coder技术报告Table 16中精确Instruct型号 Qwen2.5-Coder-3B-Instruct 的HumanEval+成绩为80.5;报告没有披露该型号的提示、采样、输出预算或生成环境,本站未复现。
- 评测日期 / 核实日期
- 未提供 / 2026-10-02
- 来源
- https://arxiv.org/html/2409.12186v3
- 来源使用说明
- 引用来源;许可:未提供;仅引用Qwen官方技术报告中的少量成绩事实并保留出处链接;不复制报告表格或图像。 查看说明
- 比较状态
- 不可比:官方报告没有披露可复现比较所需的模型revision及完整采样、提示和输出设置;原样记录成绩,不与配置不明的结果直接排名。
LiveCodeBench · 10.8%官方报告 · Qwen Team
展开评测条件与来源
- 模型标识 / 修订
- Qwen/Qwen2.5-Coder-3B-Instruct / 未提供
- 思考模式
- 不适用
- 量化 / 运行时
- 未提供 / 未提供
- 数据集 / 划分
- LiveCodeBench / 未提供
- 基准 / 报告版本
- 题目期 2024.07–2024.09
- Few-shot / 输出上限
- 未提供 / 未提供 tokens
- 提示模板 / 设置
- 未提供;Qwen2.5-Coder技术报告Table 16列出 Qwen2.5-Coder-3B-Instruct LiveCodeBench Pass@1=10.8%;正文说明采用 2024.07–2024.09 题目。具体提示、采样和输出长度未完整披露,本站未复现。
- 评测日期 / 核实日期
- 未提供 / 2026-10-02
- 来源
- https://arxiv.org/html/2409.12186v3
- 来源使用说明
- 引用来源;许可:未提供;仅引用Qwen官方技术报告中的少量成绩事实并保留出处链接;不复制报告表格或图像。 查看说明
- 比较状态
- 不可比:官方报告没有披露可复现比较所需的模型revision及完整采样、提示和输出设置;原样记录成绩,不与配置不明的结果直接排名。
运行条件与获取
Transformers
系统支持未提供 · Safetensors · 未指定量化
官方支持;本站尚未进行推理验证。
硬件:未核实。本站未实测;内存、显存和速度取决于精度、输入、运行时与硬件,不从参数量或文件体积推算资源保证。
内存:未核实;显存:未核实。
依赖:transformers、torch。
STEP 01 准备运行环境
安装Transformers与PyTorch;使用前阅读Qwen Research License,商业用途需另行确认授权。
python -m pip install -U transformers torchSTEP 02 加载模型
加载 Qwen/Qwen2.5-Coder-3B-Instruct,并按官方卡使用聊天模板。