Qwen3.5-4B
支持文本生成、编程与图像理解的4B级后训练模型。
最后核实:
https://huggingface.co/Qwen/Qwen3.5-4B特点与限制
主要特点
- 文本与图像输入
- 默认思考模式,可按官方接口配置关闭
- 原生262144 token上下文,YaRN可扩展至1010000
使用边界
- 4B是官方语言模型口径,不能直接视为整个多模态系统全部参数。
- 扩展上下文需要运行时支持与额外配置;静态YaRN可能影响短文本效果。
- 官方基准结果未在本站复现,不能作为设备速度或质量保证。
模型信息
- 家族与版本
- Qwen / 3.5
- 输入与输出
- 文本、图像 → 文本
- 公开参数规模
- 4B(以以下来源口径为准)
- 激活 / 有效参数
- 未提供 / 未提供
- 参数口径
- 官方模型卡语言模型口径为4B;同时包含视觉编码器,卡中未单列其参数量。该4B版本为稠密模型,不把系列MoE宣传当成此版本架构。 参数来源
- 原生上下文
- 262,144 tokens
- 扩展上下文
- 1,010,000 tokens;YaRN;官方示例factor=4.0,需要运行时支持并调整RoPE配置。
- 语言声明
- 多语言(官方系列声明201种语言和方言);语言支持不代表对应语言的评测水平。
- 权重许可
- Apache-2.0
- 代码许可
- 未核实
- 训练资料
- 官方提供模型卡或技术报告;未公开完整训练数据清单。
能力依据
模型变体:指令版;家族与版本:Qwen / 3.5
文本生成 仅官方依据
MMLU-Pro79.1%官方报告 · enC-Eval85.1%官方报告 · zh查看评估与来源收起补充信息
文本生成 仅官方依据
MMLU-Pro79.1%官方报告 · en
C-Eval85.1%官方报告 · zh
可将其列入中英文知识问答候选:官方卡列英文 MMLU-Pro 79.1%、中文 C-Eval 85.1%。两项考试成绩不能直接说明中文写作或日常对话表现。
已有依据支持
- 官方成绩覆盖英文知识问答与中文考试基准。
证据限制
- 考试结果不能替代中文写作和自然对话验证。
- 评测条件未完整披露,不能与其他记录横向排名。
- 本站未复现这两项评测。
MMLU-Pro · 79.1%官方报告 · Qwen Team
展开评测条件与来源
- 模型标识 / 修订
- Qwen/Qwen3.5-4B / 未提供
- 思考模式
- 未知
- 量化 / 运行时
- 未提供 / 未提供
- 数据集 / 划分
- MMLU-Pro / 未提供
- 基准 / 报告版本
- 官方模型卡报告(未标独立评测版本)
- Few-shot / 输出上限
- 未提供 / 未提供 tokens
- 提示模板 / 设置
- 未提供;官方卡语言基准表中 Qwen3.5-4B 列为 79.1。该项未完整披露prompt、shot数、采样、推理模式或生成长度;本站未复现。
- 评测日期 / 核实日期
- 未提供 / 2026-10-02
- 来源
- https://huggingface.co/Qwen/Qwen3.5-4B
- 来源使用说明
- 引用来源;许可:未提供;仅摘录少量评测事实并署名链接,不覆盖模型卡原文或第三方内容许可。 查看说明
- 比较状态
- 不可比:官方模型卡未披露该成绩的模型revision、推理模式及完整评测条件,不能纳入统一条件比较。
C-Eval · 85.1%官方报告 · Qwen Team
展开评测条件与来源
- 模型标识 / 修订
- Qwen/Qwen3.5-4B / 未提供
- 思考模式
- 未知
- 量化 / 运行时
- 未提供 / 未提供
- 数据集 / 划分
- C-Eval / 未提供
- 基准 / 报告版本
- 官方模型卡未注明数据版本
- Few-shot / 输出上限
- 未提供 / 未提供 tokens
- 提示模板 / 设置
- 未提供;官方卡语言基准表中 Qwen3.5-4B 列为 85.1。该项未完整披露prompt、shot数、采样、推理模式或生成长度;本站未复现。
- 评测日期 / 核实日期
- 未提供 / 2026-10-02
- 来源
- https://huggingface.co/Qwen/Qwen3.5-4B
- 来源使用说明
- 引用来源;许可:未提供;仅摘录少量评测事实并署名链接,不覆盖模型卡原文或第三方内容许可。 查看说明
- 比较状态
- 不可比:官方模型卡未披露该成绩的模型revision、推理模式及完整评测条件,不能纳入统一条件比较。
代码 仅官方依据
LiveCodeBench v655.8%官方报告 · code查看评估与来源收起补充信息
代码 仅官方依据
LiveCodeBench v655.8%官方报告 · code
可作为需执行测试核验的代码生成候选:官方卡报告 LiveCodeBench v6 为 55.8%,但未注明数据时间范围。该单项成绩不能保证复杂项目修改正确。
已有依据支持
- 官方表格含该型号的代码基准结果。
证据限制
- 复杂项目修改仍需在目标仓库运行测试验证。
- 模型卡未披露足够完整的生成配置,不能横向排名。
LiveCodeBench v6 · 55.8%官方报告 · Qwen Team
展开评测条件与来源
- 模型标识 / 修订
- Qwen/Qwen3.5-4B / 未提供
- 思考模式
- 未知
- 量化 / 运行时
- 未提供 / 未提供
- 数据集 / 划分
- LiveCodeBench / 未提供
- 基准 / 报告版本
- v6(官方卡未注明数据时间范围)
- Few-shot / 输出上限
- 未提供 / 未提供 tokens
- 提示模板 / 设置
- 未提供;官方卡列 Qwen3.5-4B 分数为 55.8,并仅注明 LiveCodeBench v6,未注明数据时间范围。模型卡未披露该项的few-shot、提示模板、采样、推理模式和输出长度;本站未复现。
- 评测日期 / 核实日期
- 未提供 / 2026-10-02
- 来源
- https://huggingface.co/Qwen/Qwen3.5-4B
- 来源使用说明
- 引用来源;许可:未提供;仅摘录少量评测事实并署名链接,不覆盖模型卡原文或第三方内容许可。 查看说明
- 比较状态
- 不可比:官方模型卡未披露该成绩的模型revision、推理模式及完整评测条件,不能纳入统一条件比较。
视觉理解 仅官方依据
MMMU-Pro66.3%官方报告 · en查看评估与来源收起补充信息
视觉理解 仅官方依据
MMMU-Pro66.3%官方报告 · en
可作为图文问答候选:官方视觉语言表列出 MMMU-Pro 66.3%。该单项基准不能保证 OCR 准确或细节图像识别效果。
已有依据支持
- 官方表格报告该型号的图文推理成绩。
证据限制
- OCR 与细节图像识别需要按目标输入另行验证。
- 图像预处理和提示等条件没有完整披露。
- 本站未使用本地图片输入验证。
MMMU-Pro · 66.3%官方报告 · Qwen Team
展开评测条件与来源
- 模型标识 / 修订
- Qwen/Qwen3.5-4B / 未提供
- 思考模式
- 未知
- 量化 / 运行时
- 未提供 / 未提供
- 数据集 / 划分
- MMMU-Pro / 未提供
- 基准 / 报告版本
- 官方模型卡未注明数据版本
- Few-shot / 输出上限
- 未提供 / 未提供 tokens
- 提示模板 / 设置
- 未提供;官方卡视觉语言基准表中 Qwen3.5-4B 列为 66.3。该项未完整披露prompt、shot数、采样、图像预处理、推理模式或生成长度;本站未复现。
- 评测日期 / 核实日期
- 未提供 / 2026-10-02
- 来源
- https://huggingface.co/Qwen/Qwen3.5-4B
- 来源使用说明
- 引用来源;许可:未提供;仅摘录少量评测事实并署名链接,不覆盖模型卡原文或第三方内容许可。 查看说明
- 比较状态
- 不可比:官方模型卡未披露该成绩的模型revision、图像处理与推理配置及完整评测条件,不能纳入统一条件比较。
运行条件与获取
Transformers
系统支持未提供 · Safetensors · 未指定量化
官方支持;本站尚未进行推理验证。
硬件:未核实。本站未实测;内存、显存和速度取决于运行时、精度、输入长度与硬件,不将参数量或文件大小换算为资源保证。
内存:未核实;显存:未核实。
依赖:transformers(官方要求最新版)、torch、torchvision、pillow。
STEP 01 按官方示例准备环境
打开部署来源链接,按官方安装章节配置依赖;依赖与模型版本需保持匹配。
STEP 02 加载指定模型
按同页推理示例加载此模型并处理对应输入;本站未下载权重或执行模型,需在目标设备验证。