返回模型目录
文本生成代码视觉理解

Qwen3.5-4B

支持文本生成、编程与图像理解的4B级后训练模型。

最后核实:

https://huggingface.co/Qwen/Qwen3.5-4B

特点与限制

主要特点

  • 文本与图像输入
  • 默认思考模式,可按官方接口配置关闭
  • 原生262144 token上下文,YaRN可扩展至1010000

使用边界

  • 4B是官方语言模型口径,不能直接视为整个多模态系统全部参数。
  • 扩展上下文需要运行时支持与额外配置;静态YaRN可能影响短文本效果。
  • 官方基准结果未在本站复现,不能作为设备速度或质量保证。

模型信息

家族与版本
Qwen / 3.5
输入与输出
文本、图像 → 文本
公开参数规模
4B(以以下来源口径为准)
激活 / 有效参数
未提供 / 未提供
参数口径
官方模型卡语言模型口径为4B;同时包含视觉编码器,卡中未单列其参数量。该4B版本为稠密模型,不把系列MoE宣传当成此版本架构。 参数来源
原生上下文
262,144 tokens
扩展上下文
1,010,000 tokens;YaRN;官方示例factor=4.0,需要运行时支持并调整RoPE配置。
语言声明
多语言(官方系列声明201种语言和方言);语言支持不代表对应语言的评测水平。
权重许可
Apache-2.0
代码许可
未核实
训练资料
官方提供模型卡或技术报告;未公开完整训练数据清单。

能力依据

模型变体:指令版;家族与版本:Qwen / 3.5

文本生成 仅官方依据

MMLU-Pro79.1%官方报告 · en
C-Eval85.1%官方报告 · zh
查看评估与来源收起补充信息

可将其列入中英文知识问答候选:官方卡列英文 MMLU-Pro 79.1%、中文 C-Eval 85.1%。两项考试成绩不能直接说明中文写作或日常对话表现。

已有依据支持
  • 官方成绩覆盖英文知识问答与中文考试基准。
证据限制
  • 考试结果不能替代中文写作和自然对话验证。
  • 评测条件未完整披露,不能与其他记录横向排名。
  • 本站未复现这两项评测。

MMLU-Pro · 79.1%官方报告 · Qwen Team

accuracy · 越高越好 · en · 摘要引用

展开评测条件与来源
模型标识 / 修订
Qwen/Qwen3.5-4B / 未提供
思考模式
未知
量化 / 运行时
未提供 / 未提供
数据集 / 划分
MMLU-Pro / 未提供
基准 / 报告版本
官方模型卡报告(未标独立评测版本)
Few-shot / 输出上限
未提供 / 未提供 tokens
提示模板 / 设置
未提供;官方卡语言基准表中 Qwen3.5-4B 列为 79.1。该项未完整披露prompt、shot数、采样、推理模式或生成长度;本站未复现。
评测日期 / 核实日期
未提供 / 2026-10-02
来源
https://huggingface.co/Qwen/Qwen3.5-4B
来源使用说明
引用来源;许可:未提供;仅摘录少量评测事实并署名链接,不覆盖模型卡原文或第三方内容许可。 查看说明
比较状态
不可比:官方模型卡未披露该成绩的模型revision、推理模式及完整评测条件,不能纳入统一条件比较。

C-Eval · 85.1%官方报告 · Qwen Team

accuracy · 越高越好 · zh · 摘要引用

展开评测条件与来源
模型标识 / 修订
Qwen/Qwen3.5-4B / 未提供
思考模式
未知
量化 / 运行时
未提供 / 未提供
数据集 / 划分
C-Eval / 未提供
基准 / 报告版本
官方模型卡未注明数据版本
Few-shot / 输出上限
未提供 / 未提供 tokens
提示模板 / 设置
未提供;官方卡语言基准表中 Qwen3.5-4B 列为 85.1。该项未完整披露prompt、shot数、采样、推理模式或生成长度;本站未复现。
评测日期 / 核实日期
未提供 / 2026-10-02
来源
https://huggingface.co/Qwen/Qwen3.5-4B
来源使用说明
引用来源;许可:未提供;仅摘录少量评测事实并署名链接,不覆盖模型卡原文或第三方内容许可。 查看说明
比较状态
不可比:官方模型卡未披露该成绩的模型revision、推理模式及完整评测条件,不能纳入统一条件比较。

代码 仅官方依据

LiveCodeBench v655.8%官方报告 · code
查看评估与来源收起补充信息

可作为需执行测试核验的代码生成候选:官方卡报告 LiveCodeBench v6 为 55.8%,但未注明数据时间范围。该单项成绩不能保证复杂项目修改正确。

已有依据支持
  • 官方表格含该型号的代码基准结果。
证据限制
  • 复杂项目修改仍需在目标仓库运行测试验证。
  • 模型卡未披露足够完整的生成配置,不能横向排名。

LiveCodeBench v6 · 55.8%官方报告 · Qwen Team

score · 越高越好 · code · 摘要引用

展开评测条件与来源
模型标识 / 修订
Qwen/Qwen3.5-4B / 未提供
思考模式
未知
量化 / 运行时
未提供 / 未提供
数据集 / 划分
LiveCodeBench / 未提供
基准 / 报告版本
v6(官方卡未注明数据时间范围)
Few-shot / 输出上限
未提供 / 未提供 tokens
提示模板 / 设置
未提供;官方卡列 Qwen3.5-4B 分数为 55.8,并仅注明 LiveCodeBench v6,未注明数据时间范围。模型卡未披露该项的few-shot、提示模板、采样、推理模式和输出长度;本站未复现。
评测日期 / 核实日期
未提供 / 2026-10-02
来源
https://huggingface.co/Qwen/Qwen3.5-4B
来源使用说明
引用来源;许可:未提供;仅摘录少量评测事实并署名链接,不覆盖模型卡原文或第三方内容许可。 查看说明
比较状态
不可比:官方模型卡未披露该成绩的模型revision、推理模式及完整评测条件,不能纳入统一条件比较。

视觉理解 仅官方依据

MMMU-Pro66.3%官方报告 · en
查看评估与来源收起补充信息

可作为图文问答候选:官方视觉语言表列出 MMMU-Pro 66.3%。该单项基准不能保证 OCR 准确或细节图像识别效果。

已有依据支持
  • 官方表格报告该型号的图文推理成绩。
证据限制
  • OCR 与细节图像识别需要按目标输入另行验证。
  • 图像预处理和提示等条件没有完整披露。
  • 本站未使用本地图片输入验证。

MMMU-Pro · 66.3%官方报告 · Qwen Team

accuracy · 越高越好 · en · 摘要引用

展开评测条件与来源
模型标识 / 修订
Qwen/Qwen3.5-4B / 未提供
思考模式
未知
量化 / 运行时
未提供 / 未提供
数据集 / 划分
MMMU-Pro / 未提供
基准 / 报告版本
官方模型卡未注明数据版本
Few-shot / 输出上限
未提供 / 未提供 tokens
提示模板 / 设置
未提供;官方卡视觉语言基准表中 Qwen3.5-4B 列为 66.3。该项未完整披露prompt、shot数、采样、图像预处理、推理模式或生成长度;本站未复现。
评测日期 / 核实日期
未提供 / 2026-10-02
来源
https://huggingface.co/Qwen/Qwen3.5-4B
来源使用说明
引用来源;许可:未提供;仅摘录少量评测事实并署名链接,不覆盖模型卡原文或第三方内容许可。 查看说明
比较状态
不可比:官方模型卡未披露该成绩的模型revision、图像处理与推理配置及完整评测条件,不能纳入统一条件比较。

运行条件与获取

Transformers

系统支持未提供 · Safetensors · 未指定量化

官方支持;本站尚未进行推理验证。

硬件:未核实。本站未实测;内存、显存和速度取决于运行时、精度、输入长度与硬件,不将参数量或文件大小换算为资源保证。

内存:未核实;显存:未核实。

依赖:transformers(官方要求最新版)、torch、torchvision、pillow。

STEP 01 按官方示例准备环境

打开部署来源链接,按官方安装章节配置依赖;依赖与模型版本需保持匹配。

STEP 02 加载指定模型

按同页推理示例加载此模型并处理对应输入;本站未下载权重或执行模型,需在目标设备验证。

查看官方模型资料