理解信息背后的依据

用途、能力证据和实际运行条件,分别说明。

收录范围

语言模型主要收录总参数约 10B 以内的型号,其他任务结合实际部署体积与资源需求判断。本站按具体版本收录模型,允许一个模型具有多个用途。

能力如何呈现

官方报告、第三方评测、本站实测与编辑判断分别标注。不同任务或测试条件的分数不能直接混排;本站不提供跨用途智能总排名。

能力总结按用途关联具体评测,证据充分程度与能力高低分开。思考模式、量化、数据集版本和测试条件分别保留;没有披露的设置明确标为未知。官方成绩的转载不算独立复测,未经本站运行验证的结果不会标成本站实测。

评测来源的使用范围单独核对。Artificial Analysis 原站资料可从评测方法入口查阅;当前本站未获其数据整合授权,不收录其成绩或排名。

许可与开放程度

权重许可、代码许可和训练资料开放程度分别记录。开放权重不自动意味着完整 AI 开源,使用前请阅读对应版本的许可。

未知值与验证状态

“未提供”表示来源没有给出数值;“未核实”表示本站没有确认;“不适用”表示该指标与对应任务无关。没有评测记录不表示能力为零。

部署说明

当前样本以官方支持的路线为依据,尚未执行本站模型推理测试。只有附带验证日期和复现信息的路线才标注本站已验证。内存需求不会按参数量或文件体积直接推断。

信息更新

每条模型记录显示最后核实日期,详情页提供原始来源。模型和软件持续变化,请使用前再次核对官方资料。

纠错与转载

本站原创整理采用 CC BY 4.0,代码采用 MIT。第三方模型与引用资料遵循各自许可。提交纠错、贡献条目或获取源码,请查看贡献与许可。