主流模型适配与动态部署
≥50类分类去重后,逐类验证部署与调用
在服务器上对模型执行真实的低位宽量化,并用零样本评测核对量化前后的精度对比。
“功能测试”区的低位宽量化与“性能指标”区的零样本评测均已接入服务器后端,会真实执行任务。功能测试、性能指标、测试记录也可作为三个独立页面单独访问,见 functional-testing.html、performance-metrics.html、test-records.html。
参数量下降率 =(原模型参数量 − 压缩模型参数量)÷ 原模型参数量 × 100%。降低位宽、文件大小或显存占用不等于参数量下降。
越高越好的性能指标:损耗率 = max(0,(原模型得分 − 压缩模型得分)÷ 原模型得分) × 100%。越低越好的指标反向计算差值;基线必须为正数。
同一模型配对须同时满足参数量下降率 ≥50% 和性能损耗率 ≤10%。计算使用未四舍五入的值进行判断,不得拼接不同配置的结果。
“主流模型”和“类”的划分须测试前确认。样本计数排除空内容、副本及重复导入;需另行验证多模态覆盖、持久化和实际管理能力。页面输入总量不能替代这些证据。
导出包含功能演示和后端任务的操作记录。记录保存在浏览器本地存储中,跨页面与刷新均会保留,请及时导出或按需清空。
功能步骤对应产品文档,性能阈值对应项目目标第四点。