MARD 9.0% 这类数值本身只是特定测试条件下的一个快照,用户真正需要警惕的不是数字本身,而是它背后的测试口径、算法拟合方式和报告规范缺失。同样的 9.0%,在不同测试方案下可能代表完全不同的真实精度,盲目横向对比不同厂商的 MARD 数值,很容易被"数字游戏"误导。
MARD 测试方案:口径不同,数字不可直接对比
MARD(平均绝对相对误差)的数值高度依赖测试设计。参考标准(YSI 葡萄糖乳酸分析仪)的采样频率、测试期间血糖波动的覆盖范围、受试者人群的构成比例,都会显著影响最终结果。例如,如果测试中血糖处于平稳区间的时间占比过高,或低血糖、高血糖极端事件样本不足,计算出的 MARD 会偏低,但这并不代表真实使用中(尤其是血糖剧烈波动时)的精度水平。
此外,受试者人群的年龄、糖尿病类型、体质指数等构成不同,也会影响组织液与血糖浓度关系的稳定性,进而改变 MARD 结果。用户在查看厂商公布的 MARD 时,应重点确认其测试是否覆盖了足够的血糖波动范围、是否纳入了多样化的真实用户人群,而非仅看一个孤立的数字。
算法过拟合:数据集上的"优等生",真实场景的"偏科生"
CGM 的准确性由传感器硬件与校准算法共同决定。校准算法可以显著改善精度,但若算法是在特定数据集上反复调优得到的,就可能存在过拟合风险——即在该数据分布内表现优异,一旦脱离训练数据覆盖的场景(如极端饮食、特殊用药、剧烈运动等),精度就会明显打折。
资料显示,德康医疗曾通过"Smart" CGM 算法体系,在硬件不变的情况下将某型号的 MARD 从 12.6% 降至 9.0%,这证明了算法的价值。但这也意味着,一个亮眼的 MARD 数字可能只是算法在理想数据集上的表现,真实世界中的精度还需通过独立第三方、大样本、多场景的临床验证来确认。用户在评估产品时,应关注算法是否有充分的真实世界数据支撑,而非仅依赖厂商自报的验证结果。
行业报告规范缺失:消费者决策的隐形陷阱
目前行业内缺乏统一的 MARD 测试与报告标准,各厂商在测试条件、统计方法、样本选择上存在较大差异,导致不同产品公布的 MARD 数值之间缺乏可比性。这种规范缺失直接增加了消费者的甄别成本——仅凭厂商宣传的 MARD 数字做购买决策,很可能被误导。
用户在对比不同 CGM 产品时,应优先选择有第三方机构独立验证、临床研究数据公开发表、且测试方案透明可查的产品。同时,结合自身血糖波动特点(如是否频繁低血糖、餐后波动大等),综合评估产品在相关场景下的真实表现,而非迷信单一数字。
常见问题
为什么不同品牌宣称的 MARD 差不多,实际用起来感觉差异很大?
因为 MARD 测试条件不统一。参考采样频率、血糖波动覆盖范围、受试者人群构成都会影响结果,厂商公布的 MARD 只能代表其特定测试条件下的表现,无法直接反映真实使用中的精度差异。建议关注是否有独立第三方的大样本验证数据。
MARD 越低就一定越好吗?
MARD 是重要参考,但不是唯一标准。资料指出,MARD≤10% 的 CGM 系统可替代指血血糖仪进行糖尿病治疗决策,目前主流微创 CGM 均已低于 10%。在此范围内,还需结合舒适性、便利性、性价比以及算法在真实场景中的稳定性综合判断,而非盲目追求数字最小。
如何识别算法是否存在过度拟合?
重点看验证数据的独立性、样本量和场景覆盖度。若厂商公布的数据仅来自单一中心、小样本或特定人群,且缺乏真实世界长期随访数据,则过拟合风险较高。优先选择有公开发表的第三方研究、且测试方案透明的产品。