分享自:

通过车载诊断(OBD)数据探索重型卡车的运营特征

期刊:Research in Transportation Business & ManagementDOI:10.1016/j.rtbm.2024.101204

本研究由Hongli Wang(中国环境科学研究院,国家环境保护机动车排放控制与模拟重点实验室)、Qing Liu(北京智绿交通研究中心)、Bowen Bai(北京智绿交通研究中心)等学者合作完成,于2024年9月11日在线发表于爱思唯尔(Elsevier)旗下的期刊《Research in Transportation Business & Management》。

该研究属于交通运输工程与环境科学交叉领域,聚焦于重型卡车(heavy-duty trucks,HDTs)的运营特征分析。道路运输是中国碳排放的重要来源,而重型卡车尽管数量相对较少,却贡献了运输行业超过四分之一的温室气体排放。因此,深入理解重型卡车的运营特征,包括载重状态、行程特征和启停频率,对于制定有效的减排政策、优化物流管理至关重要。然而,传统研究依赖人工调查或驾驶员日志,成本高、数据分辨率低,且难以捕捉大规模车队的宏观运营规律。随着车载诊断系统(On-Board Diagnostics,OBD)在中国“国六”标准重型卡车上的强制安装,海量实时运行数据(如速度、发动机扭矩、燃油流量、GPS坐标)得以采集,为突破上述研究瓶颈提供了可能。本研究旨在基于大数据研究范式,整合3792辆中国重型柴油卡车2022年全年的数十亿条OBD数据,开发一套全面解析重型卡车运营特征的方法框架,并从车队层面揭示其运营规律,为优化载重管理、行程规划及减少碳排放提供科学参考。

研究的工作流程主要分为三个核心部分:OBD数据收集与预处理、基于OBD数据的重型卡车运营特征识别方法构建、以及运营特征统计分析。 首先,在数据收集与预处理阶段,研究团队从中国环境科学研究院协调的远程在线监控平台获取了数据。为确保样本代表性,团队根据市场保有量确定了前十大车型,并从全国范围内随机抽取了10000辆车作为基础,最终筛选出3792辆柴油驱动的重型卡车,涵盖货车(cargo trucks)、自卸车(dump trucks)和牵引车(tractor trucks)三大类,共51个具体车型,车辆总质量(Gross Vehicle Weight,GVW)均大于12吨。原始数据时间跨度为2022年全年,总量高达数十亿行。针对原始数据,研究团队首先依据预设规则进行了清洗,清除了速度、燃油流量和GPS坐标明显错误的行,清除了14.1%的数据。为增强数据连续性,研究人员开发了一种数据补全方法。考虑到2至300秒的数据缺失通常并非由正常停车造成,而是由OBD设备记录遗漏引起,研究利用插值公式,根据缺失位置前后时间点的速度、里程数据,逐秒计算并填补缺失值,从而补充了9.5亿行数据,使最终用于分析的有效数据达到20.24亿行。 其次,在运营特征识别方法构建阶段,研究团队设计了一套创新的算法组合。为降低计算压力并平滑数据噪音,首先将逐秒的OBD数据重采样至分钟级。随后,为区分行驶段与停留(dwell)段,研究根据不同车型的运行特点,经过多次迭代优化并利用兴趣点(Points of Interest,POI)数据进行校准验证,设定了差异化阈值。例如,对自卸车和货车,速度阈值设为4 km/h,持续时间阈值设为10分钟;对牵引车,速度阈值则设为20 km/h,持续时间阈值为5分钟。在完成行驶段划分后,研究进入关键的载重状态(load status)识别环节。这是本研究的一个核心难点与创新点。研究团队首先采用车辆比功率(Vehicle Specific Power,VSP)方法,对每个数据点的燃油流量率进行工况标准化计算。通过公式结合发动机转速、净输出扭矩等OBD字段计算出每个秒点的车辆总质量。在此基础上,针对每一个已识别的行驶段,计算其平均质量。由于重型卡车通常只存在“满载”和“空载”两种独立运营状态,且在大规模数据集下均应呈现稳态分布,研究创新地引入了高斯混合模型(Gaussian Mixture Model,GMM),将每个行驶段平均质量的分布进行解卷积,生成代表空载和满载状态的两条高斯分布曲线,并将两条曲线的交点作为区分空载与满载的阈值,从而为每个行驶段标记上载重状态。此后,研究通过建立状态合并规则,消除了因短暂停车或缓行造成的连续相同载重状态标记,并定义了完整的起讫点(Origin-Destination,OD)行程。一个完整的OD行程被严格定义为按时间顺序排列的空载段及其相邻的下一个满载段,或空载段、满载段及随后的下一个空载段的组合。 最后,在运营特征统计阶段,基于上述识别出的所有OD行程,研究人员利用Python和Kepler.gl平台,从行程级层面计算并可视化了平均行驶速度、启停对(start-stop pairs)次数、平均停留时长、行驶里程和空载率等多维度运营特征。

研究结果在OD行程层面揭示了三大类重型卡车鲜明的运营特征差异。 在平均行驶速度方面,牵引车最快,达40 km/h;货车次之,为23 km/h;自卸车最慢,仅16 km/h。牵引车和货车的速度分布范围更广,而自卸车速度主要集中在一个较窄的区间内。三者的平均速度分布形态均符合正态分布特征。 在启停次数和停留时长方面,牵引车在单次OD行程中平均启停次数最高,达到4.9次,平均停留时长也最长,为2.1小时;自卸车次之,平均启停3.9次,停留1.6小时;货车最低,平均启停2.8次,停留1.2小时。停留时长的分布并非正态,而是呈现出左偏态特征,表明尽管多数车辆倾向于更快完成任务,但仍有部分车辆因意外状况或驾驶员个人行为而长时间停留。 在OD行程里程方面,牵引车因常用于长途运输,平均里程最高,约195 km;货车和自卸车则更侧重于中短途运输,平均里程分别约为110 km和95 km。这三类车型的行驶里程分布同样符合正态分布规律。 在空载率方面,三类车型的空载行驶比例存在细微差异,但均处于较高水平。货车的空载率为33.01%,自卸车为33.58%,牵引车为31.71%。这意味着装载率虽超过65%,但仍有超过三成的运输里程是在空车状态下产生,存在显著的优化空间。特别是牵引车和自卸车的空载率分布呈现出双峰形态,揭示了其运营模式的复杂性。 在OD空间分布上,这一特征差异更加直观。自卸车的起讫点高度聚集在城市建成区,形成多个密集组团;货车的分布范围稍广,开始沿交通网络呈现放射状;而牵引车的分布范围最广,不仅覆盖城市,更明显叠加在骨干交通网络上,形成了“中心枢纽-网络”型的分布格局,其长途跨城运输线路的比例显著高于其他两类。

本研究的主要结论证实了利用车载OBD数据对重型卡车运营特征进行车队级分析的可行性与高效性。研究发现,不同类型重型卡车的运营模式存在本质差异:牵引车服务于长距离、高频次启停的跨城运输,速度快但停留时间也长;货车和自卸车则分别服务于中短途城市配送和城内工地运输,速度较慢,活动范围更为聚集。尤为重要的是,量化结果表明重型卡车的空载率问题普遍存在,优化空间巨大。

本研究的科学价值与应用意义体现在多个方面。在科学层面,研究首次基于大数据范式,成功构建了融合数据补全、工况标准化、高斯混合模型解卷积和OD行程定义的完整方法论框架,解决了传统方法无法捕捉大规模车队宏观运营规律的难题。这一框架为其他学者利用OBD数据进行交通行为挖掘提供了可直接借鉴的范例。在应用层面,研究揭示的详细运营特征图谱,如高达31%-34%的空载率和差异化的时空分布模式,为政府和行业提供了具体的决策依据。结论为通过优化回程配载、加强物流信息平台建设来降低空载率、提升运输效率指明了方向,并为制定精细化的城市货运交通管理措施(如在高峰时段对特定类型货车进行导流)提供了数据基础。此外,研究还指出了未来通过嵌入更精确的载重传感器和整合环境数据来进一步提升分析精度的方向,并展望了将研究范围拓展至其他车型及建立数据驱动型知识服务平台的前景。

本研究的亮点主要体现在三方面:其一,数据规模宏大且维度丰富,基于超过20亿行真实OBD数据,实现了对车队年度运营全貌的捕捉,区别于以往仅分析数周或数天的小样本研究;其二,方法学上创新性地将高斯混合模型应用于载重状态识别,无监督地从海量数据中解构出空载与满载两种工况,精确计算了宏观空载率;其三,研究对象聚焦于政策高度关注但运营特征长期难以量化的三类重型柴油卡车,所产出的车队级特征数据库填补了该领域的研究空白,为运输行业的节能减排提供了坚实的数据支撑和科学指引。

上述解读依据用户上传的学术文献,如有不准确或可能侵权之处请联系本站站长:admin@fmread.com