移动代理物流数据
运费是按线路定价的,而不是按公司定价的。运费、运输时间和拥堵情况都是两地之间某条路线的属性,这使得物流数据本质上是一个多视角数据采集问题。
- 车道是基本单位——没有起点和终点的费率,对任何人来说都不是一个有实际意义的数字。
- 已发布的指数是所有事务的基准 —— 集装箱运价指数为您提供了可供对比的公开基准。
- 各承运商的站点按地区划分 — 报价工具和时间表因查询地点的不同而有所差异。
- 运输时间与运费率同样重要——一条虽然便宜但延误两周的运输线路,其实并不划算。
各地区的报价工具给出的结果各不相同。
将列车时刻表的可靠性作为一系列数据进行追踪。
车道,而非公司
关于货运数据的一个结构性事实是,其分析单位是“航线”——即特定起运地与目的地之间的路线——而非承运商或产品。 如果记录的运价既未注明起止两地也未标明日期,则毫无意义;而来自不同航线的两个运价也完全无法进行比较。这一核心要点决定了整个数据模型的构建,也是大多数初学者容易犯错的地方。
这也使得物流本质上成为一个多视角问题。承运商和货运代理的网站会根据地区对访问者进行路由引导:报价工具、班期查询、服务可用性,甚至提供的运输线路,都可能因请求来源地的不同而有所差异。从起运地市场进行查询,通常最能反映实际购买该运输线路的托运人所看到的实际情况。
设备和服务等级问题在微观层面表现得一模一样。在相同的起运地-目的地航线上,整箱、拼箱和冷藏箱的预订适用不同的费率结构,面临不同的运力限制;而航线记录中若未包含“设备”字段,就会将三个市场悄无声息地合并为一个数字。 服务等级也是如此:在同一航线上预订的加急或高级班次,即使报价均针对同一周,也无法与标准服务相提并论。
运费及行业基准
由知名海运分析机构和运费平台发布的集装箱运费指数,为主要航线提供了每周公开的基准参考。这些指数是您收集其他数据时合理的依据,因为它们能让您将自身数据系列与独立的参考标准进行校准。如果没有基准参考,您就无法区分真正的市场波动与数据收集过程中产生的偏差。
指定指数与实时报价
已发布的指数系列所解答的问题,与航运公司自身的报价工具所解答的问题不同。指数反映的是数千个港口对整体市场的行情;而报价工具则显示的是,在特定航线、特定航次、特定周内,某位具体托运人在应用舱位等级和合同层级后,实际需要支付的费用。 二者互不替代——指数是您进行核对的基准,而报价则是实际订舱时所依据的数字。
收集报价工具而不触发反机器人控制措施
承运商和货运代理的费率计算工具是基于会话Cookie的JavaScript渲染表单,其中大多数会在返回报价前记录请求看似来自的地区。 如果某个请求模式从同一数据中心IP地址反复且按固定时间表访问同一工具,其行为模式与该工具所针对的托运人的浏览模式截然不同,因此会被相应地进行处理。 通过在原产地市场轮换使用运营商级IP地址,可以确保每次请求都符合该工具预期的模式,但代价是数据采集速度会比数据中心爬取慢。
| 收集什么 | 为何这很重要 | Cadence |
|---|---|---|
| 公布的利率指数 | 主要车道的独立基准测试 | 每周 |
| 承运商报价和附加费 | 实际费用,包括标示费率中未包含的各项费用 | 每周 |
| 时刻表和换乘时间 | 成本的另一半——延迟运输产生的库存成本 | 每周 |
| 拥堵与航班取消 | 早期预警,这正是其价值所在 | 每日 |
承运商航班时刻表及可靠性
不考虑运输时间的运费报价只是信息的一半。一条名义上便宜但始终晚点两周的航线,所产生的库存成本远超节省的运费,而只有在同时收集价格和班期可靠性数据时,这一点才会显露出来。已公布的停航通知和港口拥堵指标,正是这一信号的先行指标。
由于可靠性是一种分布而非一个数值,因此必须通过一系列数据才能体现其意义。单次准时到达无法说明任何问题;而每条车道记录到的四分之一到达次数,则能告诉你是否需要据此进行规划。
船舶位置和港口拥堵信号
船舶追踪数据和港口管理局的拥堵情况仪表盘,正是“准时抵达”这一可靠性信号的前沿体现——尽管后者只能在事后提供信息。 一艘停泊在拥堵港口外锚地的船舶,或是承运商针对未来某周发布的取消航次公告,这两者都会在航程计划本身发生变更之前就有所动作;只要每天收集其中任何一项信息,就能让货主提前数天得知某条航线即将出现延误。
不仅仅是海运
海运的货运量最大,但其他所有运输方式都存在同样的区域报价问题,只不过数据形态各不相同。 整车运输的定价基于即期运价和合同运价,以及各州或各运输线路的装载率,而非每周指数;且即期运价可能逐日波动,而海运指数则通常按周波动。 空运是根据空运单按公斤报价的,它对客运航班时刻表导致的腹舱运力波动的反应,是海运运力所无法比拟的。 包裹和“最后一公里”追踪又呈现出第三种形态:单个货运会产生一系列扫描事件,而非价格;其有价值的信号在于该事件流与承运商自身公布的运输时效承诺之间的对比情况。
这一切都不会改变数据收集的原则。每种运输方式仍需有其自身的运输路线定义、运输节奏和区域视角,将整车运输的即期运费混入海运系列数据中,就如同将标价与全包成本混为一谈——这个数字看似连续,实则是由两个不同的市场拼凑而成的。
运行物流数据集
- 让跑道成为关键 — 起运地、目的地、设备类型和服务。缺少任何一项,就无法与任何内容关联。
- 拆分节奏 — 运价数据每周更新,与公布的指数一致;拥堵数据每日更新,其数值具有预警作用。
- 从起点一侧收取 — 报价工具根据地区提供报价,而起运地市场与实际托运人最为吻合。
- 将附加费单独列示 — 标称利率与全包费用存在显著差异,将两者混为一谈会使整篇文章难以理解。
根据信号调整采集速率
如果向报价工具或拥塞仪表盘发送的查询速度快于底层信号的实际变化速度,并不会产生更好的数据——这只会导致同一个数值被记录十次,并形成一种会立即引起任何监控方注意的请求模式。 请按照上表中的频率进行数据采集,并将船舶位置等实时更新的数据视为例外情况,而非默认做法。
关于供应链的上游部分,请参见 生产数据,以及关于多市场研究背后抽样设计, 市场调研.
从两端收集货运数据
PXM2实时位置——选择您要监控其运输线路的起运地和目的地市场:
法国
新加坡
印度
常见问题解答
物流数据与其他定价数据有何不同?
分析单位。运费是按“航线”(即特定起运地与目的地之间的路线)而非按公司或产品来定价的。如果记录的运费既没有起止点也没有日期,那么这个数据就毫无意义;来自不同航线的两个运费数据更是完全无法比较。这一事实是整个数据模型的基础,也是初学者最常犯的错误。
是否有公开的基准测试?
是的,这些正是合理的依据。由知名海运分析机构和运费平台发布的集装箱运价指数,每周都会提供主要航线的公开基准数据,这使您能够将实际收取的运费与独立的基准进行对照。如果缺乏基准数据来构建运价序列,您将无法区分市场波动与收费中的异常现象。
为什么运营商站点需要本地出口?
因为承运商和货运代理的网站会根据地区对访问者进行路由。 报价工具、班期查询、服务可用性,甚至提供的航线,都可能因请求来源地而异——这合情合理,因为不同地区的托运人购买的服务各不相同。从起运地市场进行查询,通常最能反映该航线上实际托运人所看到的情况。
除了费率之外,还应收集哪些信息?
运输时间和可靠性,这两点往往更为重要。一条名义上便宜但经常延误的航线,所产生的库存成本远超运费节省的金额。班期可靠性、港口拥堵指标以及已公布的停航信息都能反映这一点,而且这些信息都会在公开渠道发布。这些因素与运费率相结合,共同反映了该航线的实际成本。
这方面的信息需要多及时?
Weekly 与市场利率保持同步,因为主要公布指数本身每周更新一次,而合约利率的变化速度远慢于现货利率。拥堵和延误信息则需要每天关注,因为这些信息变化更快,而且其价值完全在于预警功能。根据更新频率将这两项工作分开处理,是一种高效的设计。
相关移动代理指南
物流位于制造业的下游,也面临着与制造业相同的“区域性门面”问题。