- 时间序列的定义是:定期收集的一组数据,用于预测未来趋势。
- 基本组成部分分解:趋势、季节性、周期性和随机噪声。
- 对各种建模方法进行比较,从经典方法和 ARIMA 方法到深度学习和人工智能。
- 在医疗保健、金融、能源和电子商务等关键领域具有实际应用价值。

你可能好奇过,有些公司是如何预测未来,或者如何准确把握产品需求高峰的。这并非魔法或水晶球;他们运用的是时间序列分析,这是一种强大的工具,能够帮助我们了解数据随时间推移的演变过程,并预测未来趋势。
基本上,我们指的是收集定期采集的数据,例如每日降雨量或每月销售额。有趣的是,我们并不将这些数据视为孤立的个体,而是认识到过去会直接影响未来,这使我们能够通过数据挖掘发现那些原本会被忽略的模式。
时间序列模型是如何构建的?

为了避免混淆,必须理解时间序列可以分解为几个组成部分。例如,在加性模型中,我们认为某一时刻的值是趋势、季节性和随机性的总和。如果行为更复杂,我们可能需要乘性模型,其中这些因素相互加强。
- 趋势: 这是大致方向。它告诉我们事物是会上升、下降,还是会在长期内保持稳定。
- 季节性: 这些都是周期性重复出现的模式。例如,冬季围巾销量增加,或者白天用电量增加。
- 环: 与季节性不同,周期性变化是没有固定周期的重复现象,需要从更宏观的角度进行分析。
- 随机波动或噪声: 这些都是无法预料的事件。 相互矛盾的数据或错误 它们不遵循任何规则,因此预测起来非常具有挑战性。
分类方法和方法论

根据我们的需求,我们可以从不同的角度着手解决问题。想要快速估算与构建基于人工智能和深度人工智能推理的超精确预测系统是截然不同的两回事。
经典模型和非参数模型
这里我们可以看到一些工具,例如移动平均法,它通过计算给定时间间隔的平均值来评估短期波动。还有时间平滑法,它赋予近期数据更高的权重,以更好地反映短期趋势。这些方法通常是非参数的,因为它们侧重于估计趋势,而不假设过程具有固定的结构。
自回归积分模型(ARIMA)
当情况变得更加复杂时,ARIMA模型就派上了用场。它结合了自回归、差分和移动平均技术,是一种处理复杂数据和非平稳序列的更强大的方法,能够对数据进行转换,直至其变得稳定且可预测。
深度学习和神经网络
随着人工智能的蓬勃发展,我们现在使用循环神经网络和长短期记忆(LTSM)模型。这些机器能够处理海量信息,并且能够学习识别极其复杂的模式,而这些模式是传统模型根本无法识别的,当然,它们也需要更强大的计算能力。
高级技术分类

更具体地说,专业文献将这些技术分为几类。一方面,有频域方法(例如小波分析)和时域方法(例如互相关)。此外,还可以区分参数方法和非参数方法。参数方法使用少量参数来描述过程结构,而非参数方法则不假设任何先验结构。
此外,我们还可以讨论线性模型或非线性模型,以及它们是单变量模型还是多变量模型,这取决于我们同时分析的变量数量。在诸如新冠肺炎疫情等危机情况下,稳健的时间序列方法有时已被证明优于特定模型(例如SIR模型),因为它允许使用新数据实时更新假设。
工作场所的实际应用

这种建模并非仅仅是数学理论;它已应用于涉及数百万欧元资金和拯救生命的多个领域。在医疗保健领域,它有助于预测疫情并在危机爆发前合理管理医院资源。在金融和交易领域,它是预测股票价格或加密货币走势的关键工具。
在能源领域,根据往年数据计算冬季能源需求是避免资源浪费的关键。另一方面,电子商务和营销利用这些数据优化库存,并设计精准触达目标用户的广告活动,从而提升客户体验和忠诚度。
将历史数据转化为路线图的能力,使任何组织,从小型在线商店到政府,都能最大限度地降低风险,优化人力和物力资源的规划,将未来的不确定性转化为基于统计和计算证据的战略。