基于Keras的LSTM多变量时间序列预测

作者: 阿里云云栖号 | 来源:发表于2017-08-24 15:27 被阅读903次

[转]Python Keras + LSTM 进行单变量时间序列
基于Keras的LSTM多变量时间序列预测
2019-07-23 LSTM的输入输出
LSTM-TimeSeriesRegression-Keras建
Keras使用精选
LSTM
lstm示例
基于LSTM的时间序列数据(多步)预测
keras lstm 杂记
LSTM进行时间序列预测

摘要：还在为设计多输入变量的神经网络模型发愁？来看看大神如何解决基于Keras的LSTM多变量时间序列预测问题！文末附源码！

LSTM是一种时间递归神经网络，它出现的原因是为了解决RNN的一个致命的缺陷。原生的RNN会遇到一个很大的问题，叫做The vanishing gradient problem for RNNs，也就是后面时间的节点会出现老年痴呆症，也就是忘事儿，这使得RNN在很长一段时间内都没有受到关注，网络只要一深就没法训练。后来有些大牛们开始使用递归神经网络来对时间关系进行建模。而根据深度学习三大牛的阐述，LSTM网络已被证明比传统的RNNS更加有效。

适合多输入变量的神经网络模型一直让开发人员很头痛，但基于（LSTM）的循环神经网络能够几乎可以完美的解决多个输入变量的问题。

基于（LSTM）的循环神经网络可以很好的利用在时间序列预测上，因为很多古典的线性方法难以适应多变量或多输入预测问题。

在本教程中，你会看到如何在Keras深度学习库中开发多变量时间序列预测的LSTM模型。

读完本教程后，你将学会：

如何将原始数据集转换为可用于时间序列预测的数据集。

如何准备数据并创建适应多变量时间序列预测问题的LSTM。

如何做出预测并将结果重新调整到原始单位。

本教程分为3部分：

1.空气污染预报。

2.基本数据准备。

3.多变量LSTM预测模型。

Python环境

本教程假设你已安装Python SciPy环境，你可以在本教程中使用Python 2或3。你必须使用TensorFlow或Theano后端安装Keras（2.0或更高版本）。本教程还假设你已经安装了scikit-learn，Pandas，NumPy和Matplotlib。

空气污染预报

在这个小例子中，我们将使用空气质量数据集。这是一个数据集，在美国驻北京大使馆五年内报告天气和污染水平。数据类型包括日期时间、称为PM2.5浓度的污染物、以及天气信息、包括露点（露点温度）、温度、压力、风向、风速和累积的降雪小时数。原始数据中的完整功能列表如下：

1. NO：行号。

2. year：年。

3. month：月。

4. day：日。

5. hour：小时。

6. pm2.5：PM2.5浓度。

7. DEWP：露点温度。

8. TEMP：温度。

9. PRES：压力。

10. cbwd：风向。

11. Iws：风速。

12. ls：积雪的时间

13. Ir：累积的下雨时数

我们可以使用这些数据并构建一个预测问题，基于天气条件和前几个小时的污染，我们预测在下一个小时的污染。你可以从UCI Machine Learning Repository下载数据集—北京PM2.5数据集。下载数据集并将其放在你当前的工作目录中，文件名为“raw.csv”。

基本数据准备

第一步，我们必须清洗数据。

以下是原始数据集的前几行。

第一步是将日期时间信息整合为一个日期时间，以便我们可以将其用作Pandas的索引。我们需要快速显示前24小时的pm2.5的NA值。因此，我们需要删除第一行数据。在数据集中还有几个分散的“NA”值；我们现在可以用0值标记它们。

以下脚本加载原始数据集，并将日期时间信息解析为Pandas Data Frame索引。“No”列被删除，然后为每列指定更清晰的名称。最后，将NA值替换为“0”值，并删除前24小时。

运行该示例打印转换的数据集的前5行，并将数据集保存到“pollution.csv”。

下面的代码加载了“ pollution.csv ”文件，并将每个系列作为单独的子图绘制，除了风速dir，这是分类的。

运行示例创建一个具有7个子图的程序，显示每个变量的5年数据。

多变量LSTM预测模型建立：

LSTM数据准备

第一步是为LSTM准备污染数据集。这涉及将数据集视为监督学习问题并对输入变量进行归一化处理。考虑到上一个时间段的污染测量和天气条件，我们将把监督学习问题作为预测当前时刻（t）的污染情况。根据过去24小时的天气情况和污染，预测下一个小时的污染，并给予下一个小时的“预期”天气条件。

我们可以使用在博客中开发的series_to_supervised（）函数来转换数据集：如何将时间序列转换为Python中的监督学习问题

首先，加载“pollution.csv”数据集。风速特征是标签编码（整数编码）。如果你有兴趣探索，也可以使用热编码。

接下来，所有功能都被规范化，然后将数据集转换为监督学习问题。然后删除要预测的小时的天气变量（t）。

完整的代码清单如下：

运行示例打印转换后的数据集的前5行。我们可以看到8个输入变量（输入序列）和1个输出变量（当前小时的污染水平）。

注意：我们必须提供超过一小时的输入时间步长。因为在解决序列预测问题时，LSTMs通过时间进行反向传播。

定义和拟合模型

在本节中，我们将通过多变量输入数据拟合LSTM。

首先，我们必须将准备好的数据集分成训练集和测试集。为了加快对这次示范模型的训练，我们将仅使用第一年的数据来拟合模型，然后对其余4年的数据进行评估。下面的示例将数据集分成训练集和测试集，然后将训练集和测试集分成输入和输出变量。最后，将输入（X）重构为LSTM预期的3D格式，即[样本，时间步长，特征]。