如何进行多变量LSTM时间序列预测未来一周的数据？-CDA数据分析师官网

热线电话：13121318867

如何进行多变量LSTM时间序列预测未来一周的数据？

2023-04-07

随着时间序列分析的普及，LSTM 成为了深度学习中最常用的工具之一。它以其优异的性能和对数据的自适应特征提取而闻名。然而，在实际应用中，我们通常需要通过多变量来预测未来时间序列数据。本文将介绍如何使用多变量 LSTM 模型来进行时间序列预测，并且给出一个例子来预测未来一周的气温。

首先，我们需要准备数据集。在本例中，我们将使用包含多个变量的天气数据。这些变量包括温度、湿度、风速、降雨量等。我们将选取最近一年的数据，将其前80%作为训练集，后20%作为测试集。

接下来，我们需要对数据进行归一化处理。由于不同变量之间的值域差异较大，我们需要将其进行缩放到一个相同的范围内。这里我们将使用 Scikit-Learn 库中的MinMaxScaler函数。

from sklearn.preprocessing import MinMaxScaler

scaler = MinMaxScaler()
train_data = scaler.fit_transform(train_data)
test_data = scaler.transform(test_data)

接下来，我们需要将数据转换成适合 LSTM 模型的格式。在多变量情况下，我们需要将每个时刻的输入向量扩展到包含多个变量。这里我们将以过去 30 天的数据为输入，预测未来一周的气温。

import numpy as np def create_dataset(X, y, time_steps=1):
    Xs, ys = [], [] for i in range(len(X) - time_steps):
        v = X[i:i + time_steps]
        Xs.append(v)
        ys.append(y[i + time_steps]) return np.array(Xs), np.array(ys)

TIME_STEPS = 30 X_train, y_train = create_dataset(train_data, train_data[:, 0], TIME_STEPS)
X_test, y_test = create_dataset(test_data, test_data[:, 0], TIME_STEPS)

接下来，我们可以构建 LSTM 模型。在本例中，我们将使用两层 LSTM 和一个全连接层。模型的输入形状应该是(samples, time_steps, features)。

from tensorflow.keras.models import Sequential from tensorflow.keras.layers import Dense, LSTM

model = Sequential([
    LSTM(units=64, input_shape=(X_train.shape[1], X_train.shape[2]), return_sequences=True),
    LSTM(units=32, return_sequences=False),
    Dense(units=1)])

在训练模型之前，我们需要定义损失函数和优化器，并编译模型。

model.compile(loss='mean_squared_error', optimizer='adam')

现在，我们可以开始训练模型。在每个 epoch 后，我们将记录训练集和测试集上的损失值，并可视化它们的变化。

history = model.fit(
    X_train, y_train,
    epochs=50,
    batch_size=16,
    validation_split=0.1,
    verbose=1,
    shuffle=False) import matplotlib.pyplot as plt

plt.plot(history.history['loss'], label='train')
plt.plot(history.history['val_loss'], label='test')
plt.legend()
plt.show()

在模型训练完成后，我们可以对测试集进行预测，并将预测结果与真实值进行比较。

y_pred = model.predict(X_test)

plt.plot(y_test, label='true')
plt.plot(y_pred, label='predicted')
plt.legend()
plt.show()

最后，我们将使用训练好的模型来预测未来一周的气温。首先，我们需要获取最近 30 天的数据，然后使用模型进行预测。每次预测完之后，我们将新的预测值添加到输入序列中，用于下一次的预测。

X_last30

= test_data[-TIME_STEPS:] forecast = [] for i in range(7): y_pred_one = model.predict(X_last30.reshape(1, TIME_STEPS, -1)) forecast.append(y_pred_one[0, 0]) X_last30 = np.vstack((X_last30[1:], y_pred_one))

forecast = scaler.inverse_transform(np.array(forecast).reshape(-1, 1))

以上便是使用多变量 LSTM 进行时间序列预测的整个流程。通过训练模型，我们可以获得对未来数据的预测结果，并且不仅仅考虑了单一变量的影响，而是综合了多个变量的影响。当然，这只是一个简单的例子，实际应用中可能会涉及到更加复杂的数据和模型。

相信读完上文，你对算法已经有了全面认识。若想进一步探索机器学习的前沿知识，强烈推荐机器学习之半监督学习课程。

学习入口：https://edu.cda.cn/goods/show/3826?targetId=6730&preview=0
涵盖核心算法，结合多领域实战案例，还会持续更新，无论是新手入门还是高手进阶都很合适。赶紧点击链接开启学习吧！

CDA数据分析师考试相关入口一览（建议收藏）：

▷ 想报名CDA认证考试，点击>>> “CDA报名” 了解CDA考试详情；

▷ 想学习CDA考试教材，点击>>> “CDA教材” 了解CDA考试详情；

▷ 想加入CDA考试题库，点击>>> “CDA题库” 了解CDA考试详情；

▷ 想了解CDA考试含金量，点击>>> “CDA含金量” 了解CDA考试详情；

LSTM 时间序列预测机器学习 matplotlib 特征损失函数数据转换监督学习

数据分析咨询请扫描二维码

若不方便扫码，搜微信号：CDAshujufenxi

上一篇MySQL中的日志有什么作用？

下一篇深度学习卷积神经网络提取的特征是什么？

数据分析师考试动态

CDA报考指南

数据分析学习

数据分析师资讯

京公网安备 11010802034615号经营许可证编号：京B2-20210330

联系电话：13321103290 (微信同号)

客服在线

立即咨询

客服在线

立即咨询

免密码登录

提交首次登录验证后自动注册

如何进行多变量LSTM时间序列预测未来一周的数据？

数据分析师考试动态

CDA报考指南

数据分析学习

数据分析师资讯

【CDA干货】PyTorch 核心机制：损失函数与反向传播 ...

2025 年 CDA 数据分析师考纲焕新，引领行业人才新 ...

从数据到决策：CDA 数据分析师如何重塑职场竞争力与 ...

【CDA干货】用 Power BI 制作地图热力图：基于经纬 ...

【CDA干货】解析 insert into select 是否会锁表： ...

CDA 数据分析师的工作范围解析

从 CDA LEVEL II 考试题型看 Python 数据分析要点 ...

【CDA干货】用 Python 开启数据分析之旅：从基础到 ...

【CDA干货】鸢尾花判别分析：机器学习中的经典实践 ...

【CDA干货】解析 response.text 与 response.conten ...

【CDA干货】解析神经网络中 Softmax 函数的核心作用 ...

CDA数据分析师证书考取全攻略

【CDA干货】左偏态分布转正态分布：方法、原理与实 ...

自媒体创业者：快把握风口，利用CDA＋AI新模式，轻 ...

CDA数据分析能力+AI=传统企业主的新生存法则 ——企 ...

CDA 数据分析师的职业生涯规划：从入门到卓越的成长 ...

【CDA干货】MySQL执行计划中rows的计算逻辑：从原理 ...

CDA认证基建：AI时代企业内训乘风破浪的 “超级引擎 ...

35岁+ 职场突围战：2025年最该考的证书为什么是CDA? ...

CDA 数据分析师报考条件详解与准备指南 ...

CDA教育闭环

常见问题

关于我们

CDA数据分析师公众号

CDA考试中心小程序

CDA数据分析师App下载