QQ登录

只需要一步,快速开始

 注册地址  找回密码
查看: 2749|回复: 0
打印 上一主题 下一主题

ARIMA模型 指数平滑法

[复制链接]
字体大小: 正常 放大

1192

主题

4

听众

2946

积分

该用户从未签到

跳转到指定楼层
1#
发表于 2024-3-20 10:30 |只看该作者 |倒序浏览
|招呼Ta 关注Ta
当涉及到时间序列数据分析和预测时,指数平滑法是一种常用的方法之一。它是一种简单而有效的平滑技术,可以用于处理具有趋势和季节性的时间序列数据。
* J- }, T& w; i) `% ?指数平滑法基于以下假设:' m  |9 g9 r* i3 @
1.过去的观测值对于预测未来的值更为重要。
+ R. X$ M& E$ z; v' H3 l5 u2.近期的观测值对于预测的影响程度比过去的观测值更大。
8 K, _. H. f/ h: k6 L1 B3.观测值中的随机波动应该被消除,使得预测值更稳定。
5 G( p# ?; ?0 q% j% M4 R( `" {, r) f' }' O9 ]6 T  V7 j
指数平滑法有几种不同的变体,其中最常见的是简单指数平滑、二次指数平滑和三次指数平滑。
% L* f' `4 q  d5 b  y& w3 \/ H0 X5 x$ J3 f
4.简单指数平滑(Simple Exponential Smoothing):% P' a. K, z/ N; K; ^- c0 t' S* I
简单指数平滑方法将所有观测值视为等权重,并使用一个平滑参数(通常表示为α)来确定各个观测值的权重。具体来说,简单指数平滑法的计算公式如下:7 j3 \% }3 S: w8 A
# r. s% S* T- r) O5 \# f
5.初始值:S₁ = X₁
! _3 J- v3 K' u6.平滑公式:Sₜ = α * Xₜ + (1 - α) * Sₜ₋₁
( {" r& X# k4 W其中,Sₜ表示时刻 t 的平滑值,Xₜ表示时刻 t 的观测值。6 e# L2 P: p* e) h
7.二次指数平滑(Double Exponential Smoothing):
  s1 n' q% `* C# J3 n: g二次指数平滑法相对于简单指数平滑法,将趋势也纳入考虑。它不仅考虑过去观测值的权重,还考虑了过去观测值的趋势。具体来说,二次指数平滑法的计算公式如下:
. j7 C$ q! z. Q* ^% h
; m  P9 s& w, a3 b8.初始水平值:L₁ = X₁
) ?: p2 K9 v* g& K% v" n9.初始趋势值:T₁ = X₂ - X₁
; ^3 V0 `- e6 c! X. i10.平滑公式(水平值):Lₜ = α * Xₜ + (1 - α) * (Lₜ₋₁ + Tₜ₋₁)+ E  M& k6 z0 u, z/ K' g
11.平滑公式(趋势值):Tₜ = β * (Lₜ - Lₜ₋₁) + (1 - β) * Tₜ₋₁
) U/ K# e- Z8 R* C其中,Lₜ表示时刻 t 的水平值,Tₜ表示时刻 t 的趋势值,Xₜ表示时刻 t 的观测值,α和β是平滑参数。
2 Z( O! E: W$ W" \8 O- `1 {12.三次指数平滑(Triple Exponential Smoothing):- |. n5 p/ Y) M( v5 ^) I" Z  }
三次指数平滑法是在二次指数平滑法的基础上进一步考虑了季节性的影响。它适用于具有明显季节性模式的时间序列数据。具体来说,三次指数平滑法的计算公式如下:
7 Z1 l$ u* f( l# r# Z+ k2 V* J! ]2 r1 ^7 o" ]" q
13.初始水平值:L₁ = X₁
. X3 [- ~' f9 z, d5 ^( p14.初始趋势值:T₁ = X₂ - X₁& H3 @1 F" G! n% b! K& J9 _4 u
15.初始季节性值:S₁ = X₃ - 2T₁ - L₁
2 i2 c; z. E4 B$ o16.平滑公式(水平值):Lₜ = α * (Xₜ - Sₜ₋₃) + (1 - α) * (Lₜ₋₁ + Tₜ₋₁)
- j7 F! F4 v" Y17.平滑公式(趋势值):Tₜ = β * (Lₜ - Lₜ₋₁) + (1 - β) * Tₜ₋₁0 {) C# H' m: s4 W
18.平滑公式(季节性值):Sₜ = γ * (Xₜ - Lₜ - Tₜ) + (1 - γ) * Sₜ₋₃
% k( D$ M# Z) I5 t  p其中,Lₜ表示时刻 t 的水平值,Tₜ表示时刻 t 的趋势值,Sₜ表示时刻 t 的季节性值,Xₜ表示时刻 t 的观测值,α、β和γ是平滑参数。
) r3 Q( p7 o2 Y" K  z( ^" O& Q8 p# M
请注意,指数平滑法适用于简单的时间序列模式,例如渐变性趋势或没有明显季节性模式的数据。对于更复杂的模式,如长期趋势、季节性和其他周期性模式,可以考虑使用更高级的模型,例如ARIMA模型。
7 E$ L, n6 ^  j' OARIMA(Autoregressive Integrated Moving Average)模型是一种常用于时间序列分析和预测的统计模型,它将自回归(AR)、差分(I)和移动平均(MA)三种方法结合在一起。ARIMA模型根据时间序列数据的自相关性和移动平均性来拟合模型,并用于预测未来的数值。ARIMA模型通常用于处理具有复杂模式的时间序列数据,如具有长期趋势、季节性和周期性模式的数据。* p( c2 `$ Q6 b' h7 e; ]6 \
& p$ }, o6 \2 |
# 导入所需的库
$ _& f6 y4 ~. E) Z- e: Uimport numpy as np
( F( n$ o7 l5 Yimport pandas as pd# p1 [' f% d  |5 k+ V% l
8 z0 r; o( F! O/ E+ F) Y
# 源数据
- c, l+ ^( c4 u) qdf = pd.DataFrame({
9 a" ~: h- f+ \0 P2 X' L) n    't': [i for i in range(1, 11)],  H  a0 ]1 X# H, a3 W4 Z' [$ {
    'production': [2031, 2234, 2566, 2820, 3006,6 ?) p6 i5 D! M; t) F* ~
                   3093, 3277, 3514, 3770, 4107],; T* R8 t0 F# f
})# ~) q/ `" z; k
! v  E; J) Y" B
这段代码创建了一个DataFrame df,包含了时间(t)和产量(production)的数据。' D2 F1 n  q4 d4 \
# 设 alpha=.3,计算一次、二次指数平滑+ v( [1 C& f3 \; M5 _
alpha = .3
6 h; O: V3 Z2 v* _, ~s1, s2 = [int(df['production'][0])],\
% J9 O% y7 [. O! ?    [int(df['production'][0])]
* {4 V& [. m# F' G# o7 e; x/ i( |
! Z0 W- U- s& m, h  [for i in range(1, len(df['t'])):
( Z0 S. |% Z  ^6 ~' [" }    s1.append(alpha*df['production'][i] + (1-alpha)*s1[i-1])
/ y% G9 ~2 d: T+ K5 _    s2.append(alpha*s1[i] + (1-alpha)*s2[i-1])- c" v* Z6 d) g2 J+ Y3 J
df['s1'] = s1
2 k7 q5 E& ^! L) }df['s2'] = s21 g4 _+ m% k2 J. W7 w

% w. i/ n6 s4 T8 R. K这段代码使用指数平滑法计算了一次指数平滑和二次指数平滑的值,并将结果添加到DataFrame df中的's1'和's2'列中。
; ?' e. `) y9 M6 R5 g6 @: ?# 计算过去年的预测值,以及未来年的线性表达式
5 Y/ H4 j6 u2 c  W' o) Xpredict_list = [None]& W6 v$ J2 z% l% v5 s3 x
for i in range(len(df['t'])-1):2 `+ Y$ r. o& O+ F
    a = 2*df['s1'][i] - df['s2'][i]( k  G3 l- U! k# s9 u* C, E
    b = (alpha / (1-alpha)) * (df['s1'][i] - df['s2'][i])
( s4 P7 d% o; L" d5 B  w    predict_list.append(a + b)) I- s3 g3 I; A0 a$ m( S

0 m3 s5 X! e8 b1 Y8 o- m* {t = 10
- ]4 Q* S8 Y, J3 b% G8 Pa = 2*df['s1'][t-1] - df['s2'][t-1]
8 a2 T4 r1 |6 f8 a! s2 zb = (alpha / (1-alpha)) * (df['s1'][t-1] - df['s2'][t-1]); j% T' ?/ b5 p. }
df['predict'] = predict_list
2 R, q1 _4 {* P) Eprint('at =', a)# Z+ y2 ?1 P! B
print('bt =', b)
6 Q6 _" v- U& z: f1 r- X- H  n) A$ ]; @5 R: [
这段代码计算了过去年份的预测值,并给出了未来年份的线性表达式。其中a和b是线性表达式的参数,对应于二次指数平滑法的结果。将过去年份的预测值添加到DataFrame df的'predict'列中,并打印出a和b的值。1 y0 P& s7 j8 \3 u
# 计算未来年的预测值+ f  C$ `/ W4 I; p3 e5 g% J7 J, n
pred_df = df.copy()- a* J" {0 p  P0 z% O9 v! T6 k
for i in range(5):
# |" P! x  T- J+ x6 ]    pred_df = pd.concat([pred_df, pd.DataFrame({" o. F& N$ ]) O  R  a- K
        't': [10+i+1],0 K& o9 R; ^" C$ r
        'predict': a + b*i,* `% }" |& H6 ]# X
    })])
, N. h8 X+ A6 ~8 Lpred_df
9 N! v+ `1 }* c
/ K& o4 T5 l! |这段代码使用线性表达式计算了未来5年的预测值,并将结果添加到新的DataFrame pred_df中。
, h5 \% g; E+ ^7 ^  i1 Z# 画图
) v- E: V1 W* j0 E' eimport matplotlib.pyplot as plt
" L5 i$ }$ ~0 n/ [6 {& o/ M: B) x- d' Q2 l/ L$ }( r
plt.plot(pred_df['t'], pred_df['production'],label='production')
) g5 p* x: z- z% M5 o  p" pplt.scatter(pred_df['t'], pred_df['production'])/ ~1 V5 L; t9 i9 K: z. `. y
plt.plot(pred_df['t'], pred_df['s1'],label='s1')
$ Q) Q% r! `9 b  W: g% lplt.scatter(pred_df['t'], pred_df['s1'])
- P+ i3 l# F9 O3 Hplt.plot(pred_df['t'], pred_df['s2'],label='s2')( ^7 s. C" _" [$ S  d9 k% N+ E
plt.scatter(pred_df['t'], pred_df['s2'])9 q! ?% h* `6 m6 R' N8 N- q6 C3 M
plt.plot(pred_df['t'], pred_df['predict'],label='predict')
3 a- U% B; M$ ]$ x3 ~  Mplt.scatter(pred_df['t'], pred_df['predict'])( m* F3 w9 t' p( W! `& Y
plt.legend(): ?5 Z8 e  l! h; @) k% l

9 \9 j+ i' |& _这段代码使用matplotlib库将实际产量、一次指数平滑、二次指数平滑和预测值的曲线图绘制出来。
& L6 O$ o* b' n# y  T希望以上解释对你有帮助。如果你还有任何问题,请随时提问。+ I' h' q  ~: b8 U: g6 C6 w  g
0 _2 e) G  H- O+ E/ p4 R

! F* G6 m& v) q! Q: q& E$ w* N

24.exponential_smoothing.py

1.64 KB, 下载次数: 1, 下载积分: 体力 -2 点

售价: 2 点体力  [记录]

zan
转播转播0 分享淘帖0 分享分享0 收藏收藏0 支持支持0 反对反对0 微信微信
您需要登录后才可以回帖 登录 | 注册地址

qq
收缩
  • 电话咨询

  • 04714969085
fastpost

关于我们| 联系我们| 诚征英才| 对外合作| 产品服务| QQ

手机版|Archiver| |繁體中文 手机客户端  

蒙公网安备 15010502000194号

Powered by Discuz! X2.5   © 2001-2013 数学建模网-数学中国 ( 蒙ICP备14002410号-3 蒙BBS备-0002号 )     论坛法律顾问:王兆丰

GMT+8, 2026-8-25 23:16 , Processed in 0.300110 second(s), 55 queries .

回顶部