基于模糊小波神经网络的工业机器人操作臂鲁棒自适应滑模控制
摘要
本文提出了一种基于动态结构模糊小波神经网络(FWNNs)系统的鲁棒自适应控制方法,用于存在不确定性与扰动的工业机器人操作臂(IRM)轨迹跟踪控制,通过自适应滑模控制(SMC)实现。动态结构FWNNs中的四层模糊小波神经网络基于模糊规则构建,其结论部分结合了小波函数,以补偿结构性与非结构性不确定性并建模复杂过程。然而,设计合适的控制方案以达到所需的逼近误差(如摩擦力、外部干扰误差和参数变化)仍具挑战性。为解决上述问题,动态结构FWNNs系统的所有参数均通过自适应学习算法在线调整,并依据李雅普诺夫稳定性定理确定自适应鲁棒控制律。利用动态结构FWNNs,该控制系统可实现期望的跟踪性能,同时保证闭环机械手系统的稳定性与鲁棒性。此外,通过对三连杆IRM进行仿真与实验,并与小波网络控制(WNC)和自适应模糊控制(AFC)进行比较,验证了所提出的动态结构FWNNs方法的有效性与鲁棒性。
关键词
模糊小波神经网络,工业机器人,鲁棒自适应控制,机器人机械手
引言
通常情况下,机器人操作臂是多变量非线性系统,其动态特性通常受到各种不确定性的干扰,例如外部扰动、非线性摩擦和负载变化。因此,难以建立精确的数学模型来逼近机器人操作臂的未知动态特性。为了解决这一问题,已有大量研究采用了软计算方法[1–11],如模糊逻辑、神经网络(NN)、小波神经网络(WNN)。在过去的十年中,模糊技术已成为逼近非线性系统的有效工具。模糊系统的规则通过利用人类专家的知识和经验来创建,以在无法用精确数学模型描述的不确定性条件下实现良好的控制性能[12–14]。然而,这些知识可能并不充分,且大多数自适应模糊控制器在构建合适的模糊控制规则方面存在困难。
函数,以及如何保证系统稳定性是一个有待解决的挑战。近年来,基于神经网络(NN)的智能控制器得到了广泛应用。神经网络具有学习能力、非线性映射能力、泛化能力、计算并行性和活力等特性。由于这些特点,神经网络在辨识、优化、智能控制、机器人技术等领域成为重要的应用工具。神经网络可以提供在线学习算法,并处理机器人模型中的未建模未知动态。这些算法基于李雅普诺夫稳定性定理,采用反向传播–梯度下降法[15–26]进行设计。然而,在高度不确定的动力系统中应用这些方法对神经网络权重进行自适应更新时可能会遇到困难,并且需要观察学习过程。因此,神经网络通常需要大量的神经元,且网络收敛速度一般较慢,因而不适合在线控制。为了克服这些不利缺点,提出了小波神经网络(WNN)。WNN是小波与神经网络的结合。在WNN中,小波变换能够分析非平稳信号并发现其局部细节。基于小波的网络结构简单且学习速度快,能够更快地收敛并对新数据更具适应性。在[27],一维小波框架通过使用单尺度和多尺度参数被推广到多维情况。在[28–31]中,此类结构被研究用于处理预测、逼近、分类和控制应用。
因此,与神经网络相比,WNN的学习能力更高效,训练也更容易。在[32]中,提出了WNN的逼近能力和收敛特性,能够在复杂非线性系统建模中实现优于神经网络的性能。在[33]中,提出了一种基于递归小波神经网络的稳定预测控制设计方法,以应对复杂的非线性动态。在所提出的控制器中,采用递推最小二乘法的学习算法用于辨识递归小波神经网络结论部分中的未知参数。此外,由于滑模控制(SMC)具有良好的鲁棒性,许多研究人员已成功将其应用于机器人操作臂的关节位置跟踪[34–39]。SMC与自适应控制还被用来减小逼近误差的影响,并通过整合鲁棒控制与智能控制的优点,在自适应模式与鲁棒模式之间实现平滑切换[40, 41]。SMC还使用一个足够大的增益来补偿有界不确定性,并保证非线性系统的稳定性与无源性[42]。然而,在现有SMC方案的研究中,通常需要详细的系统信息及相应的不确定性边界以确保稳定性。即使设计了辅助控制,由SMC引起的抖振现象仍然存在。本文提出一种控制方案,该方案结合模糊逻辑、神经网络、小波网络以及针对三连杆工业机器人操作臂的不同权重滑模控制,以在各种环境下实现高精度位置跟踪。这种组合使我们能够开发出具备快速学习能力、快速收敛特性,并能补偿结构性与非结构性不确定性的系统。基于李雅普诺夫理论与动态结构模糊小波神经网络系统的结合,可使跟踪误差收敛至零,并保证鲁棒自适应控制系统的稳定性。
本文的结构如下。第2节描述了问题的提出。第3节介绍了模糊小波神经网络的结构。第4节介绍了系统的控制设计与稳定性分析。第5节提供了三连杆工业机器人操作臂的仿真与实验结果。最后,第6节给出了结论性评述。
2. 问题描述
具有外部扰动的n连杆机器人机械手(图1)的动态特性可用拉格朗日方程表示如下:
$$
M(q) \ddot{q} + C(q, \dot{q}) \dot{q} + G(q) + F(\dot{q}) = \tau - \tau_0, \quad (1)
$$
其中 $(q, \dot{q}, \ddot{q}) \in \mathbb{R}^n$ 分别为关节位置、速度和加速度向量。$M(q) \in \mathbb{R}^{n \times n}$ 为对称惯性矩阵。$C(q, \dot{q}) \in \mathbb{R}^{n \times n}$ 为科里奥利和向心力向量。$G(q) \in \mathbb{R}^{n \times n}$ 表示重力向量。$F(\dot{q})$ 表示摩擦力向量。$\tau_0 \in \mathbb{R}^n$ 为输入未知扰动向量。而 $\tau \in \mathbb{R}^n$ 为关节转矩的控制输入向量。为了设计控制器,假设机器人模型(1)具有以下若干性质:
性质1
:惯性矩阵 $M(q)$ 是一个正定对称矩阵,其定义为:
$$
m_1 |x|^2 \leq x^T M(q) x \leq m_2 |x|^2, \quad \forall x \in \mathbb{R}^n \quad (2)
$$
其中 $m_1$ 和 $m_2$ 为已知的正常数,且它们取决于机器人操作臂的质量。
性质2
:$\dot{M}(q) - 2C(q, \dot{q})$ 是斜对称矩阵,其中
$$
x^T[\dot{M}(q) - 2C(q, \dot{q})]x = 0. \quad (3)
$$
性质3
:$C(q, \dot{q})\dot{q}$,$G(q)$ 和 $F(\dot{q})$ 具有如下边界:
$$
|C(q, \dot{q}) \dot{q}| \leq C_k |\dot{q}|^2, \quad |G(q)| \leq G_k, \quad |F(\dot{q})| \leq F_k |\dot{q}| + F_0 \quad (4)
$$
其中 $C_k$、$G_k$、$F_k$、$F_0$ 为正常数。
性质4
:$\tau_0 \in \mathbb{R}^n$ 是未知扰动且具有边界:
$$
|\tau_0| \leq \tau_k, \quad \tau_k > 0. \quad (5)
$$
3. FWNNS结构
所提出的模糊小波神经网络是将小波神经网络与 Takagi-Sugeno-Kang (TSK) 模糊系统相结合的产物。小波神经网络具有良好的泛化能力,能够精确逼近复杂函数,且比其他网络更容易训练。TSK模糊模型的核心在于每个输入信号被划分为若干模糊区域,且TSK的输出具有明确的解析形式[1]。在小波中,平移和 dilation 参数的最优初始选择可提高训练速度并实现快速收敛。通过使用小波,模糊小波神经网络的泛化能力得到增强,且能够以期望的精度描述非线性过程。
本文提出的模糊小波神经网络的结构如图2所示。它包含四层。
第一层:输入层
在此层中,输入信号 $x_1, x_2, …, x_m$ 被直接传递到下一层。
第二层:隶属度层
该层中的每个节点代表相应语言变量的项,并执行模糊隶属函数。
$$
\Psi(x_i) = e^{-a_{ji}^2 (x_i - b_{ji})^2}, \quad i = 1, …, m; \quad j = 1, …, n, \quad (6)
$$
其中 $a_{ji}$ 和 $b_{ji}$ 分别为 dilation 和平移参数,$m$ 为输入信号的数量,$n$ 为分配给外部输入信号 $x_i$ 的节点数量。
第三层:模糊规则层
该层中的节点数量对应于规则的数量。每个节点表示一条模糊规则。通过使用 AND 操作,计算该层的输出值:
$$
\mu_j(x_i) = \prod_{i=1}^{m} \Psi_j(x_i), \quad y_j = w_j \psi_j(x_i), \quad i = 1, …, m, \quad j = 1, …, n \quad (7)
$$
其中 $\Pi$ 为最小运算且
$$
\psi_j(x_i) = [1 - a_{ji}^2 (x_i - b_{ji})^2] e^{-a_{ji}^2 (x_i - b_{ji})^2}
$$
是墨西哥帽小波函数。$\mu_j(x_i)$ 是下一层的输入。$y_j$ 是小波函数(WF)的输出信号。
第四层:输出层
在该层中,通过将前一层的输出信号与小波神经网络的输出信号相乘并进行去模糊化,计算整个网络的输出。
$$
u = \frac{\sum_{j=1}^{n} \mu_j(x) y_j}{\sum_{j=1}^{n} \mu_j(x)}. \quad (8)
$$
所表示的模糊小波神经网络结构具有以下优点:模糊小波神经网络基于包含小波模糊的模糊规则构建,这些规则的结论部分包含了小波模糊。采用这种结构使得模糊小波神经网络更有效地逼近复杂函数。此外,模糊小波神经网络与其他建模结构相比具有更小的网络规模和更快的学习速度。在定义了模糊小波神经网络的结构后,构建了动态结构的模糊小波神经网络系统。
4. 控制设计与稳定性分析
在本节中,我们提出了一种动态结构FWNNs,以寻找合适的自适应模糊小波神经网络模型的自适应律,从而使控制系统能够达到所需的逼近误差精度。该理论的细节描述如下:自适应模糊小波神经网络的框图如图3所示。该方案的目的是构建一种依赖于非线性机器人操作臂的模糊小波神经网络自适应律。
模糊小波神经网络(8)的输出可以重写为以下向量形式:
$$
u(x,a,b,W) = [u_1, u_2, …, u_n]^T = W^T \mu(x,a,b) \quad (9)
$$
with
$$
a = [a_1,a_2,…,a_n]^T \in \mathbb{R}^{Nm}; \quad b = [b_1,b_2,…,b_n]^T \in \mathbb{R}^{Nm};
$$
$$
\mu(x,a,b) = [\mu_1,\mu_2,…,\mu_n]^T; \quad W = [w_1,w_2,…,w_n]^T \in \mathbb{R}^{nN},
$$
且 $N$ 是规则节点的总数。
模糊小波神经网络已显示出其作为逼近器的能力。因此,基于强大的逼近误差分析,存在一个最优的模糊小波神经网络来学习非线性动态 $u(x)$ 及其最优参数:
$$
u(x) = W^{
T} \mu^
(x,a^
,b^
) + u_0(x). \quad (10)
$$
这里,$W^
$、$a^
$、$b^*$ 分别是 $W$、$a$、$b$ 的最优参数,且 $u_0(x) \in \mathbb{R}^n$ 是一个最小逼近误差向量。
假设1
:逼近误差 $u_0(x)$ 是有界的,如下所示:
$$
|u_0(x)| \leq \Delta_u \quad (11)
$$
其中 $\Delta_u$ 是正实数。
假设2
:模糊小波神经网络最优参数的范数由正实数界定,如下所示:
$$
|W^
| \leq \Delta_w; \quad |a^
| \leq \Delta_a; \quad |b^
| \leq \Delta_b. \quad (12)
$$
输出模糊小波神经网络的近似值设计为:
$$
\hat{u} = \hat{W}^T \hat{\mu}(x, \hat{a}, \hat{b}), \quad (13)
$$
其中 $\hat{u}$、$\hat{W}^T$、$\hat{\mu}$、$\hat{a}$、$\hat{b}$ 分别是最优参数 $u$、$W^
$、$\mu^
$、$a^
$、$b^*$ 的近似值。
在本节中,我们考虑通过提出一种近似的自适应鲁棒律,当 $t \to \infty$ 时,系统稳定性得到保证且跟踪误差收敛到零。定义跟踪误差向量和滑动矩阵如下方程所示:
$$
e(t) = q_d - q, \quad (14)
$$
$$
s(t) = \dot{e} + \lambda e, \quad (15)
$$
其中 $\lambda = \text{diag}(\lambda_1,\lambda_2,..,\lambda_n)$ 是一个对角正定矩阵。
因此,(1) 可重写为:
$$
M \dot{s} = u - Cs - \tau, \quad (16)
$$
其中 $u$ 定义如下:
$$
u = M(q)(\ddot{q}_d + \lambda \dot{e}) + C(q, \dot{q})(\dot{q}_d + \lambda e) + G(q) + F(\dot{q}) + \tau_0. \quad (17)
$$
从图3可以看出,自适应控制律表示如下:
$$
\tau = \tau_s + Ks + \hat{u}, \quad (18)
$$
其中 $K$ 为正定矩阵,且 $K = \text{diag}(k_1,k_2,…,k_n)$;$\hat{u}$ 是自适应模糊小波神经网络函数 $u$ 的逼近值。而 $\hat{\tau}_s$ 是一个滑模控制器项,用于抑制不确定性和逼近误差的影响。
将(18)代入(16),得到:
$$
M \dot{s} = u - \hat{u} - (K + C)s - \tau_s,
$$
$$
M \dot{s} = \tilde{u} - (K + C)s - \tau_s \quad (19)
$$
with
$$
\tilde{u} = u - \hat{u} = W^{
T} \mu^
- \hat{W}^T \hat{\mu} + u_0. \quad (20)
$$
将参数误差定义为: $\tilde{W} = W^
- \hat{W}$; $\tilde{\mu} = \mu^
- \hat{\mu}$; $\tilde{a} = a^
- \hat{a}$ 和 $\tilde{b} = b^
- \hat{b}$。因此,(20) 可重写为:
$$
\tilde{u} = W^{
T} \tilde{\mu} + \tilde{W}^T \hat{\mu} + u_0, \quad (21)
$$
然后, $\tilde{\mu}$ 的函数可以用泰勒级数展开为:
$$
\tilde{\mu} = \left[\frac{\partial \mu_1}{\partial a}, \frac{\partial \mu_2}{\partial a}, …, \frac{\partial \mu_N}{\partial a}\right]
{a=\hat{a}} \tilde{a} + \left[\frac{\partial \mu_1}{\partial b}, \frac{\partial \mu_2}{\partial b}, …, \frac{\partial \mu_N}{\partial b}\right]
{b=\hat{b}} \tilde{b} + H(\tilde{a}, \tilde{b}), \quad (22)
$$
or
$$
\tilde{\mu} = A^T \tilde{a} + B^T \tilde{b} + H(\tilde{a}, \tilde{b}), \quad (23)
$$
其中 $H(\tilde{a},\tilde{b}) \in \mathbb{R}^N$ 是高阶项向量;
$$
A^T = \left[\frac{\partial \mu_1}{\partial a}, \frac{\partial \mu_2}{\partial a}, …, \frac{\partial \mu_N}{\partial a}\right]
{a=\hat{a}} \in \mathbb{R}^{N \times (Nm)};
$$
$$
B^T = \left[\frac{\partial \mu_1}{\partial b}, \frac{\partial \mu_2}{\partial b}, …, \frac{\partial \mu_N}{\partial b}\right]
{b=\hat{b}} \in \mathbb{R}^{N \times (Nm)}.
$$
将(23)代入(20),得到:
$$
\tilde{u} = \tilde{W}^T [\hat{\mu} + A^T (a^
- \hat{a}) + B^T (b^
- \hat{b})] + \hat{W}(A^T \tilde{a} + B^T \tilde{b}) + W^{
T} H(\tilde{a}, \tilde{b}) + u_0,
$$
$$
\tilde{u} = \tilde{W}^T (\hat{\mu} - A^T \hat{a} - B^T \hat{b}) + \hat{W}^T(A^T \tilde{a} + B^T \tilde{b}) + \omega(x,a,b), \quad (24)
$$
其中 $\omega = [\omega_1,\omega_2,…,\omega_n]^T \in \mathbb{R}^n$ 并利用 (23),可得
$$
\omega = \tilde{W}^T(A^T a^
+ B^T b^
) + W^{
T}(H(\tilde{a}, \tilde{b})) + u_0
= (W^{
T} - \hat{W}^T)(A^T a^
+ B^T b^
) + W^{
T}(\tilde{\mu} - A^T \tilde{a} - B^T \tilde{b}) + u_0
= W^{
T}(\tilde{\mu} + A^T \hat{a} + B^T \hat{b}) - \hat{W}^T(A^T a^
+ B^T b^
) + u_0.
$$
$\omega$ 的边界确定如下:
$$
|\omega| = |W^{
T}(\tilde{\mu} + A^T \hat{a} + B^T \hat{b}) - \hat{W}^T(A^T a^
+ B^T b^
) + u_0|
= | (W^{
T} \tilde{\mu} + u_0) + W^{
T}(A^T \hat{a} + B^T \hat{b}) - \hat{W}^T(A^T a^
+ B^T b^
) |.
$$
由于
$$
|W^{
T} A^T \hat{a}| \leq |W^{
T} A^T| |\hat{a}|;
$$
$$
|W^{
T} B^T \hat{b}| \leq |W^{
T} B^T| |\hat{b}|; \quad \text{and}
$$
$$
|\hat{W}^T(A^T a^
+ B^T b^
)| \leq |\hat{W}^T| |A^T a^
+ B^T b^
|,
$$
我们可以推断:
$$
|\omega| \leq |W^{
T} \tilde{\mu} + u_0| + |W^{
T} A^T| |\hat{a}| + |W^{
T} B^T| |\hat{b}| + |\hat{W}| |A^T a^
+ B^T b^
| \leq \beta^{
T} \phi, \quad (25)
$$
其中
$$
\beta^
= [|W^{
T} \tilde{\mu} + u_0|, |W^{
T} A^T|, |W^{
T} B^T|, |A^T a^
+ B^T b^
|]^T,
$$
$$
\phi = [1, |\hat{a}|, |\hat{b}|, |\hat{W}|]^T.
$$
根据上述分析,滑模控制项 $\tau_s$ 设计如下:
$$
\tau_s = \frac{s (\beta^T \phi)^2}{|s| \beta^T \phi + \varepsilon}, \quad (26)
$$
其中 $\varepsilon$ 是一个正标量控制增益,且
$$
\dot{\varepsilon} = -k_\varepsilon \varepsilon, \quad \varepsilon(0) > 0 \quad (27)
$$
其中 $\beta = [\beta_1, \beta_2, \beta_3, \beta_4]^T$ 是向量 $\beta^
$ 的边界。
并为了估计滑模控制项 $\tau_s$,我们提出自适应项 $\hat{\tau}_s$ 如下:
$$
\hat{\tau}_s = \frac{s (\hat{\beta}^T \phi)^2}{|s| \hat{\beta}^T \phi + \varepsilon}, \quad (28)
$$
其中 $\hat{\beta}$ 是 $\beta^*$ 的估计值。
将(24)代入(19),得到:
$$
M \dot{s} = \tilde{W}^T(\hat{\mu} - A^T \hat{a} - B^T \hat{b}) + \hat{W}^T(A^T \tilde{a} + B^T \tilde{b}) - (K + C)s + \omega - \tau_s. \quad (29)
$$
通过将自适应控制律(18)应用于动态(1),并使用滑模控制项(26),可选择模糊小波神经网络和滑模控制项参数的在线自适应更新律为:
$$
\begin{cases}
\dot{\hat{W}} = \alpha_w (\hat{\mu} - A^T \hat{a} - B^T \hat{b}) s^T, \
\dot{\hat{a}} = \alpha_a \hat{W} A^T s, \
\dot{\hat{b}} = \alpha_b \hat{W} B^T s, \
\dot{\hat{\beta}} = \alpha_\beta |s| \phi, \
\dot{\hat{\varepsilon}} = -\alpha_\varepsilon \varepsilon.
\end{cases} \quad (30)
$$
这里, $\alpha_w$、 $\alpha_a$、 $\alpha_b$、 $\alpha_\beta$、 $\alpha_\varepsilon$ 为正的自适应参数速率。
定理1 :考虑由(1)式描述的n连杆机器人机械手的模糊小波神经网络自适应控制律在(18)式中设计,滑模控制项 $\tau_s$ 由(26)式给出,参数 $(\dot{\hat{W}}, \dot{\hat{a}}, \dot{\hat{b}}, \dot{\hat{\beta}}, \dot{\hat{\varepsilon}})$ 通过自适应算法(30)进行调整。则可保证跟踪误差及所有系统参数的收敛性,并趋近于零。
考虑如下的李雅普诺夫函数候选者:
$$
V(t) = \frac{1}{2} \left[ s^T M s + \frac{1}{\alpha_w} \tilde{W}^T \tilde{W} + \frac{1}{\alpha_a} \tilde{a}^T \tilde{a} + \frac{1}{\alpha_b} \tilde{b}^T \tilde{b} + \frac{1}{\alpha_\beta} \tilde{\beta}^T \tilde{\beta} + \frac{1}{\alpha_\varepsilon} \varepsilon \right]. \quad (31)
$$
沿时间对 $V(t)$ 求导数,我们得到:
$$
\dot{V}(t) = s^T M \dot{s} + \frac{1}{2} s^T \dot{M} s - \frac{1}{\alpha_w} \tilde{W}^T \dot{\hat{W}} - \frac{1}{\alpha_a} \tilde{a}^T \dot{\hat{a}} - \frac{1}{\alpha_b} \tilde{b}^T \dot{\hat{b}} - \frac{1}{\alpha_\beta} \tilde{\beta}^T \dot{\hat{\beta}} + \frac{1}{\alpha_\varepsilon} \dot{\varepsilon}. \quad (32)
$$
将(29)代入(31),得到
$$
\dot{V}(t) = \frac{1}{2} s^T(M \dot{s} - 2C)s - s^T K s + s^T [\tilde{W}^T (\hat{\mu} - A^T \hat{a} - B^T \hat{b}) + \hat{W}^T (A^T \tilde{a} + B^T \tilde{b})] + s^T \omega - s^T \tau_s - \frac{1}{\alpha_w} \tilde{W}^T \dot{\hat{W}} - \frac{1}{\alpha_a} \tilde{a}^T \dot{\hat{a}} - \frac{1}{\alpha_b} \tilde{b}^T \dot{\hat{b}} - \frac{1}{\alpha_\beta} \tilde{\beta}^T \dot{\hat{\beta}} + \frac{1}{\alpha_\varepsilon} \dot{\varepsilon}. \quad (33)
$$
利用性质2并代入自适应算法(30)至(33),我们得到:
$$
\dot{V}(t) = -s^T K s - s^T \tau_s + s^T \omega - \tilde{\beta}^T |s| \phi - \varepsilon. \quad (34)
$$
利用(25)和(26),可得
$$
\dot{V}(t) \leq -s^T K s - s^T \frac{(\hat{\beta}^T \phi)^2}{|\hat{\beta}^T \phi| + \varepsilon} + \hat{\beta}^T |s| \phi - \tilde{\beta}^T |s| \phi - \varepsilon \leq -s^T K s + \frac{\varepsilon |s| \hat{\beta}^T \phi}{|s| \hat{\beta}^T \phi + \varepsilon} - \varepsilon. \quad (35)
$$
由于(35)中最后两项的和始终小于零,因此我们可以对 $\dot{V}$ 设定新的边界
$$
\dot{V} \leq -s^T k_s s. \quad (36)
$$
因此,如果控制系统的所有参数在 $t > 0$ 时均有界,且所有初始条件 $\tilde{W}$、 $\tilde{a}$、 $\tilde{b}$、 $\beta$、$\varepsilon$ 以及 $s$ 在初始时刻 $t = 0$ 均有界。此外,对 $\dot{V}(t)$ 关于时间进行积分,可得:
$$
\int_0^t \dot{V}(t) dv \leq -\int_0^t s^T K s dv,
$$
or
$$
\int_0^t s^T K s dv \leq -\int_0^t \dot{V}(t) dv = V(0) - V(t) \leq V(0) \leq \infty.
$$
因此,根据Barbalat引理,可以证明当 $t$ 趋于无穷时, $\lim_{t \to \infty} s(t) = 0$。因此,系统的全局稳定性以及跟踪误差均得到保证,并在时间趋于无穷时通过自适应控制律(18)收敛到零。
备注1 :根据上述分析以及所提出控制器的设计,采用了参数边界的假设来分析被控系统的稳定性。此外,在我们设计的控制器中,实际上不再需要已知参数边界的信息。容易证明,我们的控制系统结合自适应在线更新律是严格无源的。这一有利特性可用于推导被控系统的一些内部有界性,而无需假设可观测性和稳定性。
5. 仿真与实验结果
5.1. 仿真结果
在本节中,采用实验室智能自动化技术中的三连杆 IRM,如图1所示。
为了说明所提出控制方案的有效性。三连杆工业机器人操纵器模型(图4)的详细系统参数如下所示:
$$
M = \begin{bmatrix}
M_{11} & M_{12} & M_{13} \
M_{21} & M_{22} & M_{23} \
M_{31} & M_{32} & M_{33}
\end{bmatrix}, \quad C = \begin{bmatrix}
C_{11} & C_{12} & C_{13} \
C_{21} & C_{22} & C_{23} \
C_{31} & C_{32} & C_{33}
\end{bmatrix}; \quad G = \begin{bmatrix}
g_1 \ g_2 \ g_3
\end{bmatrix};
$$
$$
M_{11} = l_1^2\left(\frac{m_1}{3} + m_2 + m_3\right) + l_1 l_2 (m_2 + 2m_3)\cos(q_2) + l_2^2\left(\frac{m_2}{3} + m_3\right);
$$
$$
M_{12} = -l_1 l_2\left(\frac{m_2}{3} + m_3\right)\cos(q_2) - l_2^2(m_2 + m_3); \quad M_{13} = M_{23} = M_{31} = M_{32} = 0; \quad M_{21} = M_{12};
$$
$$
M_{22} = l_2^2\left(\frac{m_2}{3} + m_3\right); \quad M_{33} = m_3; \quad C_{11} = -\dot{q}
2(m_2 + 2m_3); \quad C
{12} = C_{21}; \quad C_{13} = C_{22} = C_{23} = C_{31} = C_{32} = C_{33} = 0;
$$
$$
g_1 = g_2 = g_3 = -m_3 g,
$$
其中,$m_1, m_2, m_3$ 为连杆质量;$l_1, l_2, l_3$ 为连杆长度; $g = 10 \, \text{m/s}^2$ 为重力加速度。
三连杆工业机器人机械手的参数如下所示:
$$
m_1 = 4 \, \text{kg}, \quad m_2 = 3 \, \text{kg}, \quad m_3 = 1.5 \, \text{kg};
$$
$$
l_1 = 0.4 \, \text{m}, \quad l_2 = 0.3 \, \text{m}, \quad l_3 = 0.2 \, \text{m}.
$$
目标是设计控制输入,以迫使关节变量 $q = [q_1 \, q_2 \, q_3]^T$ 在时间趋于无穷时跟踪期望轨迹。此处,三连杆工业机器人操纵器的期望位置轨迹选择为 $q_d = [q_{d1} \, q_{d2} \, q_{d3}]^T = [0.5\sin(2\pi t) \, 0.5\sin(2\pi t) \, 0.5\sin(2\pi t)]^T$;
此外,本仿真中的外部干扰和摩擦力选择如下:
$$
\tau_0 = \begin{bmatrix}
2\sin(\pi t) \ 2\sin(\pi t) \ 2\sin(\pi t)
\end{bmatrix}; \quad F(\dot{q}) = \begin{bmatrix}
5 \dot{q}_1 + 0.2\,\text{sign}(\dot{q}_1) \
5 \dot{q}_2 + 0.2\,\text{sign}(\dot{q}_2) \
5 \dot{q}_3 + 0.2\,\text{sign}(\dot{q}_3)
\end{bmatrix}.
$$
所提出的FWNNs控制器的结构可以由 $m = 15$,$p = 5$,$n = 3$ 个节点来表征。
自适应控制系统中使用的参数值为了仿真的方便而选择如下:
$$
\lambda = \text{diag}(5, 5, 5); \quad K = \text{diag}(100, 100, 100); \quad \alpha_w = \text{diag}(50, 50, 50, 50, 50);
$$
$$
\alpha_a = \alpha_b = \text{diag}(20, …, 20, …, 20) \in \mathbb{R}^{mp \times mp};
$$
$$
\alpha_\beta = \text{diag}(0.001, 0.001, 0.001, 0.001, 0.001); \quad \alpha_\varepsilon = 0.1.
$$
初始条件选择如下:
$$
\varepsilon(0) = 1, \quad \phi(0) = [1 \, 1 \, 1 \, 1].
$$
在以下段落中,将所提出的智能控制方案应用于工业机器人操纵器,并与WNC[9]和AFC[12]进行比较。图5显示了WNC、AFC以及所提出的智能控制器的仿真结果。从仿真结果可以看出,由于两种控制器都具有学习能力,WNC、AFC以及所提出的智能控制器均能在学习过程中使跟踪误差减小。然而,所提出的智能控制系统在跟踪误差上的减小速率比 WNC和AFC系统更快。这意味着,在动态结构模糊小波神经网络中的所有参数均被更新且规则节点数被动态调整的情况下,该动态结构模糊小波神经网络的逼近能力优于WNC和AFC系统。此外,从图5可以观察到,当跟踪误差达到较大值时,所提出的智能控制器的控制力比WNC和AFC更平滑,且振荡更小,从而实现了所需的性能水平。
5.2. 实验结果
在本节中,我们使用智能自动化技术实验室中的两连杆机器人操作手来验证所提出控制方案的有效性。
实验控制系统模型如图6所示。该系统由一台带有奔腾微处理器的IBM个人电脑、用于获取关节1、关节2和关节3角度的编码器板,以及用于向伺服放大器发送指令信号的A/D模块组成。所提出的控制算法通过MatLab Simulink实现。
第一个实验案例假设在三个连杆IRM的质量中加入了1-kg的负载,期望输入轨迹和其他参数与之前相同在仿真情况下。关节轨迹、跟踪误差和控制力矩的实验结果如图7所示。从这些结果可以看出,所提出的智能控制方案的响应和跟踪误差范数均明显优于 WNC和AFC方法。此外,图7表明,所提出的智能控制器的力矩相较于WNC[9]和AFC[12]更小且更平滑,在负载变化时仍存在抖振现象。因此,所提出控制方案的鲁棒跟踪性能优于WNC以及在参数变化下的AFC。这意味着由于动态结构,所提出的智能控制器对参数变化的敏感性低于 WNC和AFC。
第二个实验案例假设当机器人在跟踪轨迹时,外部扰动 $de(t)$ 突然更多地注入控制系统。这种情况发生在实验时间的前 2 秒之后,所有其他参数均与仿真案例中选择的一致。外部扰动的形状表达如下:
$$
de(t) = [50\sin(20t) \, 50\sin(20t) \, 50\sin(20t)]^T.
$$
第二种情况下关节轨迹、跟踪误差和控制力矩的实验响应如图8所示。从这些实验结果可以看出,所提出控制方法的性能仅受到轻微影响,而WNs方法的性能则受到严重影响。因此,该提出的智能控制器在外部扰动下的控制性能和鲁棒性优于WNC[9]和 AFC[12]。显然,在经过一段时间的学习后,动态模糊小波神经网络系统的表现优于WNC和AFC系统。
6. 结论
本文提出了一种基于动态结构FWNNs的鲁棒自适应控制方法,并给出了数学证明。同时成功应用于控制三连杆工业机器人操纵器的关节,以实现高精度位置跟踪。模糊小波神经网络中的规则节点数可以是增加的或根据所需的逼近精度随时间增加或减少。通过结合动态结构的模糊小波神经网络和李雅普诺夫稳定性定理,实现自适应自适应控制律被设计用于调节网络的所有参数,以减小逼近误差并提高控制性能。整个自适应系统的全局稳定性在李雅普诺夫意义下得到保证,且无论不确定性是否发生,跟踪误差均被驱动至期望的精度。此外,通过结合滑模控制与自适应控制,所提出的智能控制方案能够利用其鲁棒性和自学习特性来处理逼近误差。
本文还提供了三连杆IRM在所提出的智能控制方案、AFC和WNC下的仿真与实验结果,以进行比较并展示该智能控制方案的优越性。



189

被折叠的 条评论
为什么被折叠?



