LSTM神经网络输入输出究竟是怎样的?
创始人
2024-11-08 04:18:30
LSTM神经网络输入输出究竟是怎样的?

常规feedforward输入和输出:矩阵输入矩阵形状:(n_samples,dim_input)输出矩阵形状:(n_samples,dim_output)注:真正测试/训练的时候,网络的输入和输出就是向量而已。加入n_samples这个维度是为了可以实现一次训练多个样本,求出平均梯度来更新权重,这个叫做Mini-batchgradientdescent。如果n_samples等于1,那么这种更新方式叫做StochasticGradientDescent(SGD)。Feedforward的输入输出的本质都是单个向量。常规Recurrent(RNN/LSTM/GRU)输入和输出:张量输入张量形状:(time_steps,n_samples,dim_input)输出张量形状:(time_steps,n_samples,dim_output)注:同样是保留了Mini-batchgradientdescent的训练方式,但不同之处在于多了timestep这个维度。Recurrent的任意时刻的输入的本质还是单个向量,只不过是将不同时刻的向量按顺序输入网络。所以你可能更愿意理解为一串向量asequenceofvectors,或者是矩阵。

相关内容

热门资讯

原创 中... 当全球的目光紧盯国际事务发展趋势时,特朗普正忙于打造属于自己的权力舞台,而中国则默默地投身于完善全球...
原创 白... 这两天,美国总统特朗普突然宣布要建立一个名为和平委员会的新机构,并向全球60多个国家发出了邀请函。白...
原创 特... 为了夺取格陵兰岛,特朗普真的是不惜一切代价。20日,他再次公开宣称,他夺取格陵兰岛的目标从未改变,并...
液冷公司顺利注册并拿下AMD打... 12月30日,美利信官方公众号发布文章称,重庆美利信科技股份有限公司与台湾创新企业“钜量创新绿能股份...