LSTM神经网络输入输出究竟是怎样的?
创始人
2024-11-08 04:18:30
LSTM神经网络输入输出究竟是怎样的?

常规feedforward输入和输出:矩阵输入矩阵形状:(n_samples,dim_input)输出矩阵形状:(n_samples,dim_output)注:真正测试/训练的时候,网络的输入和输出就是向量而已。加入n_samples这个维度是为了可以实现一次训练多个样本,求出平均梯度来更新权重,这个叫做Mini-batchgradientdescent。如果n_samples等于1,那么这种更新方式叫做StochasticGradientDescent(SGD)。Feedforward的输入输出的本质都是单个向量。常规Recurrent(RNN/LSTM/GRU)输入和输出:张量输入张量形状:(time_steps,n_samples,dim_input)输出张量形状:(time_steps,n_samples,dim_output)注:同样是保留了Mini-batchgradientdescent的训练方式,但不同之处在于多了timestep这个维度。Recurrent的任意时刻的输入的本质还是单个向量,只不过是将不同时刻的向量按顺序输入网络。所以你可能更愿意理解为一串向量asequenceofvectors,或者是矩阵。

相关内容

热门资讯

全国社保基金理事会原副理事长王... 全国社保基金理事会原副理事长王忠民认为,“十五五”将是一个关键转换期。居民财富的增长逻辑将从依赖单一...
和讯投顾李嘉乐:商业航天ai电... 市场常见规律呈现为“周五上涨主线明确,周末相关题材舆情升温”。就本周周末消息面而言,“能源强国”战略...
科大讯飞中标:中电信人工智能科... 证券之星消息,根据天眼查APP-财产线索数据整理,根据中电信人工智能科技(北京)有限公司12月11日...
【抖音推出“AI时代前沿学科共... 【抖音推出“AI时代前沿学科共建计划”,百门名校公开课助推知识普惠】近日,抖音正式宣布启动“AI时代...
微软AI部门CEO苏莱曼谈硅谷... IT之家 12 月 14 日消息,硅谷人才争夺战持续升温,各大科技公司竞相争抢顶尖人工智能人才。然而...