自己动手制作人工神经网络0x3:训练部分

今天来实现训练的功能,给ANN类添加一个train方法。
函数的参数第一个是输入的节点(inputs_list),数据类型是list;第二个参数是预期的输出节点的值(outputs_list),数据类型也是list。

首先,把两个参数传进来的list转换成numpy的array,转换后的大小是(list.size, 1)

然后,向上一篇文章一样,分别计算隐藏层和输出层,得到我们的输出(o_o)。

接着计算误差并反向传播。这里使用梯度下降的方式,误差函数是预期值与实际值的方差。这里直接给出梯度方程,即求误差函数相对于权重的斜率。
-(e_j)sigmoid(\sum_iw_{ij}o_i)(1-sigmoid(\sum_iw_{ij}o_i))o_i
ej表示下一层节点j的误差量;oi指上一层节点i的值。

在隐藏层到输出层的权重中ej为输出层的误差量eo=tj-oj
这里tj表示输出层节点j的期望值;oj表示输出层节点j实际值

在输入到隐藏的权重中ej按权重把隐藏层到输出层的误差量反向传播得到;
即ej=eh=who.T*eo

关于这个公式我会在系列文章最后更一篇详细解释。

    def train(self, inputs_list, outputs_list):

        # translation
        i = np.array(inputs_list, ndmin=2).T
        t = np.array(outputs_list, ndmin=2).T

        # hidden
        h_i = np.dot(self.wih, i)
        h_o = self.a_f(h_i)

        # output
        o_i = np.dot(self.who, h_o)
        o_o = self.a_f(o_i)

        # error
        o_e = t - o_o
        h_e = np.dot(self.who.T, o_e)

        # fix
        #r * ( (E*o*(1-o)) * lo.T)
        self.who += self.lr * np.dot(o_e * o_o * (1 - o_o), np.transpose(h_o))

        self.wih += self.lr * np.dot(h_e * h_o * (1 - h_o), np.transpose(i))

最后说一句,权重的更新方式是减去梯度方程的值,因为梯度值为正意味着权重需要减少才能减少误差函数的值。需要注意的是代码还把梯度值乘上了学习速率,这样可以控制权重更新的幅度。
这样,我们便完成了训练部分的功能。接下来,我还会继续更新如何使用这个ANN类,来完成手写数字识别的任务。

©著作权归作者所有,转载或内容合作请联系作者
【社区内容提示】社区部分内容疑似由AI辅助生成,浏览时请结合常识与多方信息审慎甄别。
平台声明:文章内容(如有图片或视频亦包括在内)由作者上传并发布,文章内容仅代表作者本人观点,简书系信息发布平台,仅提供信息存储服务。

相关阅读更多精彩内容

  • 学习《下班后写作 最有效的个人增值方法》 第一天学习记录 一只特立独行的猫~很早就听过这个名字,泡豆瓣的时候,知道...
    贺兰无极阅读 467评论 0赞 2
  • 闺女上园有两个多月了,每天背着小书包去上学,不哭不闹的,真有点准备十年寒窗的尽头儿,倒是让我们省心不少。 ...
    Air女王阅读 418评论 0赞 0
  • 今天是出差到深圳的第二个周日,是日本那边的ERP在深圳上线后第二次月结后的第一个周日。周末项目休息,于是窝在酒店。...
    小耳清涼阅读 724评论 0赞 0
  • 人是一个复杂的社会性动物,总是充满了各种各样的想法,但其实内在和外在常常发生冲突,本来,明明你内心不喜欢某件事某种...
    Gloriousyj阅读 403评论 0赞 0

友情链接更多精彩内容