“你这里说的深度神经网络指的应该是你自己提出的那种上百上千层的神经网络,而不是目前业界的深度网络吧?”
付院长转过头来,微笑问道。
“付院长您是怎么..”
孟繁岐先是愣了一下,然后猛地反应过来,目前只有那个女生看到过自己提前准备的残差网络草稿。
“是那个女生跟您说的?”
“哈哈哈,她是我的小师妹。”
付院长笑道,“前段时间来这里,也顺便来拜访了我一下,提到了我们学校有个学生在研究什么深百层千层的神经网络,研究得像模像样的。”
“说实在的,这也不是我的领域,如果不是以前的老师让我关注一下这方面,我还真是一窍不通。
这两天我还在查询资料呢,我说这哪有什么上百层的神经网络,去年年底那个夺冠的AlNet不也才8层的深度吗。”
“我也只是刚刚有一些想法。”
孟繁岐连忙解释道。
“你不用紧张,我只是稍微有些好奇,想看看咱们学校到底是不是出了个这方面的天才。
若是真的,我肯定大力支持。”
();() 孟繁岐连忙先请付院长坐下,先为他大概介绍了一下背景,原理和现阶段难题。
付院长本身是纯数学出身,此前又在老师的指示之下对这个领域稍稍了解过一些,因此孟繁岐没说太多,他就已经掌握了大概。
“你认为深度网络难训练的问题本质上是梯度问题,所以你想使用残差的形式。”
付院长喃喃自语,左手握拳,撑住了自己的下巴。
“如果不去深究神经网络本身的变换,而只是将其的变换理解为一个未知的高维函数的话,f(x)的多次累加会比x+f(x)的残差形式要不稳定太多。”
孟繁岐后世主要以理解算法的流程,了解几种对比方法的优缺点为主。
对于其具体的内在原理,数学推导,平心而论,他的关心远远不足。
现下正是弥补这部分短板的大好机会。
“如果我们讨论一个函数的多次嵌套,f(f(f(f(..f(x)..))))的话,不管是否是残差的形式,都是相当难以分析的。
从数学上直观来看,两个相同次数的嵌套,有残差与否,不应当会改变该函数的实际表达能力。
也就说,你构建的模型其对函数拟合的能力是与原本相当的。”
“倘若真的可以观察到明显的改善,那说明这种残差的形式只是能够让你所说的模型更容易被优化。
换言之,以我的视角来说,该函数的求解变得更加精确了,从这个角度来看,残差是一种简洁的欧拉前向形式。”
付德清说着,拿起了纸笔开始了一些推演。
孟繁岐疏于数学上的推演,但他很熟悉这种形式构建的网络有什么特性,因而越听越觉得惊奇。
付院长的数学分析竟然相当接近不少后来的实验结果。
只可惜自己看他亲自上手推论,却稍微有些吃力了。
此时此刻和他一样一头雾水的还有附近竖起耳朵吃瓜的几名高年级学长学姐。
十年前我们于星空下相遇,我用机械的手指与你拉钩,共同许下明天的承诺。十年后我们在星空下相逢,虽然你早已忘记我的一切,但我还是愿意燃烧自己,只为兑现迟到了十年的承诺。因为从我们相遇的那一刻起,你便成为...
穿越到另一个平行空间的地球,这里和原来的世界历史完全一样,只是11年前,科学家做实验打开虫洞后,引发了一系列的变故,地球充满了一种叫灵能的能量,全部生物都进化了,而且地球上随机会出现未知的空间虫洞。沈...
路人甲目露怜悯之色真可怜,年纪轻轻就得了白内障。我的视角有三百六十度路人乙神色惋惜真可惜,长得这么帅却眼神儿不好。我能看到一公里以外路人丙摇了摇头,扔下几块硬币离开了。...
作为一个喜爱虐主的作者,刘攀表示怎么伤读者的心怎么写,怎么虐主怎么来。奈何,上天有好生之德,在又一本毒书即将完结的之时,他穿越了,变成了自己笔下连名字都木有的一个跑龙套。为穿越暗暗窃喜的刘攀表示哼,真以为我会跟着套路走吗?当然是抢钱抢法宝抢女人了,然而,当初未填完的巨坑狠狠打了他的脸另外书友裙246825550...
康熙三十年大选,乌林珠身为乌拉那拉家的嫡女,进宫选秀。目睹了四阿哥的热门抢手,各种秀女争奇斗艳后,她默默地同情了一把未来的四福晋,做等撂牌子回家。谁知道等来的却是她即将成为那倒霉的四福晋的暗示。没等...
卖红酒的小老板陈咬之穿越到了异能千奇百怪的星际世界。总有一本喜欢之乎者也的成语词典逼迫他装逼。陈咬之表示拒绝我只想当一个卖红酒的普通人。然而,新店开张。陈咬之先生您好,请问您要赤霞珠,梅洛还是西拉...