手机浏览器扫描二维码访问
相比效果显著,非常出色的老虎算法,移动端优化排序算法的效果要稍差一些。
因而孟繁岐并没有急着推动上线测试,而是等待结合AI语言解释模型的那一个更新准备一起推动。
目前针对语言问题所采用的通常是循环神经网络(RNN)和长短期记忆办法(LSTM),这两个工作都是上个世纪末的老办法了。
这两种方法简明好用,因而一直兴盛到2017年左右。
直到Transformer,也就是ChatGPT的T方法出现。
通常来说,大家都认为Transformer方法之所以能够迅速取代RNN和LSTM,主要是因为它更方便并行进行。
在多个设备上容易做到并行,这件事最核心的意义便是让规模庞大的版本成为可能,这也为后来ChatGPT这样的究极巨无霸模型奠定了基础。
“其实老版的RNN也有办法可以把并行做得很好,领域内对这件事有很大的误解。”孟繁岐皱着眉头思索道。
原本时间线,Transformer出来之后,所有人都放下了手头老方法的研究,拥抱了T方法。
可18年实际上有人专门做了RNN的高度并行,只可惜已经太迟了。
如果这个发现可以早一年的时间,可能RNN会长期作为T办法的竞争对手,我们也有可能看到ChatRNN的出现。
“早期的T方法需要很多数据,各种参数比较难调整,需要的计算能力也很庞大。”孟繁岐即便根据后来成熟的许多方法做了一个改进的版本,T方法在早期仍旧比较麻烦。
“好在谷歌的数据和算力都不缺,而我也比较熟悉各种经典的参数设置。”孟繁岐先写了一个雏形版本的T方法,进行了一下测试。
“不过,受限于现在显卡的显存,模型没有办法做得很大,除非我专门再去开发DeepSpeed这样的高级并行方式。”
在多张卡上训练模型,可能是为了追求速度,也可能是因为一张卡上放不下了。
其中,数据并行是最简单的,也就是不同的卡都在做同样的事情,每张卡上都会存放一个模型。
只不过输入的数据不一样,不同的卡做完运算之后,再一起整合更新。
就像是所有人都拿了同样的刀切不同的菜,最后把切好的食材堆在一起。
可有的时候,一张卡上根本就放不下模型,这样的情况就比较麻烦了。因为一个人根本拿不动这把刀了,需要多人协作。
可以把每一层拆分到不同的卡上,也可以把不同层分配到不同的卡上,如此一来,其实是用多卡实现了类似单卡训练的效果。
显然,前者会比后者容易非常多,前者只需要在不同卡上复制这些模型,分别读取数据做运算就好。
而后者则需要根据不同的情况和设置拆分合并,一个不小心就会搞错。
看了下谷歌大脑的服务器,里面有好几批2013款的GTX泰坦,这东西着实价值不菲。
考虑到当时的其他产品,6G的显存还是鹤立鸡群的。
比起孟繁岐自己重金购置的4G旗舰款,多出的2G显存,足够做很多其他的事情了。
用速度换显存,孟繁岐又做了许多参数和信息在Cpu和Gpu上反复转移的操作。
因为在正式入职之前,谷歌大脑分配给他的显卡就已经有16张泰坦,这部分卡拨给孟繁岐独享,随时都可以使用。
除此之外,还有32张在不同节点上的Gpu可以申请占用。
我在美国开诊所 学渣被家访,老爹竟是文坛巨佬 没有前世的我,只好成为在世剑仙 年代:小日子过的真好 李念洛薇 都市桃花医仙 变成幼龙被女团捡到,我震惊全网 重筑2005 我睡后混成大明星 家族修仙:我能看到提示 我有十万亿舔狗金 四合院之我是许多年 我是导演,我不比烂 导演的快乐你不懂 真话系统:我成了反向选秀顶流 从轻小说作家开始的完美人生 万族之尊 超品兵王在都市 神豪:抽奖万亿,清纯校花当场跪舔! 百妖食谱:论妖兽的烹饪技巧
新书从获得奇遇点开始宇宙深处飞来一座浩瀚无垠的大陆,从此整个世界都不一样了。同时陈荣火脑海里还突然出现了一本古书,按照古书的指引,他提前其他人三百年登陆到了新界。同样在书籍的指引下,在新界中,他的左手也变得不一样了。他从地下挖出一颗夜明珠,啪的一声,夜明珠被他捏碎,但是夜明珠的‘夜光属性’却留在了他手里。琢磨了...
蜀山有玄门正宗,一家独大。主角修炼的是魔门正宗。群号紫云宫22117110。...
李逸飞,大唐前太子李贤之子,因其父被武则天毒害,从小就被逍遥老人收养,十年之后,学艺有成的李逸飞下山报仇,最后经过与武则天的一番较量终于将女皇降服,成功光复李唐江山,揽江山美人于一身,享受人间帝王之风流。...
穿越成为火影中的奈良鹿丸!因穿越加上‘星’的能力,精神力强大到惊粟!觉醒血继限界‘影瞳’!ltBRgt先是小小的复制一套影忍法!再觉醒万花筒,剥夺影子!强者尾兽的影子一个也不放过,佐助更是憋屈的挂掉!大小美女更是一个也不放过…...
中原武林大地北有天芳谱七朵名花,南有美人图十二美人!武林之中,侠女成风,我一出世,无一落空。皇帝本多情,情深意更浓,武林有南北,皇帝就是我。...
新码的西南崛起已经上传,欢迎各位亲移驾亲临。这是一个令人发指的故事,这是一个令人发指的人。不说他其它的成就,大学刚毕业,他在纳斯达克,就已经有了两家上市公司,不对,他最近又收购了一家上市公司,哦,还在计划收购另一家。身后,还有一大堆投行追赶着,你的这家网站,什么时候上市?广大投资者也说,这样的网站,一定要接受公...