• 首页
  • 上一页
  • 目录
  • 下一页
  • 书架

《系统,我真不是苏联学霸》

第83章 这不科学!(爆更1.5w 3/3 求首订)
架构。」

    陈工和曾工吃惊地看着他。

    他昨天和陈工走的时候,漆昊明明还在为LRN的显存冲突和反向传播的写冲突折腾得眉头紧锁。

    他们都以为漆昊肯定放弃了,可听这家夥的意思,他昨晚不仅没放弃,反而把所有算子都写完了?!

    齐教授作为严谨的资深学者,本能地对漆昊的话产生了怀疑,他开口:「小漆,用GPU训练神经网络,这在目前的视觉和控制领域并不是主流,哪怕是斯坦福吴恩达团队的那篇论文,也只是在特定的实验室环境下做出的探索,在实际工程中根本无法大范围推广。」

    「GPU的显存带宽瓶颈和复杂的CUDA编程调试成本,注定了它难度非常高,你就算写出了一些测试代码,由於频繁的数据拷贝,最後跑出来的实际效率,恐怕也不会比多核CPU好到哪里去。」

    「齐教授,我昨晚用GPU训练,其实已经跑出了一批完整的数据,就目前的结果来看,它的效率比CPU要好。」

    看着漆昊那自信的样子,齐教授只好说:「既然你连数据都跑出来了,那我们今天也别在这干坐着了,去你工位上看看。」

    一群研究生和两位工程师,立刻屁颠屁颠地跟在齐教授和漆昊身後,涌向了漆昊的工位。

    当齐教授走到那台崭新的工作站前,看到旁边那个硕大的1200W电源时,他脚步一顿,看向了陈工。

    陈工假装在看天花板上的灯,一句话都不敢多说。

    漆昊没有在意这些,他坐下来,滑了滑滑鼠,唤醒了暗下去的屏幕。

    此时,屏幕上正显示着一个用C写的简易控制台界面,上面还残留着最终训练日志。

    「齐教授,这是我实验室里现成的数据集进行的测试,一共10000张。」

    「我看了下相关日志,在之前使用的伺服器CPU上,运行一个Epoch的训练耗时,平均在一个小时左右。」

    齐教授微微颔首:「没错,一个小时,这已经是优化後的极限了,想要训练到一个勉强可用的精度,至少需要叠代10个Epoch,那就是将近十三个小时。」

    「是的。」漆昊微微一笑,「所以我昨晚尝试了新的方法,这是昨晚我运行10个Epoch的实时训练输出日志,您可以看一下。」

    漆昊轻敲回车,拉动滚动条,将昨晚的训练控制台日志呈现在所有人面前。

    【Training Epoch10/10】

    【TotalTrainingTime:1小时28分27秒】

    「这时间坏了吧?」陈工脱口而出。

    齐教授顾不上教授的体面,半蹲着身子,开始快速翻看编译日志和CUDA运行态监控。

    屏幕上的实时数据显示得清清楚楚:GPU利用率在训练期间长期维持在93.2%的数值。

    双卡显存占用稳定,没有发生任何一次显存溢出。

    PCle总线带宽利用率极低,说明绝大部分计算都在显存内部的高速cache中完成的。

    而最终模型在测试集上跑出来的89.4%的识别率,更是铁一般的事实,做不了任何假I

    「你用的什麽显卡?」

    "GTX580。

    「6

    游戏显卡?

    在传统的CPU伺服器上,需要不吃不喝,辛辛苦苦跑上整整13个小时才能完成的训练闭环。

    在这个少年的编程下,两块被所有人视为不务正业的游戏卡,居然把训练时长压缩到了一小时二十八分钟!

    「我们现在可以重新测试一个数据集吗?」

    「当然可以,反正也花不了多长时间。」漆昊

    -->>(第3/5页)(本章未完,请点击下一页继续阅读)
  • 加入书签
  • 上一页
  • 目录
  • 下一页
Copyright shukugu.com 返回首页
顶部