得很好,这笔收购很干净。”
“这都是按您的战略计划走的。”
安德森停顿了一下,随后语气变得格外认真,主动提了另外一件事。
“另外,老板,关于您上次交代的关于深入英伟达CUDA架构的硬件与算法研究小组,目前有了实质性进展。”
林辰瞬间坐直了身体,目光微凝:“详细说说。”
“我们通过猎头,直接从英伟达的底层架构团队、以及斯坦福大学并行计算实验室里,挖到了整整十二名顶尖工程师。”
“按照目前的进度,我们在圣克拉拉租用了一间高规格的独立实验室,利用早期采购的一批英伟达Fermi架构显卡,成功组建了一个由一百二十八块GPU组成的小规模并行计算原型集群。”
“但正如我之前预料的那样,工程上遇到了非常棘手的麻烦。”
安德森实事求是地向林辰汇报技术现状:
“现在的硬件环境下,显卡的功耗和发热量极其惊人,我们的散热系统几乎每天都要报警,更致命的是,英伟达现在的CUDA开发工具非常原始,几乎没有任何成熟的现成算法库。”
“这十二名工程师现在必须像几十年前的先驱一样,纯手工用C语言去一行一行重写底层的矩阵并行乘法代码。”
“研发过程非常枯燥,甚至可以说是举步维艰。”
说到这里,安德森的声音突然透出一股难以掩饰的狂热:“但是,老板!”
“就在昨天夜里,我们的小组用手工编写的并行代码,在这一百多块显卡组成的集群上,进行了一次高密度的非线性浮点矩阵运算测试!”
“您知道结果是什么吗?!”
安德森在电话那头握紧了拳头,声音甚至有些颤抖。
“它的矩阵乘法运算吞吐速度,比我们机房里用八颗英特尔顶级四核至强CPU组成的计算阵列,整整快了将近十四倍!”
“十四倍的算力代差!”
“当那些工程师看到屏幕上的测试结果时,整间实验室里的人全疯了!”
“他们以前一直觉得显卡只是用来给游戏渲染3D贴图的玩具,直到昨晚他们才真正看明白,这玩意儿只要把指令集重构,就是一台专为并行计算而生的怪兽!”
本章未完,请点击下一页继续阅读!