为推动Open Compute Project(OCP)项目,Facebook本周公布了最新名为Big Basin v2的GPU服务器设计。
OCP最早是由一群致力于通过开发共享知识产权来打造高效服务器、存储和数据中心的工程师社区建立起来的。诺基亚、英特尔、思科、联想、苹果和谷歌等公司都是OCP的成员。
Big Basin v2的结构与之前的Big Basin基本相同,但升级采用了Nvidia最新八款Tesla V100图形卡。Tioga Pass CPU单元被用于头节点,同时在CPU与GPU之间数据传输的PCIe带宽也翻了一番。
Facebook在一篇博客文章中表示,在增加了OCP网卡的带宽之后,单GPU性能与之前的Big Basin设计相比增加了66%。
这意味着研究人员和工程师可以构建更大规模的机器学习模型,更有效地进行训练和部署。 Facebook通过监控用户的互动,来预测特定用户将看到什么内容。
Facebook将机器学习用于新闻推送排名、个性化广告、搜索、语言翻译、语音识别、甚至是在上传的图片中为你的朋友推荐正确的标签。
大多数机器学习是通过Facebook的AI软件平台FBLearner运行的。
Facebook机器学习基础设施的数据通道。图片来源:Facebook
它分为不同的组件:Feature Store、Flow和Predictor。
Facebook解释说:“Feature Store根据数据和数据流生成特征并将其提供给FBLearner Flow。Flow则基于生成的特征来构建、训练和评估机器学习模型。”
“然后通过FBLearner Predictor把最终的训练模型部署到生产环境中。Predictor会对实时流量进行推断或预测。例如,它可以预测某人最关心的故事、帖子或照片。”
我们很感兴趣看看用于支持大型企业人工智能和机器学习的硬件蓝图是怎样的。这对Facebook来说意义重大,因为它实际上并不真正地参与AI Cloud竞争。谷歌或亚马逊等其他技术巨头可能不会乐于采用它的系统。
“我们相信,开放合作有助于促进未来设计的创新,并使我们能够构建更复杂的人工智能系统,最终支持沉浸式的Facebook体验。”
好文章,需要你的鼓励
后来广为人知的“云上奥运”这一说法,正是从这一刻起走上历史舞台。云计算这一概念,也随之被越来越多的人所熟知。乘云科技CEO郝凯对此深有感受,因为在2017年春节过后不久,他的公司开始成为阿里云的合作伙伴,加入了滚滚而来的云计算大潮中。同一年,郝凯带领团队也第一次参加了阿里云的“双11”活动,实现了800万元的销售业绩。
随着各行各业数字化变革的不断深入,人类社会正加速迈向智能化。作为智能世界和数字经济的坚实底座,数据中心也迎来了蓬勃发展。面