为推动Open Compute Project(OCP)项目,Facebook本周公布了最新名为Big Basin v2的GPU服务器设计。
OCP最早是由一群致力于通过开发共享知识产权来打造高效服务器、存储和数据中心的工程师社区建立起来的。诺基亚、英特尔、思科、联想、苹果和谷歌等公司都是OCP的成员。
Big Basin v2的结构与之前的Big Basin基本相同,但升级采用了Nvidia最新八款Tesla V100图形卡。Tioga Pass CPU单元被用于头节点,同时在CPU与GPU之间数据传输的PCIe带宽也翻了一番。
Facebook在一篇博客文章中表示,在增加了OCP网卡的带宽之后,单GPU性能与之前的Big Basin设计相比增加了66%。
这意味着研究人员和工程师可以构建更大规模的机器学习模型,更有效地进行训练和部署。 Facebook通过监控用户的互动,来预测特定用户将看到什么内容。
Facebook将机器学习用于新闻推送排名、个性化广告、搜索、语言翻译、语音识别、甚至是在上传的图片中为你的朋友推荐正确的标签。
大多数机器学习是通过Facebook的AI软件平台FBLearner运行的。
Facebook机器学习基础设施的数据通道。图片来源:Facebook
它分为不同的组件:Feature Store、Flow和Predictor。
Facebook解释说:“Feature Store根据数据和数据流生成特征并将其提供给FBLearner Flow。Flow则基于生成的特征来构建、训练和评估机器学习模型。”
“然后通过FBLearner Predictor把最终的训练模型部署到生产环境中。Predictor会对实时流量进行推断或预测。例如,它可以预测某人最关心的故事、帖子或照片。”
我们很感兴趣看看用于支持大型企业人工智能和机器学习的硬件蓝图是怎样的。这对Facebook来说意义重大,因为它实际上并不真正地参与AI Cloud竞争。谷歌或亚马逊等其他技术巨头可能不会乐于采用它的系统。
“我们相信,开放合作有助于促进未来设计的创新,并使我们能够构建更复杂的人工智能系统,最终支持沉浸式的Facebook体验。”
好文章,需要你的鼓励
谷歌研究团队推出VaultGemma,这是其首个采用差分隐私技术的大语言模型。该模型基于Gemma 2构建,拥有10亿参数,通过在训练阶段引入校准噪声来防止模型"记忆"敏感用户数据。研究团队建立了差分隐私缩放定律,平衡计算预算、隐私预算和数据预算。尽管添加差分隐私会影响准确性,但VaultGemma在性能上与同规模非私有模型相当。该模型现已在Hugging Face和Kaggle平台开放下载。
香港中文大学联合上海AI实验室推出Dispider系统,首次实现AI视频"边看边聊"能力。通过创新的三分式架构设计,将感知、决策、反应功能独立分离,让AI能像人类一样在观看视频过程中进行实时交流,在StreamingBench测试中显著超越现有系统,为教育、娱乐、医疗、安防等领域的视频AI应用开启新可能。
英国宽带服务商Olilo正式推出多千兆宽带服务,专门面向技术人员、工程师、系统管理员和家庭实验室爱好者。该公司自建Layer 2网络基础设施,提供对称多千兆宽带,支持静态IPv4地址和原生IPv6。Olilo与伦敦三大互联网交换中心建立对等连接,在英国对等网络中排名第24位。服务经过150多名技术用户的付费封闭测试,并通过Discord社区持续收集用户反馈优化服务。
Atla公司发布Selene Mini,这是一个仅有80亿参数的AI评估模型,却在11个基准测试中全面超越GPT-4o-mini。通过精心的数据筛选和创新训练策略,该模型不仅能准确评判文本质量,还能在医疗、金融等专业领域表现出色。研究团队将模型完全开源,为AI评估技术的普及和发展做出贡献。