作者:Chris Mellor
更新时间:2024年7月24日
戴尔提高了旗下数据湖仓的查询速度,添加并升级了连接器,改进了监控并提升了安全性。
今年三月,戴尔宣布让旗下AI产品组合中的数据湖仓使用Starburst Presto 查询引擎、Kubernetes组织的湖仓系统软件以及基于戴尔ECS、ObjectScale 或 PowerScale存储产品的横向扩展S3兼容对象存储。
Starburst在去年2月推出了Warp Speed 技术,以及Apache Lucene索引和缓存技术,声称它可以将基于文本的查询处理速度提高多达7倍。现在,它携手更多连接器和其他改进一起进入了戴尔的数据湖仓。
戴尔产品经理 Vrashank Jain 写道:“Warp Speed是Dell Data Lakehouse中的一项新功能,它可以自主学习查询模式并识别经常访问的数据,以创建最佳索引和缓存,同时将不常访问的数据保留在原地。”
它可以提高查询性能,“对于前20%的查询,性能可以提高3到5倍”。
无需数据工程即可自动为数据湖编制索引,并且可以使用查询加速构建和填充更高性能的面板。自主索引“为每个数据块创建适当的索引类型(位图、字典、树),从而加速联接、过滤器和搜索等操作。索引存储在计算节点的 SSD 上,可以快速访问。”
Jain写道:“智能缓存是一种专有的SSD列式块缓存,可根据数据使用频率优化性能。缓存消除了不必要的表扫描,并在查询之间提供了更多的数据重用,从而节省了计算成本。”
“借助 Warp Speed,最终用户无需对查询进行任何修改,同一集群就可以将数据湖查询的速度提高 3 到 5 倍。它还可以帮助将集群规模减少多达 40%。”客户可以在大型集群上运行更多查询,也可以在较小的集群上运行相同数量的查询。
Jain表示:“只有Dell S3 兼容存储上的数据湖支持”该Warp Speed功能。
戴尔还为数据湖仓添加了更多增强功能:
Warp Speed 包含在现有的 Dell Data Lakehouse 许可证中。计算节点的配置将进行修改,以包括已由戴尔测试和基准测试的SSD,支持Warp Speed索引和缓存。
潜在客户可以在戴尔演示中心访问戴尔的Data Lakehouse,很快还可以在客户解决方案中心访问戴尔的Data Lakehouse,以进行交互式探索和系统验证。客户和合作伙伴可以通过在演示中心创建一个免费帐户来试用。
好文章,需要你的鼓励
最新数据显示,Windows 11市场份额已达50.24%,首次超越Windows 10的46.84%。这一转变主要源于Windows 10即将于2025年10月14日结束支持,企业用户加速迁移。一年前Windows 10份额还高达66.04%,而Windows 11仅为29.75%。企业多采用分批迁移策略,部分选择付费延长支持或转向Windows 365。硬件销售受限,AI PC等高端产品销量平平,市场份额提升更多来自系统升级而非新设备采购。
清华大学团队开发出LangScene-X系统,仅需两张照片就能重建完整的3D语言场景。该系统通过TriMap视频扩散模型生成RGB图像、法线图和语义图,配合语言量化压缩器实现高效特征处理,最终构建可进行自然语言查询的三维空间。实验显示其准确率比现有方法提高10-30%,为VR/AR、机器人导航、智能搜索等应用提供了新的技术路径。
新一代液态基础模型突破传统变换器架构,能耗降低10-20倍,可直接在手机等边缘设备运行。该技术基于线虫大脑结构开发,支持离线运行,无需云服务和数据中心基础设施。在性能基准测试中已超越同等规模的Meta Llama和微软Phi模型,为企业级应用和边缘计算提供低成本、高性能解决方案,在隐私保护、安全性和低延迟方面具有显著优势。
IntelliGen AI推出IntFold可控蛋白质结构预测模型,不仅达到AlphaFold 3同等精度,更具备独特的"可控性"特征。该系统能根据需求定制预测特定蛋白质状态,在药物结合亲和力预测等关键应用中表现突出。通过模块化适配器设计,IntFold可高效适应不同任务而无需重新训练,为精准医学和药物发现开辟了新路径。