本次的数据湖评测,是信通院推进的国内首家数据湖标准评测,共涉及存储能力、计算能力、安全能力、数据管理能力、兼容能力、运维能力、湖应用能力、高可用能力八个能力域。阿里云及国内友商等都参与标准设计,最终阿里云以得分排名第一的标准考核荣获云原生数据湖专项评测证书。国内首批!得分排名第一!
随着各行业数字化转型不断深入,基于数据驱动的业务场景不断涌现,企业开始产生“多样数据源统一存储、数据统一管理、业务高低峰资源动态调配”等需求。而数据湖是一个统一存储池,支持结构化、半结构化、非结构化等多种格式存储海量数据,同时具有低成本、可拓展性强、灵活高效等特性,越来越多企业选择数据湖作为企业数据存储、管理的解决方案。
近年来Hudi、Iceberg、Delta Lake三大开源数据湖的面世推动数据湖整体进入产品化阶段。与此同时,与容器、Serverless等云原生技术的深度融合,引领数据湖产品开始走向云原生。云原生数据湖支持异构数据灵活存储、计算资源弹性伸缩,能够帮助企业应对当前数据结构愈发复杂、数据处理分析时效性要求不断提高的业务环境。
2022年3月29日-3月31日,在中国信通院组织的第十四批“可信大数据”产品能力评测中,阿里云计算有限公司顺利完成了首个云原生数据湖评测。
参与此次评测的是阿里云云原生数据湖产品,包括云原生开源大数据平台 E-MapReduce、数据湖构建 DLF(Data Lake Formation)、对象存储 OSS 以及 DataWorks等产品。整个产品体系提供“统一元数据管理、数据入湖、数据存储、缓存加速、弹性计算、容器、数据分析、任务编排、运维管理,以及安全”等全面数据湖能力。
E-MapReduce
开源大数据平台 E-MapReduce(简称“EMR”)是云原生开源大数据平台,向客户提供简单易集成的Hadoop、Hive、Spark、Flink、Presto、Clickhouse、StarRocks、Delta、Hudi、HBase 等开源大数据计算和存储引擎。EMR 计算资源可以根据业务的负载情况做动态调整,EMR可以部署在阿里云 ECS 和 ACK 上。
数据湖构建 DLF
数据湖构建(Data Lake Formation,DLF)作为云原生数据湖架构核心组成部分,帮助用户快速构建云原生数据湖解决方案。数据湖构建DLF提供数据入湖、湖上元数据统一管理、企业级权限控制,并无缝对接多种计算引擎,打破数据孤岛,洞察业务价值。
对象存储OSS
阿里云对象存储OSS(Object Storage Service)提供海量、安全、低成本、高可靠的云存储服务,提供99.9999999999%(12个9)的数据持久性,99.995%的数据可用性。多种存储类型供选择,全面优化存储成本。
DataWorks
DataWorks 提供智能数据建模、全域数据集成、高效数据开发、主动数据管理、全面数据安全、快速数据服务六大全链路大数据开发治理能力,帮助企业快速构建数据中台。
企业可以基于 DataWorks + E-MapReduce + DLF + OSS 在云上轻松构建一套完整的数据湖解决方案,目前阿里云已经与互娱、游戏、金融和在线教育等行业客户携手,通过数据湖解决方案加速企业内部数据应用的创新。
好文章,需要你的鼓励
甲骨文云基础设施与xAI达成合作,OCI将为企业客户托管xAI的Grok模型。此次合作使Grok 3等模型可供以数据为中心的客户群进行训练和推理,支持Nvidia和AMD加速器。OCI采用独特的AI策略,专注于企业数据需求,保持模型和工具的不可知论立场,让生态系统合作伙伴专注于提供工具,而OCI确保体验的无摩擦、高性能和安全性。
华为诺亚实验室联合多家顶尖院校推出开源机器人编程框架Ark,通过Python优先设计和模块化架构,实现仿真与现实环境的无缝切换。该框架大幅降低机器人编程门槛,支持现代AI技术集成,为机器人学习研究提供统一平台,有望加速机器人技术普及。
量子计算何时能商用化仍是行业关注焦点。专家指出,除了逻辑量子比特和错误纠正技术,量子计算系统还面临诸多挑战:激光器缺乏相干性、稀释制冷机难以适应数据中心环境、系统可扩展性不足等硬件问题。此外,量子计算机需要达到99.999%的运行时间要求,编程易用性和与传统高性能计算的混合架构复杂性也有待解决。
网易有道研究团队开发了Confucius3-Math,这是一个专门针对中国K-12数学教育的14B参数AI模型。该模型在多项数学推理测试中表现出色,超越了许多规模更大的竞争对手,训练成本仅需2.6万美元,推理速度比DeepSeek-R1快15倍,能在消费级GPU上高效运行,旨在通过降低AI教育成本来促进教育公平。