开源软件推荐

_相关内容

配置自定义软件

如果您需要调整这些服务的配置项,则可以使用软件自定义配置功能,以修改现有配置或添加新的配置项。创建集群时配置 登录 E-MapReduce控制台。在顶部菜单栏处,根据实际情况选择地域 和资源组。在EMR on ECS页面,单击 创建集群。在 软件...

Alluxio(仅对存量用户开放)

Alluxio是一个面向基于云的数据分析和人工智能的开源的数据编排技术。Alluxio为数据驱动型应用和存储系统构建了桥梁,将数据从存储层移动到距离数据驱动型应用更近的位置,从而能够更容易被访问,同时使得应用程序能够通过一个公共接口连接...

E-MapReduce Serverless StarRocks服务等级协议(SLA...

2023年6月1日起,E-MapReduce Serverless StarRocks服务等级协议(SLA)生效。详情请参见 开源大数据平台E-MapReduce Serverless服务等级协议。

技术支持的范围和方式

关于阿里云EMR Serverless Spark产品和服务的相关问题,您可以通过以下渠道寻求支持和解决。...填写相关问题信息,产品分类 选择 开源大数据平台 E-MapReduce。单击 提交。售后服务SLA 售后服务SLA详情,请参见 企业支持计划 的内容。

授权信息

本文为您介绍 开源大数据平台 E-MapReduce 为 RAM 权限策略定义的操作(Action)、资源(Resource)和条件(Condition)。开源大数据平台 E-MapReduce 的 RAM 代码(RamCode)为 emr-serverless-spark,支持的授权粒度为 操作级。权限策略...

数据开发工作台(已停止新购)

如果您在2022年2月21日21点前未使用过数据开发功能,推荐您通过EMR Workflow进行数据开发,详情请参见 什么是EMR Workflow。如果您在2022年2月21日21点前使用过数据开发功能,需要继续在EMR上使用数据开发功能,建议您尽快迁移到EMR ...

内置函数

内置函数清单 Serverless Spark 兼容开源内置函数的使用,开源具体函数说明请参见 Spark SQL Functions。此外,Serverless Spark 还支持多个特有内置函数,以下是特有支持的内置函数及其相关说明。函数 说明 PARQUET_SCHEMA 获取Parquet...

Impala

当某一个Impalad进程由于节点异常、网络异常或软件问题等导致节点不可用时,StateStore确保将状况结果通知其他Impalad进程,当有新的查询请求时,Impalad进程将不会发送查询请求到该不可用的节点。Catalogd 部署在Master节点的master-1-1...

关键缺陷通知

P1:推荐升级,提前规避相关问题。P2:选择性升级,偶尔会出现问题,此类问题通常可以通过适当的改写方法或重启操作来修复。2025年08月 缺陷描述 缺陷等级 缺陷原因 实例类型 出现版本 规避建议 FE节点无法启动 P0 FE Replay线程异常删除...

管理日志

E-Mapreduce(简称EMR)开源组件运行过程中会产生大量的日志。日志管理功能将EMR与日志服务SLS相结合,允许您在EMR控制台直接查询开源组件的日志。前提条件 已在EMR控制台上创建集群,具体操作请参见 创建集群。已 开通日志服务。使用限制 ...

OpenLDAP 用户管理

EMR用户可以用于访问链接与端口,查看开源组件Web UI时的用户身份认证,也可以在开启组件LDAP认证之后进行身份认证。如果将Ranger的用户源设置为LDAP,则可以对用户管理中的用户进行权限控制。如果是高安全集群,EMR用户可以用于Kinit操作...

HDFS Web UI介绍

访问HDFS Web UI 您可以通过SSH隧道和控制台两种方式访问HDFS Web UI,具体操作请参见 通过SSH隧道方式访问开源组件Web UI 和 访问链接与端口。NameNode服务地址 版本 访问地址 说明 hadoop 3.x http://${namenode_hostname}:9870${...

查看集群资源概览

您可以参考推荐规则为集群节点组配置弹性伸缩,具体操作请参见 创建自定义弹性伸缩策略、创建托管弹性伸缩策略。方式二:查看YARN详细指标数据 进入指标监控页面。登录 EMR on ECS。在顶部菜单栏处,根据实际情况选择地域 和资源组。单击...

EMR Serverless Spark商业化公告

产品优势如下:云原生极速计算引擎 内置Fusion Engine(Spark Native Engine),相对开源版本性能提升300%。内置Celeborn(Remote Shuffle Service),支持PB级Shuffle数据,计算资源总成本最高下降30%。开放化的数据湖架构 支持计算存储分离...

OSS/OSS-HDFS

JindoData是阿里云开源大数据团队自研的数据湖存储加速套件,面向大数据和AI生态,为阿里云和业界主要数据湖存储系统提供全方位访问加速解决方案。JindoData套件基于统一架构和内核实现,主要包括 JindoFS 存储系统(原JindoFS Block模式)...

EMR Serverless StarRocks商业化发布

EMR Serverless StarRocks介绍 EMR Serverless StarRocks是开源StarRocks在阿里云上的全托管服务,您可以通过其灵活地创建和管理实例以及数据。本文为您介绍StarRocks的核心特性,并详述EMR Serverless StarRocks在此基础之上所引入的诸多...

STREAM语句

背景信息 E-MapReduce支持SET和STREAM两种方法配置WriteStream参数,推荐使用STREAM方法配置WriteStream的必要参数,包括checkpointLocation、outputMode、triggerType和triggerIntervalMs。语法 CREATE STREAM queryName OPTIONS...

安装第三方插件

EMR集群中Flume的软件安装目录为/opt/apps/FLUME/flume-current/lib。方式三:上传第三方的JAR包至$FLUME_HOME/plugins.d/目录下。相关的目录:$FLUME_HOME/plugins.d/lib:插件本身的JAR包。FLUME_HOME/plugins.d/libext:插件依赖的JAR包...

SDK下载

我们推荐您采用Maven的方式来管理您的工程。Maven依赖 dependency groupId ...

授权信息

本文为您介绍 开源大数据平台 E-MapReduce 为 RAM 权限策略定义的操作(Action)、资源(Resource)和条件(Condition)。开源大数据平台 E-MapReduce 的 RAM 代码(RamCode)为 emr,支持的授权粒度为 资源级。权限策略通用结构 权限策略...

EMR Workflow商业化公告

EMR Workflow介绍 EMR Workflow是一个全托管的工作流和任务调度服务,100%兼容开源Apache DolphinScheduler。它提供了易于使用的调度服务,您可以通过可视化的操作界面轻松地管理工作流和任务,高效构建数据仓库,并为生产任务的稳定运行...

Python使用说明

EMR-2.10.0和EMR-3.10.0之前版本默认不支持Python 3版本,您需要自行下载安装,步骤如下:下载Python 3软件包:Python-3.6.4.tgz。使用文件传输工具(SSH Secure File Transfer Client),上传JAR包至Master节点的/usr/local 目录。解压...

EMR对接外部KDC

在创建集群的 软件配置 阶段,打开 高级设置 区域的 Kerberos身份认证 开关。单击 外部KDC。默认是 本群自建KDC,即当前集群为您创建KDC。使用您外部自建的KDC,需要填写以下信息。参数 描述 KDC Hosts KDC的IP地址和端口。多个IP地址时,...

什么是EMR Serverless Spark

同时,它100%兼容开源Spark生态,能够无缝集成到客户现有的数据平台。通过使用EMR Serverless Spark,企业可以更加专注于数据处理分析及模型训练的优化,从而提升工作效率。前置概念 阅读本文前,您可能需要了解如下概念:什么是云原生?...

访问HBase

HBase配置 您可以在创建HBase集群的 软件配置 页面,利用 高级设置 的 软件自定义配置 功能,结合使用场景,修改HBase的默认参数,示例如下。{"configurations":[{"classification":"hbase-site","properties":{"hbase.hregion.memstore....

EMR Kafka配置说明

KAFKA_HOME Kafka Broker软件安装目录。LOG_DIR_ROOT EMR集群服务日志根目录。KAFKA_ZOOKEEPER EMR Kafka ZooKeeper访问路径。例如,master-1-1.c-0e6a8cxxxxxxxxxx.cn-hangzhou.emr.aliyuncs.com:2181/emr-kafka。KAFKA_CONF_DIR Kafka ...

请求结构

为了获得更高的安全性,推荐您使用HTTPS协议发送请求。涉及敏感数据时,如用户密码和SSH密钥对,推荐使用HTTPS协议。请求方法 支持HTTP GET方法发送请求,这种方式下请求参数需要包含在请求的URL中。请求参数 您需要通过 Action 参数指定...

EMR元数据迁移公告

数据湖元数据DLF是阿里云提供的统一元数据服务,具有高可用、免运维和高性能等优点,兼容Hive Metastore,无缝对接EMR上开源计算引擎,并支持多版本管理和Data Profile功能。另外,DLF还支持数据探索、湖管理和数据权限控制等功能,并与...

初始化

背景信息 OpenAPI开发者门户 提供在线调试API和动态生成SDK示例代码的功能,能显著降低API的使用难度,推荐您使用。环境准备 在Eclipse项目中使用阿里云E-MapReduce OpenAPI Java SDK。请确保代码运行环境设置了环境变量ALIBABA_CLOUD_...

查看集群列表与详情

软件信息 该区域为您展示集群版本、集群类型、软件信息和Hive元数据类型等信息。网络硬件 该区域为您展示可用区、专有网络和硬件配置等信息。安全 该区域为您展示密钥对、ECS实例角色、集群安全组和集群服务角色等信息。相关文档 查看集群...

组件操作

EMR提供的组件包括开源和自研两大类,涵盖数据开发、计算引擎、数据服务、资源管理、数据存储、数据集成等领域,您可以按需选择和配置。说明 在创建集群时,如果没有您想使用的组件,或者想使用的开源组件仅对存量用户开放,您可以自行安装...

创建Data Science集群

产品版本 默认最新的软件版本。组件版本 展示集群类型下的组件及组件版本信息。ACK集群 选择已有的ACK集群,或者在容器服务ACK控制台新建ACK集群。说明 Data Science集群会使用如下命名空间(Namespace),包括anonymous、cert-manager、...

管理集群模板

EMR集群模板可持久化保存集群配置(如软件版本、实例类型等),实现一键创建相同配置的集群,避免重复操作。该功能适用于需要快速部署测试环境或多套生产环境的场景,能显著提升效率并保证配置一致性。功能特性 配置持久化:保存除密码外的...

Fusion引擎

Fusion引擎是EMR Serverless Spark内置的高性能向量化SQL执行引擎,相比开源Spark在TPC-DS基准测试上有3倍性能提升。Fusion引擎与开源Spark完全兼容,您无需对现有代码做任何修改。在EMR Serverless Spark中,只需在创建会话时开启 使用...

EMR Spark功能增强

阿里云E-MapReduce产品构建于阿里云云服务器ECS上,基于开源的Apache Hadoop和Apache Spark,做了大量优化。本文为您介绍E-MapReduce(简称EMR)Spark相对开源增强的功能。背景信息 阿里云EMR 100%采用社区开源组件,随开源版本升级迭代,...

使用Delta Lake

Delta Lake是一个开源存储框架,旨在数据湖之上构建LakeHouse架构。Delta Lake提供了ACID事务支持、可扩展的元数据处理功能,并能够在现有的数据湖(如OSS、Amazon S3和HDFS)上整合流处理与批处理。此外,Delta Lake还支持多种引擎,如...

使用RocksDB作为元数据后端

如果需要高可用,推荐配置Tablestore(OTS)或者Raft作为元数据后端,详情请参见 使用Tablestore作为存储后端 和 使用Raft-RocksDB-Tablestore作为存储后端。单机RocksDB作为元数据服务的架构图如下所示。进入SmartData服务。登录 阿里云E-...

选择业务场景

全组件灵活组合(Spark/Flink/HBase等)支持混合负载(实时+离线+分析)说明 混合负载场景下离线业务、实时业务可能互相影响,推荐选购多种类型集群组合方案 离线ETL、实时ETL、复杂聚合分析、高并发查询服务 说明 阿里云EMR的不同版本支持...

使用RocksDB作为元数据后端

如果需要高可用,推荐配置Tablestore(OTS)或者Raft作为元数据后端,详情请参见 使用Tablestore作为存储后端 和 使用Raft-RocksDB-Tablestore作为存储后端。单机RocksDB作为元数据服务的架构图如下所示。配置RocksDB 进入SmartData服务。...

SmartData(仅对存量用户开放)

JindoSDK:为EMR各种开源计算引擎提供统一的SDK,支持Java、C、C++和Python语言,提供多种访问和API接口,包括HCFS文件系统接口、POSIX接口和Table表格接口。工具集:提供相关的工具集,例如Jindo tool和迁移工具Jindo DistCp。各种...
< 1 2 3 4 ... 200 >
共有200页 跳转至: GO
新人特惠 爆款特惠 最新活动 免费试用