基本信息
| 字段 | 内容 |
|---|---|
| 英文 | Amazon EMR |
| 全称 | Amazon Elastic MapReduce |
| 中文释义 | 大数据处理平台 |
| 日文释义 | ビッグデータ処理 |
| 考试频率 | ⭐⭐⭐ |
| 易混淆 | Glue / Athena |
一句话理解
用于运行 Spark、Hadoop 等大数据框架的托管分析平台。
核心要点
- 适合大规模、自定义、分布式数据处理和需要框架控制的工作负载。
- 可以结合 S3、Glue Catalog、EC2 和 Spot 实例构建分析集群。
- 与 Glue 相比,EMR 提供更多运行时和集群控制,但运维责任也更高。
考试重点
- 看到“Spark、Hadoop、大规模自定义处理”优先想到 EMR。
- 低运维的 Serverless ETL 通常选择 Glue。
常见误区
- 不要只凭产品名称选择服务,先确认数据类型、延迟、控制力、运维与成本限制。
重点记忆
Glue 强在托管 ETL;EMR 强在大数据框架控制。