阿里云 EMR AI 助手能力边界与安全说明

1 阅读4分钟

EMR AI 助手用于辅助 EMR Serverless StarRocks 的智能问答、性能诊断、健康巡检、告警分析和主动推送。本文说明 AI 助手的数据范围、权限边界、安全要求、生产操作原则和常见问题。

定位说明

EMR AI 助手是智能运维辅助工具,不是自动运维系统。它可以帮助用户理解实例状态、分析性能问题、总结告警原因、生成优化建议,但最终判断和生产操作仍由用户负责。

flowchart LR
  A[EMR AI 助手] --> B[只读分析]
  A --> C[建议生成]
  A --> D[巡检和推送]
  A -.不替代.-> E[人工审批]
  A -.不替代.-> F[生产变更]

可分析的数据范围

AI 助手仅应在当前账号授权和产品能力允许的范围内分析运维数据。

数据类型用途注意事项
实例基本信息判断实例规格、版本、状态受 RAM 权限控制
系统表信息辅助诊断实例运行状态不应读取业务表明细数据
Query Profile分析 SQL 执行瓶颈与具体 Query ID 关联
监控指标判断资源水位和趋势可能存在采集延迟
任务执行记录查看巡检和告警结果以任务中心记录为准
错误摘要和日志片段分析异常事件输入前应脱敏
IM 推送配置发送巡检和告警摘要Webhook 属于敏感信息

权限控制原则

  • AI 助手的可见范围应受当前账号和 RAM 权限限制。

  • 权限不足时,诊断结论可能不完整。

  • 不应为了临时诊断授予超出职责范围的权限。

  • 涉及实例配置、权限、网络、资源等变更时,应按照企业审批流程执行。

  • AI 助手输出的变更建议不等于授权执行。

不应输入的信息

信息类型示例
账号凭证密码、AccessKey、SecretKey、Token、Cookie
数据库密钥数据库账号密码、私钥、连接串明文密码
Webhook 密钥钉钉、飞书机器人地址和签名密钥
个人敏感信息手机号、身份证、邮箱、个人身份数据
未脱敏业务数据订单、用户、交易、合同等明细内容

生产操作原则

flowchart TD
  A[AI 输出建议] --> B{是否涉及生产变更}
  B -- 否 --> C[执行低风险检查]
  B -- 是 --> D[人工复核]
  D --> E[评估影响范围]
  E --> F[准备回滚方案]
  F --> G[提交变更审批]
  G --> H[执行并观察]
  H --> I[记录复盘]

涉及以下动作时,必须谨慎处理:扩缩容、重启、参数修改、DDL、权限调整、删除或重建物化视图、导入链路重建、生产 SQL 改造、告警静默或关闭。

AI 输出如何判断是否可用

检查项要求
对象明确包含实例、时间范围、SQL、任务或告警
证据充分引用 Profile、指标、日志、任务记录等证据
结论分级区分确定结论和待验证假设
风险清楚标注低风险动作和高风险变更
可验证给出验证方法和回滚建议
不越权不要求访问未授权资源或输入密钥

声明建议

AI 助手输出内容由人工智能模型生成,可能存在不完整、不准确或不适用于当前环境的情况。用户应结合监控、日志、控制台状态、官方文档和业务上下文综合判断。因采纳 AI 建议而进行的生产操作,应由用户自行评估和承担相应责任。

常见问题

AI 助手会自动执行生产变更吗?

不会。AI 助手主要提供诊断和建议。任何配置修改、扩缩容、重启、权限变更或数据变更,都应由用户人工确认后执行。

AI 助手会读取业务数据吗?

AI 助手用于运维诊断,应以系统表、Query Profile、监控指标、任务记录和错误摘要等运维数据为主。不要主动提供业务表明细或未脱敏数据。

为什么 AI 诊断有时不准确?

可能因为权限不足、指标延迟、日志缺失、时间范围不准确、上下文不足或业务场景特殊。建议补充证据并进行人工复核。

如何安全地使用 IM 推送?

只推送必要摘要和详情链接,避免在群里展示敏感 SQL、密钥、未脱敏日志或业务明细。Webhook 和签名密钥只应保存在控制台配置中。

如何提高诊断质量?

提问时提供明确实例、时间范围、问题现象、Query ID、Profile、错误摘要、业务基线和期望输出格式。信息越完整,诊断越可验证。