EMR AI 助手用于辅助 EMR Serverless StarRocks 的智能问答、性能诊断、健康巡检、告警分析和主动推送。本文说明 AI 助手的数据范围、权限边界、安全要求、生产操作原则和常见问题。
定位说明
EMR AI 助手是智能运维辅助工具,不是自动运维系统。它可以帮助用户理解实例状态、分析性能问题、总结告警原因、生成优化建议,但最终判断和生产操作仍由用户负责。
flowchart LR
A[EMR AI 助手] --> B[只读分析]
A --> C[建议生成]
A --> D[巡检和推送]
A -.不替代.-> E[人工审批]
A -.不替代.-> F[生产变更]
可分析的数据范围
AI 助手仅应在当前账号授权和产品能力允许的范围内分析运维数据。
| 数据类型 | 用途 | 注意事项 |
|---|---|---|
| 实例基本信息 | 判断实例规格、版本、状态 | 受 RAM 权限控制 |
| 系统表信息 | 辅助诊断实例运行状态 | 不应读取业务表明细数据 |
| Query Profile | 分析 SQL 执行瓶颈 | 与具体 Query ID 关联 |
| 监控指标 | 判断资源水位和趋势 | 可能存在采集延迟 |
| 任务执行记录 | 查看巡检和告警结果 | 以任务中心记录为准 |
| 错误摘要和日志片段 | 分析异常事件 | 输入前应脱敏 |
| IM 推送配置 | 发送巡检和告警摘要 | Webhook 属于敏感信息 |
权限控制原则
-
AI 助手的可见范围应受当前账号和 RAM 权限限制。
-
权限不足时,诊断结论可能不完整。
-
不应为了临时诊断授予超出职责范围的权限。
-
涉及实例配置、权限、网络、资源等变更时,应按照企业审批流程执行。
-
AI 助手输出的变更建议不等于授权执行。
不应输入的信息
| 信息类型 | 示例 |
|---|---|
| 账号凭证 | 密码、AccessKey、SecretKey、Token、Cookie |
| 数据库密钥 | 数据库账号密码、私钥、连接串明文密码 |
| Webhook 密钥 | 钉钉、飞书机器人地址和签名密钥 |
| 个人敏感信息 | 手机号、身份证、邮箱、个人身份数据 |
| 未脱敏业务数据 | 订单、用户、交易、合同等明细内容 |
生产操作原则
flowchart TD
A[AI 输出建议] --> B{是否涉及生产变更}
B -- 否 --> C[执行低风险检查]
B -- 是 --> D[人工复核]
D --> E[评估影响范围]
E --> F[准备回滚方案]
F --> G[提交变更审批]
G --> H[执行并观察]
H --> I[记录复盘]
涉及以下动作时,必须谨慎处理:扩缩容、重启、参数修改、DDL、权限调整、删除或重建物化视图、导入链路重建、生产 SQL 改造、告警静默或关闭。
AI 输出如何判断是否可用
| 检查项 | 要求 |
|---|---|
| 对象明确 | 包含实例、时间范围、SQL、任务或告警 |
| 证据充分 | 引用 Profile、指标、日志、任务记录等证据 |
| 结论分级 | 区分确定结论和待验证假设 |
| 风险清楚 | 标注低风险动作和高风险变更 |
| 可验证 | 给出验证方法和回滚建议 |
| 不越权 | 不要求访问未授权资源或输入密钥 |
声明建议
AI 助手输出内容由人工智能模型生成,可能存在不完整、不准确或不适用于当前环境的情况。用户应结合监控、日志、控制台状态、官方文档和业务上下文综合判断。因采纳 AI 建议而进行的生产操作,应由用户自行评估和承担相应责任。
常见问题
AI 助手会自动执行生产变更吗?
不会。AI 助手主要提供诊断和建议。任何配置修改、扩缩容、重启、权限变更或数据变更,都应由用户人工确认后执行。
AI 助手会读取业务数据吗?
AI 助手用于运维诊断,应以系统表、Query Profile、监控指标、任务记录和错误摘要等运维数据为主。不要主动提供业务表明细或未脱敏数据。
为什么 AI 诊断有时不准确?
可能因为权限不足、指标延迟、日志缺失、时间范围不准确、上下文不足或业务场景特殊。建议补充证据并进行人工复核。
如何安全地使用 IM 推送?
只推送必要摘要和详情链接,避免在群里展示敏感 SQL、密钥、未脱敏日志或业务明细。Webhook 和签名密钥只应保存在控制台配置中。
如何提高诊断质量?
提问时提供明确实例、时间范围、问题现象、Query ID、Profile、错误摘要、业务基线和期望输出格式。信息越完整,诊断越可验证。