首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >借助重新设计的 AutoOps,更快地排查 Elasticsearch 问题

借助重新设计的 AutoOps,更快地排查 Elasticsearch 问题

作者头像
点火三周
发布2026-07-27 16:18:27
发布2026-07-27 16:18:27
1120
举报
文章被收录于专栏:Elastic Stack专栏Elastic Stack专栏

借助重新设计的 AutoOps,更快地排查 Elasticsearch 问题

通过实时问题检测和可操作的建议,简化您的 Elasticsearch 运维,从而优化性能并降低成本。AutoOps 适用于云端和自管部署。了解更多关于 AutoOps 的信息。

AutoOps 为 Elastic Cloud Hosted 部署和 Cloud Connect 集群带来了全新的体验。此次更新新增了一个 Critical(严重)级别,并刷新了所有页面,包括 Template Optimizer(模板优化器)、Nodes(节点)、Shards(分片)和 Overview(概览)。更新后的布局和导航使 Elasticsearch 问题的扫描和排查变得更加容易。本文将介绍重新设计的 UI,以及 AutoOps 的未来发展方向,包括无头(headless)和代理式(agentic)体验。

AutoOps Deployment view for an Elasticsearch cluster showing events over time, open events list and resource metrics including JVM memory, CPU and storage across hot and cold tiers

重新设计的 AutoOps 部署视图,事件时间线更清晰,开放事件和已关闭事件之间区分更明确

为什么 Elasticsearch 的 AutoOps 需要更清晰的优先级划分

大规模运行 Elasticsearch 要求管理员同时监控集群的健康状况、性能、容量和配置。AutoOps 现在提供了一种更清晰的方式,来区分威胁集群功能的状况和虽然重要但没那么紧急的性能下降。重新设计的界面也遵循熟悉的 Elastic Cloud Console 模式,使活动问题更容易查找和调查。

AutoOps 的变化:严重性、导航、配置和页面设计

监控引擎保持不变。重新设计的布局、导航和工作流现在遵循熟悉的 Elastic 模式。

更清晰的严重性模型

AutoOps events over time heatmap showing Critical Status Red, High Cluster Pending Tasks and Medium severity events including Unbalanced Shards and Template Optimization across an an Elasticsearch deployment over 10 days
AutoOps events over time heatmap showing Critical Status Red, High Cluster Pending Tasks and Medium severity events including Unbalanced Shards and Template Optimization across an an Elasticsearch deployment over 10 days

AutoOps events over time heatmap showing Critical Status Red, High Cluster Pending Tasks and Medium severity events including Unbalanced Shards and Template Optimization across an an Elasticsearch deployment over 10 days

新的事件严重性级别和重新分类的事件严重性。

我们新增了 Critical(严重)级别,用于表示对集群功能构成直接威胁并需要紧急干预的状况。此前被归类为 High(高)的几个事件现在被提升为 Critical。而其他一些事件则被降级为 Medium(中),因为它们代表的是潜在风险,而非活跃且严重的性能下降。重新分类的事件如下:

  • 从 High 提升到 Critical:Disk Watermark Flood Stage(磁盘水印泛洪阶段)、Master Not Discovered(主节点未发现)和 Status Red(状态红色)。
  • 从 High 降级到 Medium:Disk Watermark Low Threshold(磁盘水印低阈值)、Disk Watermark Low(磁盘水印低)和 Disk Watermark Configuration Incorrect(磁盘水印配置不正确)。

严重性

含义

Critical

对集群功能构成直接威胁。需要紧急干预。

High

可用性、性能或稳定性严重下降。

Medium

潜在风险,若不及时处理可能升级。

Low

轻微异常,对运维影响极小。

Info

常规运维更新和配置更改。无需采取行动。(将在近期更新中推出)。

每个严重性级别都配备了更新的图标集和调色板。级别是固定的,因此团队可以构建一致的运行手册和通知过滤器:将 CriticalHigh 级别的事件路由到 PagerDuty 或 Slack,将 MediumLow 级别的事件保留在控制台中进行定期审查,当 Info 级别到来时,使用它进行信息提示,而不会造成警报疲劳。

部署视图:开放事件和历史记录,并排显示

重新设计的部署视图以更清晰的布局展示了现有的“开放事件”和“事件历史”选项卡。

AutoOps Deployment view showing the Event history tab with an events over time heatmap for Critical, High and Medium Elasticsearch events including Status Red, Data Node Disconnected and Index Queue Size

“开放事件和历史记录的独立选项卡让当前问题和过往活动一目了然。”

事件浮窗:更清晰地查看重要信息

事件详情浮窗围绕“行动”进行了重新设计。高严重性事件包含通知提示和交互式徽章,显示是否已配置警报,并直接链接到设置页面。建议默认折叠,以便核心事件保持焦点。设置位于浮窗菜单中;分享是一个独立的图标,位于标题栏。只有当您的角色具有所需的管理员权限且事件可关闭时,“关闭”操作才会出现。

AutoOps Deployment view showing an open High severity event flyout for a high index queue on an Elasticsearch node, with recommendations and event timeline
AutoOps Deployment view showing an open High severity event flyout for a high index queue on an Elasticsearch node, with recommendations and event timeline

AutoOps Deployment view showing an open High severity event flyout for a high index queue on an Elasticsearch node, with recommendations and event timeline

“事件浮窗显示通知设置和推荐操作,无需离开当前界面。”

AutoOps 概览:在您的 Elasticsearch 集群中排查活动事件

概览页面根据运维人员扫描整个资产的方式进行了重新组织。Elasticsearch 上下文直接位于页面标题下方,活动事件以事件条带的形式出现在部署表下方。每个条带显示您所选时间范围内的最新活动事件;如果同一事件类型在其他部署上处于开放状态,新的徽章允许您展开视图,而无需单独打开每个资源。事件搜索已移至左侧,以便更快地进行筛选。

“随时间变化的事件”图表已从概览页面移开,以使此页面专注于集群级别的排查;当您需要时间线时,请打开单个部署。

AutoOps Overview page showing a fleet of 7 Elasticsearch deployments with ES status, priority events, node and shard counts, and a Top events list filtered by Critical, High and Medium severity
AutoOps Overview page showing a fleet of 7 Elasticsearch deployments with ES status, priority events, node and shard counts, and a Top events list filtered by Critical, High and Medium severity

AutoOps Overview page showing a fleet of 7 Elasticsearch deployments with ES status, priority events, node and shard counts, and a Top events list filtered by Critical, High and Medium severity

“事件条带将跨部署的活动问题分组,以便您无需单独打开每个部署即可进行排查。”

节点、分片和索引的设计更易于导航和信息分层

节点视图现在使用更新的图表组件和 Elastic UI 配色方案,并在手风琴式折叠部分上带有清晰的展开指示器。重复部署级别视图的事件和实例列表已被移除,以减少干扰。

AutoOps Nodes view for an Elasticsearch deployment showing disk usage, shards count, segments count, and documents count charts across 24 nodes over a two-day period
AutoOps Nodes view for an Elasticsearch deployment showing disk usage, shards count, segments count, and documents count charts across 24 nodes over a two-day period

AutoOps Nodes view for an Elasticsearch deployment showing disk usage, shards count, segments count, and documents count charts across 24 nodes over a two-day period

分片视图改进了节点选择,并将视图控件分组在右上角。水平滚动条支持更宽的布局,时间滑块现在使用原生的 Elastic UI 组件。分片视图中的节点选择现在适用于大型集群,并一次显示多达 100 个节点。

AutoOps Shards view for an Elasticsearch cluster showing hot and cold tier nodes with an indexing rate tooltip for a specific index on instance-181, displaying 3K/sec indexing rate and 56 million documents
AutoOps Shards view for an Elasticsearch cluster showing hot and cold tier nodes with an indexing rate tooltip for a specific index on instance-181, displaying 3K/sec indexing rate and 56 million documents

AutoOps Shards view for an Elasticsearch cluster showing hot and cold tier nodes with an indexing rate tooltip for a specific index on instance-181, displaying 3K/sec indexing rate and 56 million documents

“分片视图整合了控件,并使用原生的 Elastic UI 组件进行时间范围选择。”

索引视图保留了您已习惯使用的索引表体验,包括排序、时间范围刷选和针对有意义范围调整的图表缩放行为。

Template Optimizer(模板优化器)

Template Optimizer 现在提供了一个可搜索的模板列表,按最近识别出的推荐建议进行排序。您可以直接打开每个推荐建议,或展开 JSON 面板以检查完整的模板。

AutoOps Template Optimizer showing a codec compression recommendation alongside the full JSON template configuration for autoops_standard_index_settings
AutoOps Template Optimizer showing a codec compression recommendation alongside the full JSON template configuration for autoops_standard_index_settings

AutoOps Template Optimizer showing a codec compression recommendation alongside the full JSON template configuration for autoops_standard_index_settings

“模板优化器根据最新发现的问题显示模板列表,并改进了搜索功能。”

配置通知和事件设置

通知设置现在包括连接器搜索、更清晰的过滤器以及更简单的连接器编辑流程。事件设置已从弹出窗口移至浮窗,与 AutoOps 中使用的模式保持一致。通知报告保留了相同的 10 天历史记录窗口,并进行了少量布局更新;关闭事件使用与 Elastic UI 对齐的更新确认组件。

AutoOps Events settings page showing the Edit event settings flyout with index filter pattern, empty indices threshold, and per-deployment configuration options
AutoOps Events settings page showing the Edit event settings flyout with index filter pattern, empty indices threshold, and per-deployment configuration options

AutoOps Events settings page showing the Edit event settings flyout with index filter pattern, empty indices threshold, and per-deployment configuration options

“事件设置,更易于导航和跨多个集群应用自定义设置”

导航和控件

部署选择器现在显示部署 ID 和实时集群状态,并在下拉子菜单中提供部署名称和 ID 的复制操作。节点选择支持全选、按层级分组选择以及清晰的主节点指示。日期选择器遵循 Kibana 和其他 Cloud Console 监控视图中使用的相同相对范围和自定义范围模型。

AutoOps 路线图:API、MCP、CLI 和代理式体验

展望未来,我们正在构建无头(headless)和代理式(agentic)的 AutoOps 体验。即将推出的公共 AutoOps API 将使洞察和原始指标在 AutoOps 界面之外可用。管理员和代理将能够直接查询 API 或将其数据存储在 Elasticsearch 中。该 API 还将为与 MCP, Elastic Agent Builder, Elastic CLI、Kibana 和原生 AutoOps 聊天集成奠定基础。

  • Hosted MCP server:使 AutoOps 洞察对 Claude 和 Cursor 等 MCP 客户端可用。
  • Native Elastic Agent Builder tool:在 Elastic Agent Builder 中使用 AutoOps 洞察。
  • Elastic CLI support:通过 Elastic CLI 访问 AutoOps API。
  • AutoOps in Kibana:在 Kibana 中显示相关的洞察和指标。
  • Native AutoOps chat:通过 Elastic Cloud Console 中 AutoOps UI 内的代理式聊天体验调查集群问题。

应用程序的重新设计是基础;这些界面将满足运维人员在自动化和 AI 已经存在的环境中进行操作的需求。阅读更多关于 Elastic 公共路线图上的内容。

如何开始使用 Elastic Cloud Console 中重新设计的 AutoOps

登录 Elastic Cloud Console,打开一个部署、项目或已连接的集群,然后从导航中选择 AutoOps。在 AutoOps 文档中了解更多信息。

本文中描述的任何功能或特性的发布和时间安排均由 Elastic 自行决定。任何目前尚未可用的功能或特性可能无法按时交付,甚至根本无法交付。

本文参与 腾讯云自媒体同步曝光计划,分享自微信公众号。
原始发表:2026-07-26,如有侵权请联系 cloudcommunity@tencent.com 删除
目录
  • 借助重新设计的 AutoOps,更快地排查 Elasticsearch 问题
    • 为什么 Elasticsearch 的 AutoOps 需要更清晰的优先级划分
    • AutoOps 的变化:严重性、导航、配置和页面设计
      • 更清晰的严重性模型
      • 部署视图:开放事件和历史记录,并排显示
      • 事件浮窗:更清晰地查看重要信息
      • AutoOps 概览:在您的 Elasticsearch 集群中排查活动事件
      • 节点、分片和索引的设计更易于导航和信息分层
      • Template Optimizer(模板优化器)
      • 配置通知和事件设置
      • 导航和控件
    • AutoOps 路线图:API、MCP、CLI 和代理式体验
    • 如何开始使用 Elastic Cloud Console 中重新设计的 AutoOps
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档