全部产品
Search
文档中心

全域智能运维平台 STAROps:常用名词

更新时间:Sep 30, 2026

本文列出全域智能运维平台 STAROps 的常用术语及其英文名,供阅读其他文档时查阅。术语按六个概念层分组;概念之间的数量约束与状态口径写在条目正文中。

执行主体与能力

  • 数字员工(Digital Employee):STAROps 的智能执行主体,可即时应答提问,也可承接长期任务。分系统内置员工和自定义数字员工。

  • 系统内置员工:STAROps 预置的受限员工,线上也作“系统员工”“内置员工”“默认员工”,对应 Ops Agent(apsara-ops)。不绑定 RAM 角色,运行时继承使用者权限;不支持技能管理,不能配置连接器,但可以创建长期任务。

  • 自定义数字员工:您创建的数字员工,线上也作“自建数字员工”“自定义员工”。绑定 RAM 角色,运行时可访问范围由该角色的权限策略决定,可配置技能、MCP 服务、连接器和阿里云 CLI。

  • 默认规则(Default Rule):以 Markdown 编写的数字员工行为约束,由角色定义、数据源聚焦、分析逻辑约束和输出要求四部分组成;修改后仅对后续创建的会话生效。

  • 技能(Skill):为数字员工配置的可复用能力模块,由 SKILL.md 定义;采用渐进式加载,任务匹配时才加载完整指令。与默认规则的区别:默认规则约束做事方式,技能扩展具体能力。

  • MCP 服务:遵循 MCP(Model Context Protocol)协议,向数字员工提供一组可调用工具。添加后需为每个工具配置执行方式,写操作建议配置为每次询问。

数据接入与建模

  • 连接器(Connector):把云监控 2.0、日志服务等外部系统接入数字员工的配置模块,每个连接器使用一套访问身份,不会自动创建角色或授予数据权限。分系统连接器(可观测、资源、流水线、代码访问)和自定义连接器(MCP 服务、环境代理)。

  • 数据建模(Fabric):为连接器目标创建数据模型的过程。Agentic 建模开关开启后由系统自动建模,也可对话建模、经您审阅后应用;保存连接器成功不等于建模完成。

  • 可观测模型(UModel):描述系统拓扑和实体关系的模型,例如服务与实例的归属关系、服务之间的调用关系。其中的运维对象称实体(Entity),会话中可输入 @ 引用实体。

  • 地域(Region):数据存放区域,双中心支持华北 2(北京)和新加坡,在创建数字员工时选择。与所操作资源不在同一法域时可能产生跨境数据传输。

会话与长期任务

  • 智能会话:自然语言交互能力,通过多轮对话完成数据查询、告警分析、指标解读、日志分析和故障诊断。控制台中的对应模块为智能助手,可从 STAROps、云监控 2.0 和日志服务发起。

  • 会话(Thread):一次智能会话的记录单元,可继续、改名或删除;删除后历史消息与分析结果不可恢复。

  • 模型(Model):生成回答与分析结论所使用的大语言模型(LLM),在发送第一条消息或创建长期任务前选择;未手动选择时使用 Auto,即服务端配置的默认模型。

  • 长期任务(Mission):承载长周期异步的运维目标,可规划出跨天、跨月的事项。执行模式分定时执行与事件触发,事项还可手动触发。

  • 执行蓝图(Blueprint):长期任务的执行计划,由 AI 生成、经您确认后启动,定义各事项的内容、触发方式、执行顺序和通知方式;对话追加的更新需您确认,且仅对后续事项生效。

  • 事项(Task):长期任务下的一次具体执行单元,按定时、手动或事件触发,完成后生成任务报告;它和问题发现下的处理项都写作 Task,指的不是一回事。

  • 产物(Artifact):事项执行的输出物,包括任务报告(Task Report)和过程快照。

  • 通知渠道:长期任务向外发送消息的通道,与云监控 2.0 的通知对象共用体系;通知类型为 AI 求助、报告生成和事项异常。

问题与闭环

  • 问题发现(Finding):数字员工从一组现象中归纳出的稳定问题判断,带着影响对象、证据、处理项和验证条件;同一问题只更新一条、不重复创建。默认开启,可在数字员工设置中关闭。能力名写作 Findings。

  • 处理项(Task):闭环一个问题发现的最小处理单元,含执行动作、负责人、验证条件和风险等级;低风险可自动执行,高风险需人工确认。

安全与权限

  • 使用者权限:决定您能否使用和管理数字员工、会话、长期任务、产物、技能和 MCP 服务,不决定数字员工能访问哪些数据。

  • 数字员工运行时权限:决定数字员工运行时可访问哪些数据和资源;与使用者权限相互独立、需分别授权。系统内置员工除外,其继承使用者权限。

  • 人工确认(Human-in-the-Loop,简称 HIL):AI 遇到高风险操作、信息不足、多种处置方案或预期外情况时,暂停执行并请求您确认后继续。待响应请求以“AI 求助”消息触达;长时间未响应会导致该次执行失败。

  • 执行策略:数字员工调用工具的确认机制,依次经过拒绝策略、自动放行策略、人工确认(HIL)和 RAM 角色权限四层校验:命中拒绝直接拒绝,命中自动放行(或内置只读规则)直接执行,其余需人工确认。

计量与配额

  • 积分(AI_Credit):STAROps 的统一计量与结算单位,抵扣智能会话、长期任务等场景的模型资源消耗,不可兑换现金。一次问答约 30 积分、一次根因分析约 200 积分为预估值。

  • 值守服务(Agent_Day):自定义数字员工 7×24 持续值守的计费项,按“个/自然日”计量;仅对自定义数字员工收取,系统内置员工不计费。自 2026-10-10 起生效,单价与扣减规则见《计费说明》。