运行监控: 运行监控:先确认系统、模块和实时数据状态
画面无实时值、报警未触发、趋势无曲线或脚本无执行结果时,先在运行监控中确认服务、模块、联邦拓扑和 Tag 实时状态。
系统状态看什么
系统状态页分成系统概览、进程内存、联邦拓扑、模块状态和服务状态。先看主机、平台、运行时长和内存,再看联邦拓扑里的站点访问名、节点、本地模式、备用节点、启用设备数和当前采集设备。最后看模块状态与服务状态,判断 IO、报警、趋势、联邦、留存、事件记录、WebSocket 网关是否正常。
- 进入路径:配置中心 -> Runtime Monitoring -> System Status。
- 先刷新页面,确认运行时长不是一直归零。
- 再看模块状态,IO、报警、趋势、事件记录、WebSocket 网关至少要是可用状态。
- 绿色一般表示模块已安装且运行中,橙色或告警表示需要继续查看原因。
- IO 模块告警时,要优先看设备是否离线、采集分组是否异常、当前采集节点是否正确。
- 报警、趋势和画面应看到一致的实时值;如果三者不一致,先回到 Tag 诊断和设备连接页核对。
本地执行和访问能力要分开看
系统状态中的模块能力应同时查看本地执行和访问能力。本地执行表示模块是否在当前节点运行;访问能力表示当前节点是否还能读取、消费或转发该模块结果。联邦或冗余场景下,本地 IO 停用不一定表示当前节点完全不可读,需要结合联邦链路、远端 IO 端点和 Tag 质量判断。
- 本地执行:判断模块是否在当前节点实际运行。
- 访问能力:判断当前节点是否还能读取、消费或转发该模块结果。
- IO 模块可出现本地执行与访问能力不同的情况。
- 报警、趋势、事件和留存当前按保守模型查看本地状态与访问状态。
- 页面是否可用应结合模块安装状态、访问能力和具体数据来源判断。
数据留存配置方法
进入“Data Retention / 数据留存”,先看当前历史数据、事件和归档策略。项目早期可以先用默认策略,正式交付前要按客户要求确认保存周期、迁移策略和归档目标。
- 先确认哪些数据需要长期保留:报警、事件、趋势、操作记录。
- 再设置保存周期和迁移策略,避免磁盘无限增长。
- 保存后回系统状态,确认留存模块仍然运行正常。
- 交付资料里写清楚保留多久、超过周期后处理方式。
事件记录查询方式
进入“Event Records / 事件记录”,按时间、事件类型、操作者或关键词筛选。它适合排查配置修改人员、数据导入时间,以及特定配置项的变化原因。
- 发现配置被改,先按时间范围筛选最近事件。
- 发现导入后异常,筛选导入、发布、保存相关事件。
- 交付时告诉运维人员:管理端变更先看事件记录,再查日志。
Tag 抽屉里的报警规则维护
进入“Tags / Tag 管理”,筛选设备和 Tag,打开编辑抽屉的“报警”页签。开启报警后,每行维护一条报警级别规则;数值点可用标准阈值、偏差或变化率,布尔点可按 ON / TRUE 或 OFF / FALSE 触发。规则保存后到报警看板或事件记录验证。
- 配置前先用 Tag 诊断确认这个点位有实时值。
- 标准报警、偏差报警和变化率报警分别用于固定阈值、偏离目标值和变化过快的场景。
- 每条规则都要确认 Critical / High / Medium / Low / Info 等级、死区、延时和消息 key。
- 需要高高限、高限、低限、低低限时,可以先用快速添加生成规则,再按现场单位微调阈值。
- 保存后触发一次确认场景,确认报警能产生、确认、搁置、恢复和记录。
- 批量配置时先选少量点位验证,再复制到同类点位。
Tag 抽屉里的趋势归档维护
在同一个 Tag 编辑抽屉切到“趋势”页签。开启趋势后,按点位特性选择变化记录或定时采集;变化记录用死区减少重复落点,定时采集按间隔落点;趋势策略可留空让系统自动匹配。
- 只给需要历史曲线的点位开启趋势,避免无效数据写满磁盘。
- 变化快且只关心有效变化的点位使用变化记录和趋势死区。
- 需要固定时间间隔的报表点位使用定时采集,并确认采集间隔。
- 趋势保存后,要同时检查数据留存策略,确认历史能保留到项目要求的时间。
Tag 诊断使用方法
进入“Tag Diagnosis / Tag 诊断”,输入完整点名或按设备筛选,查看实时值、质量和时间戳。如果需要写值,先确认该 Tag 已开启控制能力且当前账号有写入权限。
- 读值确认:先看值是否变化,再看质量码和时间戳是否更新。
- 写值确认:先在非生产场景验证,写入后回画面或 PLC 侧确认结果。
- Tag 诊断可用于确认读值来源,但不能代替本机 Tag 主数据。
- Tag 诊断有值、画面没值时,先检查本机是否存在同名 Tag,再检查画面绑定的完整点名和大小写。
图示 1: 系统状态
系统状态把主机、联邦拓扑、模块状态和服务状态放在同一页,适合作为管理端排查的第一站。
图示 2: Tag 报警页签
报警规则在 Tag 编辑抽屉里维护,同一页可以配置标准阈值、偏差、变化率、报警等级、死区、延时和消息 key。
图示 3: 报警看板
报警看板用于验证规则是否真正触发,支持实时、历史和 Top10 视图,并按 Critical、High、Medium、Low、Info 区分行状态。
图示 4: 确认与搁置菜单
点击报警状态可执行确认或搁置,搁置时间支持 15 分钟、1 小时、8 小时和 24 小时,适合临时屏蔽已知现场处理项。
图示 5: 数据留存
数据留存决定历史数据保存周期和迁移策略,应在正式上线前确认。
图示 6: 留存策略编辑
调整留存策略时要先确认历史查询要求、磁盘容量和项目验收周期。