ARTICLE DETAIL

资讯详情

深耕网站建设、视觉设计与SEO优化的一线实战洞察。

浪潮存储AS Manager运维全解:存储池、主机映射、监控告警与固件升级

浪潮存储AS Manager运维全解:存储池、主机映射、监控告警与固件升级 简介这是浪潮存储系统 AS Manager 的官方存储管理手册主要面向浪潮存储运维人员、IT管理员及存储入门学习者帮助解决管理软件安装配置、日常监控与存储资源调配等问题。手册内容涵盖 AS Manager 技术特性、JRE 环境要求与安装向导、登录及用户权限验证、通道参数配置、磁盘与 Logical Drive 管理、逻辑卷与分区操作、LUN 映射建立等模块并附有安全使用注意事项能够引导读者按照规范流程完成存储系统管理。资源为 1 个 PDF 文件压缩包约 3.58MB文件体积小、目录结构明确适合在工作场景中快速查阅或系统学习。目前该手册已有 1564 人学习下载对正在使用浪潮存储设备或希望提升存储运维能力的读者是实用性较强的官方技术参考资料。1. AS Manager 存储管理手册的核心不是按钮位置而是操作顺序浪潮存储系统的 AS Manager 存储管理手册解决的是“盘都能看见业务却起不来”的尴尬。存储设备上架加电后磁盘灯全亮、控制器状态正常但业务管理员过来要空间时你打开 AS Manager 却不知道先建存储池还是先加主机。这就是手册真正要覆盖的链路。AS Manager 是浪潮存储的集中管理入口负责把裸盘变成存储池再切成卷映射给主机同时承担告警、性能监控和固件升级。它不是装完就能乱点的控制台而有一套必须遵守的先后顺序先通管理网再建资源池然后做主机映射最后把监控和维护接进去。下面从一线运维习惯出发把这套流程拆开讲每步给出参数、命令和常见坑适合刚接手浪潮存储的运维也适合做存储巡检的老手查漏补缺。2. AS Manager 的部署与登录先规划管理网络再谈“卡在登录”2.1 管理网规划给存储控制口留一条独立通道浪潮存储通常带两个控制器每个控制器都有独立管理口AS Manager 默认监听在这些带外管理端口上。常见做法是把两个控制器的管理地址分别规划为同网段的两个 IP例如 A 控 10.10.10.2/24、B 控 10.10.10.3/24管理机在相同 VLAN 内访问。我一般会在首次上电前就把 IP、掩码、网关填进表格并在机柜侧贴上标签避免现场临时翻面板查地址。参数建议值说明管理 IP独立网段不要与业务网段混跑管理 VLAN100便于防火墙限制访问源网关10.10.10.1发送邮件、SNMP Trap 时需要控制器 A/B两个独立 IP保证单控故障时仍可管理参数说明管理口不承载业务流量不需要给它配置过高规格但必须保证到管理机三层可达。如果设备需要发送告警邮件默认网关必须配置正确否则 SMTP 报文出不去。忘记管理 IP 时可以通过设备前面板液晶菜单或串口进入 CLI 查看但这属于应急手段正常交付时就应该把地址固化到运维台账。2.2 登录前先探测端口别盲目敲回车新版 AS Manager 一般提供 HTTPS 访问常见端口是 8443部分老版本或调试模式也开放 8080。在浏览器打开之前我习惯先从管理机上测一下端口避免浪费大量时间等超时。curl -k -I --connect-timeout 3 https://10.10.10.2:8443逻辑说明-k表示跳过证书校验因为 AS Manager 默认使用自签证书-I只取响应头--connect-timeout 3限制连接等待时间。命令返回 HTTP 302 或 200说明管理服务正常如果卡住直到超时说明网络不通或服务未启动。Windows 环境下也可以使用 PowerShellTest-NetConnection 10.10.10.2 -Port 8443参数说明命令输出里的TcpTestSucceeded为 True 表示端口可达。如果端口通但浏览器打不开常见原因如下表现象可能原因处理方式无法打开 8443管理 VLAN 未放通用串口或液晶面板确认地址再查交换机浏览器提示证书不信任自签证书添加安全例外不要直接关闭证书校验页面空白或按钮错位浏览器兼容性换较新版 Chrome/Edge禁用广告拦截插件2.3 初始化向导里必须改定的四个项目首次用超级管理员账号登录后AS Manager 会引导初始化。我一般按顺序改四项管理员密码、NTP 时间同步、SMTP 邮件服务器、告警通知级别。修改默认密码并放进公司密码管理箱不要只存在个人笔记里。填入内网 NTP 服务器地址存储和数据库服务器之间的时间偏差会直接影响日志排查。填写发件邮箱、SMTP 地址和认证信息用于告警转发。确认告警级别先保留严重和紧急跑通后再把警告级加上避免初始化阶段被邮件轰炸。注意如果公司 SMTP 使用 465 或 587 端口需要在 AS Manager 里选择对应的 SSL/TLS 模式否则邮件发送失败。DNS 也必须正确AS Manager 要解析 SMTP 服务器域名时离不开它。2.4 账号分级不是所有人都需要管理员权限日常巡检、只读监控和配置变更应该使用不同账号。AS Manager 支持按角色分配权限常见角色如下角色权限范围适用场景只读用户查看事件、性能、配置值班巡检、脚本采集存储管理员存储池、卷、映射、升级日常变更操作超级管理员全局配置、账号管理部署和应急恢复建议为日常监控系统单独建一个只读账号密码周期性轮换避免多个值班人员共用超级管理员。共享账号一旦出事审计日志里无法定位责任人。创建账号时使用明显的命名规则例如monitor_0001、ops_zhangsan方便后来人接手。3. 从磁盘到主机AS Manager 里的空间分配全链路3.1 先清点磁盘再定 RAID 策略不能照抄服务器本地 RAID 的习惯浪潮存储配置 RAID 的思维与服务器本地 RAID 卡不一样。服务器本地 RAID 只需要服务一台机器而存储设备通常有几十块盘需要先把盘按策略组成磁盘组再划到存储池里。打开 AS Manager 的“磁盘管理”第一件事不是直接建池而是检查每块盘的状态。磁盘状态常见有未初始化、在线、热备、异常。如果混入历史盘必须先确认数据可丢弃再执行清空操作。RAID 级别选择参考RAID 级别最少盘数冗余能力适用场景RAID 12允许坏 1 块控制数据、系统日志RAID 53允许坏 1 块视频监控、文件共享RAID 64允许坏 2 块大容量存储、重建时间长RAID 104每组坏 1 块数据库、高并发随机读写参数说明RAID 5 在随机写入时有校验计算开销RAID 10 空间利用率只有一半。容量一致、转速一致的磁盘应该放在同一磁盘组不要混插 SAS 和 SATA否则整组性能会被慢盘拖低。设计 RAID 时还需要考虑重建时间单盘容量越大重建期间故障窗口越长大容量盘组优先考虑 RAID 6。3.2 创建存储池热备盘和容量告警阈值一起设在 AS Manager 左侧菜单“存储池”中点击“创建”选择磁盘组再设置应用类型、RAID 级别和热备盘。我一般会在磁盘组里预留 1 到 2 块热备盘容量越大越不能省。热备盘不能参与业务读写但它能在一盘故障时自动顶替减少人工介入时间。参数建议值说明应用类型高性能 / 容量影响后端分层和缓存策略RAID 级别按磁盘组规划创建后不可随意变更热备盘1~2 块自动替换故障盘池容量告警阈值80%达到阈值发通知而不是等满注意存储池不是越大越好的“大水池”。跨多个磁盘组的大池会扩大故障半径一个池里的盘坏了可能影响所有业务卷。创建完成后需要把池的 owner 分配到合适控制器两个控制器都能访问存储池但同一个卷同时只由一个控制器提供访问owner 设置不当会造成控制器负载不均。3.3 卷类型选精简还是厚先算清业务增长曲线创建卷时AS Manager 会让选择“精简配置”还是“传统卷厚卷”。两者最直接的区别是空间分配方式。卷类型分配方式优势风险厚卷创建时全量分配性能稳定容量浪费精简卷按需分配利用率高超分配导致池写满数据库卷我会优先选厚卷避免后期因为按需分配产生额外开销。虚拟化场景用精简卷比较多但必须搭配监控否则多个虚拟机同时增长时存储池一旦写满所有虚拟机 IO 都会卡死。创建卷时还可以设置缓存策略默认读写缓存一般不动除非遇到数据库日志盘写多读少的情况再单独调整。3.4 主机映射WWN 和启动器一个都不能漏存储空间最终要映射给服务器服务器才能看到磁盘。这个过程不能直接在卷列表里“分配一个盘”完成必须先注册主机和启动器。流程是注册主机名称 → 添加主机启动器FC 的 WWPN 或 iSCSI 的 IQN → 选择可映射卷 → 确认主机多路径配置。以 Linux FC 环境为例查询 HBA 的 WWN 可以使用以下命令for host in /sys/class/fc_host/host*; do wwn$(cat $host/port_name) echo $(basename $host): $wwn done逻辑说明/sys/class/fc_host/host*对应每块 FC HBA 端口port_name文件保存 64 位 WWN。执行结果形如host0: 0x21000024ff...把0x后面的内容复制到 AS Manager 的启动器列表即可。注意双口 HBA 会显示两个 host两个 WWN 都要注册否则多路径少一条链路。映射完成后服务器需要扫描新磁盘。常见做法是执行rescan-scsi-bus.sh或重载 HBA 驱动之后用lsblk确认新磁盘出现。如果同一个卷要映射给集群多台主机需要先确认文件系统支持共享访问普通 ext4/xfs 不能直接在多节点同时挂载否则可能损坏元数据。这一点在映射前就要确认清楚AS Manager 只是提供“裸设备映射”不负责上层文件系统一致性。4. 监控告警与性能分析让 AS Manager 替你值班4.1 告警级别要分级别用“全部关闭”回应告警疲劳AS Manager 把事件分成信息、警告、严重、紧急四级不同级别需要对应不同响应时效。级别示例建议响应信息配置变更、登录成功记录审计警告池容量超阈值、电池老化当天处理严重硬盘故障、链路降级立即处理紧急控制器宕机、写缓存失败应急响应配置告警时我一般把“信息”级别关闭保留警告以上。不要在第一次看到告警多时直接把所有通知关掉那等于把故障预警关在门外。正确做法是先在事件列表里确认告警原因再把重复性噪音规则调低。如果公司已有监控平台支持 SNMP Trap可以把 AS Manager 的 Trap 地址指向监控服务器这样存储事件能被集中收集不需要每天都登录 Web 界面。4.2 性能分析先看延迟再看 IOPS 和带宽打开 AS Manager“性能监控”可以按控制器、存储池、卷或启动器查看实时曲线。很多运维先看 IOPS但我更习惯先看平均延迟。IOPS 高并不代表业务慢延迟持续偏高才说明真正有瓶颈。指标常见合理范围需要留意的信号控制器 CPU 利用率低于 70%持续超过 80% 且伴随延迟上升平均 IO 延迟SSD 小于 3msHDD 小于 20ms超过基线两倍以上IOPS随业务波动连续多周期爬升带宽低于链路速率 80%接近端口极限延迟高时先看是控制器 CPU 高还是某块物理盘忙。如果控制器 CPU 高可能是快照差异读、压缩功能开启后带来的计算开销如果是单盘 busy 高则要考虑热点数据集中在单盘上可能需要迁移卷或调整 RAID。性能监控窗口一般支持把当前数据导出方便做后续分析。4.3 导出的性能 CSV用 Python 算 P95别只信平均值AS Manager 性能报表可以导出 CSV 文件。导出的文件包含时间、控制器、卷名、IOPS、延迟等列。只打开 Excel 看平均值会掩盖问题比如定时任务在整点产生大量 IO平均延迟看着还好但业务侧已经明显卡顿。用脚本取 P95 能更真实反映尾部延迟。import pandas as pd # 读取从 AS Manager 导出的性能数据 df pd.read_csv(as_manager_perf.csv, encodinggbk) # 按实际导出的列名替换 for col in [IOPS, Latency(ms)]: if col in df.columns: # 输出平均值和95分位值观察尾部抖动 print(col, avg, round(float(df[col].mean()), 2), p95, round(float(df[col].quantile(0.95)), 2))逻辑说明encodinggbk用于兼容中文版导出文件如果报 UnicodeDecodeError 就改成utf-8。quantile(0.95)计算 95 分位值表示 95% 的时间内延迟低于该值。如果 P95 和平均值的差距很大说明存在周期性尖刺可以进一步按小时分桶统计定位抖动发生时间段。这个脚本同样适用于容量趋势分析把列名换成“已用容量”即可。4.4 日常巡检不是看灯是核对状态和事件存储设备四个月不坏不代表不需要巡检。我的巡检清单固定在以下三项硬件状态控制器、电源、风扇、BBU/电池重点看写缓存是否处于回写模式如果电池异常控制器会强制写透性能会明显下降。逻辑容量存储池使用率、卷分配率、快照剩余空间。快照空间不足时老快照可能被自动删除。事件日志按级别拉出最近 24 小时的告警确认所有严重和紧急事件都已关闭警告项有处理计划。巡检周期建议每两周一次。如果 AS Manager 已经接入邮件告警巡检时可以只核对未恢复事件不用重复截取所有硬件状态。5. AS Manager 维护操作配置备份、固件升级与效率习惯5.1 先备份配置再谈任何变更在 AS Manager“系统管理 → 配置管理”中可以把存储池、卷、映射、告警设置导出为配置文件。这个备份不包含业务数据只包含存储配置。我一般把备份文件按AS_BK_IP地址_日期的格式命名并在变更前导出一次、变更后导出一次。备份文件要下载到本地或异地不要只留在 AS Manager 所在的服务器上否则存储故障时备份也跟着消失了。5.2 固件升级的三个前提和两个确认升级控制器固件前必须满足三个前提配置已完成备份、升级包与当前型号和版本兼容、业务处于空闲窗口。两个确认分别是确认升级过程是否需要自动重启控制器确认服务器端多路径软件能够在控制器切换期间保持 IO 不中断。升级过程中不要在 AS Manager 上进行其他配置操作也不要人为断电。双控制器设备如果厂家明确支持在线升级按顺序逐个控制器升级不要同时重启两个控制器。5.3 三个能直接照搬的效率技巧给卷命名时带上应用和用途如DB_ERP_01、VM_DEV_05既方便在 AS Manager 里搜也方便在映射时一眼确认。把 AS Manager 的会话超时调成 30 分钟以上排障时翻文档、确认服务器状态时不会频繁被踢出登录出于安全考虑不要设置成永不过期。每月导出一次事件日志和配置备份并在运维台账里记录一行“存储配置备份已完成”。这行记录在故障恢复、容量规划、审计时都能派上用场。本文还有配套的精品资源点击获取
返回列表