3PAR-Primera-Alletra 9000 hardware replacement







cliehlp -col showvv





















存储高可用:
直连

1、 内存镜像机制,多控制器
2、 BBU保护内存数据下刷
3、 Raid级别(cage ,mag,port):
将一块物理磁盘分成1G的逻辑磁盘;
cage冗余的意思是每次取1G的虚拟磁盘,从不同的cage里面取+菊花链
mag冗余的意思是每次取1G的虚拟磁盘,从不用的槽位的磁盘里面取

菊花链:

请问4个盘柜(包括节点盘柜),能不能做RAID 6 cage冗余(6+2个数据校验)?
Cage冗余的意思是一个cage故障,raid还能访问~
RAID 6(6+2) 每个盘柜取两个虚拟磁盘;RAID 6允许坏2块盘,E3盘柜盘坏了;
菊花链节点盘柜,E2 E4能访问,只有E3的两个数据块不能访问;RAID 6是不是还正常;
折中:只需要4个盘柜
节点盘柜 存 1号数据 2号数据
E4 存3号数据 4号数据
E2 存 5号数据 6号数据
E3存 7号校验 8号校验
Best: 如果你盘柜足够多,raid6 (6+2) ,最好是8个盘柜(包含节点盘柜)
3PAR RAID结构



盘柜只能连接到一个node pair对
4控制器允许两个控制器故障,前提是2个控制器在不同的node pair对下
8控制器允许4个控制器故障,前提是4个控制器在不同的node pair对下
传统存储的弊端:
1、 存在node pair对的概念,一个node pair对不能同时故障,也不能接连故障,不能都坏,因为盘柜只连接到一个node pair对
2、 内存镜像机制复杂,对于多控制器场景,算法复杂,只要镜像由问题,都会造成前端卡顿;且为了内存数据不丢失,需要使用超级电容, BBU给内存供电;,nvdimm,scm的价格昂贵,且不好维护;物理硬件损坏是必然,同时发生只是概率问题,不代表不发生,只有0和1

Attention: Primera Alletra 9000、Alletra MP B10000只支持精简卷和压缩去重卷,不支持full卷; 不支持任何特色功能,比如AFC,AO等;raid类型只支持raid6,其他都不支持;且不能指定raid6 几加几,系统系统判定;
设计新的存储机制:B10000
要求:NVME技术,全网状互联(控制器和所有的盘柜),不用写缓存;

内存镜像机制:内存镜像复杂,还需要硬件维护----- 我不要写缓存了;
写缓存—》 write back,写到内存立马返回给主机
写的机制变成写盘;所有的数据写入到后端磁盘才给主机返回---- write through;需要硬盘足够快,我们现在已经出现了NVME硬盘;
下一代存储B10000: write through ,全闪NVME,交换机(连菊花链都不再需要);






SDN软件定义网络:实际就是调用交换机的API,当我们扩容的时候,控制器会调用交换机的API,给新的端口配置vlan, 获取端口状态信息是通过lldp协议

关机顺序:
1、 关闭业务
2、 关于存储shutdownsys halt
开机顺序:
1 、 先给交换机加电
2、给拓展盘柜加电
3、 给控制器节点加电
4、 业务主机
分布式热备的机制:


每块磁盘里面的spare空间只能用于spare,不能用于数据使用;
如果空间非常紧张;可以移除spare。removespare a:a 移除热备
没有spare的情况下,坏盘怎么办? 坏盘还是会重构,会使用normal chunklet下的free空间重构
如果需要重新生成热备:admithw spares
热备全部是全局的,只针对磁盘类型,同种磁盘,就能重构;如果同种磁盘没空间,会向上取磁盘,取性能更好的磁盘,FC取SSD,NL盘取FC

存储登陆:
1、 串口登陆:使用root账户或者3paradm账户

3PAR/PRIEMRA/ALLETRA 9000系列波特率为57600
Alletra B10000系列,波特率为115200

2、 管理网命令行登陆,22号端口,3paradm账户登陆,密码找客户要
3、 UI界面登陆: Primera .Alletra 9000 ,Alletra B10000自带UI界面,可以直接使用管理网打开,3PAR系列不具有UI界面


4、 SSMC仅仅能用于管理3PAR,PRIEMRA 其余产品不支持;
5、 3par系列无UI界面,需要安装VSP虚拟机,这个虚拟机单纯就是用于收集3PAR的日志;一套VSP只能管理一套存储;VSP可以配置邮件告警;
硬件更换:
定位灯:显示蓝灯

![]()

Locatenode

1、 硬盘更换
更换前判断----400、800都会给你们判断好,只需要更换和验证servicemag status
判断方式一:硬盘的状态是failed,且used里数据为0,则硬盘可以正常更换

判断方式二:showpdch 95 代表95号盘里面没有数据了,就不用看showpd -c used里面是不是都是0;这个时候磁盘就可以更换
3par8200 cli% showpdch 95

判断方式三:当硬盘故障,系统会自动发起servicemag start的命令,将硬盘的数据迁移到热备空间,如果servicemag status看到是succeed的,则该槽位的硬盘可以更换;
一定要注意槽位号!! Slot和mag的概念是一样的

硬盘更换后:
换上硬盘以后,系统会自动触发servicemag resume的进程,我们只需要看servicemag status是不是在跑就可以了;

如果系统没自动触发servicemag resume数据回迁,showpd -s看看磁盘磁盘是不是正常;或者最简单的拨打400,找case owner
Ps:
硬盘如果没分配pdid

admitpd识别硬盘后,可以手动触发servicemag resume的进程:
Servicemag resume cageid slotid ;如servicemag resume 4 6 指对cage4的slot6进行数据回迁
2、 3PAR、primera、allTERA 9000 IOM更换:更换完成后以后,拔了,插了,检查固件;固件不匹配会报cage degraded,此时需要手动执行upgradecage cage0 进行升级IOM固件; 需要注意,如果3par系列系统版本低于3.2.2 MU6的找400确定能不能执行upgradecage;
showcage -d cage0

3、 控制器更换(出guide给你们)
4、 SFP更换—>没啥技术含量
5、 盘柜更换--- > 在线和离线;