简介:H3CUIS-Cell超融合题库(GB0-620)是一份面向H3C认证考试的超融合复习资料,专门针对GB0-620考生以及需要掌握UIS平台运维的工程师,以题库形式提炼超融合核心考点。文档共1个docx文件,大小约465KB,内容以选择题与答案解析为主,涉及虚拟化技术、分布式存储、集群部署、双机热备、SSD缓存、系统安装与硬件选型等众多高频考点。目前已有901人学习下载,适合考前冲刺与日常查漏补缺。题库中多数题目附有详细解析,并对存疑选项进行标注,有助于快速甄别易错点;同时结合具体场景讲解RBD与iSCSI访问方式对比、PG状态判断、副本冗余机制等易混淆知识点,帮助考生建立清晰的知识框架,提升备考效率与运维实操能力。
1. 拿到 GB0-620 题库文档后,先搞清楚 UIS-Cell 是什么
当手里拿到一份名为“H3CUIS-Cell超融合题库(GB0-620)[2021.10.10].docx”的文档时,绝大多数人第一个动作是翻到里面开始背题。但如果你没搭过或者没管过任意一套超融合环境,这仍是背了个寂寞。这里的 UIS-Cell 是 H3C 面向数据中心推出的超融合基础设施,卖点是计算、存储、网络三块资源在 x86 服务器上全软件定义。GB0-620 这门认证考试考的正是围绕 UIS-Cell 的架构认知、部署操作和日常运维。这篇文章我不聊“怎么背题库”,只讲这套系统背后的技术脉络,把文档里那些没有前后文的题目,还原成你可以照做的落地方案。
2. UIS-Cell 超融合的三大件:计算虚拟化、存储虚拟化、统一管理
2.1 计算虚拟化:KVM/CAS 调度器是考试的理论地基
UIS-Cell 的计算虚拟化层以 KVM 为内核,H3C 将其包装成 CAS 虚拟化平台,对外提供一整套虚拟机生命周期管理。考试题目里反复出现的“虚拟机热迁移”“内存热添加”“CPU 超分”这些概念,最后都要落回到 KVM 的模块上。很多人以为这些只是产品文档里的名词,其实它们在真实环境里对应的是你每天都会碰到的调度行为。
先说你最可能被问到的“H3C 如何计算 CPU 和 vCPU 的关系”。这本质上是超分比的算法:超分比等于宿主机上所有虚机的 vCPU 总数除以物理 CPU 线程数。UIS-Cell 管理界面里可以设置默认超分比,常见做法是给 CPU 密集型业务留低一点,给桌面虚拟化这类多数时间空闲的场景调高一些。题库里如果问“某宿主机有 64 个逻辑核,上面跑了 10 台 4 vCPU 的虚机,还能不能再创建虚机”,答案不是看内存,而是看超分比阈值有没有触顶。你不需要把这个算式背得多精确,但要知道它的调度逻辑是:CPU 超分省的是空闲时间片,不是峰值算力。两台虚机同时跑满,谁都快不了。
热迁移也是高频考点。热迁移的实质是把虚拟机内存状态从源宿主机搬到目标宿主机,通过 TCP 连接完成。考题里“热迁移需要什么前提”这个选项,经常把“共享存储”和“网络带宽”混在一起。在传统虚拟化里,共享存储指 SAN 或 NAS;在 UIS-Cell 里,分布式存储本身就提供了共享卷的能力,所以前提变成了“目标宿主机可达且资源充足,迁移流量所走的网络带宽足够”。你答题时要把“迁移依赖网络传输”这层因果拆开,就不会被选项带偏。
内存超分和热添加也要分清楚。内存超分是把物理内存按一定比例分给虚机,前提是虚机实际使用量不高;热添加是虚机运行中动态加内存,需要客户机操作系统支持,而且不是所有操作系统都认。考试里“Windows Server 2008 R2 能否热添加内存”这道题,标准是看系统版本和驱动支持,这类记忆点没有捷径,只能靠刷题时顺手把每个系统版本的兼容矩阵存个档。
2.2 存储虚拟化:ONEStor 副本与条带化如何决定 IO 行为
UIS-Cell 的存储虚拟化由 ONEStor 承担,它把各节点本地硬盘汇总成统一资源池,再以副本或纠删码方式提供数据冗余。GB0-620 里存储部分的题目比重一直不小,因为超融合的“融合”核心就体现在这里:你不再有独立的存储阵列,存储能力藏在每台 x86 服务器里。
考试经常问“两副本与三副本怎么选”。两副本适合测试或非核心业务,能容忍单块盘故障;三副本适合生产,数据同时写三份,任意坏一块盘都可以直接重建,不用等备份。副本数不是拍脑袋定的,它跟集群节点数直接相关:三副本至少需要三个存储节点,否则数据无法分布;两副本至少两个节点。题目里若出现“只有两台服务器却要配三副本”的选项,直接排除。这个约束不是软件限制,是数据分布的基本逻辑——三个副本必须放在三个不同故障域里,只有两个节点时第三个副本无处可放。
另一个必考点是数据重建的优先级。ONEStor 默认在硬盘故障后启动 rebuild,但重建过程占磁盘 IO,会影响线上业务。在题库里,这道题的坑在于“该不该把重建优先级调到最高”。实际经验是:如果故障盘是数据盘,而且剩余副本还在,可以把重建优先度调低,保证生产 IO;如果是单副本的关键卷,那必须立即重建。考试选项里两个极端都会出现,你要按“业务连续优先”的原则答题,而不是机械地选“越高越好”。
条带化策略则对应你在存储策略页面里看到的“性能优先”和“容量优先”。性能优先会把数据条带化到尽量多的硬盘上,获得更高并发度;容量优先则倾向于先写满一块再写下一块,减少空间碎片。做题时,“OLTP 数据库选哪个”的答案是性能优先,“冷数据备份选哪个”是容量优先。这套逻辑在 ONEStor 里对应的就是对条带宽度和数据分布的调控,理解了之后不用死记,看到业务特征就能选出来。
2.3 网络虚拟化:vSwitch、VXLAN 与聚合口的带宽边界
UIS-Cell 支持两种网络路径:虚拟交换机(vSwitch)负责同宿主机内虚拟机互访,VXLAN 负责跨节点二层互通。题库里关于“虚拟网络与物理网络怎么对应”的题目,是很多人翻车的地方。
vSwitch 并不等于传统交换机,它只是宿主机内核里的一块软件交换模块。虚拟机发出报文后,先经过 vSwitch,再通过物理网卡上联到接入交换机。这个“上联口”如果是一条物理链路,带宽就是它的瓶颈;如果做了链路聚合,聚合组成员的数量直接决定可用带宽。热词里提到的“h3c 聚合口满了”,指的就是这种场景:聚合成员带宽被占满,虚机互访变慢。考题中问“vSwitch 上联口带宽不够怎么办”,答案是增加物理链路或者优化负载均衡算法,而不是在虚拟机里加 vCPU。这个方向一定要记牢,因为超融合里网络性能问题的根因,经常不在虚机内部,而在物理链路。
VXLAN 的题则更偏概念:VTEP 端点、VNI 标识、隧道封装。UIS-Cell 的 VXLAN 网关可以部署在软件里,也可以借助硬件交换机实现。考试题目一般不会让你手写 VXLAN 报文,但会问“VXLAN 解决了什么问题”——即突破了传统 VLAN 4096 的数量限制,同时允许跨三层网络延伸二层域。在多租户场景下,每个租户一个 VNI,互不干扰。把这个因果记住,比死记术语管用。
网络部分还有一个容易被忽略的考点:管理网络和业务网络必须隔离。管理网络承载的是集群心跳、虚机迁移控制面、UI 访问,业务网络承载的是客户流量。如果把两者放在同一个广播域里,一个广播风暴就能让整个集群判定彼此失联,触发 HA 误切换。考试里“集群节点反复重启”的案例,最后查出来的原因往往就是网口复用,而不是系统缺陷。
2.4 管理面:UIS Manager 上那些反复出现的考题点
UIS Manager 是整个超融合的“黑匣子”入口,装好之后所有集群、主机、虚机、存储策略都在这里操作。题库里有相当比例的记忆型题目,考的是菜单路径和默认值,例如“创建业务虚机时,默认存储策略是哪一项”“集群高可用开启后心跳走哪个网络”。
面对这些记忆点,光背题不够,我一般建议在实验环境里亲手把“创建集群 → 添加主机 → 配置存储策略 → 创建虚机 → 开启 HA”走一遍。走完一遍之后,题目里的菜单名称就变成上下文记忆:你会记得“存储策略”不是在主机页面,而是在存储资源池页面;你会记得“HA 心跳网口”是单独预留的,不能和业务网络共用。这种从操作反推的记法,比题海战术稳得多。
还有一个考点是管理节点能否复用为计算节点。答案是可以,但不推荐生产这么干。管理面一旦过载,整个集群的 UI 会卡死,而后面的业务虚机不受影响。题库里那道“管理节点负载过高导致 UI 无法访问,但业务正常”的题,正确做法是把管理节点上承载的虚机迁走,而不是重启管理节点。这个细节考的不是技术能力,是运维习惯。
3. 按题库考点搭一套最小 UIS-Cell 集群:部署顺序与参数边界
3.1 最小拓扑:三节点部署与前两阶段的检查点
考试大纲里最常见的部署场景是三节点标准集群,因为这是能支撑三副本的最低配置。超融合服务器能不能归类为 PC 服务器?硬件形态上确实差不多,都是标准 x86 服务器,但配置上有明确约束:CPU 必须支持虚拟化,内存要比普通 PC 服务器大得多,网卡至少要区分管理口和业务口两组,硬盘要分系统盘和数据盘。这些约束在部署预检阶段就会卡掉一批“看起来能装”的机器。
物理机上电前,先规划好这几件事:每台服务器至少两块硬盘,一块系统盘一块数据盘,管理网络和业务网络分开、分配两个不同的 VLAN。下面是一段部署预检时我常跑的检查命令,用于确认宿主机是否满足虚拟化条件:
# UIS-Cell 部署预检的三个最小检查 # 1. 看 CPU 是否带虚拟化指令集(Intel 是 vmx,AMD 是 svm) grep -E "vmx|svm" /proc/cpuinfo | head -n 1 # 2. 看物理网卡名称和 PCI 地址,方便后续确认哪个口做管理、哪个口做业务 lspci | grep -i ethernet # 3. 确认 KVM 内核模块已经加载 lsmod | grep kvm这段脚本看起来简单,但能挡掉一批装到一半装不下去的环境。第一行如果输出为空,说明 BIOS 里没开 CPU 虚拟化,装完 CAS 虚拟机起不来,后面所有步骤全废。第二行用于核对网卡,因为同一个服务器可能有板载网卡和 PCIe 网卡,名称不同,驱动也不同。第三行确认 KVM 模块存在,输出里应该有 kvm_intel 或 kvm_amd 字样。
三节点接好后,第一步是在第一台服务器上部署管理节点。管理节点装好后它会把自己的 IP 作为集群入口。安装阶段有两个常见检查点:一个是主机名规划,建议按角色命名,避免装完三台分不清谁是谁;另一个是 IP 规划,管理 IP、业务 IP、存储 IP 最好分开段,后面配 VXLAN 和分布式存储时会省很多事。如果这几个 IP 段混在一起,考试里那类“路由冲突导致存储节点互 ping 不通”的题,就会在你自己环境里真实上演。
3.2 创建业务虚拟机与存储策略:关键参数在哪里
在 UIS Manager 里创建虚拟机时,重点不是 CPU 和内存给多大,而是“存储策略”和“网络”两栏别选错。
存储策略选项里有“性能优先”和“容量优先”两类,前面说过,性能优先对应条带化写盘,容量优先对应顺序写满。题目给出“虚机跑数据库,存储策略怎么选”,答案是性能优先。这里有一个很容易忽略的边界:性能优先策略会占用更多 SSD 缓存空间,如果集群里 SSD 容量不足,创建虚机可能会失败。考试里“存储策略无法创建”的场景,原因往往指向 SSD 容量不足,而不是 CPU 不够。这个因果关系要记住。
网络栏里要区分“管理网络”和“业务网络”。管理网络用于和 CAS 组件通信,不适合承载客户流量;业务网络才接对外服务。如果题目描述是“虚机 ping 不通网关”,第一步查的就是虚机网卡是否挂到了业务网络里,而不是查防火墙。这个点被问到的频率很高,因为线上环境里大多数连通性问题,确实都是虚机挂错网络导致的。
创建完虚机后,可以用底层命令看虚机的实际挂接网络,和界面里显示的信息做交叉验证:
# 查看虚机的接口配置(UIS-Cell 底层是 KVM/libvirt) virsh dumpxml vm-name | grep -A5 interface输出里会看到<source bridge='br0'/>这类字段,br0 对应哪个网络,去 UIS Manager 的网络页面核对一遍即可。如果这里配到了管理网络的 bridge 上,业务流量就会绕远路,这也是考试里“虚机能上网、物理机不通”类题目的实际答案来源。参数说明:dumpxml 导出的 interface 段里,bridge 名称是关键,必须确认它属于业务网络。
3.3 用命令行做最小规模的故障演练
正规考试不会让你在真机上做破坏性操作,但题库里“节点宕机 HA 如何动作”的题,最好亲自演练一遍。操作流程是:在三节点集群里选中一台宿主机,执行强制关电源,观察 UIS Manager 是否在判定时间内把上面的虚机迁移到另外两台节点。
# 模拟节点宕机(把 10.10.10.2 这台直接断电) ssh root@10.10.10.2 "poweroff -f" # 然后回到管理节点,持续观察虚机状态 watch -n 1 "virsh list --all"这里有个参数值得注意:UIS-Cell 的 HA 默认有一个“判定时间”,比如 30 秒或 60 秒。判定时间过短,网络抖动就可能触发误切换;过长则业务中断时间被拉长。生产环境一般设在 60 到 90 秒。做演练时,你可以顺便对比恢复时间,看看判定时间对业务的影响是不是真如书上写的那样。这个细节在很多题目选项里出现过,理由正是这个。
演练完之后,要恢复集群到正常状态:把宕机节点重新开机,等它重新加入集群,再检查数据重建进度。很多人忽略的是,节点恢复后不会自动把虚机迁回来,因为 UIS 的 HA 只保证虚机拉起,不保证负载均衡。如果你想让虚机回到原节点,需要手动执行迁移。这个“恢复后手动迁回”的动作,在考试里就是一道判断题,选项是“节点恢复后系统会自动回切”和“需要管理员手动迁移”,正确答案是后者。
4. 从 GB0-620 考题反推运维动作:超融合排障到底在查什么
4.1 存储性能拉胯:慢节点和延迟现象的判别
题库里有一类题描述“某节点上所有虚机 IO 延迟升高,其他节点正常”,选项往往包括升级固件、增加副本数、迁移虚机。正确方向通常是迁移虚机或查看该节点硬盘健康状态,而不是盲目加副本。加副本不能解决慢,只会让慢扩散到更多节点。
判断这类问题要分两步。先看是不是单盘故障:找到撑高延迟的那块物理盘,检查 SMART 信息。再看是不是某一块盘进入了 rebuild 状态:重建会持续占用磁盘带宽,拖累同节点的其他虚机。命令层面可以用 iostat 看每块盘的 util 指标,util 持续接近 100% 而吞吐上不去,基本可以断定磁盘在忙别的:
# 查看每块物理盘的 IO 使用率和延迟(在对应存储节点上执行) iostat -x 1 3重点关注 %util 和 await 两列。%util 常驻 90% 以上说明盘被持续占用;await 超过 20 毫秒说明延迟已经偏高。参数说明:iostat 的 -x 表示显示扩展统计,1 是采样间隔秒数,3 是采样次数。如果你看到某块盘 util 很高但其他盘都正常,那就是节点本地盘的问题,优先处理磁盘,而不是调整集群策略。
这个场景做题时,你要记住超融合的排障是以“节点”为单位看的。某节点性能差,大概率是它的本地盘出问题,而不是计算资源不够。这个方向选对,后面几条推理就顺了。
4.2 硬盘故障与数据重建:先保业务再修硬件
考试中,硬盘故障后的流程是一整套故事:状态变为降级 → 系统触发重建 → 后备盘顶上 → 数据达到完整冗余。题目通常要求你选“故障后第一步做什么”。
正确的第一步永远是确认业务虚机是否还能正常读写。多数情况下,由于副本机制,业务不会断,系统处于“降级运行”状态。这时你才开始触发更换硬盘、重新上线。如果题目把“立即更换”放在“确认业务”之前,它是在考你运维纪律:在副本足够的前提下,先保业务,再修硬件。这是超融合运维里最重要的一条原则,也是考试最想传递的价值判断。
还有一道高频坑:新换上的硬盘容量比原盘小,能不能加入存储池?答案是不能。ONEStor 要求同一存储池内硬盘规格尽量一致,至少容量不能低于同池平均值,否则会造成数据分布不均,甚至写盘失败。题库里出现“1.2T 和 600G 混插”的选项,直接判断为不合理的配置。这个点也是很多人在真实环境里踩过的:以为容量够就行,结果存储池某几个节点空间提前写满,其他节点还是空的。
4.3 计算节点宕机与脑裂:仲裁逻辑与恢复路径
节点宕机是超融合集群最常见的异常之一,考试会围绕“仲裁”和“脑裂”展开。UIS-Cell 集群内各节点通过心跳网络交换状态,当某个节点失联,剩余节点需要仲裁是否把它踢出集群。
如果集群只有两节点,心跳网络一断,两边都认为对方挂了,就会出现“双主”现象,也就是脑裂。解决方法是引入仲裁节点,或者把节点数做成奇数。题目中的“为什么生产环境至少三节点”考点,本质就是在考这个。三节点下,某节点失联,剩余两个节点能通过多数派原则做出决策,不会出现脑裂。
恢复路径我一般按三步走:先检查心跳网络是不是断了(物理链路、VLAN 配置),再把故障节点隔离,最后检查未完成的数据重建任务。题库里的“节点恢复后最先检查什么”,答案是数据重建和虚机负载均衡,而不是立刻把业务迁回去。原因是节点刚恢复,IO 能力还没回到正常水平,立即迁虚机反而会拖慢重建。
5. UIS-Cell 常见问题与避坑:5 个高频踩坑记录
5.1 现象:安装 UIS-Cell 时提示“CPU 不支持虚拟化”
原因:BIOS 中 Intel VT-x 或 AMD-V 未开启,部分品牌服务器出厂默认关闭。另一种情况是在虚拟机里嵌套安装,嵌套环境没有把硬件虚拟化指令透传进去。
解决:进 BIOS 打开 CPU 虚拟化开关,保存重启后再跑部署预检。如果是虚拟机嵌套安装,需要在虚拟机 CPU 配置里勾选“向客户机暴露硬件虚拟化”选项。
5.2 现象:两台节点的存储池一直显示“降级”
原因:最常见的是存储池内硬盘容量差异过大,或某节点硬盘接口不稳定,导致数据分布不均。很多人在这个阶段直接判断为硬盘故障,实际上硬盘 SMART 信息是正常的。
解决:先把存储池里的硬盘容量统一,低容量的盘替换掉,然后通过存储管理页面触发一次“数据均衡”,观察是否恢复正常。题库里那道“存储池降级但无硬盘故障”的题,答案项里选“触发数据均衡”,而不是“拔盘更换”。
5.3 现象:虚机热迁移失败,报错“无法获取目标主机资源”
原因:目标宿主机没有足够的 CPU 或内存满足该虚机需求;也可能目标主机的 CPU 型号与源主机差异过大,导致迁移后指令集不兼容。
解决:检查目标主机的剩余资源,释放后再迁移。如果是 CPU 型号差异问题,CAS 支持在“允许 CPU 不匹配迁移”的模式下强制迁移,但生产环境不建议长期这么做,因为虚机可能在目标主机上性能下降。考试中问“热迁移失败最常见原因”,优先检查资源是否足够,网络是第二排查点。
5.4 现象:重启某节点后,集群自动迁移了多台虚机,业务闪断
原因:节点在维护窗口被关闭时,UIS 判定为主机故障,触发 HA 切换,虚机在另一节点拉起,中间有几秒到几十秒的中断。
解决:维护操作前先在 UIS Manager 里把节点置为“维护模式”,让系统提前迁移虚机并关闭 HA 动作,再下电操作。这个动作是超融合维护的“后悔药”,忘记做了,后面就得面对闪断加数据重建的双重麻烦。这个坑在题库里对应的是“维护操作前必须执行的动作”这道题。
5.5 现象:UIS Manager 登录后频繁提示“证书有效期异常”,集群状态抖动
原因:宿主机系统时间与 NTP 服务器不同步,导致节点间心跳报文携带的时间戳不一致,逻辑上表现为“对端失联”,同时 HTTPS 证书校验失败。
解决:在所有节点上配置统一的 NTP 时间源,并确保管理节点、计算节点、存储节点指向同一个时间服务器。同步完成后重启 UIS Agent 服务,再观察集群状态。超融合环境里时间同步不是“锦上添花”,是分布式存储和集群仲裁的正常工作前提。
6. GB0-620 备考:把题库文档用出价值的三件事
第一件事是建立“题—技术点—操作”的映射。题库里每一道题,都可以在 UIS-Cell 的技术栈里找到一个具体的功能点。拿到题不要直接记答案,先翻到超融合手册对应功能的章节,想清楚这道题在考哪个知识点。我当年刷题时用的办法是,把每道错题标记成“架构认知”或“操作细节”两类。架构认知题必须理解后记忆,操作细节题才允许死记,这样到了考场上遇到变形题也不怕。
第二件事是动手搭一次三节点实验环境。哪怕是虚拟机嵌套搭建,也至少完成“创建集群 → 配置存储 → 创建虚拟机 → 故障演练”这个闭环。没有实操,题库里“判定时间设多少”“触发数据均衡”这类选项,你只能靠猜;有实操经验后,这类题目是靠肌肉记忆答对的。血泪经验告诉我,超融合考试最大的误区就是把题库当教材,把考点当速查表。考场上真正拉开差距的,是你有没有在真实环境里见过“降级”“脑裂”“维护模式”这三个词对应的画面。
第三件事是刻意记默认值。UIS-Cell 的认证考试里,默认值题的比例不低:HA 判定时间、存储策略默认副本数、管理网络默认 VLAN、虚机磁盘默认格式。这些默认值在产品手册里都有,整理成一张表刷几遍即可。常见默认值可以说是“题感”的来源,因为题目提供的四个选项往往只有一个和实际默认值一致,其他都是干扰项。
超融合考试的难处不在题量,在于它把不同领域的网络、存储、虚拟化知识压缩到一套场景里。做完上面三件事,考场里的 UIS-Cell 题目就都变成了你在实验环境里已经撞过一遍的场景,而不是需要靠记忆力硬扛的黑匣子。我自己在备考 GB0-620 时,最有效的做法就是把文档里每一道题旁边标注“这题对应 UIS Manager 哪个页面”“这参数在哪个策略里”,而不是整理一份标准答案去背。希望这个思路能帮你在 GB0-620 面前少走弯路,也让你真正掌握 H3C UIS-Cell 这套超融合系统的落地能力。
本文还有配套的精品资源,点击获取