值班人员执行自动扩容脚本创建10台服务器。脚本在返回结果前超时,实际资源已经创建;值班人员直接重跑,又创建10台。改造该运行手册时,最关键的是()。
第 1112 题
围绕信息系统管理工程师备考中常见的概念辨析、公式计算、流程判断和易错知识点整理,适合先刷高频题,再回到历年题查漏补缺。
值班人员执行自动扩容脚本创建10台服务器。脚本在返回结果前超时,实际资源已经创建;值班人员直接重跑,又创建10台。改造该运行手册时,最关键的是()。
一次配置误发布导致服务中断。复盘结论只写“值班人员粗心,以后加强责任心”,没有时间线、审批记录或后续任务。更有效的做法是()。
订单服务新版本先承接5%流量。整站平均错误率变化不明显,但按版本拆分后,新版本支付失败率为4%,稳定版本为0.2%,且差异持续超过观察窗口。发布系统应该()。
某服务的月度可用性SLO为99.9%,允许的错误比例为0.1%。监控发现最近1小时错误率持续为1%,业务请求量稳定。此时最合理的判断是()。
数据库计划维护两小时,会引发应用连接和下游探针告警。值班人员准备临时关闭全公司的所有监控,维护结束后再手工恢复。更合理的做法是()。
工单异步处理队列平时约有500条消息。某天队列长度仍在400至600之间,但最老消息已等待45分钟,而服务目标要求10分钟内处理。最需要优先关注的是()。
审计发现一个生产数据库服务账号已使用五年,密码写在脚本中,多套系统共享,登记负责人已经离职。最合理的治理措施是()。
服务目录中有一项“申请数据库权限”,页面只有一个自由文本框。用户不知道可申请哪些权限、由谁审批、多久完成,服务台不断退回补充信息。最有效的改进是()。
服务台处理故障工单时需要用户补充日志。工程师为避免超时,直接把工单改为“等待用户”并无限期暂停SLA,却没有通知用户,也没有约定恢复条件。下列改进最合适的是()。
商城服务器CPU、内存、端口和进程监控均为正常,但支付接口返回了格式正确的业务拒绝,导致所有用户无法完成下单。现有监控仍显示绿色。最有效的改进是()。
某单位希望降低单盘故障、存储设备损坏以及机房级灾害同时导致数据丢失的风险,计划保留三份数据、使用两类存储介质,并至少保存一份异地副本。该思路通常称为()。
运维团队发现同一集群中的服务器经过多次临时处理后,防火墙规则、软件版本和系统参数逐渐不一致。要持续发现并治理这种配置漂移,较合理的做法是()。
核心交换机中断后,监控平台同时收到链路、服务器、应用和接口不可达等数百条告警,值班人员难以定位根因。较合理的治理方式是()。
某核心业务系统需要升级中间件版本。运维团队没有选择工作日上午业务高峰直接操作,而是申请变更审批,安排在低峰期变更窗口实施,并提前准备回退方案和验证清单。这样做的主要目的较合理的是()。
用户向 IT 服务台反馈无法登录业务系统。即使问题需要转交二线处理,一线服务台仍负责记录工单、跟踪进展、协调反馈,并在解决后确认用户是否恢复使用。这种做法主要体现了()。
某单位对外承诺业务系统可用率、响应时间和故障恢复时间;内部运维、网络、数据库团队之间也约定各自支撑责任;同时与第三方云服务商签订支撑合同。上述三类约定分别更接近()。
运维中心同时收到两类事件:一类是全公司员工无法登录核心业务系统,另一类是单个用户的打印机偶尔卡纸。值班人员在分派处理顺序时,应优先考虑()。
某系统记录管理员登录、权限变更、数据导出等关键操作。为了保证事后追溯和责任认定,日志不应被普通管理员随意删除或修改,必要时还应集中存储并做完整性保护。这主要是为了保证审计日志的()。
某单位在发布前检查配置项版本、配置记录、变更批准情况和实际部署内容是否一致。该活动更接近配置管理中的()。
某单位的资产台账能查到服务器编号、采购日期、金额、责任人和存放位置,但在准备数据库服务器停机维护时,无法判断会影响哪些应用系统、接口和业务服务。若要支持变更影响分析,更需要完善()。
某系统偶尔出现同类报错,暂时无法彻底修复,但运维团队已经确认根因,并整理了临时绕行办法和最终解决计划。为了让服务台快速处理同类事件,较合适的做法是建立或更新()。
某业务系统的新版本已经通过变更审批,运维团队接下来要安排上线窗口、发布包、部署步骤、回退方案和上线验证。这个阶段更偏向()。
某信息系统平均无故障时间 MTBF 为 198 小时,平均修复时间 MTTR 为 2 小时。该系统可用率约为()。
某系统最近告警很多,值班人员为了少被打扰,直接把 CPU、磁盘和接口超时的告警阈值大幅调高,也没有区分告警级别和业务影响。这样做最可能带来的风险是()。
某员工已经离职,但其业务系统账号、VPN 权限和数据库查询权限仍然保留。几周后审计发现该账号还有登录记录。这个案例最直接暴露的问题是()。
某单位要评估数据库服务器停机维护会影响哪些业务系统、应用接口和用户部门。如果 CMDB 只登记设备名称和编号,却没有记录配置项之间的依赖关系,最容易造成的问题是()。
某系统每天都有数据库备份文件,但从未进行过恢复演练。一次故障后才发现备份文件不完整,恢复脚本也无法在新环境正常执行。该案例最能说明()。
某单位每月底集中办理业务,系统平时运行正常,但月底两天经常出现 CPU 使用率飙升、数据库连接数耗尽、页面响应变慢。为了避免业务高峰反复压垮系统,更应该加强的是()。
某运维人员发现生产系统需要调整一项配置,为了图方便,没有提交变更申请,也没有评估影响范围和回退方案,直接在业务时间修改。该做法最主要违反了()。
某单位的业务系统一周内没有发生完全宕机,但高峰期多次出现登录很慢、查询超时、部分接口间歇性不可用。运维人员如果只用“服务器没有停机”来判断服务状态,最容易忽略的是()。
某业务系统每隔几天就会出现同类报错,值班人员每次都能通过重启服务临时恢复。为了减少同类故障反复发生,后续更应该重点开展()。
为了规范信息系统运维服务交付,提升服务质量和用户满意度,组织通常会建立哪类管理体系?
用户报告系统无法登录,运维团队记录、分类、诊断并恢复服务,这通常属于 IT 服务管理中的哪类过程?