
安全问题也是如此,与其事后补救不如事前预防。因此,建立应用系统上线前的安全管理措施同样非常重要,主要包括:
(1)在应用系统规划阶段,充分考虑运行后的安全性因素,设计好解决方法或者规避措施。
(4)检查己启用的服务,根据需要关闭掉不必要的服务例如:FTP、IIS、Telnet等。
(6)更换administrator用户,设置符合强度要求的密码和权限范围;停用guest等账号。
(7)在完成上述步骤后,使用专业的安全评估设备,进行漏洞扫描及安全评估,在评估结果为安全的情况下,再进行应用程序的安装。
(8)在完成应用程序部署后,再次使用安全评估设备,进行漏洞扫描及安全评估,只有评估安全的情况下才正式上线运行。
安全问题的特点为“三分技术、七分管理”。除了各种技术手段外安全管理的落实是解决安全问题、提高安全水平的基石。面对网络与信息安全的脆弱性除了完善系统的安全防御措施外还须加强网络与信息安全的日常工作管理,在遵循ISO20xx0标准的前提下,重点做好以下工作:
(1)根据《数据机房运行管理办法》要求,每天定时对机房的环境、设备和应用系统的状态进行巡检。
(3)通过机房环境监控系统对机房内的动力、温度、湿度和消防状态,进行监控管理。
(4)通过应用系统监控软件对服务器、网络设备、中间件、数据库和WEB应用的运行状态进行监控管理,一旦发生异常及时进行报警。
(6)任何人对应用服务器进行的任何操作,都必须在授权后才能进行,对于变更程序等重大操作,必须填写变更申请单和记录单。
(7)对系统的操作过程必须使用相关人员账号,通过堡垒机进行操作,以便对操作过程进行记录、录像。
(8)建立用户权限申请、变更审批流程制度,同时对用户操作内容进行记录,并定期审计以上内容。
为了提供全面的数据保护,降低应用系统的停机时间,提高安全性和连续性,根据下图中应用系统的层次,利用冗余、群集、备份和容灾等技术,对包括服务器硬件、操作系统、应用程序、数据库及重要文件制定了全套的保护措施和保护方案。
服务器的硬盘数据保护:目前可通过磁盘阵列来实现磁盘上数据的保护,常用的阵列有Raid10和Raid5等,Raid10能提供很高的读写性能和数据安全性,但是磁盘的利用率很低,阵列的总容量只有磁盘数量的一半。Raid5的读写性能和数据安全性虽然没有Raid10高,Raid的配置可根据预算和应用系统的需求进行合理配置。
服务器的网卡保护:为每台服务器配置两块网卡,,将两块网卡绑定为一块网卡,当任意一块网卡故障,或连接的网络设备故障时,另一块网卡可继续保持工作,可避免因网络故障引起的停机事件。
服务器其它硬件保护(如主板、CPU等):发生硬件故障造成停机,必然会造成应用系统的中断,可通过群集技术,实现应用系统的高可用。常用的群集有服务器群集、应用系统群集、数据库群集等。
现在各种常用操作系统都提供了群集管理软件。通过群集管理软件,可在一台节点服务器发生故障停机时,将该节点的应用迁移到群集中,其它正常工作的节点服务器上运行,从而保证应用系统的高可用性。
应用程序发生故障会对业务产生直接影响,为了实现应用系统的连续性,多采用群集部署方式。例如采用了websphere群集技术,将应用程序部署在一个前台web服务管理器和多个应用程序服务器上,前端web服务负责管理调度,会根据事先定义的策略,将每个客户发起的会话请求,分配到不同的应用服务器上,当某个应用程序节点发生故障时,前端web服务停用该节点,而使用其它应用程序节点继续工作,这样的部署不仅实现了高可用,同时也实现了应用的负载均衡。
数据库是应用系统的后台部分,高可用性要求是最高的,因此数据库群集以双机热备为主。如Oracle数据库群集采用RAC技术,使用多节点服务器实现数据库的高可用。
由于数据库的连续性要求较高,因此数据库的备份以在线式备份为主。根据数据库恢复数据的需求不同,采用多种备份方式进行备份,如归档备份、日志备份、控制文件备份、导出备份和数据库备份。在线式备份在备份的时候,需要消耗操作系统和数据库资源,备份时会降低应用系统的性能,所以一般在系统相对空闲的时间段进行。
存储是群集的,因此对存储的安全性要求也是最高的。目前常用的能实现高可用的存储有光纤SAN、IPSAN等,可采取同步复制或者镜像技术实现高可用。
如何进行全面的数据备份,首先需要通过各种备份策略,对操作系统、应用程序和数据库的数据,进行不同时间点,不同类型的数据备份,其次需要制定各种场景的恢复方案和容灾方案,最后需要定期对各种数据恢复方案,进行恢复演练,并根据演练结果,调整数据恢复方案,以保障数据恢复方案和容灾方案的可行性和有效性。容灾机制包括建立灾难备份系统的管理机制、组织架构、灾难响应流程、灾难切换流程、灾难应急流程等。
数据备份的目的是为了恢复,针对恢复场景的不同,需要制定各种不同的恢复方案,包括常规数据恢复方案和灾难性故障的容灾机制。数据恢复方案和容灾机制制定后,必须进行严格的测试,确保方案的成功率和有效性。需要按照恢复演练计划定期进行恢复演练,演练是为了熟悉容灾切换、回切流程,使员工熟悉自己在容灾中所扮演的角色,在灾难真正发生时,能够有条不紊地开展恢复的过程。通过演练,还可以发现切换、回切流程的不足,验证和优化灾难恢复方案,确保在灾难发生时,灾难恢复方案能够行之有效。
无论我们的安全措施如何完善,也没有办法预测所有可能发生的事件。因此无论在架构设计、系统维护、数据备份和灾难演练等环节,都需要不断的完善和改进,尽可能的降低应用系统的风险,只有技术和管理相结合,不断发现问题,持续改进完善安全机制,才能保证应用系统的稳定和安全。
简介:刘晨(1968—),男,湖北武汉人,中级工程师,研究方向:计算机技术及应用。