`
liwenshui322
  • 浏览: 519266 次
  • 性别: Icon_minigender_1
  • 来自: 北京
社区版块
存档分类
最新评论

(转) OCP知识点讲解 之 检查点队列与增量检查点

 
阅读更多

原博客地址:http://blog.chinaunix.net/uid-26762723-id-3271558.html

讲得非常好,值得推荐

 

 

检查点的主要目的是以对数据库的日常操作影响最小的方式刷新脏块。脏块不断的产生,如何将脏块刷新到磁盘中去呢?在8i之前,Oracle定期的锁住所有的修改操作,刷新Buffer cache中的所有脏块,这种刷新脏块的方式被称为完全检查点,这极大的影响了效率,从9i之后只有当关闭数据库时才会发生完全检查点。

 

     从8i开始,Oracle增加了增量检查点的概念,增量检查点的主要宗旨就是定期的刷新一部分脏块。将脏块一次刷新完是不合理的,因为脏块不断产生,没有穷尽。像完全检查点那样停止用户所有的修改操作,将脏块刷新完再继续,这绝对会极大的影响性能。所有增量检查点的一次刷新部分块是脏块问题的最好解决办法。那么,每次刷新时,都刷新那些块呢?根据统计研究,根据块变脏的顺序,每次刷新那些最早脏的块,这种方式最为合理。为了实现这一点,Oracle在Buffer cache中又建立了一个链表,就是检查点队列。每个块在它变脏时,会被链接到检查点队列的末尾。就好像排队一样,9:00来的人站在第一位,9:05来的人排第二位,以后每来一个人都站在队伍的末尾,这个队伍就是按来到的时间顺序排列的一个队列。检查点队列就是这样,块在变脏时会被链到末尾。因此检查点队列是按块变脏的时间顺序,将块排成了一个队列。

 

 

     如上图,检查点队列中的每一节点,都指向一个脏块。检查点队列每个节点中的信息其实非常少,就是记录对应块在Buffer cache中的地址,脏块对应的重做记录在日志文件中的位置,另外还有前一个节点、后一个节点的地址。检查点队列还有LRU、脏LRU,这些都是双向链表。双向链表就是在节点中记录前、后两个节点的地址。

     检查点队列头部的块是最早变脏的,因此,Oracle会定期唤醒DBWn从检查点队列头开始,沿着检查点队列的顺序,刷新脏块。在刷新脏块的同时,仍可以不断的有新的脏块被链接到检查点队列的尾部。这个定期唤醒DBWn刷新脏块的操作,Oracle就称为增量检查点。

 

     如上图,1、2、3号节点所指向的脏块已经被刷新为干净块。同时,又有两个块变脏,它们被链接到了检查点队列的末尾,它们是9号、10号节点。

     检查点队列的头,又被称为检查点位置,Checkpoint postion,这些名称我们不必从字面上去理解。总之,检查点位置就是检查点队列头。检查点队列头节点(也就是检查点位置)的信息,Oracle会频繁的将它记录到控制文件中,而且会很频繁的记录。一般是每隔三秒,有一个专门的进程CKPT,会将检查点位置记录进控制文件。

 

     如上图,当前的检查点位置是检查点队列的1号节点。又一个三秒到了,CKPT进程启动,将新的检查点位置记入控制文件:

 

 

 

     新的检查点位置是4号节点,它对应当前变脏时间最早的脏块。1、2、3号节点已经从检查点队列中摘除了。因为它们对应的脏块已经不脏了。一般来说,控制文件中的检查点位置之后的块都是脏块。但是有时也例外,因检查点位置每三秒才会更新一次,就像上图,1、2、3号节点对应的脏块已经被刷新过了,但是由于三秒间隔没到,检查点位置还是指向1号节点。只有当三秒到后,检查点位置才会被更新到4号节点上。

     关于检查点队列、检查点位置我们先说到这里,在全面的介绍什么是增量检查点之前,我们先说一下检查点队列的一个重要作用。

     让我们先来总结一下用户修改块时,Oracle内部都发生了什么:

     1.如果块不在Buffer cache,将块读入Buffer cache

     2.先生成重做记录,并记入日志缓存,在用户提交时写到日志文件中

     3.在Buffer cache中修改块

     4.在Buffer cache中设置块的脏标志位,标志块变成脏块,同时在检查点队列末尾增加一个新节点,记录这个新脏块的信息,信息包括:脏块在Buffer cache中的位置,在步骤2时生成的与此脏块对应的重做记录位置。

     5.用户提交后,将相应的重做记录从重做缓存写入日志文件。

 

     我现在将日志补充到上面的图中:

 

     就像上图,检查点队列的每个节点,都保存有脏块的地址和脏块对应的重做记录的编号。脏块在Buffer cache中的位置是随机的,用户不一定修改那个块。但重做记录是顺序生成的,就和检查点队列的排列顺序一样。因为,它们都是当块被修改而变脏时产生的。块A先被修改,块A的重做记录就排在前面,块B后被修改,块B对应的重做记录会被排在块A对应的重做记录的后面。和它们在检查点中的顺序是一样。每当数据库因异外而当机,比如异常死机、断电等等,Buffer cache中有许多脏块没来的及写到磁盘上。以图为例,比如说现在断电了,现在磁盘上还有7个脏块,它们里面有用户修改过的数据,Oracle已经将反馈信息“你的修改完成”发送给用户,用户也以为他们的修改完成了,将为一直保存到数据库中。但是,断然的断电,令这几个脏块中的数据丢失了,它们没来得及写到磁盘上。

     Oracle如何解决这个问题呢?很简单,当数据库重新启动时,Oracle只需从控制文件中读出检查点位置,检查点位置中记录有重做记录编号,根据此编号,Oracle可以很快的定位到日志文件中的重做记录n,它读出重做记录n中的重做数据,将用户的修改操作重现到数据库。接着,Oracle读取重做记录n+1中的重做数据,重现用户修改,这个过程将沿着日志流的顺序,一直进行下去,直挡最后一条重做记录,在上图的例子中,最后一条重做记录是第n+6条。这个过程完成后,用户所有的修改又都被重现了,一点都不会丢失。只要你的日志文件是完整,日志流是完整的,就一点信息都不会丢失。

     有人可能会有一个问题,重做记录在生成后,也是先被送进重做缓存,再由重做缓存写往日志文件。这样的机制下,一定会有某些重做记录在没来的及写到日志文件中时,数据库突然当机,而造成这些重做记录丢失。这样,这些重做记录所对应的脏块,将得不到恢复。用户还是会丢失一些数据。

     这种情况的确会发生,但丢失的都是没用的信息。为什么这么说的。Oracle会在用户每次发出提交命令时,将事务所修改脏块对应的重做记录写进日志文件,只有当这个操作完成时,用户才会收到“提交完成”,这样的信息,对于一个完整的事务,当用户看到提交完成后,也就意味着所对应的重做记录一定被写到了日志文件中,即使发生异常死机,它也是绝对可以恢复。而当用户没有提交,或没来得及提交,数据库就崩溃了,那么事务就是不完整的,这个事务必须被回滚,它根本用不着恢复。对于这样不完整的事务,它对应的重做记录有可能丢失,但这无所谓了,因为不完整的事务根本不需要恢复。也就是说,只有用户的事务提交了,用户的修改一定不会丢失。不过这还有一个前提,就是日志文件千万不能损坏,DBA所要做的就是要保证日志文件不能损坏。DBA可以使用RAID1这样的磁盘镜像技术,或者多元备份日志文件,等等,这个我们在前面章节中已经讲过了的。

     我们上面所讲到的这种恢复,是自动进行的,并且不需要DBA参与,它被称之为实例恢复。

     检查点队列与增量检查点的作用我们已经说的差不多了,它们的主要目的就是让DBWn沿检查点队列的顺序刷新脏块。还有,就是实例恢复。

 

     下面我们来讨论一下增量检查点的设置。

 

 

 

     这里所说的检查点设置,主要指增量检查点频繁的设置。注意增量检查点只是一个名词,不必按字面的意义去理解它。增量检查点发生时,Oracle会唤醒DBWn沿着检查点队列写脏块,这就是增量检查点。那么到底多长时间一次发生一次增量检查点呢?这个增量检查点的频率是非常重要的,它基本上控制着DBWn多长时间去刷新一次脏块。DBWn活动的太频繁,会影响数据库的整体性能,如果DBWn活动太不频繁,又会使脏块挤压太多,这同样也会影响性能。而且,如果出现异常崩溃,需要实例恢复,脏块越多,实例恢复越慢。。在9i之前DBA主要靠间隔时间等方式来设置增量检查点的频率,比如可以让Oracle每10分钟发生一次增量检查点。如果这个数字设置不合适,对数据库性能的影响是很大的。而且有可能造成实例恢复时间过长。在9i之后,特别是到了10g中,检查点已经相当的智能化了,很少会成为I/O问题的原凶。9i中设置fast_start_mttr_target参数为你所期望的实例恢复时间,系统将自动控制增量检查点的频率。比如,你希望实例恢复可以在5分钟内完成,你可以将此参数设置为300,也就是300称。

     如果此参数设置的值超出了硬件实际的限制,比如你将它设置为60,你期望无论在任何情况下,数据库都可以在1分钟内完成实例恢复,但根据数据库的脏块生成速度、存储设备的写性能,1分钟内根本无法完成实例恢复。这时候Oracle会自动设置合适的fast_start_mttr_target参数值,我们可以在参数文件中看到修正后的参数值,也可以在V$instance_recovery视图中的Target_mttr列中看到实际的值。例如:

     (举个例子)

     我们不能将这个值设置的太小,因为实例恢复必竞只是偶然现象。如果为了让实例恢复尽快完成,而设置fast_start_mttr_target为很小的值,那么DBWn将活动的很频繁,这会造成性能问题的。为了避免用户设置不合理的增量检查点频率,在10G中,如果将fast_start_mttr_target设置为0,Oracle将根据产生脏块的速度、存贮硬件的性能自动调节检查点的频率,尽量使检查点频率不成为I/O问题的原凶。

     检查点的主要任务就是催促DBWn刷新脏块,如果DBWn刷新脏块时的等待事件太多,就说明脏块太多、存储设备的写速度太慢,或者就是增量检查点的频率太高了,或太低了。DBWn写脏块的等待事件是Db file parallel write。如果你的增量检查点频率很低,你发现了此事件,在排除了存储设备写性能的问题后,你应该将增量检查点频率设置的高一些。反之,如果你的增量检查点频率本身很高,出现了Db file parallel write事件,这说明检查点频率太高了。

     除它之外,还有一个和DBWn、增量检查眯有关的等待事件,它是Write complete waits事件,当前台进程要修改DBWn正要成批写的块中的若干个块时,就会有此等待事件,这个事件是前台进程再等待DBWn写完成。这个等待事太多,说明了存储设备写性能有问题,或者增量检查点太频率了。

 

     我们可以V$instance_recovery中看到有关检查点的很多信息:

 

     Estimated_mttr列如果太大,说明检查点不够频繁,同时也说明脏块产生的太多。同时在V$sysstat资料视图中,还有两个资料background checkpoints startedbackground checkpoints completed,前面的一个是后台进程检查点开始次数,后一个是后台进程检查点完成次数。后台进程检查点的意义,其实就是增量检查点。只有增量检查点是由后台进程触发的。如果你用Alter system checkpoing命令让系统完成完全检查点,这叫做前台检查点与增量检查点无关,是不会被记入这两个资料了。如果这两个值经常相差一些,比如检查点的开始次数比完成次数大的不至1,这说明有太多次检查点开始,但没有及时完成。这说明检查点太频繁或检查点完成的太慢。

     (举例,大量的产生脏块、日志文件比较小5MB,日志文件频率的切换而触发检查点,同时查看一下等待事件)

     检查点的问题大多数情况下其实都是DBWn写I/O的问题, DBWn写脏块的等待事件是Db file parallel write,还有Write complete waits等待事件,是当前台进程要修改DBWn正要成批写的块中的若干个块时,就会有此等待事件,这个事件是前台进程再等待DBWn写完成。这个等待事太多,也说明了DBWn有问题。

     注意,对于数据文件的I/O问题,除了等待事件外,我们还可以用上几节讲过了V$filestat视图帮助确定问题。)

分享到:
评论

相关推荐

    MySQL_OCP5.7带讲解.pdf

    知识点一:MySQL复制与备份的配置 在MySQL中,实现复制和备份是常见的运维任务。题目中提到了使用mysqldump工具来搭建复制的从服务器,并需要从正在运行的生产服务器上获取一个一致性备份。为了减小备份对活跃服务器...

    OCP

    **知识点二:OCP认证过程** 成为OCP的途径通常包括以下几个步骤: 1. **基础认证**:首先,候选人需要通过Oracle Certified Associate(OCA)级别的认证,这通常涉及一门基础知识考试,如Oracle Database SQL。 2...

    oracle OCP经典题库1,付答案讲解。

    这两个压缩包中的题库涵盖了以上所有知识点,通过解答这些题目并阅读配套的讲解,可以帮助你巩固理论知识,提高实际操作技能,为顺利通过Oracle OCP认证考试打下坚实的基础。记得在学习过程中,不仅要理解和记忆,更...

    OCP 1Z0-051讲解视频.zip

    【标题】"OCP 1Z0-051讲解视频.zip" 提供的是Oracle Certified Professional(OCP)认证考试1Z0-051的相关教学视频资源。Oracle Certified Professional是Oracle公司为数据库专业人士设立的一项专业认证,旨在验证其...

    Oracle OCP 19C 刚刚过了,题库分享062 063 071新题

    Oracle OCP 19C 刚刚过了,题库分享062 063 071新题

    最新oracle ocp 053题库解析

    053题库将涉及这一关键特性以及与之相关的配置、管理、性能优化等内容。 1. **多租户架构**:理解CDB和PDB的概念,如何创建、挂载、打开和关闭PDB,以及如何在CDB和PDB之间迁移对象。 2. **数据库安装与升级**:...

    OCP 1Z0-053讲解视频.zip

    这个压缩包"OCP 1Z0-053讲解视频.zip"显然包含了针对这个考试的视频教程资源,旨在帮助学习者深入理解Oracle 11g数据库管理的各个方面,以通过认证考试。 "开闭原则"是面向对象设计中的一个核心原则,由艾尔伯特·...

    11g ocp培训大纲_chs

    - 增量备份与全备份的区别。 - 数据库的还原与恢复流程。 - 使用 RMAN 进行灾难恢复。 **4. 数据库性能监控与调优** - **目标**:了解数据库性能监控工具及其调优方法。 - **知识点**: - 使用企业管理器(EM)...

    OCP认证复习和学习经验分享

    oracle学习,OCP认证复习和学习经验分享,基本知识点介绍

    OCP 042全真试题讲解-1

    OCP 042全真试题讲解,学习oracle必备

    OCP 042全真试题讲解-3

    OCP 042全真试题讲解,学习oracle必备

    OCP 042全真试题讲解-2

    OCP 042全真试题讲解,学习oracle必备

    Oracle课程之OCP免费教学视频

    Oracle课程之OCP免费教学视频 本资源为Oracle高级开发课程之PL_SQL编程课程,旨在为初学者提供一个系统的学习路径,帮助他们快速掌握Oracle数据库管理的技能。课程涵盖了PL/SQL编程的基础知识、实践操作和高级开发...

    OCP-053 VCE-模拟

    通过这份OCP-053 VCE模拟资源,考生可以对这些关键知识点进行深入学习和实践,提升解决问题的能力,为通过考试做好充分准备。每个题目后的深度解析能帮助考生理解问题背后的原理,提高学习效果。共享这些资源,不仅...

    ocp-052最新题库-2019年3月最新

    在数据库管理中,增量检查点(incremental checkpoint)是指一个记录在重做日志文件中,标明在该检查点之前所有改变的数据块都已经被写入磁盘的点。题库中提到的检查点触发条件,选项A) 当一个在线重做日志切换发生...

    OCP认证题库中文解析

    OCP认证主要涵盖以下几个核心知识点: 1. **Oracle数据库基础**:这是所有OCP学习的基础,包括了解数据库的概念、数据库的架构以及Oracle数据库的安装与配置。考生需要熟悉SQL语言,如数据查询、数据更新、数据插入...

    oracle ocp考试模拟器

    使用这个模拟器,考生可以进行自我测试,检查对上述知识点的理解程度,及时查漏补缺。"OCP考试模拟器201703"可能包含2017年3月更新的最新试题,确保考生能够接触到最新的考试趋势和重点内容。 总之,Oracle11g OCP...

    oracle OCP 培训教材

    Oracle 9i OCP培训教材可能涵盖了以下几个关键知识点: 1. **数据库安装与配置**:包括Oracle 9i的软件安装、数据库创建、初始化参数文件(init.ora)的管理和实例启动与关闭等操作。 2. **数据存储管理**:讲解了...

    OCP 12c之02_12c_ocp_Administration_Workshop

    OCP 12c之02_12c_ocp_Administration_Workshop课程主要围绕Oracle数据库12c版本的体系结构、内存结构、后台进程、逻辑与物理存储结构、可插拔数据库(PDBs)以及自动存储管理(ASM)存储组件等内容进行展开。...

Global site tag (gtag.js) - Google Analytics