论文标点检测

发布时间：2023-12-10 12:13:19

论文标点检测

标点符号对论文查重的重复率是没有影响的，因为在论文查重系统中，所要查重的，具体事宜段落为单位的整段复制和粘贴的内容。

首先要知道我们论文的查重范围，会检查正文、引言、引文、结论。标点符号是否参与查重？我们的论文以文字为主，当然也会有一些图片、表格、公式。写论文的时候，大家肯定会用到标点符号。标点符号是最常用的，我们所有的内容都需要用标点符号隔开。所以我们的论文正文里也包含了标点符号，也需要参与查重。但是我们从来没有听过标点符号重复的说法，所以说论文中的标点符号是重复的，但是一般情况下，是不会有标点符号重复的。符号是具有代表意义的符号。首先，它是用来指代和表示其他事物的符号。其次，我们的标点符号也是一种载体，承载着双方的一些信息。标点在我们的论文中起着非常重要的作用。一篇文章如果没有标点符号，整篇文章就没有意义，你就没有办法理解这篇文章在讲什么，所以标点符号在论文中是必不可少的。所以，你会参与查重是肯定的。在写论文的过程中，一定要注意标点符号的正确应用。标点符号用得不对，就会偏离你想表达的意思。

上传到论文查重系统上论文通常是以整片的形式发表的，格式有些不同可能会造成一些影响，几十个字应该检测不出来，所以，对于文字较多的论文（如3万字符以上）是可以忽略的。接着，在上传完毕后，PpaperPP查重系统将自动化检查你所提交的论文，检查其中的章节和目录信息，可以按章或者按段分开检测。因为论文查重系统对灵敏系统做了阀值，为5%，抄袭或者引用的量未超过这个值都不会被检测出来，所以即使做了引用也不会被检测出来，这种常见于对小概念和小句子的引用。连续有十三个字相似或相同都会检测出来，并以红色字体标记出来，其前提是你所引用或抄袭的文字已经超过阀值5%。论文撰写的基本要求(一)论文写作必须坚持学术道德和写作规范，不得抄袭他人的文字或剽窃他人的研究成果，论文中除已注明部分外不包含他人已发表或撰写过的研究成果，对本文的研究工作做出重要贡献的个人和集体均应在文中注明，论文作者需要承担论文的法律后果。(二)理论与实际相结合，论文应有一定的学术价值，或具有实际意义和应用价值。对论文涉及的问题，作者应具有坚实的理论基础和系统的专业知识，掌握丰富的资料。 (三)论文在导师指导下独立完成，要有独立见解，或对学士界已提出的问题做出新的分析和论证，学术观点必须言之有理，逻辑严谨，文字顺畅。 (四)论文字数一般为2—4万字。

论文在查重的时候只针对于某一段文字或者是某一个观点，并不针对于标点符号，所以你的变态符号重复了之后，并不影响你的作文质量。

检测论文标点符号

从知网查重入口摘取部分内容如下：知网论文查重系统能够识别待检论文的参考文献并把它排除在外，以免参考文献部分也被标红。但是，只有你的论文的参考文献满足以下的要求，知网论文查重系统才能够从中提取信息。因此，请确保你的参考文献满足以下的格式：1、有明显的“参考文献”标记，参考文献四个字独占一行，下面是各个参考文献条目；2、每个参考文献有明显的标号，标号可以是以下任意一种：[num]、(num)、【num】；此符号可以是word自动生成也可以手工书写；标号内不要添加标点符号，例如：不要[num。]或(num、)等；3、每个参考文献中最好有时间信息或URL或《》书目信息；4、一条参考文献内及在此条参考文献没有结束时不要有手动换行符或者回车符：例如：[10] 权衡，易有彬，俞彩娟等.丝光羊毛柔软平滑剂RH-NB-S2033的研制及其应用性能研究.[J].毛纺科技.2005，10：12-14.应该这样：[10] 权衡，易有彬，俞彩娟等.丝光羊毛柔软平滑剂RH-NB-S2033的研制及其应用性能研究.[J].毛纺科技.2005，10：12-14.

标点符号对论文查重的重复率是没有影响的，因为在论文查重系统中，所要查重的，具体事宜段落为单位的整段复制和粘贴的内容。

第一步：初稿一般重复率会比较高(除非你是自己一字一句写的大神)，可以采用万方、papertest去检测，然后逐句修改。这个系统是逐句检测的，也就是说你抄的任何一句话都会被检测出来。这种检测算法比较严格，从程序的角度分析这种算法比较简单。因而网上卖的都很便宜，我测的是3万字，感觉还是物美价廉的。(注意：1 这个库不包含你上一届研究生师兄的大论文，修改一定注意. 2 个人建议如果学校是用万方检测，就不要去检测维普之类的先把论文电子版复制一份，保存一份。看检测结果，其中一份复制的备份论文，把检测出重复的部分能删了先删了，把不能删的，15字以内改一改，最好是加减字符，不要改顺序，改顺序没太大用，参考文献删掉一部分，不能删的话，先改下，英文文献可以15个字符换一个词。把修改过的上交，重新过系统检查。保存的原论文稍做改动上交纸质版。那个系统很麻烦的，很多没看过没应用过的文献都能给你加上，可见中国人抄袭的功夫，都是互相抄，但是为了保证论文的完整性和表述的准确性，不要随意改动，上交的纸质版，一定要斟酌，一般检查完就不会再过检测系统了，所以纸质版的不用担心。第二步：经过修改后，重复率大幅下降了。这时你可以用知网查了，知网查重系统是逐段检测的，比较智能。检测后再做局部修改就基本上大功告成了，我最后在网上用知网查是4%，简单修改后，在学校查是。注意：记住，最忌讳的是为了查重，把论文语句改得语句不通、毫无逻辑，这样是逃不过老师的，哈哈，大家加油！知网系统计算标准详细说明：1．看了一下这个系统的介绍，有个疑问，这套系统对于文字复制鉴别还是不错的，但对于其他方面的内容呢，比如数据，图表，能检出来吗？检不出来的话不还是没什么用吗？学术不端的各种行为中，文字复制是最为普遍和严重的，目前本检测系统对文字复制的检测已经达到相当高的水平，对于图表、公式、数据的抄袭和篡改等行为的检测，目前正在研发当中，且取得了比较大的进展，欢迎各位继续关注本检测系统的进展并多提批评性及建设性意见和建议。 2．按照这个系统39%以下的都是显示黄色,那么是否意味着在可容忍的限度内呢?最近看到对上海大学某教师的国家社科基金课题被撤消的消息,原因是其发表的两篇论文有抄袭行为,分别占到25%和30%. 请明示超过多少算是警戒线？百分比只是描述检测文献中重合文字所占的比例大小程度，并不是指该文献的抄袭严重程度。只能这么说，百分比越大，重合字数越多，存在抄袭的可能性越大。是否属于抄袭及抄袭的严重程度需由专家审查后决定。 3．如何防止学位论文学术不端行为检测系统成为个人报复的平台？这也是我们在认真考虑的事情，目前这套检测系统还只是在机构一级用户使用。我们制定了一套严格的管理流程。同时，在技术上，我们也采取了多种手段来最大可能的防止恶意行为，包括一系列严格的身份认证，日志记录等。 4．最小检测单位是句子，那么在每句话里改动一两个字就检测不出来了么？我们对句子也有相应的处理，有一个句子相似性的算法。并不是句子完全一样才判断为相同。句子有句子级的相似算法，段落有段落级的相似算法，计算一篇文献，一段话是否与其他文献文字相似，是在此基础上综合得出的。 5．如果是从相关书籍上摘下来的原话，但是此话已经被数据库中的相关文献也抄了进去，也就是说前面的文章也从相关书籍上摘了相同的话，但是我的论文中标注的这段话来自相关的书籍，这个算不算学术抄袭？检测系统不下结论，是不是抄袭最后还有人工审查这一关，所以，如果是您描述的这种情况，专家会有相应判断。我们的系统只是提供各种线索和依据，让人能够快速掌握检测文献的信息。6．知网检测系统的权威性？学术不端文献检测系统并不下结论，即检测系统并不对检测文献定性，只是将检测文献中与其他已发表文献中的雷同部分陈列出来，列出客观事实，而这篇检测文献是否属于学术不端，需专家做最后的审查确认。

论文查重中标点符号也是算字符查重的PaperRater论文查重中，查重的计算是按照字符计算的，白电符号查重是算一个字符的这个论文查重软件的查重精准度是很高的，你可以去查重试试看的

目标检测论文的创新点

论文名称：Rich feature hierarchies for accurate object detection and semantic segmentation 提出时间：2014年论文地址：针对问题：从Alexnet提出后，作者等人思考如何利用卷积网络来完成检测任务，即输入一张图，实现图上目标的定位（目标在哪）和分类（目标是什么）两个目标，并最终完成了RCNN网络模型。创新点： RCNN提出时，检测网络的执行思路还是脱胎于分类网络。也就是深度学习部分仅完成输入图像块的分类工作。那么对检测任务来说如何完成目标的定位呢，作者采用的是Selective Search候选区域提取算法，来获得当前输入图上可能包含目标的不同图像块，再将图像块裁剪到固定的尺寸输入CNN网络来进行当前图像块类别的判断。参考博客：。论文题目：OverFeat: Integrated Recognition, Localization and Detection using Convolutional Networks 提出时间：2014年论文地址：针对问题：该论文讨论了，CNN提取到的特征能够同时用于定位和分类两个任务。也就是在CNN提取到特征以后，在网络后端组织两组卷积或全连接层，一组用于实现定位，输出当前图像上目标的最小外接矩形框坐标，一组用于分类，输出当前图像上目标的类别信息。也是以此为起点，检测网络出现基础主干网络(backbone)+分类头或回归头（定位头）的网络设计模式雏形。创新点：在这篇论文中还有两个比较有意思的点，一是作者认为全连接层其实质实现的操作和1x1的卷积是类似的，而且用1x1的卷积核还可以避免FC对输入特征尺寸的限制，那用1x1卷积来替换FC层，是否可行呢？作者在测试时通过将全连接层替换为1x1卷积核证明是可行的；二是提出了offset max-pooling，也就是对池化层输入特征不能整除的情况，通过进行滑动池化并将不同的池化层传递给后续网络层来提高效果。另外作者在论文里提到他的用法是先基于主干网络+分类头训练，然后切换分类头为回归头，再训练回归头的参数，最终完成整个网络的训练。图像的输入作者采用的是直接在输入图上利用卷积核划窗。然后在指定的每个网络层上回归目标的尺度和空间位置。参考博客：论文题目：Scalable Object Detection using Deep Neural Networks 提出时间：2014年论文地址：针对问题：既然CNN网络提取的特征可以直接用于检测任务（定位+分类），作者就尝试将目标框（可能包含目标的最小外包矩形框）提取任务放到CNN中进行。也就是直接通过网络完成输入图像上目标的定位工作。创新点：本文作者通过将物体检测问题定义为输出多个bounding box的回归问题. 同时每个bounding box会输出关于是否包含目标物体的置信度, 使得模型更加紧凑和高效。先通过聚类获得图像中可能有目标的位置聚类中心，（800个anchor box）然后学习预测不考虑目标类别的二分类网络，背景or前景。用到了多尺度下的检测。参考博客：论文题目：DeepBox: Learning Objectness with Convolutional Networks 提出时间：2015年ICCV 论文地址：主要针对的问题：本文完成的工作与第三篇类似，都是对目标框提取算法的优化方案，区别是本文首先采用自底而上的方案来提取图像上的疑似目标框，然后再利用CNN网络提取特征对目标框进行是否为前景区域的排序；而第三篇为直接利用CNN网络来回归图像上可能的目标位置。创新点：本文作者想通过CNN学习输入图像的特征，从而实现对输入网络目标框是否为真实目标的情况进行计算，量化每个输入框的包含目标的可能性值。参考博客：论文题目：AttentionNet: AggregatingWeak Directions for Accurate Object Detection 提出时间：2015年ICCV 论文地址：主要针对的问题：对检测网络的实现方案进行思考，之前的执行策略是，先确定输入图像中可能包含目标位置的矩形框，再对每个矩形框进行分类和回归从而确定目标的准确位置，参考RCNN。那么能否直接利用回归的思路从图像的四个角点，逐渐得到目标的最小外接矩形框和类别呢？创新点：通过从图像的四个角点，逐步迭代的方式，每次计算一个缩小的方向，并缩小指定的距离来使得逐渐逼近目标。作者还提出了针对多目标情况的处理方式。参考博客：论文题目：Spatial Pyramid Pooling in Deep Convolutional Networks for Visual Recognition 提出时间：2014年论文地址：针对问题：如RCNN会将输入的目标图像块处理到同一尺寸再输入进CNN网络，在处理过程中就造成了图像块信息的损失。在实际的场景中，输入网络的目标尺寸很难统一，而网络最后的全连接层又要求输入的特征信息为统一维度的向量。作者就尝试进行不同尺寸CNN网络提取到的特征维度进行统一。创新点：作者提出的SPPnet中，通过使用特征金字塔池化来使得最后的卷积层输出结果可以统一到全连接层需要的尺寸，在训练的时候，池化的操作还是通过滑动窗口完成的，池化的核宽高及步长通过当前层的特征图的宽高计算得到。原论文中的特征金字塔池化操作图示如下。参考博客：论文题目：Object detection via a multi-region & semantic segmentation-aware CNN model 提出时间：2015年论文地址：针对问题：既然第三篇论文multibox算法提出了可以用CNN来实现输入图像中待检测目标的定位，本文作者就尝试增加一些训练时的方法技巧来提高CNN网络最终的定位精度。创新点：作者通过对输入网络的region进行一定的处理（通过数据增强，使得网络利用目标周围的上下文信息得到更精准的目标框）来增加网络对目标回归框的精度。具体的处理方式包括：扩大输入目标的标签包围框、取输入目标的标签中包围框的一部分等并对不同区域分别回归位置，使得网络对目标的边界更加敏感。这种操作丰富了输入目标的多样性，从而提高了回归框的精度。参考博客：论文题目：Fast-RCNN 提出时间：2015年论文地址：针对问题： RCNN中的CNN每输入一个图像块就要执行一次前向计算，这显然是非常耗时的，那么如何优化这部分呢？创新点：作者参考了SPPNet（第六篇论文），在网络中实现了ROIpooling来使得输入的图像块不用裁剪到统一尺寸，从而避免了输入的信息丢失。其次是将整张图输入网络得到特征图，再将原图上用Selective Search算法得到的目标框映射到特征图上，避免了特征的重复提取。参考博客：论文题目：DeepProposal: Hunting Objects by Cascading Deep Convolutional Layers 提出时间：2015年论文地址：主要针对的问题：本文的作者观察到CNN可以提取到很棒的对输入图像进行表征的论文，作者尝试通过实验来对CNN网络不同层所产生的特征的作用和情况进行讨论和解析。创新点：作者在不同的激活层上以滑动窗口的方式生成了假设，并表明最终的卷积层可以以较高的查全率找到感兴趣的对象，但是由于特征图的粗糙性，定位性很差。相反，网络的第一层可以更好地定位感兴趣的对象，但召回率降低。论文题目：Faster R-CNN: Towards Real-Time Object Detection with Region Proposal Networks 提出时间：2015年NIPS 论文地址：主要针对的问题：由multibox（第三篇）和DeepBox（第四篇）等论文，我们知道，用CNN可以生成目标待检测框，并判定当前框为目标的概率，那能否将该模型整合到目标检测的模型中，从而实现真正输入端为图像，输出为最终检测结果的，全部依赖CNN完成的检测系统呢？创新点：将当前输入图目标框提取整合到了检测网络中，依赖一个小的目标框提取网络RPN来替代Selective Search算法，从而实现真正的端到端检测算法。参考博客：

|声明：遵循CC BY-SA版权协议建立在YOLOv1的基础上，经过Joseph Redmon等的改进，YOLOv2和YOLO9000算法在2017年CVPR上被提出，并获得最佳论文提名，重点解决YOLOv1召回率和定位精度方面的误差。在提出时，YOLOv2在多种监测数据集中都要快过其他检测系统，并可以在速度与精确度上进行权衡。 YOLOv2采用Darknet-19作为特征提取网络，增加了批量标准化（Batch Normalization）的预处理，并使用224×224和448×448两阶段训练ImageNet，得到预训练模型后fine-tuning。相比于YOLOv1是利用FC层直接预测Bounding Box的坐标，YOLOv2借鉴了FSR-CNN的思想，引入Anchor机制，利用K-Means聚类的方式在训练集中聚类计算出更好的Anchor模板，在卷积层使用Anchor Boxes操作，增加Region Proposal的预测，同时采用较强约束的定位方法，大大提高算法召回率。同时结合图像细粒度特征，将浅层特征与深层特征相连，有助于对小尺寸目标的检测。下图所示是YOLOv2采取的各项改进带了的检测性能上的提升： YOLO9000 的主要检测网络也是YOLO v2，同时使用WordTree来混合来自不同的资源的训练数据，并使用联合优化技术同时在ImageNet和COCO数据集上进行训练，目的是利用数量较大的分类数据集来帮助训练检测模型，因此，YOLO 9000的网络结构允许实时地检测超过9000种物体分类，进一步缩小了检测数据集与分类数据集之间的大小代沟。下面将具体分析YOLOv2的各个创新点: BN概述：对数据进行预处理（统一格式、均衡化、去噪等）能够大大提高训练速度，提升训练效果。BN正是基于这个假设的实践，对每一层输入的数据进行加工。 BN是2015年Google研究员在论文《Batch Normalization: Accelerating Deep Network Training by Reducing Internal Covariate Shift》一文中提出的，同时也将BN应用到了2014年的GoogLeNet上，也就是Inception-v2。 BN层简单讲就是对网络的每一层的输入都做了归一化，这样网络就不需要每层都去学数据的分布，收敛会更快。YOLOv1算法（采用的是GoogleNet网络提取特征）是没有BN层的，而在YOLOv2中作者为每个卷积层都添加了BN层。使用BN对网络进行优化，让网络提高了收敛性，同时还消除了对其他形式的正则化（regularization）的依赖，因此使用BN后可以从模型中去掉Dropout，而不会产生过拟合。 BN优点：神经网络每层输入的分布总是发生变化，加入BN，通过标准化上层输出，均衡输入数据分布，加快训练速度，因此可以设置较大的学习率（Learning Rate）和衰减（Decay）；通过标准化输入，降低激活函数（Activation Function）在特定输入区间达到饱和状态的概率，避免梯度弥散（Gradient Vanishing）问题；输入标准化对应样本正则化，BN在一定程度上可以替代 Dropout解决过拟合问题。 BN算法：在卷积或池化之后，激活函数之前，对每个数据输出进行标准化，方式如下图所示：公式很简单，前三行是 Batch内数据归一化（假设一个Batch中有每个数据），同一Batch内数据近似代表了整体训练数据。第四行引入了附加参数 γ 和 β，此二者的取值算法可以参考BN论文，在此不再赘述。 fine-tuning：用已经训练好的模型，加上自己的数据集，来训练新的模型。即使用别人的模型的前几层，来提取浅层特征，而非完全重新训练模型，从而提高效率。一般新训练模型准确率都会从很低的值开始慢慢上升，但是fine-tuning能够让我们在比较少的迭代次数之后得到一个比较好的效果。 YOLO模型分为两部分，分类模型和检测模型，前者使用在ImageNet上预训练好的模型，后者在检测数据集上fine-tuning。 YOLOv1在预训练时采用的是224*224的输入（在ImageNet数据集上进行），然后在检测的时候采用448*448的输入，这会导致从分类模型切换到检测模型的时候，模型还要适应图像分辨率的改变。 YOLOv2则将预训练分成两步：先用224*224的输入在ImageNet数据集训练分类网络，大概160个epoch（将所有训练数据循环跑160次）后将输入调整到448*448，再训练10个epoch（这两步都是在ImageNet数据集上操作）。然后利用预训练得到的模型在检测数据集上fine-tuning。这样训练得到的模型，在检测时用448*448的图像作为输入可以顺利检测。 YOLOv1将输入图像分成7*7的网格，每个网格预测2个Bounding Box，因此一共有98个Box，同时YOLOv1包含有全连接层，从而能直接预测Bounding Boxes的坐标值，但也导致丢失较多的空间信息，定位不准。 YOLOv2首先将YOLOv1网络的FC层和最后一个Pooling层去掉，使得最后的卷积层可以有更高分辨率的特征，然后缩减网络，用416*416大小的输入代替原来的448*448，使得网络输出的特征图有奇数大小的宽和高，进而使得每个特征图在划分单元格（Cell）的时候只有一个中心单元格（Center Cell）。为什么希望只有一个中心单元格呢？由于图片中的物体都倾向于出现在图片的中心位置，特别是比较大的物体，所以有一个单元格单独位于物体中心的位置用于预测这些物体。 YOLOv2通过引入Anchor Boxes，通过预测Anchor Box的偏移值与置信度，而不是直接预测坐标值。YOLOv2的卷积层采用32这个值来下采样图片，所以通过选择416*416用作输入尺寸最终能输出一个13*13的特征图。若采用FSRCNN中的方式，每个Cell可预测出9个Anchor Box，共13*13*9=1521个（YOLOv2确定Anchor Boxes的方法见是维度聚类，每个Cell选择5个Anchor Box）。在FSRCNN中，以一个51*39大小的特征图为例，其可以看做一个尺度为51*39的图像，对于该图像的每一个位置，考虑9个可能的候选窗口：3种面积3种比例。这些候选窗口称为Anchor Boxes。下图示出的是51*39个Anchor Box中心，以及9种Anchor Box示例。 YOLOv1和YOLOv2特征图数据结构： YOLOv1：S*S* (B*5 + C) => 7*7（2*5+20）其中B对应Box数量，5对应边界框的定位信息（w,y,w,h）和边界框置信度（Confidience）。分辨率是7*7，每个Cell预测2个Box，这2个Box共用1套条件类别概率（1*20）。 YOLOv2：S*S*K* (5 + C) => 13*13*9（5+20）分辨率提升至13*13，对小目标适应性更好，借鉴了FSRCNN的思想，每个Cell对应K个Anchor box（YOLOv2中K=5），每个Anchor box对应1组条件类别概率（1*20）。聚类：聚类是指事先没有“标签”而通过某种成团分析找出事物之间存在聚集性原因的过程。即在没有划分类别的情况下，根据数据相似度进行样本分组。在FSR-CNN中Anchor Box的大小和比例是按经验设定的，然后网络会在训练过程中调整Anchor Box的尺寸，最终得到准确的Anchor Boxes。若一开始就选择了更好的、更有代表性的先验Anchor Boxes，那么网络就更容易学到准确的预测位置。 YOLOv2使用K-means聚类方法类训练Bounding Boxes，可以自动找到更好的宽高维度的值用于一开始的初始化。传统的K-means聚类方法使用的是欧氏距离函数，意味着较大的Anchor Boxes会比较小的Anchor Boxes产生更多的错误，聚类结果可能会偏离。由于聚类目的是确定更精准的初始Anchor Box参数，即提高IOU值，这应与Box大小无关，因此YOLOv2采用IOU值为评判标准，即K-means 采用的距离函数（度量标准）为： d(box,centroid) = 1 - IOU(box,centroid) 如下图，左边是聚类的簇个数和IOU的关系，两条曲线分别代表两个不同的数据集。分析聚类结果并权衡模型复杂度与IOU值后，YOLOv2选择K=5，即选择了5种大小的Box 维度来进行定位预测。其中紫色和灰色也是分别表示两个不同的数据集，可以看出其基本形状是类似的。更重要的是，可以看出聚类的结果和手动设置的Anchor Box位置和大小差别显著——结果中扁长的框较少，而瘦高的框更多（更符合行人的特征）。 YOLOv2采用的5种Anchor的Avg IOU是61，而采用9种Anchor Boxes的Faster RCNN的Avg IOU是，也就是说本文仅选取5种box就能达到Faster RCNN的9中box的效果。选择值为9的时候，AVG IOU更有显著提高。说明K-means方法的生成的boxes更具有代表性。直接对Bounding Boxes求回归会导致模型不稳定，其中心点可能会出现在图像任何位置，有可能导致回归过程震荡，甚至无法收敛，尤其是在最开始的几次迭代的时候。大多数不稳定因素产生自预测Bounding Box的中心坐标（x,y）位置的时候。 YOLOv2的网络在特征图（13*13）的每一个单元格中预测出5个Bounding Boxes（对应5个Anchor Boxes），每个Bounding Box预测出5个值（tx,ty,tw,th,t0），其中前4个是坐标偏移值，t0是置信度结果（类似YOLOv1中的边界框置信度Confidence）。YOLOv2借鉴了如下的预测方式，即当Anchor Box的中心坐标和宽高分别是（xa,ya）和（wa,wh）时，Bounding Box坐标的预测偏移值（tx,ty,tw,th）与其坐标宽高（x,y,w,h）的关系如下： tx = (x-xa)/wa ty= (y-ya)/ha tw = log(w/wa) th = log(h/ha) 基于这种思想，YOLOv2在预测Bounding Box的位置参数时采用了如下强约束方法：上图中，黑色虚线框是Anchor Box，蓝色矩形框就是预测的Bounding Box结果，预测出的Bounding Box的坐标和宽高为（bx,by）和（bw,bh），计算方式如图中所示，其中：对每个Bounding Box预测出5个值（tx,ty,tw,th,t0），Cell与图像左上角的横纵坐标距离为（cx,cy），σ定义为sigmoid激活函数（将函数值约束到［0,1］），该Cell对应的Anchor Box对应的宽高为（pw,ph）。简而言之，（bx,by）就是（cx,cy）这个Cell附近的Anchor Box针对预测值（tx,ty）得到的Bounding Box的坐标预测结果，同时可以发现这种方式对于较远距离的Bounding Box预测值（tx,ty）能够得到很大的限制。 YOLOv2通过添加一个转移层，把高分辨率的浅层特征连接到低分辨率的深层特征（把特征堆积在不同Channel中）而后进行融合和检测。具体操作是先获取前层的26*26的特征图，将其同最后输出的13*13的特征图进行连接，而后输入检测器进行检测（检测器的FC层起到了全局特征融合的作用），以此来提高对小目标的检测能力。为了适应不同尺度下的检测任务，YOLOv2在训练网络时，其在检测数据集上fine-tuning时候采用的输入图像的size是动态变化的。具体来讲，每训练10个Batch，网络就会随机选择另一种size的输入图像。因为YOLOv2用到了参数是32的下采样，因此也采用32的倍数作为输入的size，即采用{320,352,…,608}的输入尺寸（网络会自动改变尺寸，并继续训练的过程）。这一策略让网络在不同的输入尺寸上都能达到较好的预测效果，使同一网络能在不同分辨率上进行检测。输入图片较大时，检测速度较慢，输入图片较小时，检测速度较快，总体上提高了准确率，因此多尺度训练算是在准确率和速度上达到一个平衡。上表反映的是在检测时，不同大小的输入图片情况下的YOLOv2和其他目标检测算法的对比。可以看出通过多尺度训练的检测模型，在测试的时候，输入图像在尺寸变化范围较大的情况下也能取得mAP和FPS的平衡。 YOLOv1采用的训练网络是GoogleNet，YOLOv2采用了新的分类网络Darknet-19作为基础网络，它使用了较多的3*3卷积核，并把1*1的卷积核置于3*3的卷积核之间，用来压缩特征，同时在每一次池化操作后把通道（Channels）数翻倍（借鉴VGG网络）。 YOLOv1采用的GooleNet包含24个卷积层和2个全连接层，而Darknet-19包含19个卷积层和5个最大池化层（Max Pooling Layers），后面添加Average Pooling层（代替v1中FC层），而Softmax分类器作为激活被用在网络最后一层，用来进行分类和归一化。在ImageNet数据集上进行预训练，主要分两步（采用随机梯度下降法）：输入图像大小是224*224，初始学习率（Learning Rate）为，训练160个epoch，权值衰减（Weight Decay）为，动量（Momentum）为，同时在训练时采用标准的数据增强（Data Augmentation）方式如随机裁剪、旋转以及色度、亮度的调整。 fine-tuning：第1步结束后，改用448*448输入（高分辨率模型），学习率改为，训练10个epoch，其他参数不变。结果表明：fine-tuning后的top-1准确率为，top-5准确率为，若按照原来的训练方式，Darknet-19的top-1准确率是，top-5准确率为。可以看出，两步分别从网络结构和训练方式方面入手提高了网络分类准确率。预训练之后，开始基于检测的数据集再进行fine-tuning。首先，先把最后一个卷积层去掉，然后添加3个3*3的卷积层，每个卷积层有1024个卷积核，并且后面都连接一个1*1的卷积层，卷积核个数（特征维度）根据需要检测的类数量决定。（比如对VOC数据，每个Cell需要预测5个Boungding Box，每个Bounding Box有4个坐标值、1个置信度值和20个条件类别概率值，所以每个单元格对应125个数据，此时卷积核个数应该取125。）然后，将最后一个3*3*512的卷积层和倒数第2个卷积层相连（提取细粒度特征），最后在检测数据集上fine-tuning预训练模型160个epoch，学习率采用，并且在第60和90个epoch的时候将学习率除以10，权值衰减、动量和数据增强方法与预训练相同。 YOLO9000通过结合分类和检测数据集，使得训练得到的模型可以检测约9000类物体，利用带标注的分类数据集量比较大的特点，解决了带标注的检测数据集量比较少的问题。具体方法是：一方面采用WordTree融合数据集，另一方面联合训练分类数据集和检测数据集。分类数据集和检测数据集存在较大差别：检测数据集只有粗粒度的标记信息，如“猫”、“狗”，而分类数据集的标签信息则更细粒度，更丰富。比如“狗”就包括“哈士奇”、“金毛狗”等等。所以如果想同时在检测数据集与分类数据集上进行训练，那么就要用一种一致性的方法融合这些标签信息。用于分类的方法，常用Softmax（比如v2），Softmax意味着分类的类别之间要互相独立的，而ImageNet和COCO这两种数据集之间的分类信息不相互独立（ImageNet对应分类有9000种，而COCO仅提供80种目标检测），所以使用一种多标签模型来混合数据集，即假定一张图片可以有多个标签，并且不要求标签之间独立，而后进行Softmax分类。由于ImageNet的类别是从WordNet选取的，作者采用以下策略重建了一个树形结构（称为WordTree）：遍历ImageNet的标签，然后在WordNet中寻找该标签到根节点(所有的根节点为实体对象)的路径；如果路径只有一条，将该路径直接加入到WordTree结构中；否则，从可选路径中选择一条最短路径，加入到WordTree结构中。 WordTree的作用就在于将两种数据集按照层级进行结合。如此，在WordTree的某个节点上就可以计算该节点的一些条件概率值，比如在terrier这个节点，可以得到如下条件概率值：进而，如果要预测此节点的概率（即图片中目标是Norfolk terrier的概率），可以根据WordTree将该节点到根节点的条件概率依次相乘得到，如下式：其中： YOLO9000在WordTree1k（用有1000类别的ImageNet1k创建）上训练了Darknet-19模型。为了创建WordTree1k作者添加了很多中间节点（中间词汇），把标签由1000扩展到1369。训练过程中GroundTruth标签要顺着向根节点的路径传播：为了计算条件概率，模型预测了一个包含1369个元素的向量，而且基于所有“同义词集”计算Softmax，其中“同义词集”是同一概念下的所属词。现在一张图片是多标记的，标记之间不需要相互独立。在训练过程中，如果有一个图片的标签是“Norfolk terrier”，那么这个图片还会获得“狗”以及“哺乳动物”等标签。如上图所示，之前的ImageNet分类是使用一个大Softmax进行分类，而现在WordTree只需要对同一概念下的同义词进行Softmax分类。然后作者分别两个数据集上用相同训练方法训练Darknet-19模型，最后在ImageNet数据集上的top-1准确率为，top-5准确率为；在WordTree数据集上的top-1准确率为，top-5准确率为。这种方法的好处是有“退而求其次”的余地：在对未知或者新的物体进行分类时，性能损失更低，比如看到一个狗的照片，但不知道是哪种种类的狗，那么就预测其为“狗”。以上是构造WordTree的原理，下图是融合COCO数据集和ImageNet数据集以及生成它们的WordTree的示意图（用颜色区分了COCO数据集和ImageNet数据集的标签节点），混合后的数据集对应的WordTree有9418个类。另一方面，由于ImageNet数据集太大，YOLO9000为了平衡两个数据集之间的数据量，通过过采样（Oversampling）COCO数据集中的数据，使COCO数据集与ImageNet数据集之间的数据量比例达到1：4。对YOLO9000进行评估，发现其mAP比DPM高，而且YOLO有更多先进的特征，YOLO9000是用部分监督的方式在不同训练集上进行训练，同时还能检测9000个物体类别，并保证实时运行。虽然YOLO9000对动物的识别性能很好，但是对衣服或者装备的识别性能不是很好（这跟数据集的数据组成有关）。 YOLO9000的网络结构和YOLOv2类似，区别是每个单元格只采用3个Anchor Boxes。 YOLO9000提出了一种在分类数据集和检测数据集上联合训练的机制，即使用检测数据集（COCO）的图片去学习检测相关的信息即查找对象（例如预测边界框坐标、边界框是否包含目标及目标属于各个类别的概率），使用仅有类别标签的分类数据集（ImageNet）中的图片去扩展检测到的对象的可识别种类。具体方法是：当网络遇到一个来自检测数据集的图片与标记信息，就把这些数据用完整的损失函数（v2和9000均沿用了v1网络的损失函数）反向传播，而当网络遇到一个来自分类数据集的图片和分类标记信息，只用代表分类误差部分的损失函数反向传播这个图片。 YOLO v2 在大尺寸图片上能够实现高精度，在小尺寸图片上运行更快，可以说在速度和精度上达到了平衡，具体性能表现如下所示。 coco数据集 voc2012数据集

怎样检测论文标点错误

1、打开浏览器搜索论文查重网站同学们在进行论文查重时，一定要从浏览器搜索正规的论文查重网站，现在网络上的论文查重网站真的是非常的多，一般学校所用的论文查重网站是比较权威的，但是这些网站的论文查重费用是对于学生来说是比较贵的，可也有一些论文查重的网站，既免费又可以帮助毕业生论文查重。论文查重2、论文查重入口学生在选择好一个论文检测系统后需要去他们的官方网站进行论文查重步骤。一般情况下论文查重网站的首页都会有检测的入口。有些论文查重系统将其分为本科毕业论文查重、硕博毕业论文查重和专业学术论文查重，毕业生在进行论文查重之前，必须根据个人的实际情况选择系统，如果选择错误了，结果是不准确的。3、上传毕业论文毕业生在上传论文前必须修改自己的论文格式。毕业论文的格式必须符合学校论文检测系统的要求。如果论文的格式有错误，极有可能导致论文的重复率过高。这就需要毕业生仔细检查，以免他们的论文检测报告发生误差，这样会浪费同学们的时间和精力。4、打印论文查重报告在最后的论文检测结束、重复率符合要求之后，我们需要打印自己的论文检测报告（PDF）。一般来说，论文检测报告对论文重复率各方面都有详细的解释。毕业生可根据后论文报告进行论文修改。以上就是论文查重的步骤，大家可以参考一下小编说的这些内容，这样就不至于到论文查重的时候变得手忙脚乱。最后，小编祝所有大学生都能顺利毕业。

首先，找到一个靠谱的论文查重系统，之后按照系统的提示一步步提交操作，把论文内容提交到框中，然后点击检测，等待检测结束后生成报告。最后按照检测报告中的重复部分进行修改，达到学校的标准为止。

Paperbye论文查重系统，是自带改重的论文查重系统，解决了目前市场论文查重之后，不知道怎么修改和修改论文效率低的问题，利用软件的“机器人改重”功能，实现软件的自动修改论文重复内容，从而达到迅速自动降低论文重复率，特别是对于第一次写论文的同学，软件自动修改论文内容，会给同学们一些启示或直接使用机器修改的内容进行替换原文内容，提高的文章查重和修改效率。

优秀功能1、自动降重，根据论文重复率情况，自己选择性软件自动降重辅助提高论文修改效率；2、自动排版，根据各校论文要求格式会自动进行格式排版，一键生成，快速便捷；3、同步改重，在查重报告里实现一边修改文章，一边进行查重，及时反馈修改结果。4、自建库，自建上传参考过的文章进行单独比对，可以查出所有抄袭内容。5、自动纠错，AI识别文档中的错别字和标点误用，提示错误位置并提供修改建议。

总结了五种修改论文方法，感觉是降重必备的。

1、变换表达。先理解原句的意思，用自己的话复述一遍。

2、词语替换，在变换表达方式的基础上结合同义词替换，效果更好。

3、变换句式，通过拆分合并语句的方式进行修改，把长句变短句，短句变长句，。

4、图片法，针对专业性太强不好修改的语句或段落（比如计算机代码，法律条款，原理理论等），可以适当把文字写在图片上展现，但是这种方法不宜用的太多。

5、翻译法，用百度翻译或谷歌翻译，中文翻译成英文，英文翻译成日语或其他语种，再从日语翻译成中文，这种看似不错，感觉效果还是不好。

Word本来就具有一定的标点符号查错能力，但是所有的软件在查找标点符号错误方面都很弱，需要你自己在撰写的时候就用心，并且在检查的时候自己校对

论文检测标点符号有问题

不影响，但是导师审核被发现可能叫你修改

对于大学毕业生来说，论文查重是一件非常重要的事，为了顺利完成这件事大家需要注意哪些方面？今天paperfree小编来给大家讲解一下。 1、论文的内容和格式应加以规范。学院对毕业论文的写作有规定，要想顺利进行论文查重，就能检测出正确的论文查重率结果，我们在写论文时就要按照学校的要求来写。许多时候，我们在查重时遇到的各种问题，其根本原因是论文没有按照学校的要求写好，比如格式不规范，没有按照学校的要求排版，最终导致查重失误。 2.注意查重系统的选择。现在市面上的论文查重系统也是百花齐放，是有各种不同品牌的，其质量也是参差不齐，所以我们要注意选择正规可靠的论文查重系统，这样才能检测到准确的论文查重率，避免在查重过程中被泄露。文章泄露是因为有些文章查重系统实际上会盗取大家提交的文章，建议大家可以选择正规的论文查重系统。 3.注意保留论文查重报告。通过正规可靠的查重系统，系统会出一份查重报告，非常重要，因为我们的查重结果都在上面，包括论文的总查重率、章节重复率、检测出的重复内容等。我们必须尽快下载，否则超过系统保存期会被清除。最后，我们也可以参考查重报告修改论文，以达到降低论文重复率的效果。

对查重不影响，如果高校用的是知网系统，那么系统会自动识别文献，不会参与正文检测。也不会算重复率。

论文查重的具体内容，其实还是要看你具体写的论文是怎么样的。具体操作方法就是到某个查重网站把你的论文上传，接着网站就会把你的论文跟其他网络上的论文进行对比，看看有没有类似的句子或者是词组。若有类似的话，会把那些类似标注为红色或者橙色，这个时候你就可以用同义词之类的方法降重

索引序列
论文标点检测
检测论文标点符号
目标检测论文的创新点
怎样检测论文标点错误
论文检测标点符号有问题
返回顶部

论文标点检测