目前,高校对于硕博士论文,需要通过抄袭检测系统的检测才能算过关。对本科生来说,大部分学校也采取抽查的方式对本科论文进行检测。
抄袭过多,一经查出超过30%,后果严重。轻者延期毕业,重者取消学位。辛辛苦苦读个大学,学位报销了多不爽。
但是,软件毕竟是人工设置的一种机制,里面内嵌了检测算法,我们只要摸清其中的机理,通过简单的修改,就能成功通过检测。
本文是在网络收集的资料。整理了最重要的部分,供大家参考。
论文抄袭检测算法:
1.论文的段落与格式
论文检测基本都是整篇文章上传,上传后,论文检测软件首先进行部分划分,上交的最终稿件格式对抄袭率有很大影响。不同段落的划分可能造成几十个字的小段落检测不出来。因此,我们可以通过划分多的小段落来降低抄袭率。
2.数据库
论文检测,多半是针对已发表的毕业论文,期刊文章,还有会议论文进行匹配的,有的数据库也包含了网络的一些文章。这里给大家透露下,很多书籍是没有包含在检测数据库中的。之前朋友从一本研究性的著作中摘抄了大量文字,也没被查出来。就能看出,这个方法还是有效果的。
3.章节变换
很多同学改变了章节的顺序,或者从不同的文章中抽取不同的章节拼接而成的文章,对抄袭检测的结果影响几乎为零。所以论文抄袭检测大师建议大家不要以为抄袭了几篇文章,或者几十篇文章就能过关。
4.标注参考文献
参考别人的文章和抄袭别人的文章在检测软件中是如何界定的。其实很简单,我们的论文中加了参考文献的引用符号,但是在抄袭检测软件中。都是统一看待,软件的阀值一般设定为1%,例如一篇文章有5000字,文章的1%就是50字,如果抄袭了多于50,即使加了参考文献,也会被判定为抄袭。
5.字数匹配
论文抄袭检测系统相对比较严格,只要多于20单位的字数匹配一致,就被认定为抄袭,但是前提是满足第4点,参考文献的标注。
论文抄袭修改方法:
首先是词语变化。文章中的专业词汇可以保留,尽量变换同义词;
其次,改变文中的描述方式,例如倒装句、被动句、主动句;打乱段落的顺序,抄袭原文时分割段落,并重组。
通过上述方法,能有效降低抄袭率。
下面举几个例子,大家可以参考下:
例句A:
本文以设备利用率最大化为目标函数,采用整数编码与实数编码相结合的遗传算法,研究了HFS的构建问题。本文提出的染色体编码方法及相应的遗传操作方法可实现研究对象的全局随机寻优。通过对car系列标准算例的研究,显示了本文提出方法具有较高的计算重复性和计算效率。
修改A:
本文研究了HFS问题的构建,通过遗传算法并结合整数与实数编码,目标函数为最大化设备利用率来求解。本文的染色体编码方法与对应的遗传算法操作可有效提高算法的全局搜索能力。通过对一些列基准算例的研究,验证了本文算法的有效性,并具有较高的计算重复性和较高的运算效率。
例句B:
由于房地产商品的地域性强,房地产开发企业在进行不同区域投资时,通常需要建立项目公司,此时就会面临建立分公司还是子公司的选择。子公司是一个独立的法人,而分公司则不是独立法人,它们在税收利益方面存在差异。子公司是独立法人,在设立区域被视为纳税人,通常要承担与该区域其它公司一样的全面纳税义务;分公司不是独立的法人实体,在设立分公司的所在区域不被视为纳税人,只承担有限的纳税义务,分公司发生的利润与亏损要与总公司合并计算。
修改B:
房地产开发企业在不同区域进行投资时,由于此类商品的地域性强,因此需要建立项目公司。此时,企业需要选择建立分公司还是子公司。主要的区别是子公司具有独立的法人,分公司则不是独立法人。其次,在税收利益方面,由于分公司不是独立的法人实体,在设立分公司的所在区域不被视为纳税人,只承担纳税义务,总公司需要合并计算分公司的利润与亏损;而子公司是独立法人,在所在区域被视为法人实体,需要承担与区域其他公司一样的全面纳税义务。
修改抄袭的方法不外乎这些,这里更建议同学们,先熟悉你所看的参考论文,关闭文档,用自己的话写出来,这样就不会受参考文献的太多影响。
有同学这里就提出问题了,学校用的检测系统是知网的学术不端检测系统,不是淘宝几元钱买的万方数据检测。
其实,各个检测系统的算法区别并不大,只是数据库有多有少,如果你没有太多,什么系统都不用怕。既然你抄了,得到检测报告的同时,先好好修改自己的文章。
抄了之后,改相拟度,可以这样去头去尾留中间,意同词不同。
一、查重原理
1、知网学位论文检测为整篇上传,格式对检测结果可能会造成影响,需要将最终交稿格式提交检测,将影响降到最小,此影响为几十字的小段可能检测不出。对于3万字符以上文字较多的论文是可以忽略的。
对比数据库为:中国学术期刊网络出版总库,中国博士学位论文全文数据库/中国优秀硕士学位论文全文数据库,国重要会议论文全文数据库,中国重要报纸全文数据库,中国专利全文数据库,个人比对库,其他比对库。部分书籍不在知网库,检测不到。
2、上传论文后,系统会自动检测该论文的章节信息,如果有自动生成的目录信息,那么系统会将论文按章节分段检测,否则会自动分段检测。
3、有部分同学反映说自己在段落中明明引用或者抄袭了其他文献的段落或句子,为什么没有检测出来,这是正常的。中国知网对该套检测系统的灵敏度设置了一个阀值,该阀值为5%,以段落计,低于5%的抄袭或引用是检测不出来的,这种情况常见于大段落中的小句或者小概念。举个例子:假如检测段落1有10000字,那么引用单篇文献500字以下,是不会被检测出来的。实际上这里也告诉同学们一个修改的方法,就是对段落抄袭千万不要选一篇文章来引用,尽可能多的选择多篇文献,一篇截取几句,这样是不会被检测出来的。
4、一篇论文的抄袭怎么才会被检测出来?知网论文检测的条件是连续13个字相似或抄袭都会被红字标注,但是必须满足3里面的前提条件:即你所引用或抄袭的A文献文字总和在你的各个检测段落中要达到5%。
二、快速通过论文查重的七大方法
方法一:外文文献翻译法
查阅研究领域外文文献,特别是高水平期刊的文献,比如Science,Nature,WaterRes等,将其中的理论讲解翻译成中文,放在自己的论文中。
优点:1、每个人语言习惯不同,翻译成的汉语必然不同。因此即使是同一段文字,不同人翻译了之后,也 不会出现抄袭的情况。2、外文文献的阅读,可以提升自身英语水平,拓展专业领域视野。
缺点:英文不好特别是专业英文不好的同学实施起来比较费劲。
方法二:变化措辞法
将别人论文里的文字,或按照意思重写,或变换句式结构,更改主被动语态,或更换关键词,或通过增减。当然如果却属于经典名句,还是按照经典的方法加以引用。
优点:1.将文字修改之后,按照知网程序和算法,只要不出现连续13个字重复,以及关键词的重复,就不会被标红。2.对论文的每字每句都了如指掌,烂熟于心,答辩时亦会如鱼得水。
缺点:逐字逐句的改,费时费力。
方法三:减头去尾,中间换语序
将别人论文里的文字,头尾换掉中间留下,留下的部分改成被动句,句式和结构就会发生改变,再自行修改下语病后,即可顺利躲过查重。
优点:方便快捷,可以一大段一大段的修改。
缺点中文没学好的,会很费劲,要想半天。
方法四:转换图片法
将别人论文里的文字,截成图片,放在自己的论文里。因为知网查重系统目前只能查文字,而不能查图片和表格,因此可以躲过查重。
优点:比改句序更加方便快捷。
缺点:用顺手了容易出现整页都是图片的情况,会影响整个论文的字数统计。
方法五:插入文档法
将某些参考引用来的文字通过word文档的形式插入到论文中。
优点:此法比方法四更甚一筹,因为该方法日后还可以在所插入的文档里进行重新编辑,而图片转换法以后就不便于再修改了。
缺点:还没发现。
方法六:插入空格法
将文章中所有的字间插入空格,然后将空 格 字 间距调到最小。因为查重的根据是以词为基础的,空格切断了词语,自然略过了查重系统。
优点:从查重系统的原理出发,可靠性高。
缺点:工作量极大,课可以考虑通过宏完成,但宏的编制需要研究。
方法七:自己原创法
自己动手写论文,在写作时,要么不原文复制粘贴;要么正确的加上引用。
优点:基本上绝对不会担心查重不通过,哪怕这个查重系统的阈值调的再低。
缺点:如果说优缺点的话,就是写完一篇毕业论文,可能会死掉更多的脑细胞。呵呵。。。
知网系统计算标准详细说明:
1.看了一下这个系统的介绍,有个疑问,这套系统对于文字复制鉴别还是不错的,但对于其他方面的内容呢,比如数据,图表,能检出来吗?检不出来的话不还是没什么用吗?
学术不端的各种行为中,文字复制是最为普遍和严重的,目前本检测系统对文字复制的检测已经达到相当高的水平,对于图表、公式、数据的抄袭和篡改等行为的检测,目前正在研发当中,且取得了比较大的进展,欢迎各位继续关注本检测系统的进展并多提批评性及建设性意见和建议。
2.按照这个系统39%以下的都是显示黄色,那么是否意味着在可容忍的限度内呢?最近看到对上海大学某教师的国家社科基金课题被撤消的消息,原因是其发表的两篇论文有抄袭行为,分别占到25%和30%. 请明示超过多少算是警戒线?
百分比只是描述检测文献中重合文字所占的比例大小程度,并不是指该文献的抄袭严重程度。只能这么说,百分比越大,重合字数越多,存在抄袭的可能性越大。是否属于抄袭及抄袭的严重程度需由专家审查后决定。
3.如何防止学位论文学术不端行为检测系统成为个人报复的平台?
这也是我们在认真考虑的事情,目前这套检测系统还只是在机构一级用户使用。我们制定了一套严格的管理流程。同时,在技术上,我们也采取了多种手段来最大可能的防止恶意行为,包括一系列严格的身份认证,日志记录等。
4.最小检测单位是句子,那么在每句话里改动一两个字就检测不出来了么?
我们对句子也有相应的处理,有一个句子相似性的算法。并不是句子完全一样才判断为相同。句子有句子级的相似算法,段落有段落级的相似算法,计算一篇文献,一段话是否与其他文献文字相似,是在此基础上综合得出的。
5.如果是从相关书籍上摘下来的原话,但是此话已经被数据库中的相关文献也抄了进去,也就是说前面的文章也从相关书籍上摘了相同的话,但是我的论文中标注的这段话来自相关的书籍,这个算不算学术抄袭?
检测系统不下结论,是不是抄袭最后还有人工审查这一关,所以,如果是您描述的这种情况,专家会有相应判断。我们的系统只是提供各种线索和依据,让人能够快速掌握检测文献的信息。
6.知网检测系统的权威性?
学术不端文献检测系统并不下结论,即检测系统并不对检测文献定性,只是将检测文献中与其他已发表文献中的雷同部分陈列出来,列出客观事实,而这篇检测文献是否属于学术不端,需专家做最后的审查确认。
一篇论文的抄袭怎么才会被检测出来?知网论文检测的条件是连续13个字相似或抄袭都会被红字标注,但是必须满足3里面的前提条件:即你所引用或抄袭的A文献文字总和在你的各个检测段落中要达到5%。
论文查重修改的规律:
1、如果是引用,在引用标号后,不要轻易使用句号,如果写了句号,句号后面的就是剽窃了(尽管自已认为是引用),所以,引用没有结束前,尽量使用分号。有些人将引用的上标放在了句号后面,这是不对的,应该在句号之前。
2、可以将文字转换为表格,将表格边框隐藏。
3、如果你看的外文的多,由外文自己翻译过来引用的,个人认为,不需要尾注,就可以当做自己的,因为查重的数据库只是字符的匹配,无法做到中文和英文的匹配。
4、查重是一个匹配的过程,是以句为单位,如果一句话重复了,就很容易判定重复了,所以:
的确是经典的句子,就用上标的尾注的方式,在参考文献中表达出来,或者是用:原文章作者《名字》和引号的方式,将引用的内容框出来。引号内的东西,系统会识别为引用
如果是一般的引用,就采用罗嗦法,将原句中省略的主语、谓语、等等添加全,反正哪怕多一个字,就是胜利,也可以采用横刀法,将一些句子的成分,去除,用一些代词替代。或者是用洋鬼子法,将原文中的洋名,是中文的,就直接用英文,是英文的直接用中文,或是哦中文的全姓名,就用中文的名,如果是中文的名,就找齐了,替换成中文的姓名。
故意在一些缩写的英文边上,加上(注释)(画蛇添足法),总之,将每句话都可以变化一下,哪怕增加一个字或减少一个字,都是胜利了。
特别注意标点符号,变化变化,将英文的复合句,变成两个或多个单句,等等,自己灵活掌握。
因为真正写一篇论文,很罕见地都是自己的,几乎不可能,但大量引用别人的东西,说明你的综合能力强,你已经阅读了大量的资料,这就是一个过程,一个学习、总结的过程。
所有的一切,千万别在版面上让导师责难,这是最划不来的。导师最讨厌版面不规范的,因为他只负责内容,但又不忍心因为版面问题自己的弟子被轰出来。
5、下面这一条我傻妞试过的,决对牛B:将别人的文字和部分你自己的文字,选中,复制(成为块,长方形),另外在桌面建一个空文件,将内容,复制到文件中,存盘,关闭。将这个文件的图标选中,复制,在你的正文中的位置上,直接黏贴,就变成了图片了,不能编辑的。这个操作事实上是将内容的文件作为一个对象插入的,所以是图片。这个操作事实上是将内容的文件作为一个对象插入的。所以是图片。
以上那些东西再次总结一下:
查重是一个匹配的过程,是以句为单位,如果一句话重复了,就很容易判定重复了,所以:
1)如果的确是经典的句子,就用上标的尾注的方式,在参考文献中表达出来。
2)如果是一般的引用,就采用罗嗦法,将原句中省略的主语、谓语、等等添加全,反正哪怕多一个字,就是胜利。
3)也可以采用横刀法,将一些句子的成分,去除,用一些代词替代。
4)或者是用洋鬼子法,将原文中的洋名,是中文的,就直接用英文,是英文的直接用中文,或是中文的全姓名,就用中文的名,如果是中文的名,就找齐了,替换成中文的姓名。
5)故意在一些缩写的英文边上,加上(注释)(画蛇添足法),总之,将每句话都可以变化一下,哪怕增加一个字或减少一个字,都是胜利了。
6)如果是引用,在引用标号后,不要轻易使用句号,如果写了句号,句号后面的就是剽窃了(尽管自已认为是引用),所以,引用没有结束前,尽量使用分号。有些人将引用的上标放在了句号后面,这是不对的,应该在句号之前。
7)可以将文字转换为表格、表格基本是查重不了的,文字变成图形、表格变成图形,一目了然,绝对不会检查出是重复剽窃了。
硕士论文复制比要求
为了防止学术论文的学术不端行为,各高校都将使学术不端行为成为学术不端行为。高校论文的总重量有多少份?复印比例是多少?强调论文的重复率。
1、论文不存在问题(总文字复制比在9%以下、段落复制比在20%以下的学位论文),进行正常评审。
2、论文存在轻度抄袭问题(总文字复制比在10-24%,且段落复制比在29%以下的学位论文),由学院反馈指导教师,由导师指导研究生进行修改,修改完成后不再进行检测,直接进入正常评审。
3、论文存在中度抄袭问题(总文字复制比在25%-39%或段落复制比在30%-49%的学位论文),由学院反馈指导教师,由导师责令研究生进行修改,在规定时间内(一般为一周)修改完成后进行二次检测。检测结果达到1,2条件的进入正常评审。二次检测中总文字复制比仍在25%及以上的或者单个段落文字复制比在30%及以上的,本次不予送审。
4、高度存在抄袭(总文字复制复制比在40% - 55%比50% - 59%学位论文或段落),反馈学院,学院学位评定委员会指定的2个专家评审,并作出对抄袭的高度存在的书面确认,如果专家高度抄袭,这个时候如果没有提交;专家同意修改提交,然后改变在指定的时间后重新检验,如果检验结果符合1或2的条件下,进入正常审核,研究报告的书面记录(芯片)。
5、论文存在整体抄袭问题(总文字复制比在56%及以上或段落复制比在60%及以上的学位论文),本次不予送审。
6、对于针对本人已发表论文的文字复制比,根据情况酌情考虑相关文字复制比的比率。
7、研究生提交的送检论文如果是非完全稿或送审稿,被查出或被检举者,经查实,直接取消本次学位论文的送审资格。
扩展:硕士论文选题攻略
1. 选择自己感兴趣的
几乎所谓的领域都可以写出优秀的论文,选择一个你感兴趣的,愿意投入全部热情来研究的领域和问题,远比追逐时髦问题和时髦理论要重要的多。学术有前沿,但是学术价值没有前沿。——听几个师兄师姐都讲,要选自己感兴趣的东西来做论文。毕竟,我至少要在上面倾注一年的时间。一年的时间,在生命中不算长;但在我三年的硕士研究生生涯中,不能算短了。
所以,我要花费心力去做的东西,一定是我挚爱和喜欢的,也要有价值。如何判断论文的价值呢?
2. 判断论文的价值
(1)“新”:提供新材料、发现新问题、发明新观点;
(2)直接问导师:但是记住,你不能永远依靠导师,要多动自己的大脑。——自从丁老师说要从丁老师现有的项目中进行毕业论文选题后,我就把选题的责任“推”到老师身上了,等着老师给自己定个题目。我这种做法是多么幼稚啊?!直到最近两天才翻然悔悟,做毕业论文是自己的事啊,要开动自己的大脑!
3. 从何处着手:硕士论文的研究策略
(1)写作前准备很重要。确定论文选题后,大家要做的第一个工作就是尽量搜集资料,要搜集到你能看到的、检索到的所有的研究资料。这是个体力活,需要耐心和时间,但却是不可缺少的。途经包括书店、图书馆、中外文学术期刊网和你朋友的书架等等。
(2)构思很重要。如果你头脑中没有一个论文的基本写作框架,那么千万不要动手,因为那是浪费时间。理想状态是,你能看到你的论文写成后大体是个什么样子的,分几部分,每个部分论述几个问题,分析几个作品,大约多少字数,等等。——这两点主要在论文开题阶段完成,可见开题之重要。开题是硕士论文写作的基础,一定要把基础打好才行,不能抱着应付的态度。
(3)论文构思过程中要遵循“由小到大”和“由大到小”的顺序。所谓“由小到大”,就是要将你选题时的灵感和思路,丰富化、细致化、条理化、理论化,将一个小思路、小灵感变成大问题。比如你发现某位作家的叙事手法很有特点,那么请你将这个思路和叙事学、结构主义等理论联系起来思考,利用理论帮助你把小发现放大,形成一个大的论文框架。所谓“由大到小”就是把你确定的大问题,再分解成一个个的小问题,将一个4-5万字左右的硕士论文,分成5-6篇包含5-6个小问题的单篇论文。这样就可以很好地解决,很多同学不知道怎么写和写什么的困惑。
(4)时间安排。不要突击硕士论文,一个月之内固然可能完成一篇硕士论文,但是请相信,那和花费1年半的时间写出来的硕士论文,是绝对不一样的。具体方法如上所说,就是把大论文分成小论文,一篇一篇慢慢完成,然后组合到一起。单篇论文写成了,可以及时让导师指导,还可以参加院里的五四论文比赛,一举两得,何乐不为?——这两点是论文写作中的注意事项,从平时做起,从点滴做起,让自己从容,不要让别人拿着鞭子在自己后面追。
4. 论文写作过程中的几个小技巧
(1)抓住每一个机会讲述你的硕士论文思路。讨论是整理思路的最好方法之一,如果你不能在讨论甚至辩论的'时候,把你的思路清晰的讲述出来,那说明你还没有把问题想透。讲述和讨论可以帮助你清晰思路,不要轻视每一个人,因为即使读书比你少的人,也能听出你想法的优劣,并可能给你很好的提示。——与别人闲聊的时候,或在路上,在吃饭的时候,不妨多把自己的想法和困惑讲给别人听。“讨论犹如砺石”,能使思想更锋利。不要怕被别人耻笑和不屑。这是开放系统的必备特征,与环境交换信息。
(2)笔耕不辍,千字小文不断。不要忽视小文章,它不仅可以锻炼文笔,更能消除眼高手低的毛病,加深你对问题的认识。——“冰冻千尺非一日之寒”,五、六万字的硕士论文,非一朝一夕之功。
(3)阅读权威,质疑权威。不要阅读低质量的论文,因为那不仅浪费你的时间,而且败坏你的胃口。要尽量选择本领域内的权威学者的论文来阅读,因为他们视野开阔,对问题认识清楚,读了他们的著作,你就站在了巨人的肩膀上。优秀硕士论文需要创见,要研究前沿,所以单单阅读权威还是不够的,必须要有质疑权威的胆量。即使你无法驳倒他,但是质疑精神或许会带给你意想不到的收获。
(4)如果有机会,当面向本领域内的权威人士请教,他们的一句话,一个点播,往往会让你有豁然开朗的感觉。——华南师范大学经常会有一些大型的国际会议或国内会议,专家大腕也经常光顾,要抓住这些学术研讨的机会。
(5)如果你有能力,请合理利用跨学科知识。
硕士查重率各个高校要求不一样,一般是查重率不得超过20%-30%,有的学校要求更严不得超过10%、5%
一般硕士论文查重要求,大于30%的取消本次学位论文答辩资格。总文字复制比大于等于20%,小于30%,疑似有抄袭行为,需要再修改;小于15%(不含15%)可正常送审或答辩。