就离谱!论文“撞衫”,11篇不同高校论文中竟出现同一块桌布....

AI权益加码!Claude Code、Cursor等20+工具免费用! 购周边限时加赠Coding Plan Lite,畅享主流AI工具!学习进阶更高效! 阅读详情

本文来源:募格课堂整理自Retraction、丁香园、SCI论文投稿

撞衫不可怕,最多是尴尬,可是论文“撞衫”,就是件细思极恐的事情了......

日前,Retraction刚刚报道了一起匪夷所思的事件——6 个不同单位的作者,在 6 篇论文中,疑似用了同样一把尺子作为标尺。

最近,同类事件又被扒出!“撞衫”论文数量不仅增加,作者涉及单位甚至有同济大学、武汉大学、兰州大学、中国医科大学等多所知名高校!

其中一篇论文,直接把作者单位“陕西中医药大学”拼写成了“山西中医药大学”(陕西Shaanxi ,山西Shanxi),这些迷惑操作着实令人摸不着头脑。

de12b78616a501d472d7e00cbe569b77.png

时隔2年多终被撤稿

11篇文章重复使用标尺及桌布

2018年2月8日,陕西中医药大学朱振宁(音译,Zhu Zhenning)在Bioscience Reports 在线发表题为”HOTAIR contributes to cell proliferation and metastasis of cervical cancer via targeting miR-23b/MAPK1 axis“的研究论文,该研究确定了HOTAIR发挥其致癌作用的新途径,并为HOTAIR在宫颈癌预后和治疗中的潜在应用提供了分子基础。

2021年6月8日,该文章被撤回,主要原因是该文章的实验样品,标尺及桌布在其他多达10篇文章出现重复使用,同时作者没有回应编辑的询问;另外,作者的单位是陕西中医药大学(Shaanxi University of Chinese Medicine),却拼写成了山西中医药大学(Shanxi University of Chinese Medicine)。

1a440a561759c3c698659e9ac186929f.png

在收到读者的通知后,应主编和编辑委员会的要求,本文将从 Bioscience Reports 中撤回,提醒编辑委员会注意图 2C、3C、5E、6J 和 7A,其中包含重叠数据和图像与其他几个出版物的重复

已就撤稿事宜与作者联系,但作者未回应杂志社的询问和提出的担忧。鉴于所提出问题的严重程度,编辑委员会支持撤回该文章的决定。

Retraction编辑部发现,该文章使用的桌布与其他10篇不同单位的作者使用的桌布高度相似,具体情况如下:

[1] 陕西中医药大学,Bioscience Reports ,图7A(已撤稿)

4913ccd7f6d82f63c59cde390ed3c154.png

[2] 武汉大学,ONCOLOGY LETTERS ,图4A(已撤稿)

f8116eddef8272ade80de8cfa0e59d13.png

[3] 浙江台州市立医院,Oncology Research ,图6A(已撤稿)

216f22773a2b5bca66e3d04f26002ad2.png

[4] 中国人民解放军成都军区总医院,International Journal of Oncology ,图8A(已撤稿)

6b25352c9e39b0bd283f6144a273de1d.png

[5] 榆林市中医院,Oncology Reports ,图6A(已撤稿)

8fd139866eb559bfa8e54a4f66e82c8d.png

[6] 郑州大学,International Journal of Oncology ,图6A(已撤稿)

14c8c7538307c368af7f87044fcd3040.png

[7] 中国医科大学,Oncology Research ,图7A(已撤稿)

15ff4525de1740f021be37e5ba006c65.png

[8] 山东聊城市人民医院,Oncology Research ,图6A

c49586a8b5a25ddd0f625324dd153df4.png

[9] 兰州大学,Oncology Research ,图7A(已撤稿)

c4c229976c117bfb30b51b84115cc600.png

[10] 同济大学,Biochemical and Biophysical Research Communications ,图4A

d9ae6ef3393692c01d975ae5cf4fb94c.png

[11] 西南医科大学,International Journal of Oncology ,5A(已撤稿)

4134d0718b1abf26c7d8f8485ed06a8b.png

另外,Retraction编辑部也发现,该文章使用的样品,也与其他文章的样品/曲线出现重叠:

1261b64a1c7c34c0ccd64075aa725ce2.png

459562ce02ce0e954823b5a620a24b91.png

以上这些论文逃不开典型的“论文工厂造假”案,共享数据,高通量造假被论文工厂里的写手们运用地淋漓尽致。

论文工厂“产品”将难以遁形

知名打假学者伊丽莎白·比克 (Elisabeth Bik) 的团队在近几年爆出了太多离奇的论文造假案例,揭露了一个又一个论文工厂的造假套路,编辑在对论文进行初审时可以多多留心一些论文工厂的流水线作品的既定套路,以减少这类论文被顺利送审的情况。

453c5d75c658d19e5f931a96f833997a.png

图片来源:比克的博客

此外,随着图片打假软件的开发和普及,出版商应该充分利用机器学习的火眼金睛,让上述这种形式的图片共享式造假在未来难以遁形。

这也为难了不少学术期刊,从论文见刊到发现造假问题,需要耗费不少的时间精力去检索证据。某些学者总想抱着侥幸的心态“放手一搏”,然而因几篇论文获得荣誉只是一时的,但凡被发现后撤稿,造假的记录却是无法抹消的,这样的行为确实值得三思而后行。

以上。

觉得还不错就给我一个小小的鼓励吧!
聚类在 RAG 里的落地细节 RAG 主检索一般还是向量相似度(ANN),聚类解决「向量分布混乱、上下文割裂、检索冗余、长文档分片语义漂移」问题。常见聚类算法:K-Means、DBSCAN、HDBSCAN、层次聚类;RAG 场景,K-Means 适合已知类数的场景。 阅读详情

相关推荐

离谱论文撞衫”,11不同高校论文出现一块桌布....

本文来源:募格课堂整理自Retraction、丁香园、SCI论文投稿撞衫不可怕,最多是尴尬,可是论文撞衫”,就是件细思极恐的事情了......日前,Retraction刚刚报道了一起匪夷...

lsxxx2011的专栏 358

AI-XGBoost机器学习与生态—植被与土地利用识别、土壤碳氮空间预测、生物多样性驱动机制、土壤微生物功能预测、生态退化与风险识

在众多机器学习方法中,XGBoost以其卓越的预测精度、对非线性和交互作用的天然刻画能力、对中小样本数据的良好适应性,以及SHAP等配套解释框架带来的机制解析能力,已成为生态、地学、环境、农业等领域高水平论文中应用最广泛的算法之一。课程不做概念宣讲,而是以真实研究流程为主线——从研究问题界定、多源数据整合、模型构建与调优、结果解释,到论文图表与文字表达——通过五类高频生态地学案例的完整实操,帮助学员把机器学习真正用进自己的课题中,形成可复现、可解释、可发表的研究成果。

weixin_xiao5kou4chang6kai4的博客 93

离谱!结论相反的两论文共用一张图,教授:可能是研究生的错

本文来源:整理自Retraction、丁香园、SCI论文投稿,编辑:募格学术两结论相反的论文一张实验图?在被质疑后作者“甩锅式”回应:重复可能是因为研究生滥用了该图像。近期,据撤稿快讯报道,广东省第二人民医院的Jinqian Zhang、Guoan Xiang两位教授作为共通讯作者在International Journal of Oncology(IF5.884/2区)期刊发表了题为...

3D视觉工坊 1482

K-Means 聚类的目标函数:簇内误差平方和

K-Means 是一种无监督迭代式的聚类算法:给定数据集与预设簇数K,算法把样本划分为K个不相交的簇,使得一簇内样本尽可能相似,不同簇间样本尽可能远离。核心思想:> “让簇内‘抱团’,让簇间‘疏远’。

Frost_Descent的博客 5036

数学建模国赛倒计时 1 天 ——《机器学习精讲(决策树理论)》

决策树 = 一张流程图 + 一套规则。解释给评委听,用决策树;追求精度,用随机森林。两者不冲突,可以先用决策树解释变量关系,再用随机森林提高精度。

统计学小王子的博客 182

AI机器学习深度学习学习资源合集

大家好,今天想和大家分享一下关于AI机器学习深度学习的学习心得。很多人觉得AI的学习曲线很陡峭,但其实只要掌握了核心概念,入门并没有想象中那么难。从最初的图灵测试到现代的深度学习,AI经历了三次重大浪潮。第二次浪潮引入机器学习,让机器从数据中学习;第三次浪潮则通过深度学习实现了真正的突破,让机器能够自动提取特征并完成复杂任务。机器学习是AI的核心,主要分为三种范式: 1. 监督学习:需要标注数据,擅长分类和回归任务,如图像识别和房价预测。2. 无监督学习:无需标注,擅长发现数据中的隐藏模式。

a777511471的博客 83

统计学中的六大估计方法:从最大似然到核密度估计的本质理解

<think>我们只需要根据内容生成摘要,控制在150字以内。先理解文章主题:介绍统计学中六种估计方法(MLE、MAP、LSE、BLUE、贝叶斯估计、KDE)的核心思想、数学形式及区别。摘要需概括主要内容和本质。 写一个简短的摘要,不超过150字中文。先草稿: 本文介绍统计学中六种基本估计方法:最大似然估计、最大后验估计、最小二乘估计、最优线性无偏估计、贝叶斯估计和核密度估计。它们基于不同推断哲学:MLE只依赖数据最大化似然;MAP加入先验;LSE最小化误差平方;BLUE寻找线性无偏方差最小;贝叶斯估计输出

qq_51352578的博客 264

机器学习1导学:算法分类、建模流程、特征工程、模型拟合

找西瓜,

2401_87118211的博客 46

机器学习在信贷风控建模中的优势和挑战

目前该方法应用于页面埋点动作的特征提取,将点击和浏览动作看作词,用户完整周期内的所有动作行为组成了段落和文章,再使用 word2vec 方法,将用户的点击浏览行为隐含表征为一定维度的向量,再将向量作为用户的特征输入 xgboost 进行建模,单个特征有 1-2 个 ks 点的提升,效果还是不错的。2)数万维的特征,数十万参数的模型。互联网金融中资质较差的客群基本没有资质数据以及合规的信贷数据, 虽然有一定的消费数据但是该类数据大多掌握在巨头电商平台手中,所以所能获取到的就是开放度高的互联网行为类数据。

qq_42865713的博客 206

机器学习】数据集不是素材库:样本、标签与分布决定了学习上限

本文以单关节机械臂的负载估计和温升预测为例,说明数据集不是存放日志的素材库,而是对模型任务边界的提前定义。文章从样本、标签与数据分布三方面展开:样本必须保留决策时可获得的时序上下文;标签必须准确表达目标,并通过时间步、故障状态和规则校验;数据分布则应覆盖负载、温度、速度、方向与异常等真实工况,不能被重复的常态记录掩盖。文中进一步讨论时间泄漏、类别失衡、训练测试划分和数据契约,并给出从问题定义、质量筛选到影子运行的准备流程。核心结论是,模型能力上限往往早在训练前,已由数据的可信度与覆盖范围决定。

2402_86234774的博客 236

机器学习-03-2-预测模型-线性回归-损失函数01

所属总体流程节点1-基本概念1-1-误差误差= 预测值y - 真实值y1-2-损失函数上一节我们通过线性回归公式算出了预测值,现在需要统一计算所有预测值与真实值的整体误差

2601_96229353的博客 178

机器学习笔记】

信息存在于数据的相对大小中的数据时加上/减上/乘上/除去一个常量,信息不变数据预处理,没有改变信息本身,但是对后面模型的训练/收敛有帮助以0为中心,以1为标准差的数据。

2301_76821799的博客 200

【优化方法】最小二乘:从误差平方到线性与非线性拟合

二乘:把误差的二次方作为代价;最小:寻找让这些二次误差之和最小的参数。一般地,给定观测值yiy_iyi​、模型预测值yifxi;θ和参数θ\thetaθ,定义残差riθyi−fxi;θ最小二乘问题写作θarg⁡min⁡θ∑i1nriθ2θargθmin​i1∑n​ri​。

weixin_48846514的博客 145

机器学习】从机理建模到数据学习:机器学习替代了什么

本文以单关节机械臂为例,说明机器学习并不是把控制理论、物理规律和安全约束全部换成黑箱,而是在摩擦、负载、温漂、间隙等因素使精确机理模型难以完整描述时,用历史数据学习输入与输出之间的映射或模型残差。文章分析失配来源、数据任务、时序样本的时间关系与故障标签,以及训练集和线上工况不一致带来的分布偏移。最后给出“机理模型打底、数据模型补偿、安全边界兜底”的混合方案,并提出离线评估、影子运行、受限接入和持续监控的落地路径。机器学习替代的不是工程责任,而仅是部分难以手工写出的经验映射;当数据失去可信性或超出覆盖范围时,

2402_86234774的博客 532

机器学习谈起

本文以通俗易懂的方式介绍机器学习,通过“等人”故事引出其核心思想——基于数据归纳规律。文章系统阐述了机器学习的定义、方法(如回归、神经网络、SVM)、应用(如语音识别、图像处理)及与大数据深度学习人工智能的关系。强调机器学习是模拟人类经验归纳的过程,具有广泛前景,尤其在自动驾驶、推荐系统等领域表现突出。作者呼吁将高深技术落地于实际场景,推动技术普惠。

sheep404的博客 198

Cisco Splunk for AI Operations:AIOps机器学习

AIOps定义:基于机器学习的智能运维,核心是将传统被动式IT运维转变为主动式洞察("The Intelligent Engine: Transforming Reactive IT with Machine Learning")。核心价值:解决传统IT运维的"数据噪音淹没信号"问题,通过ML技术从海量告警和日志中提取关键信息,实现故障的自动检测、关联分析与根因定位。典型场景:IT团队面临告警风暴("I'm drowning in noise!

pt1043的博客 53

AI大模型与数学 第75课 基、维度、向量空间坐标

这三个概念,是线性代数的「终极落地工具」,也是AI词向量、特征空间、模型降维、OPT空间梯度理论的底层地基。3. 多余特征大概率线性相关,造成维度冗余、空间信息重叠,模型拟合噪声,引发过拟合、计算冗余。样是二维平面,为什么有的10个向量撑不起新维度,有的2个向量就能铺满整个空间?这两个向量斜着交叉,线性无关,也能组合出平面所有点,也是一组合格的二维基。除了横竖标准基,任意两个不共线、不重合的向量,都是二维空间的合法基。特征矩阵维度混乱、基向量冗余,无效维度太多,模型记住噪声而非真实规律。

2601_96546232的博客 专注数学与电子科学及工程技术分享交流。 425

【有源码】基于机器学习的电信网络诈骗话术语义识别与可视化分析系统 XGBoost算法+Hadoop+Spark

基于机器学习的电信诈骗话术语义识别与可视化分析系统融合分布式计算、机器学习及Echarts技术,对五类诈骗话术进行预处理、特征挖掘、关联规则、聚类与XGBoost分类,实现诈骗类型自动判别及多维度可视化分析

qq_2105837402的博客 140
上一篇: 我们为什么要读书,这是我见过最好的答案
下一篇: ICLR 2022杰出论文奖出炉!清华、人大获奖,浙大提名
Wang_AI
博客等级 码龄11年 930粉丝 162原创
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值