
网问答>>北大计算机学院再登国际AI顶刊!张铭教授团队揭露医疗AI致命漏洞
问题
北大计算机学院再登国际AI顶刊!张铭教授团队揭露医疗AI致命漏洞
时间:2026-01-19 23:15:02
北大计算机学院再登国际AI顶刊!张铭教授团队揭露医疗AI致命漏洞
最佳回答
北京大学计算机学院张铭教授团队联合华盛顿大学等团队登上国际AI顶刊,揭示医疗AI漏洞并提出防御手段。2024年9月20日,相关研究成果发表于国际顶尖人工智能期刊Nature Machine Intelligence,题为“Poisoning medical knowledge using large language models”。研究背景从科研文本中构建的生物医学知识图谱,已被广泛应用于辅助医学决策和挖掘新的医学发现。大语言模型虽能生成高质量文本,但也可能污染公开数据库,对基于这些数据库构建的医学知识图谱推理系统构成潜在风险,影响药物推荐和疾病研究等决策,威胁患者治疗效果和安全。因此,揭示并评估这种风险,制定防御策略具有重要意义。研究内容开发Scorpius系统:研究团队开发了名为Scorpius的条件文本生成系统,该系统利用大模型为指定的药物 - 疾病关系对生成恶意文本。发现漏洞:研究发现,只需一篇恶意文本,就能显著误导推理系统对相应药物 - 疾病关系的认知。例如,在基于3,818,528篇论文构建的知识图谱上评估,仅通过添加一篇恶意摘要,Scorpius就能将71.3%的药物 - 疾病对的相关性从1000名之外提升到前10名,且生成的摘要在六项评估指标上都表现出难以被有效检测的特性。验证可毒害性:图谱推理的可毒害性:研究人员通过在已构建图谱上直接添加恶意连边的方式评估。对于只针对特定药物 - 疾病的毒害,添加一条连边,经典的DistMult、ConvE和ComplEx推理方式便会被误导到指定结果上,使目标药物 - 疾病的相关性排名大幅上升;对于不针对特定疾病,旨在提升某一药物全局重要性的毒害,图谱推理系统抵抗性更强,需要添加多条恶意连边才能达成毒害目的,同时图谱中存在高敏感的中心节点,添加与之相关的恶意连边更容易达成毒害目的,这表明图谱推理系统自我纠错能力较低,容易被毒害误导。 - 知识图谱构建的可毒害性:研究团队验证了从文本数据中抽取知识图谱这一过程的可毒害性。即使对真实文本进行大量简单替换改写,即使改写后的文本质量显著降低,现有的图谱抽取工具(包括医学专家知识驱动的GNBR,以及通用数据驱动的UIE、TDERR和LUKE)依然能抽取出目标关系,说明各种更高性能的大模型都能有效欺骗相关图谱抽取模型。提出防御手段:研究采用更强的defender,建立更大更多元的医学知识图谱,使用专家审议的数据库取代预印本数据库,均能在一定程度上降低毒害带来的影响。研究模型Scorpius模型工作流程:对于给定的毒害目标,Scorpius首先基于有害性和隐蔽性的综合考量来选择恶意连边,随后采用模板提示 + 大模型生成 + 领域适配改写的方式生成对应的恶意摘要文本,最后将生成的恶意摘要和包含百万篇真实paper的数据库混合,从头构建图谱并完成推理,比较毒害目标在推理系统中的排名变化。模型效果:现有的大模型GPT - 3.5,GPT - 4,Finetune - GPT - 3.5,RAG - GPT - 3.5,RAG - GPT - 4均能达成毒害目的,而Scorpius取得了最强的毒害效果。研究意义研究团队不仅衡量了医学图谱推理系统中各环节的可毒害性,揭示并定量评估了大模型的误用对医学发现可能造成的误导,而且从defender设计和数据增强的角度对减少此类毒害做出了探索。这些结果展现了基于公开数据集的医学图谱推理存在的高危漏洞,为在大模型时代开展更可信的医学知识发现开辟了新的研究思路。作者介绍论文一作杨君维为北京大学计算机学院三年级博士生,导师为张铭教授。王晟和肖之屏也是北京大学信息学院计算机系校友,与张铭教授团队有多年的合作。北大团队成员还有硕士留学生Srbuhi Mirzoyan,博士生刘泽群,博士后琚玮、刘卢琛。全体作者为Junwei Yang, Hanwen Xu, Srbuhi Mirzoyan, Tong Chen, Zixuan Liu, Zequn Liu, Wei Ju, Luchen Liu, Zhiping Xiao#, Ming Zhang#, Sheng Wang#(标#的为通讯作者)。
时间:2026-01-19 23:15:05
本类最有帮助
- 关于贵巢床垫,听说其环保性能怎么样呢?
- 喜元帅瓷砖属于几线品牌?
- 长安的荔枝被禁播了么
- 这是边牧串吗?
- 云彩石地坪漆有什么优势?家里能用吗?
- 针对一般家庭装修,云彩石品牌提供怎样的组合方案?
- 听说藏天参和普通人参存在区别,为什么它的价格会更
- 叶良柱为什么选择给家具涂木蜡油而不是化学漆呢?
- 王浩输给过谁
- 小人全部滚。。。别想合好。。一个字穷?
- 包头包钢友谊宾馆酒店介绍
- 为啥应该感谢别人帮忙,但是有些人是要求别人感谢他
- 感恩是怎么来的,为啥有的人劝人目的是别人必须感谢
- 关于央心心理咨询,目前它的收费贵不贵呢?
- 关于央心心理咨询,第一次体验目前感觉如何?
- 对于央心心理咨询APP,收费标准是怎样的?
- 关于央心心理咨询,听说有线下机构分布吗?
- 二把手做好二把手
- 他对我有意思吗?
- 我喜欢你和能做我女朋友吗哪个正式有仪式感?
- 教师节写给教师的贺卡祝福贺词
- 以前很珍贵的应用,不小心删了,然后又忘了他的名字
- 以前很珍贵的赚钱应用,不小心删了,然后又忘了他的
- 最近麻烦事多,工作干不下去做不开心,新工作又不可
- 为什么我总是被用别人的咒骂语才能把自己隐藏到人群
- 一个未婚大龄女性,被一个已婚有子女的女人骂绝子绝
- 汽修兄弟们,有没有轻巧还贼拉带劲的电动扳手?
- 新国标电动车能解限速吗
- 光伏发电组成部分?
- 光伏板最多串联多少组?
- 光伏板之间怎么连接?
- 炫潮隐形车衣怎么样?
- 炫潮隐形车衣值得购买吗?
- 隐形车衣炫潮怎么样?
- 汽车解码器进不到系统是什么原因?
- 自由光喇叭什么牌子
- 炫潮品牌隐形车衣质量怎么样?
- 简单回答一下发动机电脑控制点火系统的工作过程
- 2014年A8发动机电脑版多少钱?
- 鉴别本田割草机真假识别
- 关于店商豹,它是怎么赚钱的?
- 当前银监会能否帮助协商还款
- 重庆丰都中学高考成绩亮眼
- 广东岭南职业技术学院有几个校区?地址分别在哪?
- 马明义平凉一中校长
- 广东岭南职业技术学院从广州天河区如何到达清远校区
- 长沙市通航中等职业学校是中专还是大专?可以学哪些
- 手机第一次充电充多长时间好?
- 怎么刷机?
- 王老师买粉笔用去29元7角,买墨水用去57元9角,她付
网问答为提供知识和解答各类疑难的平台,目标是做到有问必答解决您遇到的各类问题.本站内容均为网友发表,并不代表本站立场!
Copyright © 2008-2013 www.wangwenda.com All rights reserved.冀ICP备12000710号-1
投诉邮箱: