安永《生命科学4.0报告》曾用FV=ID描述生命科学的未来价值,即未来价值等于“创新”的“数据”次方。左右“价值”指数增长的“数据”,影响着科研成果的获取。
根据《全民健康信息化调查报告》医院大数据应用情况调研结果为,2021年我国三级医院医疗大数据平均应用率不足20%,二级医院不足5%,即使是热度最高的临床数据,也只有1/5的医院尝试展开研究。
为了打破医疗大数据惨淡的应用现状,协助医生挖掘各式医疗数据中的潜在价值,广州中康数字科技有限公司借助百度飞桨深度学习、文心大模型等人工智能技术,结合自研的数据采集网络、大数据处理技术与生态化的健康产业平台,打造“基于文心大模型的AI临床科研大数据平台”。
将大模型应用于医疗,究竟能在医疗领域掀起怎样的波澜?近日,在百度飞桨承办的第四届OpenI/O启智开发者大会“深度学习与大模型产业应用专场”上,中康科技数字医疗人工智能技术产品总监黄毅宁做了进一步分享。
通常而言,开发者们可通过深度学习技术处理文本数据、图像数据、文图多模态等各类数据,而多模态数据在医疗领域尤其常见。
“我们之前跟一位心内科专家研究AI心脏骤停预警的课题。心脏骤停场景与常见的肺结节、肺炎等场景不一样,它具有突发性,所以AI技术的应用强调预测而非诊断。因此,要实现对心脏骤停进行尽可能精准地预警,我们不仅需要处理患者的临床数据,还需要分析心电图数据、检验数据,甚至患者发病时所处环境的水文气象数据。从理论上讲,数据源越丰富,模型预测越精准。”黄毅宁解释道。
为了有效利用多模态大数据,中康科技基于飞桨搭建了AI临床科研大数据平台。具体而言,中康以飞桨自然语言处理模型库PaddleNLP为基础,采用通用信息抽取技术文心ERNIE-UIE进行医疗数据结构化;以中文医疗预训练模型文心ERNIE-Health为底座,应用于医疗文本理解、分析等更多下游任务上。
除NLP技术外,CV等各领域技术也必不可少。中康科技运用了飞桨计算机视觉检测模型库PaddleDetection,采用RetinaNet和SSD进行目标检测,还基于飞桨时序建模库PaddleTS的USAD和SCINet进行时序数据特征抽取,最终实现包括患者临床数据、心电图、心电时序、水文气象等等多模态数据融合处理、解析与理解。
对于心脏骤停患者而言,发病后的每一分钟救治时间都弥足珍贵。若能够通过预警提前感知危险,相信能够挽救更多生命。融合各类模态数据的全新技术方案下,平台预警效果明显提升,已经能够提前5-10个小时预测患者心脏骤停的情况,助力医疗服务的品质大幅度的提高。丰富、多样的医疗数据经有效治理后,能够进一步为临床医生提供辅助决策,也为后续的一系列临床科研打下了坚实基础。
算力不足以处理大量的高维度数据是医生科研过程中常常遇见的另一个问题。譬如,在训练超声AI的过程中,研究人需要从超声影像的高维空间提取关键信息,但是在条件一般的医院很难做到复杂度很高的模型训练与预测。面对这一情况,基于文心大模型的AI临床科研大数据平台可以为医生提供强大的运算能力,使从前很难做到的高维度深度学习建模变得更容易。
为了更清晰地厘清高维度数据处理的价值,中康科技谈到了与一位康复科主任合作研究的“四肢关节活动度AI识别模型建设”这一课题。简单来说,该课题的目的是要用视频的方式评估人们的行动力,替代传统的问卷调查,帮助患者洞悉康复过程中的每一处变化并做出对应决策,最终缩短康复时间,提升康复效率。
“在使用问卷评估行动力时,人们常常会在填写时掺杂主观因素,导致最终评估结果出现偏差,”黄毅宁告诉动脉网,“通过要求用户完成指定的姿态动作,使用视频检测的方式能解决这一问题,更客观更全面地完成用户的行动力分级评价。”
这个课题的第一步是对人体姿态进行采集及分析处理,这一步骤中,中康科技运用了飞桨PaddleDetection视觉检测模型库,包括HRNet、DarkPose、SWAHR等模型自动化识别人体重要关节点,再使用PaddlePaddle深度学习框架构建时间图卷积神经网络根据关节点运动轨迹、运动幅度、运动速率等信息,实现用户的行动力等级评价,并针对性不一样的等级用户更好的提供更精准地个性化的诊疗服务。
除了上述两种医学科研普遍的问题外,中康还将基于飞桨,针对医院数据的复杂情况,继续深化数据治理。
举个例子。根据某科室主任反馈,以往整理一个700名患者包含600个字段的专病数据库,需要5名临床医生利用一整年工作以外的时间去人工整理,数据的利用存在严重的滞后问题。
而采用PaddleNLP的文心ERNIE-UIE,可自动抽取专病语料的关键字段,形成结构化数据。ERNIE-UIE具备高效的零样本抽取能力、少样本微调能力,仅需标注少量样本,微调训练之后即可达到极高精度。PaddleNLP还提供了信息抽取全流程方案,覆盖“数据标注-微调训练-通过模型蒸馏进行性能加速-部署”所有的环节,对于不太熟悉NLP深层技术原理的医疗领域从业者,非常友好。
第一级,相较于传统人工作业,科研平台的自然语言解决能力能将时间效率提升约10倍(时间短);第二级,基于文心大模型的小样本学习仅需使用原来十分之一的数据量就可以完成建模,效率再次提升10倍(数据量变小);第三级,规范化标准化的数据治理使得一个专病数据库能服务于多个科研项目,效率再次提升约5倍,整体实现约500倍的效率提升。
“基于文心大模型的AI临床科研大数据平台”已在国内众多知名医院落地实际应用,且已获得各医院主任的广泛认可。某省级医院主任表示:“原本临床科研课题中符合入组条件的患者数据只能依靠人工整理和筛选的方式获取到,但自从应用了人工智能技术后,这一工作的难度与耗时极大缩小,切实给我们的科研工作带来很大帮助”。
基于文心大模型的AI临床科研大数据平台正在以领先的AI技术助力客户推进科研项目,进一步推进学科研究事业发展。
不过,效率的飞速提升并非打造AI临床科研大数据平台的全部目的。目前,中康科技已规划好了基于飞桨和文心大模型继续扩展大数据平台的应用边界的具体路径。
据黄毅宁透露,中康将基于本身在医疗领域深厚的数据积累,对文心ERNIE-Health进行领域适应的大模型训练,进而将其应用于医学领域各类NLP任务之中。
AI临床科研大数据平台还将进一步对药品说明、医学病历等内容做信息抽取及中文医学术语对齐,自动构建医学知识图谱。
这意味着,曾经的AI临床科研大数据平台将跳出临床数据范畴,逐步将医院全域大数据纳入治理范畴。
中康科技CTO唐珂轲博士表示,中康科技与百度飞桨通过研发技术、生态共建等方面搭建了合作桥梁,实现了繁荣共赢。未来,中康科技期待与百度飞桨建立更紧密的合作伙伴关系,以百度飞桨和文心大模型的人工智能技术优势,以中康科技在健康产业大数据的领先者地位、医学科研领域的技术积累和沉淀,实现产品与方案的联合创新。期待双方全方位、多领域、更深入的交流,为中国医学科研事业持续赋能,共创生命科学领域新篇章。
黄毅宁——中康科技数字医疗人工智能技术产品总监,也是百度AICA首席AI架构师培养计划 6期班学员。正是这份特殊的经历,让黄毅宁看到了飞桨与医疗大数据融合的价值。
加速产业AI大生产,复合型AI人才教育培训至关重要。百度AICA首席AI架构师培养计划由深度学习技术及应用国家工程研究中心与百度联合发起,旨在培养集“分析业务问题、掌握模型算法、操刀落地应用”于一身的首席AI架构师。
伴随人工智能愈发深入地应用于医疗领域,百度AICA首席AI架构师培养计划的未来价值愈发值得期待。当更多人才进入医疗AI领域,推动更多运营、健康等大数据走向应用,我们将能清楚看到一个更加智慧的医疗体系,为更多患者谋求新生。(动脉网)
探索人工智能新型安全挑战与创新应用赋能——学会服务365TALK品牌沙龙走进瑞莱智慧
学会大咖谈|中国力学学会冯西桥:发挥学会优势,让科学研究服务于国家战略需求
学会大咖谈|中国科学技术期刊编辑学会魏均民:推动平台建设和集约化发展,向期刊强国迈进
7月31日,国网新源新疆阜康抽水蓄能电站4号机组正式投入商业运行,标志着新疆首座抽水蓄能电站、我国西北地区首座百万千瓦级大型抽水蓄能电站全面投产发电,将有效助力新疆建设新型电力系统和新型能源体系。
8月1日,中国科学院空天信息创新研究院(以下简称“空天院”)公布消息,国家重大科学技术基础设施——航空遥感系统近日成功在河北省塞罕坝机械林场、御道口牧场等地开展“植被与土壤的水分遥感试验”。
8月1日21时14分,我国在西昌卫星发射中心使用长征三号乙运载火箭,成功将卫星互联网高轨卫星02星发射升空,卫星顺利进入预定轨道,发射任务获得圆满成功。卫星互联网高轨卫星02星由航天科技集团五院抓总研制。
弹跳、腾空、旋转、稳落……巴黎奥运会体操跳马项目是技巧与力量的完美结合。目前,除了体操项目,“时间切片”技术也在巴黎奥运会跳水、乒乓球等项目的赛事转播中得到全面应用。
钟崴提到的“工作”,即宁夏回族自治区银川市选聘“周末工程师”活动。银川市此次选聘的“科技副总”和“周末工程师”,合作企业共93家,涉及新材料、新能源、装备制造等多个产业领域。
暑假期间,各地公共文化机构精心策划、用心准备了别开生面的“科技大餐”,以生动有趣的形式向公众传播科学知识,弘扬科学家精神,助力涵育创新文化。
西湖大学副校长邓力团队在有机小分子催化实验中,实现转化数(TON)1∶100万,即1个催化剂分子,完成100万次催化。据了解,由于这种有机小分子催化物改变了科学界对小分子催化剂和生物酶的传统认知,研究团队将其命名为“小分子酶”。
研究团队认为,刚果和圣佛朗西斯科克拉通(前寒武纪形成的稳定陆块)的碰撞及合并成一处,产生了独特且丰富的水下火山活动。尽管第一次产生的复杂生命未能在全球“遍地开花”,但第二次进化创造了人们今天在地球上看到的动物多样性。
31日,国家中医药管理局召开新闻发布会,介绍《中医药标准化行动计划(2024—2026年)》及中医药标准化工作进展。在中医药国际标准方面,国际标准化组织中医药技术委员会(ISO/TC249)已发布中医药国际标准112项,包括中医术语类、医疗器械类等内容。
智能技术进入快速地发展期,随着ChatGPT、Sora等生成式人工智能模型的突破性进展,人工智能加速渗透到军事领域的各个角落,智能化战争慢慢的变成了未来战争的重要趋势。 碳纤维复合材料既是实现高隐身性能不可或缺的基础性材料,也是衡量武器装备系统先进性的重要标志。
宁夏宁东能源化工基地管委会供图青海德令哈市光伏(光热)产业园的光热电站。 许峰:西部地区传统优势产业大多基于各地区资源禀赋条件,并在当地经济社会持续健康发展中扮演着重要角色。
不断提高设备兼容性、安全性、稳定性,让智能家居真正智能起来,智能家居产业必能迎来更广阔的发展空间,让我们消费者尽享科学技术进步带来的便利和愉悦。
随着重约1200吨的储罐穹顶升顶就位,我国超大型全“坐地式”液化天然气储罐,宁波“绿能港”三期项目3座27万立方米液化天然气储罐完成升顶。
日前发布的《青海湖流域生态气象公报(2023)》显示,青海湖2023年年平均水位为3196.6米,较近十年平均上升1.3米。
近年来,武汉加快建设疾病防控、医疗救治、基层防控、卫生应急保障四大体系,初步建成中心城区15分钟、农村地区30分钟基本医疗卫生服务圈。
中国农业科学院生物技术研究所近日联合国内多家单位,共同绘制了水稻全景定量蛋白质组图谱。
在科研的广阔天地中,每一位研究者都渴望最先触摸到知识前沿,做揭示未知奥秘的先行者。然而,传统的学术出版流程往往烦琐漫长,导致最新研究成果难以及时分享。而预印本平台作为一个便捷的学术交流空间,以开放、共享、快捷的特征,塑造了数字时代学术交流与传播新方式,有利于加快知识传播、扩大学术影响,日益成为科研工作重要组成部分,对提升我国国际学术话语权具备极其重大作用。
所谓“预印本”(Preprint),是指科研成果未经同行评议、尚未在正式出版物上公开发表之前,作者出于交流和证明优先权等目的,自愿先在学术会议上或利用互联网平台发布的科研论文、科技报告等文章。与传统学术论文发表需要同行评议且发表周期很长不同,作为一种新型的学术交流模式,预印本具有发表快速、能带来合作新机遇、有助于提升学术影响力、可在与他人的互动分享中改进稿件等优点,因而受到慢慢的变多科研工作者的欢迎。而由于预印本具有迅速传播和共享功能,有利于加速科研成果的转化和利用,预印本平台建设也得到各级政府组织的重视和支持。
第一届陈景润奖29日在京揭晓,山东大学数据科学研究院教授黄炳荣的“L-函数的矩及其在Rankin-Selberg问题和算术量子混沌中的应用”和中国科学院数学与系统科学研究院研究员聂思安的“仿射Deligne-Lusztig簇的不可约分支”两项成果入选。
从生态环境部29日召开的例行新闻发布会上获悉,生态环境部多个方面数据显示,截至2024年6月底,全国已完成较大面积农村黑臭水体治理3400余个,达到“十四五”规划目标任务的80%以上;全国农村里的生活污水治理(管控)率达到45%以上,农村污水横流状况大幅度减少,农业农村污染治理成效明显。
新闻推荐
【2024-11-18】
【2024-11-18】
【2024-11-18】
【2024-11-17】
【2024-11-17】
【2024-11-04】
【2024-11-04】
【2024-11-04】
【2024-11-04】
【2024-11-01】
【2024-11-01】
【2024-11-01】