深蓝色背景下的深色药丸插图

制药行业中的人工智能:数据策略助力药物重定位成功

药物重定位具有显著降低成本和时间、提高监管成功率以及加速产品上市的潜力,正逐渐成为药物开发中一种极具吸引力的策略。随着人工智能 (AI) 不断融入药物重定位框架,这些优势有望进一步扩大,从而实现更精简的流程和更高的发现效率。在这些高期望之下,关键问题依然存在:人工智能需要具备什么条件才能充分发挥其潜力,从而变革药物重定位工作?

本文深入探讨了决定您人工智能辅助药物重定位项目成败的关键考量因素。

Is your R&D data ready for the future? The CAS Intelligence Hub is a powerful integrated solution that transforms fragmented scientific R&D data into a harmonized, AI-ready knowledge environment.

暗数据与可访问性:您的数据准备好迎接人工智能了吗?

众所周知,人工智能分析的力量源于数据。在海量信息的驱动下,人工智能能够发现人类分析师经常忽略的趋势和模式,并生成可操作的见解,从而加速您的重定位项目。  

您最具洞察力的数据是否难以触及?

据估计, 55% 的组织知识,“暗数据”是指公司随时间积累但从未用于其他目的的非结构化信息。这类数据通常未经统一整理且存储在分散的系统中,其可访问性有限,这阻碍了将其整合到运营效率和战略性人工智能分析中,而这些分析本可以推动重定位工作向前发展。

暗数据可能包括:

  • 未发表和存档的临床试验报告 如被放弃的试验。  
  • 真实世界数据 (RWD) 如保险索赔、电子健康记录 (EHR) 和患者病史。

近期的应用表明,暗数据与人工智能技术相结合,有望成功发现现有药物的新治疗用途。然而,如果组织未能利用这些沉睡的数据来支持其药物重定位工作,可能会将一个充满希望的战略变成错失的良机。

2020 年,Insitro 与百时美施贵宝 (Bristol Myers Squibb) 利用人工智能支持的筛选平台和存档的临床试验数据,确定了新的靶点, 用于治疗肌萎缩侧索硬化症 (ALS) 和额颞叶痴呆。

数据多样性与预测准确性:您能信任您的人工智能模型吗?

数据多样性对于人工智能模型的准确性至关重要,尤其是在药物重定位等高风险领域。在有限数据上训练和运行的人工智能模型会影响您的分析结果和所生成见解的质量,从而削弱您的战略优势并阻碍药物重定位工作流程。

缺乏数据多样性可能导致:

  • 模型验证效果不佳且能力受限— 在同质化数据上训练人工智能模型,会将它们的学习范围限制在狭窄的场景中,并限制其模式识别能力。这可能导致关键见解被忽略,并可能阻碍模型广泛应用其研究结果的能力,从而妨碍药物重定位工作。
  • 偏差和误导性见解— 如果输入的数据存在偏差或缺乏代表性,人工智能算法可能会生成有偏见的见解,从而导致决策失误。这可能导致药物重定位建议对未被代表的群体效果不佳或不安全,并可能在临床应用中造成不良后果。
  • 假阳性与资源浪费— 依赖基于偏差数据的人工智能预测可能会导致假阳性,即错误地追求不可行的药物重定位候选药物。这不仅浪费时间和财务资源,还会分散对更有前景的候选药物的注意力。

将暗数据整合到训练和分析数据集中,可以增强数据的多样性并有助于规避信息偏差。然而,为了增强预测算法的能力,各机构必须超越其内部资源,丰富数据库,加强人工智能模型的稳健性,并为精确预测奠定基础,从而加快药物重定位的进程。

2024年, 研究人员利用机器学习模型对十年的真实世界数据(RWD)进行了分析, 以模拟数千项临床试验,并已确定了五种用于治疗阿尔茨海默病的药物重定位候选药物。  

数据质量与可靠性:您的数据基础有多稳固?

拥有丰富多样的数据库可以显著提升人工智能在药物开发中的潜力,并加速您的重定位管线。然而,数据量大并不一定意味着数据质量高。

Data integrity for AI-powered scientific research. AI’s capacity for data and its computational speed surpass what humans are capable of and the technology will continue to redefine what is possible. But data integrity and harmonization are critical components of any successful application of AI in science.

仅仅积累大量信息来驱动人工智能分析,不足以保证结果的可靠性和可信度。为此,各机构必须确保每一条数据都符合以下要求:

  • 完整性:确保所有数据集全面,补全缺失值,并识别可能影响分析的缺口。
  • 准确性:验证数据是否反映现实,并纠正数据质量评估过程中发现的任何错误或异常。
  • 一致性:统一所有数据源的格式、数值和结构,以促进分析和整合。
  • 相关性:使数据与特定的研究目标或项目需求保持一致,从而使其直接有助于所考虑的见解或决策。

尽管数字技术和数据共享计划的兴起简化了海量信息的获取,但您必须对数据进行验证和清洗,以确保人工智能驱动的药物重定位策略取得积极成果,并避免代价高昂的错误。

查看真实案例:药物研发公司 Insilico Medicine 与梅奥诊所(Mayo Clinic)和哈佛医学院(Harvard Medical School)等顶级机构合作,获取了广泛且经过精心收录的临床数据,从而增强了其人工智能驱动的平台。这为肌萎缩侧索硬化症(ALS)等疾病带来了新的药物重定位机会。

知识管理:人工智能辅助药物重定位成功的基石

随着药物重定位框架越来越依赖认知技术,各机构必须重新评估其收集、清洗和存储信息的方式,以应对数据相关的挑战并最大化人工智能的潜力。正因如此,知识管理策略近年来变得愈发重要。

通过投资合适的知识管理解决方案,您可以确保数据的可用性、多样性和质量,从而实现与人工智能驱动的药物重定位策略的无缝集成。然而,选择并部署符合您项目需求和目标的正确方法,需要深入了解各种知识管理选项,以克服数据集成障碍,并将您的重定位工作推向新的高度。

下载此白皮书,探索有效的知识管理解决方案

成功的人工智能驱动药物重定位策略:一切归根结底在于数据

随着人工智能在药物重定位工作流程中占据核心地位,制药公司必须仔细审查驱动其模型的数据,以避免盲目投资并降低相关风险。通过了解先进数据驱动技术的关键要素,各机构可以制定并部署有效的知识管理解决方案,以加强其人工智能驱动的药物重定位策略,为改变数百万患者生活的治疗突破奠定基础。

Related CAS Insights

AI 药物开发技术的兴起

Defining the path to TBK1 inhibition with QSAR modeling

Embracing the future of AI in the food industry

Gain new perspectives for faster progress directly to your inbox.