M42推出新一代人工智能临床大语言模型 助力全球医疗创新

阿通社阿布扎比2024年5月14日电 全球医疗技术巨头M42近日在阿布扎比全球医疗周期间推出了下一代开放获取生成式人工智能临床大语言模型Med42。在最初成功发布的基础上,Med42代表了人工智能驱动的医疗创新的下一次发展,旨在推进医疗人工智能应用,改善患者护理,同时帮助减轻临床医生的行政负担。

M42于2023年10月首次推出Med42,为医疗保健人工智能的准确性、效率和可访问性设定了新标准。在美国医师执照考试(USMLE)样本考题中,最初版本得分为72%,优于OpenAI的GPT3.5和谷歌的MedPaLM模型。迄今为止,该模型的下载量超过8200次,吸引了全球范围内独立开发人员的关注和赞誉。

第二次迭代基于Meta最新开放访问LLM Llama-3的完全优化的700亿参数微调模型。新模型在使用USMLE专门提示时,零射击精度得分为85.1%,最高精度得分为87.3%,性能与OpenAI的GPT-4和谷歌的Med-Double等专有模型相当。这突出了Med42的效率和可访问性,巩固了其作为开放临床LLM技术领跑者的地位。

M42集团首席运营官阿希什·科什表示:"我们很高兴发布Med42的第二个版本,这代表着我们在负责任地利用人工智能造福患者和医疗从业者的使命中向前迈出了重要一步。此次发布使我们更接近我们的愿景,即可组合多模态人工智能平台,集成跨健康数据模式的专家模型,包括文本、基因组学、健康记录和成像。我们旨在应对需要多模态方法的复杂医疗挑战。"

阿希什强调,在评估Med42性能时,需要同时考虑领先和滞后指标。像USMLE这样的基准是衡量模型能力的有价值的领先指标,但成功的真正衡量标准在于它在特定应用中的真实表现。M42的跨学科团队正在积极开展研究,以全面评估和完善Med42在临床环境中的性能。

Med42通过简化留档流程、减轻行政负担和支持医疗从业者,展示了医疗保健自动化的潜力。该模型有助于检索相关见解、搜索患者病史和总结记录。此外,Med42正在接受评估,以评估其制定定制治疗策略的能力。该模型还有望成为医生的临床决策支持工具,协助药剂师做出准确的剂量决策,并帮助研究人员有效审查治疗文献。

Med42可通过HuggingFace平台访问,实现全球科学和开发者社区的广泛测试、贡献、审查和评估。M42旨在通过广泛提供Med42,催化人工智能的全球创新,使全球专家能够完善和扩展该模型在不同医学领域的应用,最终推动患者护理和医学研究的进步。