慢思考助力医学大语言模型突破数据瓶颈:上海交大联合上海AI Lab推出MedS3系统

霞舞
发布: 2025-02-21 23:38:10
原创
642人浏览过

上海交通大学、复旦大学和上海人工智能实验室的研究团队推出新型医学推理系统meds3,该系统采用自我进化“慢思考”范式,无需预训练和模型蒸馏,即可实现细粒度推理流程验证。

图片

MedS3克服了现有医疗推理模型在长链推理和数据效率方面的不足。现有模型通常依赖于医疗考试题上的模型蒸馏,忽略了推理过程的可验证性和医疗任务的全面覆盖。而MedS3通过策略模型和过程奖励模型(PRM),结合蒙特卡洛树搜索(MCTS)和规则验证,在16个不同数据集上进行迭代优化,仅需7465条种子数据。

图片

图片

论文链接:https://www.php.cn/link/eb32c69f88aa347dcb335d47f0c075e7

项目主页:https://www.php.cn/link/35109f5ad05b4af6bf2f9279ef9d145c

MedS3的创新之处在于其自我进化框架。MCTS生成可验证的推理链,每一步都进行正确性验证并赋予展开值,用于训练策略模型和PRM。PRM引导的投票求和(P-VS)策略选择最终答案,兼顾PRM评判和回复间的语义一致性。

图片

图片

MedS3优势:高数据利用率、支持单步监督、高效支持多任务学习。实验结果显示,MedS3在医疗知识问答、生物医学问答、长上下文问答和医疗诊断任务上显著优于现有模型,成为首个在医疗诊断任务上实现长链推理“R1”的大语言模型框架。 MedS3展现了几乎无界的性能外推潜力,并且MCTS+PRM方法在医疗推理领域展现出显著优势。

图片

图片

图片

图片

图片

MedS3为医疗领域大模型的推理能力带来了显著提升,为未来研究提供了新的方向。 研究团队也指出,将强化学习与MCTS+PRM结合,有望进一步提升模型的泛化能力。

以上就是慢思考助力医学大语言模型突破数据瓶颈:上海交大联合上海AI Lab推出MedS3系统的详细内容,更多请关注php中文网其它相关文章!

豆包AI编程
豆包AI编程

智能代码生成与优化,高效提升开发速度与质量!

下载
相关标签:
来源:php中文网
本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn
最新问题
开源免费商场系统广告
热门教程
更多>
最新下载
更多>
网站特效
网站源码
网站素材
前端模板
关于我们 免责申明 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送
PHP中文网APP
随时随地碎片化学习
PHP中文网抖音号
发现有趣的

Copyright 2014-2025 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号