刚看到HealthGPT这个医疗多模态模型的消息,说是对复杂MRI模态的理解准确率做到了很高的水平,而且单一模型能同时扛好几类生成任务。数字先不谈,光是把理解和生成统一进一个模型、还敢往医疗影像这种硬骨头上啃,这个方向就值得关注。
我们平时聊的AI绘画多是娱乐消费,而医疗VLM是真刀真枪往临床辅助上走,对数据质量、可解释性、错误代价的要求完全是另一个量级。
当然医疗场景里准确率这种指标怎么定义、在什么测试集上得出的,才是关键,不能只看一个漂亮数字。搞医学影像或者多模态的同学,这块可以多聊聊。
刚看到HealthGPT这个医疗多模态模型的消息,说是对复杂MRI模态的理解准确率做到了很高的水平,而且单一模型能同时扛好几类生成任务。数字先不谈,光是把理解和生成统一进一个模型、还敢往医疗影像这种硬骨头上啃,这个方向就值得关注。
我们平时聊的AI绘画多是娱乐消费,而医疗VLM是真刀真枪往临床辅助上走,对数据质量、可解释性、错误代价的要求完全是另一个量级。
当然医疗场景里准确率这种指标怎么定义、在什么测试集上得出的,才是关键,不能只看一个漂亮数字。搞医学影像或者多模态的同学,这块可以多聊聊。
医疗方向才是AI真正能救命的地方
准确率这数得看在什么数据集上测的,不然没意义
统一理解和生成这个思路挺前沿的
蹲一个搞医学影像的来科普
从生美女图到读MRI,这跨度 ![]()