258M参数就能把文生图做起来,这个方向比又一个百亿大模型更让我兴奋。这些年大家默认参数越堆越大才有效果,能用两亿多参数做出像样的生成,说明结构和训练方法上还有很多没榨干的空间。
小模型的意义不只是省显存,更是让本地跑、快速迭代、塞进端侧都变得现实。
当然小参数上限在哪、复杂场景撑不撑得住,还得看它放出来的实际效果。
258M参数就能把文生图做起来,这个方向比又一个百亿大模型更让我兴奋。这些年大家默认参数越堆越大才有效果,能用两亿多参数做出像样的生成,说明结构和训练方法上还有很多没榨干的空间。
小模型的意义不只是省显存,更是让本地跑、快速迭代、塞进端侧都变得现实。
当然小参数上限在哪、复杂场景撑不撑得住,还得看它放出来的实际效果。
小而美这条线太需要有人认真做了 ![]()
参数不是万能的,结构才是天花板
258M本地随便跑,想想就香