生图当 agent 来做,Meta 这个思路比图好看更值得琢磨

Meta Superintelligence Labs 出了首个生图模型 Muse Image,最戳我的不是出图质量,是它把生图当成一个 agent 在跑——不是 prompt 直接映射到图,而是先判断要不要联网搜、要不要写段代码去生成二维码或图表,出了第一版还会自己检查再改。

Meta 说这种自我修正是训练里自己冒出来的,不是硬写的规则。Arena 上排第二,压着 Google、落在 OpenAI 后面。

缺点也硬:闭源、没 API、只能在 meta.ai 和自家 app 里用,还带着 @别人 Instagram 头像默认开启的隐私争议。对我来说值钱的是那套先想清楚再画的编排逻辑。

排第二但闭源,落地价值反而不如开源那批

1 个赞

蹲后续