Agnes AI 直接把文本、图像、视频三个模态的核心模型一起端出来了,一次发三个。
从产品角度这个动作挺明确的:不是想在某一项上跟谁拼单点,而是要占“全模态自研”这个位置。好处是内部链路能打通,文案、配图、片子在一个体系里流转,讲故事讲得通;风险也摆在那儿——精力摊成三份,每一项都得跟各自领域里已经卷疯了的选手正面碰。哪怕都做到七十分,用户真到要出活的时候还是会挑各自最强的那个。
目前具体能力怎么样我没看到可信的东西,就不编了。真正决定这套东西活不活的,通常也不是首发那天的样张,是能不能持续迭代,以及有没有一个真实业务在养它。