Agnes AI 一口气把文本、图像、视频三个模态的核心模型都发了

Agnes AI 直接把文本、图像、视频三个模态的核心模型一起端出来了,一次发三个。

从产品角度这个动作挺明确的:不是想在某一项上跟谁拼单点,而是要占“全模态自研”这个位置。好处是内部链路能打通,文案、配图、片子在一个体系里流转,讲故事讲得通;风险也摆在那儿——精力摊成三份,每一项都得跟各自领域里已经卷疯了的选手正面碰。哪怕都做到七十分,用户真到要出活的时候还是会挑各自最强的那个。

目前具体能力怎么样我没看到可信的东西,就不编了。真正决定这套东西活不活的,通常也不是首发那天的样张,是能不能持续迭代,以及有没有一个真实业务在养它。

全模态自研这四个字现在门槛比两年前低多了,人人都能喊