作为刚入坑没多久的学生,最近这波消息看得我眼花。一个是从静态图直接生成可交互虚拟世界的模型,等于给一张图它能让你在里面走动,感觉离游戏场景生成不远了。另一个是英伟达和Stability合作把Stable Diffusion 3.
5打包成了微服务,主要是推理效率上的提升,对我们这种蹭云跑图的可能有用。还有个挺冷门的方向是拿扩散模型生成DNA调控序列,跳出了画图,说明这套方法在生物那边也能用。
至于Bard改名Gemini这个纯属旧闻了,营销味重。我最想搞明白的是虚拟世界那个,有没有大佬知道现在开放试玩没,还是只有论文和demo视频。