字节自己研发的PixelDance视频生成模型,结合视频转化工具Boximator,实现了全新的静态图转换成流畅视频方式。就是在图上框一个圈,圈住选择对象,比如猫猫狗狗,飞机大炮。然后基于这些物体画出一个轨迹,也就是运动路径,然后这个物体就以视频的形式动起来了。
据了解,该工具的优势是视频质量上超越了基础模型,其视频效果更受欢迎。可以帮助用户的创意实现的更好。让个性化和创意表达更流畅。
“有意见”留言板
@卡卡卡卡西:文生视频已经是生成式AI一个风口之上的应用场景了,去年看到国外做文生视频的软件已经有几十款,实际体验过几款后发现还是有一些问题,一是生成的视频内容不可控,不一定是你想要的,二是对提示词有很高的依赖,三是对算力有较高要求、这也直接导致不少创业团队做的这类软件每人每天只会有几个体免费生成视频的额度,更多就需要额外再收费了。
@贰言;Boximator能够生成多样可控的视频动态,创作独特且吸引人的内容,为用户提供全新编辑体验。迫不及待去尝试下,结果发现功能尚未完善,且暂无移动端版本。因此,要真正评估Boximator的效果和实用性,还需要亲自体验才能得知。
好文章,需要你的鼓励
2024年10月8日,Geoffrey Hinton(杰弗里·辛顿)因在人工神经网络领域的开创性工作获得诺贝尔物理学奖。
NVIDIA联合多伦多大学开发的ChronoEdit系统通过将图像编辑重新定义为视频生成问题,让AI具备了物理常识。该系统引入时间推理机制,能够想象编辑的完整变化过程,确保结果符合物理规律。在专业测试中,ChronoEdit超越了所有开源竞争对手,特别在需要物理一致性的场景中表现突出,为自动驾驶、机器人等领域的应用提供了重要技术突破。
这项研究提出了MITS框架,使用信息论中的点互信息指导AI推理过程,解决了传统树搜索方法计算成本高、评估标准模糊的问题。通过动态采样和加权投票机制,MITS在多个推理数据集上显著超越现有方法,同时保持高效的计算性能,为AI推理技术开辟了新方向。