字节自己研发的PixelDance视频生成模型,结合视频转化工具Boximator,实现了全新的静态图转换成流畅视频方式。就是在图上框一个圈,圈住选择对象,比如猫猫狗狗,飞机大炮。然后基于这些物体画出一个轨迹,也就是运动路径,然后这个物体就以视频的形式动起来了。
据了解,该工具的优势是视频质量上超越了基础模型,其视频效果更受欢迎。可以帮助用户的创意实现的更好。让个性化和创意表达更流畅。
“有意见”留言板
@卡卡卡卡西:文生视频已经是生成式AI一个风口之上的应用场景了,去年看到国外做文生视频的软件已经有几十款,实际体验过几款后发现还是有一些问题,一是生成的视频内容不可控,不一定是你想要的,二是对提示词有很高的依赖,三是对算力有较高要求、这也直接导致不少创业团队做的这类软件每人每天只会有几个体免费生成视频的额度,更多就需要额外再收费了。
@贰言;Boximator能够生成多样可控的视频动态,创作独特且吸引人的内容,为用户提供全新编辑体验。迫不及待去尝试下,结果发现功能尚未完善,且暂无移动端版本。因此,要真正评估Boximator的效果和实用性,还需要亲自体验才能得知。
好文章,需要你的鼓励
谷歌近期悄然调整账户存储政策:新注册用户若未绑定手机号,免费存储空间将从原来的15GB缩减至5GB。用户需验证手机号后,方可获得完整的15GB空间,用于Gmail、Drive和Photos的共享使用。谷歌表示,此举旨在确保存储空间"每人仅限一份",有效防止滥用。有分析认为,存储硬件成本上升也是推动此次政策调整的重要原因之一。
FORTIS是专门测量AI代理"越权行为"的基准测试,研究发现十款顶尖模型普遍选择远超任务需要的高权限技能,端到端成功率最高仅14.3%。
AT&T、Verizon和T-Mobile宣布计划组建合资企业,利用卫星技术消除美国境内的网络覆盖盲区,重点服务农村及网络欠发达地区。该合资企业将整合知识产权与地面频谱资源,推动下一代直连设备(D2D)通信发展。目前三方尚未签署正式协议,现有运营商与卫星服务协议不受影响。此前,T-Mobile已与SpaceX合作推出星链卫星服务,美国联邦通信委员会也刚批准了价值400亿美元的EchoStar频谱出售案。
荷兰Nebius团队提出SlimSpec,通过低秩分解压缩草稿模型LM-Head的内部表示而非裁剪词汇,在保留完整词汇表的同时将LM-Head计算时间压缩至原来的五分之一,端到端推理速度超越现有方法最高达9%。