未来你看到的画家可能不是在画画,而是在写文字。
最近,谷歌研究出了一个文字-图像生成模型DreamBooth,用户只需上传3-5张某物体的照片,再用文字描述想要生成的背景、动作或表情,就能生成相应的图片,且动作表情都能达到“以假乱真”的程度。
DreamBooth可以在保留物体关键特征的前提下,完成换景、加滤镜、修改外观和艺术渲染等任务。DreamBooth在Imagen的基础上做了调整,它会给物体加上一个独特的“标识符”,这个唯一的标识符就可以用来合成该物体在不同场景中的逼真图像。
我们的科技留言板“有意见”如下
@媒体搬运工:这就是paper级的美图秀秀,AI在尝试从爬行到直立行走的越迁,只是这种过程能不能实现类似猿到人的进化,也许时间才能证明。
@大内密探:DreamBooth用了微调的思路,模型会通过独特标识符来学习指定物体的个性化细节,再加上模型在这一物体大类中学到的共性,从而生成合理又有个性的照片。
@有想法的向日葵:DreamBooth的换景、指定动作、表情服饰、更迭风格等功能,能让不会PS的人也能成“大神”了。不久的将来,朋友圈里就分不清哪些是真的,哪些是假的。
好文章,需要你的鼓励
谷歌深度思维团队开发出名为MolGen的AI系统,能够像经验丰富的化学家一样自主设计全新药物分子。该系统通过学习1000万种化合物数据,在阿尔茨海默病等疾病的药物设计中表现出色,实际合成测试成功率达90%,远超传统方法。这项技术有望将药物研发周期从10-15年缩短至5-8年,成本降低一半,为患者更快获得新药治疗带来希望。
继苹果和其他厂商之后,Google正在加大力度推广其在智能手机上的人工智能功能。该公司试图通过展示AI在移动设备上的实用性和创新性来吸引消费者关注,希望说服用户相信手机AI功能的价值。Google面临的挑战是如何让消费者真正体验到AI带来的便利,并将这些技术优势转化为市场竞争力。
哈佛医学院和微软公司合作开发了一个能够"听声识病"的AI系统,仅通过分析语音就能预测健康状况,准确率高达92%。该系统基于深度学习技术,能够捕捉声音中与疾病相关的微妙变化,并具备跨语言诊断能力。研究团队已开发出智能手机应用原型,用户只需完成简单语音任务即可获得健康评估,为个性化健康管理开辟了新途径。