以GPT-4的表现,很多人觉得它应该能拿捏70岁的图灵测试了。自1950年以来,图灵测试一直作为评估机器思维能力的标准,它要求AI通过文本交流让人相信它是人类。最近,研究人员又进行了一次测试,将GPT-4、GPT-3.5、ELIZA与真人进行对比,看谁最能诱使人们相信。结果GPT-4以41%的成功率优于GPT-3.5的14%和ELIZA的27%,但仍低于人类的63%。
“有意见”留言板
@Ada:在1950年,图灵测试非常超前,但70年后的现在,它大概只能作为一个学术上的参考,做实际产品的IT界如果再拿它说事,就没意思了。
@媒体搬运工:GPT-4没有通过图灵测试,这让我很意外!但是机器归机器,人归人,没必要纠结图灵测试。
@辣腿堡不加酱:至少目前的人工智能还不能完全做到跟人类一样,表达起来显得过于专业,用词也严谨,输出速度和内容量也是明显比人类强。但情绪变化和幽默程度应该是和人类有些区别的,如果有天人工智能能跟人类真像人类之间沟通那样,也是一件细思极恐的事情。
好文章,需要你的鼓励
随着大语言模型在人工智能时代展现强大力量,可穿戴设备成为收集人体数据的重要载体。通过实时监测血压、心率、血糖等生命体征,结合AI边缘计算能力,医疗正向个性化转型。基因治疗、数字孪生技术让每个人都能拥有专属的医疗数字化身,实现从"报销型医疗"向"创新循证医疗"的转变,为疾病预防和健康管理带来革命性突破。
这项由DP Technology和北京大学联合完成的研究提出了SphereAR方法,通过超球面约束解决连续标记自回归图像生成中的方差崩溃问题。该方法将所有输入输出限制在固定半径球面上,实现尺度不变性,在ImageNet数据集上创下自回归模型新纪录,SphereAR-H达到1.34 FID分数,首次让纯自回归方法在同等参数规模下超越扩散和遮蔽生成模型。
在巴黎举办的欧洲开放基础设施峰会期间,专门用一整天时间讨论VMware迁移问题。博通收购VMware后许可证价格上涨,导致客户运营成本大幅增加。开源开发者展示了将VMware虚拟机迁移到开源替代方案的产品。Forrester分析师指出VMware客户对此感到信任破裂。OpenStack等开源解决方案虽然复杂度较高,但提供了健康的开源生态系统替代方案。
微软研究院联合清华大学开发的PixelCraft系统,通过多智能体协作突破了AI视觉推理瓶颈。该系统采用专业分工模式,包含调度员、规划员、推理员等角色,配备图像记忆库实现灵活推理。在权威测试中准确率提升5-9个百分点,特别擅长分析复杂图表和几何图形,为科研、金融、教育等领域提供精确的视觉分析能力。