著名大模型开源平台stability.ai推出了——Stable Diffusion 3,据官方介绍,其对prompt的理解以及在图像质量、拼写能力方面的AI生图效果达到全新高度。关键是其创新的模型组合是在消耗更少的算力下实现的。
该创新模型指的是Transformer和Flow FMatching(简称“FM”)的组合。Transformer让AI效果更好,而FM这是更加高效的一种建模、训练技术。这样用不了多久在移动设备上实现更好的AI生图开发成为可能。
这就是开源平台的优势,越来越多的天才注视下,大模型由虚化实正在加速。
“有意见”留言板
@PC瑟瑟发抖:开源阵营追得好快,演示效果看起来很棒,有条件当然值得升级,但怎么又是waitlist?!而且参数规模比SD 2.1大了不少,根据Emad的说法,恐怕对硬件要求也更高了吧,起码用消费级PC带它感觉有点悬啊。
@变天了:采用了sora的架构,是不是侧面证明,美国的AI届现在已经在图片和视频生成上达成共识,diffusion transformers就是当前的最优解呢
好文章,需要你的鼓励
施耐德电气以“新质服务+产业向‘新’行”为主题,第六次参会,展示全新升级的“新质服务体系”,围绕创新驱动、生态协同和行业赋能三大核心领域,以全新升级的“新质服务体系”,助力中国产业向高端化、智能化、绿色化迈进。
香港中文大学联合上海AI实验室推出Dispider系统,首次实现AI视频"边看边聊"能力。通过创新的三分式架构设计,将感知、决策、反应功能独立分离,让AI能像人类一样在观看视频过程中进行实时交流,在StreamingBench测试中显著超越现有系统,为教育、娱乐、医疗、安防等领域的视频AI应用开启新可能。
甲骨文正在成为大规模基础设施供应商的可靠选择。该公司通过AI技术推动应用开发,构建GenAI模型并将智能代理集成到应用套件中。CEO萨弗拉·卡茨透露,公司剩余履约义务达4553亿美元,同比增长4.6倍,并预测OCI收入将从2026财年的180亿美元增长至2030财年的1440亿美元。甲骨文正积极布局AI推理市场,凭借其作为全球最大企业私有数据托管方的优势地位,有望在云计算领域实现重大突破。
Atla公司发布Selene Mini,这是一个仅有80亿参数的AI评估模型,却在11个基准测试中全面超越GPT-4o-mini。通过精心的数据筛选和创新训练策略,该模型不仅能准确评判文本质量,还能在医疗、金融等专业领域表现出色。研究团队将模型完全开源,为AI评估技术的普及和发展做出贡献。