据说,名为 Groq 的初创公司带着史上最快的大模型和自研芯片LPU来了。经过网友测试,Groq每秒生成速度接近500 tok/s,碾压GPT-4的40 tok/s。
根据Groq官网的介绍,LPU是一种专为AI推理所设计的芯片。但要训练大模型,仍然需要购买GPU。如果把训练必做养兵千日,那么推理就是用兵一时,两者缺一不可。Groq LPU的快速输出,还是离不开背后GPU的数据训练。 因此结合训练和推理的总成本来看。如人工智能专家贾扬清分析称,Groq综合成本相当于英伟达GPU的30多倍。
“有意见”留言板
@卡卡卡卡西:面对大模型,船大不好掉头的反而是芯片厂商,大家都知道大模型更需要的是访存密集型芯片,但现在的芯片厂商都是基于自己干了那么多年的芯片架构进行优化,没勇气从头再来,所以OpenAI奥特曼才想自研芯片,这也才有了Groq的震撼登场。
@贰言:Groq的自研LPU比英伟达的GPU性能更强,这对英伟达等传统AI芯片制造商来说是个巨大的挑战。在AI技术日益普及的当下,传统制造商必须考虑如何更高效地整合AI技术,以增强自身产品和服务的竞争力
好文章,需要你的鼓励
英国研究人员开发出一项名为Fastball的三分钟检测技术,通过脑电图头戴设备分析大脑对图像的识别能力,能够在认知衰退早期发现记忆问题。研究涉及107名参与者,发现该技术可有效识别轻度认知障碍患者的记忆缺陷,比现有诊断工具提前10-20年发现阿尔茨海默病征象。该技术可在家中使用,为早期干预治疗提供可能。
山东大学等高校联合研究揭示智能手机AI助手隐私保护能力严重不足。研究团队构建了首个隐私意识评估基准SAPA-Bench,包含7138个真实场景。测试结果显示,即使最佳模型的隐私风险感知能力也仅达67%,多数开源模型仅30%左右。研究发现闭源模型表现优于开源模型,明确提示可显著提升隐私感知能力。
随着智能代理AI的兴起,CIO必须调整IT战略重点、降低新安全风险并为员工重新培训技能。75%的CIO将在AI和机器学习项目上投入更多时间。IT部门需要从管理基础设施转向编排智能化,在每个业务流程中嵌入AI代理。CIO应重新考虑人机协作模式、多学科敏捷团队演进、IT治理职能重新定位,以及培养AI数据质量专家、AI诊断师等新兴角色技能。
香港理工大学等机构研究团队发现扩散语言模型存在"早期答案收敛"现象:高达99%的问题在推理中途就已得出正确答案,却仍继续无效推理。基于此发现,团队开发了Prophet方法,通过监控AI推理信心动态决定提前停止时机,实现3.4倍推理加速且几乎不损失准确性,为AI文本生成效率优化开辟新方向。