维度网讯,中国灵汐科技在WAIC期间发布自研类脑超节点集群产品LynAInfra(灵琍),该产品以30kW功耗提供近100P算力,瞄准AI推理行业面临的能耗与延迟两大痛点。

当前AI推理业务规模化落地面临能耗过高和推理延迟偏高的双重瓶颈。即便GPU产品不断迭代,传统芯片架构的底层局限仍未突破。与此同时,市场端对推理时延和使用成本的要求日益提升,在AI编程加速、AI视频生成、多智能体协同等高价值场景中尤为突出。英伟达布局Groq加码高速推理赛道,也印证行业正在急切寻找推理架构的革新方案。灵汐科技依托自研类脑芯片存算一体、事件驱动、众核并行的特性,推出面向高速推理场景的LynAInfra类脑高性能超节点,其推理能效比相较传统GPU方案提升3至10倍,首token延迟压缩至几十到百毫秒级别。

LynAInfra超节点集群基于中国国内已实现规模化商用落地的类脑芯片构建,其LynAInfra128算力柜搭载128张HP640系列板卡,单柜级联数千颗类脑芯片,释放近100P@FP16算力,整机功耗控制在30kW以内。产品采用自研LynxLink高速互联协议与统一内存地址编译技术,支持单机柜算力提升(Scale up)及多机柜横向扩展(Scale out),设备使用风冷散热方案并采用模块化设计,与现有智算中心机柜、供电、网络等设施兼容,降低客户部署改造成本。

LynAInfra从芯片架构到集群互联实现全链路创新,多机柜之间可无感级联以承载超大模型推理任务。该产品凭借架构级节能优势,在30kW功耗下提供近100P算力,有助于减少算力使用过程中的碳排放,响应中国双碳战略;对企业客户而言,可降低大模型推理的单位算力开销,促进大模型在产业数字化、城市治理、前沿科研等场景落地。整套方案坚持国产自主创新路线,旨在加固中国算力供应链安全。










