亮相WAIC|灵汐科技LynAInfra(灵琍)类脑超节点重磅登场,重构大模型推理新格局

栏目:互联网 | 来源:智东西 | 2026-07-19 22:22

本届世界人工智能大会WAIC期间,灵汐科技正式重磅发布自研类脑超节点集群产品——LynAInfra(灵琍),以全链路自研的类脑算力方案,破解当下AI推理行业痛点,为国产高速推理赛道带来全新选择。

当前人工智能行业发展遇到明显桎梏,能耗过高、推理延迟偏高两大难题,持续阻碍AI推理业务大规模落地。即便GPU产品迭代更新,传统芯片架构的底层局限依旧无法被打破;但市场端推理需求迎来爆发,未来推理业务将占据AI基础设施市场80%以上份额。

伴随着Token经济兴起,AI编程加速、AI视频生成、多智能体协同等高价值场景,对推理时延和使用成本提出更高标准,GPU方案运营开销大、首token延迟偏高的短板愈发突出,英伟达布局Groq加码高速推理赛道,也印证行业正在急切寻找推理架构革新方案。

立足行业现状,灵汐科技依托自研类脑芯片存算一体、事件驱动、众核并行的先天特质,发挥低功耗、低时延核心优势,倾力打造面向高速推理场景的LynAInfra类脑高性能超节点,对标创新版Groq。

相较传统GPU方案,产品推理能效比提升3-10倍,首token延迟压缩至几十到百毫秒级别,兼顾强悍推理性能与出色能耗水平,树立起“瓦特换比特”的算力全新标杆。

LynAInfra灵琍一体化超节点集群由灵汐科技完全自主研发,依托国内已实现规模化商用落地的类脑芯片构建。LynAInfra128算力柜搭载128张HP640系列板卡,单柜级联数千颗类脑芯片,释放近100P@FP16算力,整机功耗控制在30kW以内。

依托自研LynxLink高速互联协议以及统一内存地址编译技术,产品既支持单机柜算力提升(Scale up),也可以多机柜横向扩展(Scale out),打破单卡、单节点显存和算力上限,适配不同体量大模型部署任务。设备采用风冷散热方案,模块化设计兼容现有智算中心机柜、供电、网络配套设施,大幅降低客户部署改造成本。

LynAInfra实现从芯片架构到集群互联的全链路创新。多机柜之间可以做到无感级联,轻松承载超大模型运行任务,将推理性能与能效比推向行业前列。

放眼产业长远价值,LynAInfra128凭借架构级节能优势,用30kW功耗撑起近100P算力,减少算力使用过程中的碳排放,助力智算中心绿色建设,响应国家双碳战略;对于企业客户而言,可以显著降低大模型推理的单位算力开销,缩减整体拥有成本,助力大模型落地于产业数字化、城市治理、前沿科研等场景;更深层次来看,整套方案坚持国产自主创新路线,摆脱国外算力架构束缚,加固国产算力供应链安全,以类脑创新算力赋能数字经济高质量发展。

← 返回首页