首次商用试运行,类脑智算集群支持大模型快速推理服务
2025/08/14 14:16AI云资讯12777
据悉,“杭州灵汐类脑智算集群”已于7月底实现了大模型快速推理API的企业服务试运行。该集群由杭州灵汐类脑科技有限公司牵头搭建运营,中国电信、中国电子科技南湖研究院以及脑启社区作为合作方参与,由杭州电信具体承担集成建设。该集群部署在中国电信杭州智算中心,算力规模超200POPS。这也是类脑智算集群在全球范围内,首次以支持大模型快速推理的方式,走向商用试运行。
作为类脑智能技术的创新应用成果,该智算集群具有”存算一体、众核并行、稀疏计算、事件驱动”的特性,可显著提升计算效率、大幅降低能耗,实现大语言模型推理的“一快、一低、一降”:一是推理速度快,单用户的推理延迟控制在毫秒级别,速度性能相对于传统方案有明显优势(可流畅响应实时交互及长本文深度推理),告别卡顿;二是首token延迟低,可降至百毫秒乃至十毫秒级;三是智算集群的功耗大幅下降,较业界同等推理算力水平可降低功耗二分之一至三分之二以上。异构融合类脑芯片具有兼容PyTorch框架的类CUDA软件栈,可直接服务于多类开源大模型的快速推理、而不需要转换类脑算法。

图1灵汐智算平台大模型登录

图2灵汐智算平台大模型快速推理
当前,大模型推理普遍存在吞吐速度慢(每秒十到几十词输出)和高延迟问题(常常超过1秒甚至数秒),对众多行业场景构成了制约。在此背景下,灵汐科技基于类脑智能技术给出了“高实时、高吞吐、低延迟“的推理服务解决方案,将在金融应用、情感陪聊、快速导览、大规模数据标注以及无人机实时航拍处理、灾害预警与应急处置等领域场景逐步落地。据介绍,该智算集群(中心)将持续升级,新一代类脑智算高密度计算平台也将在近期正式发布推出,集群能效比预计将进一步提升。
相关文章
- 湖北移动实现高校智算单板全覆盖 校园迈入“智能追焦”网络时代
- 魏桥国科智算中心:以国产算力,为发展未来产业提供创新支撑
- 中科通量推出OmniMate BOX,以“边缘智算主机+存量屏幕“模式降低AI数字员工落地门槛
- 亚洲新型电力展|算电协同进入工程实践阶段,维谛技术分享智算基础设施建设实践
- 强力落地环京智算核心战略 中国移动天津公司加速在津算力AI产业布局
- 智算资产运营新范式:东软Neusoft SDA发布,业内唯一全栈闭环
- 首家!九章云极通过中国信通院智算云平台能力评测
- 湖北移动:算启新程 毫秒智算赋能千行百业
- 中兴通讯携手Sky47建成巴基斯坦规模最大智算数据中心 —— 喀喇昆仑一号数据中心正式落成
- 中国移动智算底座加持, 长三角(嘉兴)Token运营中心正式启航
- 科士达 × 鹏城云脑 Ⅲ|10.43MWh 锂电系统,四维安全筑牢国家级智算大科学装置电力底座
- 青云智算上线 Kimi-K3,解锁全新 AI 作业模式
- 云尖沐曦号卫星成功入轨,国产智算产业链开启太空计算新实践
- 智算重构能源,海光亮相2026能源产业生态论坛
- 浪潮计算机深度参编《超节点定义与实践白皮书》,筑牢智算基础设施发展根基
- 信而泰亮相2026世界人工智能大会,以全栈智算网络测试赋能AI基础设施高质量发展
AI企业
更多>>AI硬件
更多>>AI产业
更多>>AI技术
更多>>- 全球最强开源模型 Kimi K3 发布,参数规模 3 万亿,真的是强!
- 范式变革!东软发布AI原生软件工程白皮书,重构软件产业底层逻辑
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练
- 高德发布鸿蒙首个生成式 UI 开源框架 AGenUI,告别传统 UI 开发模式
- 发布即适配| 天数智芯全力支持腾讯混元Hy3 preview 开源落地,共推国内大模型产业普惠









