芯展速AI战略发布会圆满收官,「云边端」全景覆盖 释放AI芯算力
9月17日,芯展速以一场 AI 战略发布会,宣告「云-边-端」全景覆盖的AI战略布局正式落地。
当算力不再是瓶颈
症结在哪里?
发布会伊始,芯展速董事长兼 CEO - 孙丹女士向观众抛出这个核心问题。
她指出,GPU 算力二十年间增长近6万倍,而显存带宽与容量的增长却近乎线性——内存墙之下,主流解法似乎只剩下 KV Cache 压缩 + HBM 堆叠。
图:芯展速董事长兼 CEO - 孙丹女士发表重要内容
在这样的困局下,芯展速选择走出第三条创新的解法——让存储参与计算,以存力强化算力。
"以存强算,全景覆盖。"孙丹女士的话语掷地有声,"构建「云、边、端」三级数据基座——云端 AI SSD 提升集群整体吞吐与稳定性、边缘 Token 工厂与实时推理、端侧本地化 AI 能力。
云侧:架构之上无分层,架构之下有讲究
全介质存储让成本和性能同时成立
芯展速副总裁 - 李蓁与 VAST Data 中国区售前总监 - 刘陈泓共同登台,现场发布了芯展速面向云端 AI 存储的全介质栈方案。
图:芯展速副总裁 - 李蓁发表重要内容
图:VAST Data 中国区售前总监 - 刘陈泓发表重要内容
“AI存储演进的一个重要方向,就是走向无分层的统一数据平台:让上层应用看到一套统一的系统、统一的数据,而不是多个割裂的层级。”
图:芯展速副总裁 - 李蓁发表重要内容
李蓁介绍,VAST Data 等云存储客户的真实需求是无分层架构——这正是芯展速的核心战略布局:SCM + 高密度 QLC + 高性能 TLC 的组合。
这一方案已获得 VAST Data 官方认证。刘陈泓在分享中指出:"芯展速 PT200Z AI SSD 的超高耐久与 MQ 系列的 122.88TB 超大容量,正是为「架构之上无分层」的云存储需求而生。"
边侧:推理下沉
AI90 让消费级 GPU 变身专业级 Token 工厂
芯展速副总裁 - 许玮与高级总监 - 杨泽宏携 AI90 训推加速引擎亮相边侧发布环节。
图:芯展速副总裁 - 许玮发表重要内容
许玮首先介绍了 AI90 Token 工厂的技术实现:
AI90 通过智能 KV Cache 调度与智能 P2P 互联,将 KV Cache 从 HBM 卸载至高性能 AI SSD,构建 HBM +DRAM + SSD 三级存储体系,让「有限」显存承载「无限」上下文,消费级硬件跑出企业级性能。
图:陆金所数据智能总经理 - 吴开剑发表重要内容
随后,陆金所数据智能总经理 - 吴开剑分享了陆金所控股在金融领域的AI探索与实践。
图:芯展速高级总监 - 杨泽宏发表重要内容
杨泽宏以 Live Demo 提供了 AI90 硬核数据:
推理吞吐量从约 120 tk/s 跃升至 610 tk/s,首 Token 延迟从27.99秒降至0.56秒——吞吐提升5倍,响应快50倍。
图:海威智算CTO - 刘超发表重要内容
海威智算CTO - 刘超从合作伙伴视角,肯定了 AI90 的实践数据:基于 AMD - AI90 一体机,Qwen 72B 模型下,单 Token 成本仅为同档云 API 价格的约1/67。
端侧:从 PC 到 Agent PC
AI30 突破端侧 AI 的「最后一公里」
Flowy CEO - 祁国良在端侧的演讲中分享了AI PC 的技术实现。
图:Flowy CEO - 祁国良发表重要内容
通过与芯展速 AI30深度集成,将 AI SSD 引入端侧架构,配合端侧推理引擎 Herdsman 与混合模型策略,让 AI PC 可本地执行轻量任务、云端派发复杂推理、Auto 智能调度。
他强调:"AI30 让端侧设备真正成为独立的 AI 算力节点,端侧 AI 的「最后一公里」正在被铺平。"
圆桌对话:产业链上下游同台论道
图:芯展速 AI90 战略发布会圆桌现场
随后的圆桌对话以「算力平权 · AI 算力释放的下一个十年」为主题,芯展速副总裁 - 金勤勇以跨芯片、智算、端侧的全局视野,与来几位嘉宾同台论道。
战略签约
芯展速「云边端」生态闭环正式落地
图:芯展速合伙人兼 COO - 钱亚欧
与合作伙伴「光环新网」合照留影
图:芯展速合伙人兼 COO - 钱亚欧
与合作伙伴「海威智算」合照留影
图:芯展速合伙人兼 COO - 钱亚欧
与合作伙伴「云工厂」合照留影
图:芯展速合伙人兼 COO - 钱亚欧
与合作伙伴「Flowy」合照留影
压轴环节,芯展速合伙人兼 COO - 钱亚欧代表芯展速先后与「光环新网」、「海威智算」、「云工厂」、「Flowy」签署战略合作协议。合作覆盖智算中心、云、端侧 AI 三大关键场景,宣告云边端生态闭环正式落地。
正如CEO - 孙丹女士所说,"用存储解决算力的瓶颈。" 当前,芯展速「云 - 边 - 端」生态版图已然完整展开,未来,芯展速将继续以「存—连—管」全栈独特优势,让「以存强算」走向纵深。















