PG麻将胡了股份有限公司 - 边缘计算AI智能分析系统

工业安防趋势

再赴外滩之约:清微智能以国产可重构算力解码互联网AI新经济

类别:工业安防趋势日期:2026-09-11 01:45:52
我要分享

  央广网北京9月10日消息(记者 刘家怡)9月9日至12日,以“共创AI新经济”为主题的2026 Inclusion·外滩大会在上海黄浦世博园区拉开帷幕。这场盛会吸引超5万人报名、300余家企业参展,汇聚600余位全球学者、科学家、企业家与投资人,海外嘉宾覆盖50余个国家和地区。

  本届大会首次将AI经济增长动能作为核心议题,把目光从“AI能做什么”投向“AI如何创造新的增长”。国产可重构AI芯片领军企业清微智能亮相“数据与计算”展区,再度成为人气焦点。

再赴外滩之约:清微智能以国产可重构算力解码互联网AI新经济(图1)

  2026 Inclusion·外滩大会拉开帷幕。(清微智能供图 央广网发)

  如果说去年首秀,是清微智能携可重构算力与蚂蚁联袂破局;那么今年二度赴约,清微则带来了一份实打实的成绩单。

  从2025年下半年开始与蚂蚁集团的深度调优,跑出的大模型推理性能实现十倍跃升;到今年陆续与腾讯云等互联网客户战略握手;再到接下来Token工厂的全力布局,清微正在竞争激烈、要求严苛的互联网算力赛道上,走出一条属于可重构架构的差异化路径。

  走进本届外滩大会的科技展区,最直观的感受是“AI正在变成生意”。当AI走出对话框、进入生产与生活的真实场景,产业对算力的诉求,也正从追求峰值性能,转向高并发、低成本、绿色低碳的稳定供给。

再赴外滩之约:清微智能以国产可重构算力解码互联网AI新经济(图2)

  这正是清微的优势“主场”。本届外滩大会,清微带来了适配互联网算力场景的两大成果。

  芯片层面,可重构计算3.0以3.5D存算融合技术为核心,将可重构计算芯粒与DRAM存储芯粒高密度集成,把部分信号传输距离从毫米级压缩至微米级,有效缓解“内存墙”问题,提升带宽并降低数据搬运延迟。

  系统层面,REX81 Supernode 4K超节点单集成4096颗TX81芯片,算力突破每秒500千万亿次,并以创新的算力网格互联架构,将节点间互联成本降低约90%。

  高性能与低成本的兼得,恰好回应了AI新经济时代“算力既要跑得快、又要用得起”的产业命题。

  而算力的成色,终究要放到最严苛的场景中去检验。互联网场景历来是AI算力的“试炼场”——高并发、低延迟、强灵活性,任何一项短板都可能让算力方案止步于实验室。

  今年6月,清微智能与腾讯云正式签署战略合作协议,双方将围绕国产算力供给、智算中心建设、行业解决方案及应用等领域展开深度协同:清微算力产品纳入腾讯云异构算力资源池,并将为腾讯云提供基于国产算力的Token推理服务。依托RAISA软件栈,清微实现对腾讯混元Hy3等主流大模型的Day-0适配。

  腾讯之外,清微的互联网“朋友圈”仍在持续扩容,从“东数西算”枢纽的千卡智算中心,到服务亿万用户的互联网云平台,国产可重构算力正加速涌入互联网产业的主航道。

  互联网算力场景的能力跃升,并非一日之功。这份亮眼成绩单背后,站着一位深度协同的“老搭档”——蚂蚁集团。

  时间回到2025年初,蚂蚁集团旗下上海云玡战略投资清微智能,资本牵手成为双方故事的起点。

  但真正让彼此“绑定”的,是技术层面的深度磨合:在互联网大模型推理这一核心场景中,双方迅速组成联合调优团队,围绕TX8系列可重构算力芯片与Qwen系列大模型,展开了长达数月的“驻场式”系统级性能优化。

  一组数字彰显了“芯网协同”所带来的成果:QPS(每秒查询量)提升26.7倍;TTFT(首字延迟)降低87.5%,首字响应速度提升7倍;TPOT(非首字延迟)降低75%,生成速率提升3倍——整体推理性能实现十倍以上跃升。

  落到用户侧,这些数字意味着“几乎感受不到的等待”与“三倍于以往的内容输出”;对于日活千万级的互联网产品而言,性能的每一次提升,都直接转化为体验的跃升与运营成本的下降。

  生态层面,双方同样打通了“任督二脉”。TX8系列芯片已完成对SGLang框架的适配,全面支持Qwen系列模型;同时完成对SGLang-JAX框架的适配,支持Qwen2.5-VL-72B、Qwen2.5-Omni等多模态模型,实现图像、视频等视觉内容的高效解析。作为当前大模型推理领域的主流框架,SGLang生态的打通,意味着可重构算力能够无缝接入互联网企业现有技术栈,大幅降低迁移成本。

  资本、技术、生态的三重协同,正是清微在互联网算力场景快速突围的“底层密码”:蚂蚁的场景需求,为清微提供了最真实的“练兵场”;清微的架构创新,则为蚂蚁的AI战略回馈了差异化的算力底座。双向奔赴、彼此成就——这也是清微连续两年亮相外滩大会、与蚂蚁同场展示的深意所在。

  与腾讯云的合作、与蚂蚁的调优,是清微在互联网算力赛道的“现在进行时”;而Token工厂的布局,则是清微面向未来的“将来时”。

  方兴未艾的大模型时代,Token已成为AI新经济的基础计量单位——每一轮对话、每一次Agent决策、每一帧内容生成,背后都是Token的规模化生产与消耗。面向这一趋势,清微智能在本届外滩大会上系统描绘了下一阶段的战略蓝图——Token工厂。

  围绕“Token Factory(词元工厂)+ Token Hub(词元枢纽)”体系的构建,清微将提供以国产可重构AI算力为核心的芯片与产品支撑:供给侧面向大模型厂商、云厂商、运营商及智算中心、MaaS厂商,通过高性能推理、PD分离部署、弹性扩缩容与稳定SLA,支撑高质量Token的规模化生产与稳定交付;服务侧打造通用Token Hub,以统一入口实现多模型聚合与弹性调度,支持按Token、按AI Key计量与清分结算,让互联网应用、企业级Agent、政企客户乃至个人开发者,像用水用电一样便捷地获取AI算力服务。

  目前,清微已在北京与合作伙伴共建专业Token工厂,以可重构算力芯片与产品为底座,将算力资源转化为可计量、可交易、可交付的Token服务。这一布局背后是清晰的能力支撑:在互联网场景中打磨出的高并发推理能力、与蚂蚁协同建立的性能优化方法论、覆盖近20个智算中心的规模化交付经验,共同构成了Token高质量供给的能力底盘。

  面向未来,清微将持续加大在Token工厂方向的布局投入,以可重构算力为基座,推动国产算力从“可用”走向“好用”“经济”。

再赴外滩之约:清微智能以国产可重构算力解码互联网AI新经济(图3)

  9月9日至12日,以“共创AI新经济”为主题的2026 Inclusion·外滩大会在上海黄浦世博园区拉开帷幕。这场盛会吸引超5万人报名、300余家企业参展,汇聚600余位全球学者、科学家、企业家与投资人,海外嘉宾覆盖50余个国家和地区。