Google开源发布DiffusionGemma文本扩散模型,基于图像扩散原理实现一次并行生成256个token,推理速度比传统LLM快4倍。采用混合专家架构,260亿总参数仅激活38亿,可在RTX 5090消费级GPU上运行,H100上每秒超1000 token。
本次项目的成果,为开发者借助昇腾技术优化 MoE 稀疏大模型推理性能提供了可贵借鉴
亚马逊云科技和英伟达扩大战略合作,共建下一代AI基础设施
进化 · 乘势而上 2026戴尔科技峰会暨“进化者”论坛在沪启幕
直击AI4S算力难题!中科曙光全链路解决方案亮相2026科学智能大会
市占率56.8%!曙光数创连续五年领跑国内液冷市场
Cloudera 携手 NVIDIA,降低云成本并加速 Apache Spark 数据管道
又一AI超集群落地!国家先进计算产业创新中心(安徽)正式启用
西门子 Realize LIVE 落地深圳:深化数智化布局,加速工业 AI 价值兑现
Oracle 与 AWS 深化战略合作,企业对 Oracle AI Database@AWS 的采用加速增长