Google开源发布DiffusionGemma文本扩散模型,基于图像扩散原理实现一次并行生成256个token,推理速度比传统LLM快4倍。采用混合专家架构,260亿总参数仅激活38亿,可在RTX 5090消费级GPU上运行,H100上每秒超1000 token。
谷歌近期推出全新开源实验模型DiffusionGemma,创新采用文本扩散架构,打破传统自回归生成模式,有效提升大模型文本推理速度。不过该模型现阶段为实验版本,生成质量不及Gemma4标准版,且在云端高并发场景优势有限。
亚马逊云科技和英伟达扩大战略合作,共建下一代AI基础设施
进化 · 乘势而上 2026戴尔科技峰会暨“进化者”论坛在沪启幕
直击AI4S算力难题!中科曙光全链路解决方案亮相2026科学智能大会
市占率56.8%!曙光数创连续五年领跑国内液冷市场
Cloudera 携手 NVIDIA,降低云成本并加速 Apache Spark 数据管道
又一AI超集群落地!国家先进计算产业创新中心(安徽)正式启用
西门子 Realize LIVE 落地深圳:深化数智化布局,加速工业 AI 价值兑现
Oracle 与 AWS 深化战略合作,企业对 Oracle AI Database@AWS 的采用加速增长