GPU
-
北大联合中科院发布全球首款相变忆阻器神经动力学芯片,类脑脑模拟运算较A100 GPU最高提速478倍,突破半世纪类脑计算硬件瓶颈
2026年7月3日,北京大学集成电路学院杨玉超团队联合中科院上海微系统所宋志棠团队,全球首次研制出基于相变忆阻器的神经动力学专用芯片,成果正式刊发于国际顶刊《Science》,彻底…
-
GPU并行计算如何把“算力”堆成“数据高铁”?ZeRO数据并行、流水线并行、张量切片、序列并行四大技术拆解,大模型训练效率翻倍的秘密!
在AI大模型训练中,GPU并行计算将分散的计算资源巧妙堆叠,构建出如同“数据高铁”般的高速通道。通过ZeRO数据并行、流水线并行等技术,GPU集群实现数据的高效流动,突破显存瓶颈,…
-
AI训练模型迭代周期多长?训练场如何加速模型优化?反向传播优化与正则化技术:GPU/TPU高算力与自动化工具如何实现训练效率提升50%!
在AI技术的快速迭代中,模型训练周期过长已成为项目落地的关键瓶颈。数据显示,AI训练模型迭代周期从几天到数月不等,取决于数据规模、模型复杂度和硬件资源。这不仅拖慢创新速度,还增加成…
-
DeepSeek的硬件支持广泛吗?其对GPU和TPU的优化如何呢?DeepSeek的硬件支持与GPU、TPU优化探究!
在当今科技飞速发展的时代,人工智能领域的发展备受瞩目,而DeepSeek作为其中的重要力量,其硬件支持情况以及对GPU和TPU的优化程度成为人们关注的焦点。随着AI应用场景的不断拓…