漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2025-06-11 talkingdev

[论文推荐]上海研究团队推出DiTorch与DiComm框架,实现异构芯片集群高效训练百亿级AI模型

上海科研团队最新发布的DiTorch和DiComm技术框架,突破了AI训练对同构硬件的依赖。该创新通过统一编程接口整合NVIDIA、AMD等异构芯片架构,在1,024块规格差异显著的芯片集群上训练千亿参数模型时实现116%的超线性效...

Read More
2025-04-17 talkingdev

Stable Diffusion在AMD GPU上实现性能优化

Stability AI与AMD近日宣布,双方已成功针对Radeon显卡及Ryzen AI处理器优化了多款Stable Diffusion模型。这一技术突破显著提升了AMD硬件平台在生成式AI工作负载下的运行效率,实测显示推理速度最高可提升40%。该优...

Read More
2024-12-25 talkingdev

AMD GPU优化助力大型语言模型推理性能

2023年,AMD针对其图形处理单元(GPU)进行了优化,以增强其在大型语言模型(LLM)推理任务中的竞争力。这项优化涉及到硬件和软件层面的协同工作,使得AMD的GPU在处理复杂的机器学习任务时能提供更好的性能和效率。...

Read More
2024-12-12 talkingdev

Proxmox支持即时安装macOS并集成AMD补丁

近日,Proxmox VE(Virtual Environment)宣布支持在Proxmox平台上进行macOS的即时安装,并包含AMD补丁,这对于运维人员和开发者而言是一个巨大的进步。Proxmox VE是一个开源的虚拟化平台,允许用户运行和管理虚拟机...

Read More
2024-11-19 talkingdev

AMD超越Nvidia,全球超算500强中计算能力领先

根据最新的全球超级计算机500强(TOP500)排行榜,AMD处理器所占的计算能力首次超过Nvidia。这一变化标志着AMD在高性能计算领域的显著进步。AMD近年来在处理器技术方面不断突破,通过其EPYC系列处理器,以及与NVIDIA...

Read More
2024-09-24 talkingdev

基于AMD GPU的Llama 405B微调成功

近日,研究团队成功在AMD GPU上对Llama 405B进行了微调。这一进展不仅提升了模型的性能,也展示了AMD硬件在深度学习领域的潜力。通过针对特定任务的微调,Llama 405B在处理复杂自然语言处理任务时表现出色,证明了其...

Read More
2024-07-27 talkingdev

Zen 5的2-ahead分支预测器:如何利用30年前的想法实现新功能

Zen 5是AMD公司的一款最新处理器,它的2-ahead分支预测器是一项重要的技术创新。这种分支预测器可以帮助CPU在处理指令时更快地判断分支的方向,从而避免处理器浪费时间在错误预测上。这项技术的基础理论可以追溯到30...

Read More
2024-07-17 talkingdev

AMD GPU上无需修改即可运行CUDA

NVIDIA的CUDA是一种广泛使用的GPU编程框架,但是它只能在NVIDIA GPU上运行。然而,一家名为Nek5000的研究团队近日发现了一种方法,在AMD GPU上运行未经修改的CUDA代码。他们使用了名为“ROCm”,即Radeon开放计算平台...

Read More
  1. Prev Page
  2. 3
  3. 4
  4. 5
  5. Next Page