Indie Hackers · Newest9/5 06:2653 分
AMD Hyperloom实验性运行于Radeon AI PRO R9700
I got AMD Hyperloom running experimentally on a Radeon AI PRO R9700.
作者成功在AMD Radeon AI PRO R9700上实验性运行了Hyperloom,尽管该GPU官方不支持。R9700是RDNA 4显卡,配备32GB VRAM、gfx1201、64个计算单元,支持ROCm 10。Hyperloom原本针对Instinct GPU,作者通过将r9700映射为gfx1201/64 CU,并添加GPU检测,使用架构无关的基准测试后端,实现了初步移植。本地运行栈包括ROCm 10、vLLM、Qwen3-Coder 30B和Hyperloom实验端口。初步基准测试显示,在并发1时基线为21.80 tokens/s,并发2时候选配置为36.59 tokens/s,聚合吞吐量提升67.89%,但作者强调这是并发调优结果,并非GPU性能提升,且延迟有所增加。作者计划让Hyperloom的自主优化循环使用本地Qwen模型作为优化代理,实现闭环优化。目前仍存在限制:无官方R9700支持、无RDNA4内核调优、无法直接复用Instinct内核等。作者公开了整个开发过程,相关代码和挑战项目已在GitHub上发布,作为AMD与lablab.ai AI学院挑战赛的一部分。