Haiyun LIU
-
5700X + Radeon AI PRO R9700 32GB 简单测试,求优化建议 (换了3090) -
5700X + Radeon AI PRO R9700 32GB 简单测试,求优化建议 (换了3090)5700X + B550 + Corsair RM850x
因为工作需要(主要是法律/咨询类文本分析),希望逐步把工作流本地 AI 化,所以最近开始折腾本地 LLM。
前几天也发帖请教过各位大神,未来如果升级双显卡,到底继续消费级平台还是走工作站平台。结合预算和自己的需求,最后决定还是先走 AM4/X570 路线,暂时放弃工作站平台。
最近把 RTX 3090 换成了 Radeon AI PRO R9700 Creator 32GB。
我人在海外,这边二手 3090 和全新的 R9700 价差大概只有 2000 RMB 左右(3090 二手、R9700 全新),考虑到新卡保修、32GB 显存以及长期使用,所以最后没有选择魔改卡。
当前配置
CPU:Ryzen 7 5700X
主板:B550(已买了X570为将来如需要升级铺路)
GPU:Radeon AI PRO R9700 Creator 32GB
电源:Corsair RM850x
系统:Windows 11
Backend:llama.cpp
模型:Qwen/Qwen3.6-27B 的 Q4_K_M GGUF 量化版
MTP:关闭
Context:64K目前主要就是法律、合同、咨询类文本工作,不玩游戏,也不跑图片生成。
为了方便比较,3090 与 R9700 都限制在约 225W TBP(HWiNFO 监控)下测试。
测试结果
相同模型、相同参数、相近功耗限制下:
RTX 3090:约 24 tok/s
Radeon AI PRO R9700:约 27.6 tok/sllama.cpp 输出:
Prompt Processing(16K Prompt):约 780 tok/s
Decode(Generation):约 27.6 tok/s(附 llama.cpp 输出、HWiNFO、GPU 使用率截图)
目前这个结果比我预期好,至少对于我的使用场景来说,R9700 的表现让我很满意。
目前很多东西还在摸索阶段,基本原则就是先把工作流跑通,再一点一点优化。
AMD YES!

想请教各位大神几个问题
R9700 跑 Qwen3.6-27B Q4_K_M(MTP 关闭,64K Context),27.6 tok/s 大概属于什么水平?还有多少优化空间?
目前还有哪些地方值得继续优化?
llama.cpp 参数
Flash Attention
HIP/ROCm
还有哪些容易忽略的优化项?
目前工作必须使用 Windows。未来半年到一年,如果本地 AI 工作流越来越成熟,我有考虑单独组一台 Linux AI 主机。
不知道在 llama.cpp + R9700 这个组合下,Linux 相比 Windows 是否还有比较明显的提升?
欢迎大家拍砖,也欢迎分享自己的 R9700 / 3090 测试数据,谢谢!



-
双3090 本地AI,大家现在还用消费级平台,还是已经转 TRX40 了?@Thirty 谢谢建议,codex 弄得是流程,本地弄得是内容,我挺清楚我自己的需求的呀
-
双3090 本地AI,大家现在还用消费级平台,还是已经转 TRX40 了?@williamlouis 是不是3090 换R9700 新卡的意思? 我刚买了R9700 准备试试能不能把3090做的都替掉,然后就准备继续折腾学习看看把工作流继续优化,然后再看需不需要堆卡堆算力,平台主板选好,显卡大头再考虑,因为应该双卡怎么也够了,毕竟也也就做些文书工作。。。
-
双3090 本地AI,大家现在还用消费级平台,还是已经转 TRX40 了?@applejuice 我不是香港,否则我不会说我是海外 我听取@Xiaote 还有lcz youtube 听劝,不折腾魔改卡了,准备试试r9700,@applejuice 你是魔改还是因为二手踩坑,我的3090二手海外当地买的目前还好
还有你买的是通过aliexpress或京东吗?我aliexpress买过cpu和一些东西,目前感觉还可以 -
双3090 本地AI,大家现在还用消费级平台,还是已经转 TRX40 了?各位大佬,想请教一下硬件路线,主要用于家用本地 AI 文档处理。
目前配置
Windows 11
Ryzen 7 5700X
64GB DDR4
RTX 3090 24GB(AI 专用)
RTX 3050 6GB(Windows、网页、显示)
Qwen 27B Q4 GGUF(Hermes,64K 上下文)目前配合 Codex Plus,日常工作已经基本够用了。
未来规划
考虑以后模型越来越大、Agent 越来越复杂,想提前规划下一台机器。
因为人在海外,所以比较在意:
功耗(电费)
性价比
售后/保修
Windows 或 Linux 都可以接受目前主要纠结两条路线:
方案一
W680 + i5-14500T + 双 GPU
考虑:
有核显,Windows 可以走核显,独立显卡全部给 AI
功耗低
日常办公体验应该最好不知道以后双3090(或者3090+下一代显卡)是否还能满足未来本地 AI。
方案二
TRX40 + 3960X
优点:
PCIe Lane 多
双3090、三GPU 扩展舒服
真正 AI 工作站缺点:
CPU 功耗高
平台成本高如果未来长期只是双 GPU,会不会有点浪费?
另外还有两个问题
①对于我这种主要做:
OCR
RAG
Agent
文档处理
本地推理(SGLang / vLLM)大家会更推荐哪条路线?
有没有我没考虑到的平台?
(例如 X299、TRX40、W680、甚至其他方案。)
②
海外保修的问题。
最近也在看国内一些魔改卡(例如 32GB 版本)。
有人实际从京东自营或淘宝买到海外使用过吗?
如果返修:
运费
关税
保修流程实际体验怎么样?
感谢各位!
现在(2026),真正长期玩本地 AI 的朋友,大多数还是消费级平台(AM4/LGA1700),还是已经开始转向 TRX40/TRX50 这类 HEDT 工作站?为什么?
