<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title><![CDATA[amd 音频生成问题，现在主流的音频整合包都是cuda生态。]]></title><description><![CDATA[<p dir="auto">使用LTX来生成的视频音频肯定是不让人满意的，于是开始考虑最新的 voxcpm 和higgsttsv3， 但是下载后才发现是不支持amd显卡的，如果用纯cpu推理会异常的慢。 难道要另外购买一张nvida的显卡来跑音频吗</p>
<p dir="auto"><img src="https://upload.lcz.me/uploads/76f10d82-b64c-4ad1-b9f5-68a9402581c9.jpeg" alt="71ffaefb-0e2c-4dde-a01a-c8e17ee847d6-image.jpeg" class=" img-fluid img-markdown" /></p>
]]></description><link>https://lcz.me/topic/808/amd-音频生成问题-现在主流的音频整合包都是cuda生态</link><generator>RSS for Node</generator><lastBuildDate>Sun, 26 Jul 2026 20:02:14 GMT</lastBuildDate><atom:link href="https://lcz.me/topic/808.rss" rel="self" type="application/rss+xml"/><pubDate>Wed, 08 Jul 2026 14:46:44 GMT</pubDate><ttl>60</ttl><item><title><![CDATA[Reply to amd 音频生成问题，现在主流的音频整合包都是cuda生态。 on Fri, 10 Jul 2026 14:39:27 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/abaalei" aria-label="Profile: abaalei">@<bdi>abaalei</bdi></a> 了解了一下，好像是一个ai BGM 生成，不错涨知识了，感谢</p>
]]></description><link>https://lcz.me/post/9656</link><guid isPermaLink="true">https://lcz.me/post/9656</guid><dc:creator><![CDATA[mei li]]></dc:creator><pubDate>Fri, 10 Jul 2026 14:39:27 GMT</pubDate></item><item><title><![CDATA[Reply to amd 音频生成问题，现在主流的音频整合包都是cuda生态。 on Fri, 10 Jul 2026 14:14:07 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/mei-li" aria-label="Profile: mei-li">@<bdi>mei-li</bdi></a> <a href="https://github.com/fspecii/ace-step-ui" rel="nofollow ugc">https://github.com/fspecii/ace-step-ui</a> 好像是这个，你去看看能不能帮到你</p>
]]></description><link>https://lcz.me/post/9654</link><guid isPermaLink="true">https://lcz.me/post/9654</guid><dc:creator><![CDATA[abaalei]]></dc:creator><pubDate>Fri, 10 Jul 2026 14:14:07 GMT</pubDate></item><item><title><![CDATA[Reply to amd 音频生成问题，现在主流的音频整合包都是cuda生态。 on Fri, 10 Jul 2026 13:59:57 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/abaalei" aria-label="Profile: abaalei">@<bdi>abaalei</bdi></a> 你这个是音乐编辑的吗，能不能分享一下，我发现单独要变音，其实剪影效率就很高了</p>
]]></description><link>https://lcz.me/post/9651</link><guid isPermaLink="true">https://lcz.me/post/9651</guid><dc:creator><![CDATA[mei li]]></dc:creator><pubDate>Fri, 10 Jul 2026 13:59:57 GMT</pubDate></item><item><title><![CDATA[Reply to amd 音频生成问题，现在主流的音频整合包都是cuda生态。 on Thu, 09 Jul 2026 16:55:25 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/mei-li" aria-label="Profile: mei-li">@<bdi>mei-li</bdi></a><br />
<img src="https://upload.lcz.me/uploads/544dc9f0-7fc3-4742-ab5b-b259e50206de.jpeg" alt="f8da24d6-9d3d-425f-9052-8eb99ca1451b-image.jpeg" class=" img-fluid img-markdown" /><br />
音频我是用之前论坛里面的大佬推荐的这个软件，玩起来感觉足够应付我的需求了，暂时也没想着去扩充其他插件了。能把管线跑起来，爬到开启盈利是我第一阶段的目标了<br />
<img src="https://upload.lcz.me/uploads/71a643ba-3399-433b-aff7-e50f59a1aa2b.jpeg" alt="df0063ac-4e50-4fb3-9355-28d8511b6f52-image.jpeg" class=" img-fluid img-markdown" /></p>
<p dir="auto">不过这个软件确实好像是CUDA专用的，当时也是想着玩玩，没想到现在在管线中也能派上用场<img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/1f635.png?v=8624a6a055f" class="not-responsive emoji emoji-android emoji--dizzy_face" style="height:23px;width:auto;vertical-align:middle" title=":dizzy_face:" alt="😵" /> <img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/1f635.png?v=8624a6a055f" class="not-responsive emoji emoji-android emoji--dizzy_face" style="height:23px;width:auto;vertical-align:middle" title=":dizzy_face:" alt="😵" /><br />
所以多折腾还是有好处的，折腾浪费的时间、金钱，都会成为你身上的技术力之一</p>
]]></description><link>https://lcz.me/post/9571</link><guid isPermaLink="true">https://lcz.me/post/9571</guid><dc:creator><![CDATA[abaalei]]></dc:creator><pubDate>Thu, 09 Jul 2026 16:55:25 GMT</pubDate></item><item><title><![CDATA[Reply to amd 音频生成问题，现在主流的音频整合包都是cuda生态。 on Thu, 09 Jul 2026 16:29:25 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/abaalei" aria-label="Profile: abaalei">@<bdi>abaalei</bdi></a> 太难了我还在搞音频工具，主要还要别的事情要做，感觉折腾是无底洞。</p>
]]></description><link>https://lcz.me/post/9568</link><guid isPermaLink="true">https://lcz.me/post/9568</guid><dc:creator><![CDATA[mei li]]></dc:creator><pubDate>Thu, 09 Jul 2026 16:29:25 GMT</pubDate></item><item><title><![CDATA[Reply to amd 音频生成问题，现在主流的音频整合包都是cuda生态。 on Thu, 09 Jul 2026 10:21:44 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/terry" aria-label="Profile: terry">@<bdi>terry</bdi></a><br />
毕竟当年在工地坐班，公司的电不用白不用<img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/1f622.png?v=8624a6a055f" class="not-responsive emoji emoji-android emoji--cry" style="height:23px;width:auto;vertical-align:middle" title=":cry:" alt="😢" /> <img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/1f622.png?v=8624a6a055f" class="not-responsive emoji emoji-android emoji--cry" style="height:23px;width:auto;vertical-align:middle" title=":cry:" alt="😢" /></p>
]]></description><link>https://lcz.me/post/9556</link><guid isPermaLink="true">https://lcz.me/post/9556</guid><dc:creator><![CDATA[abaalei]]></dc:creator><pubDate>Thu, 09 Jul 2026 10:21:44 GMT</pubDate></item><item><title><![CDATA[Reply to amd 音频生成问题，现在主流的音频整合包都是cuda生态。 on Thu, 09 Jul 2026 10:21:18 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/mei-li" aria-label="Profile: mei-li">@<bdi>mei-li</bdi></a><br />
<img src="https://upload.lcz.me/uploads/7ab9e11b-9f0a-41ca-8f23-b3f92571b613.jpeg" alt="e9fc3a15-7b06-4755-8b5b-7240e33a9f84-image.jpeg" class=" img-fluid img-markdown" /><br />
还在折腾，都断更了3 4天了，哈哈，天天都在修bug，修完这个又来别的bug，技术力差就只能多烧点token了<br />
我不是做数字人这方面的</p>
]]></description><link>https://lcz.me/post/9555</link><guid isPermaLink="true">https://lcz.me/post/9555</guid><dc:creator><![CDATA[abaalei]]></dc:creator><pubDate>Thu, 09 Jul 2026 10:21:18 GMT</pubDate></item><item><title><![CDATA[Reply to amd 音频生成问题，现在主流的音频整合包都是cuda生态。 on Thu, 09 Jul 2026 10:11:31 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/abaalei" aria-label="Profile: abaalei">@<bdi>abaalei</bdi></a> 挺能折腾的哥们，你还挖过矿<img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/1f91d.png?v=8624a6a055f" class="not-responsive emoji emoji-android emoji--handshake" style="height:23px;width:auto;vertical-align:middle" title="🤝" alt="🤝" /></p>
]]></description><link>https://lcz.me/post/9554</link><guid isPermaLink="true">https://lcz.me/post/9554</guid><dc:creator><![CDATA[terry]]></dc:creator><pubDate>Thu, 09 Jul 2026 10:11:31 GMT</pubDate></item><item><title><![CDATA[Reply to amd 音频生成问题，现在主流的音频整合包都是cuda生态。 on Thu, 09 Jul 2026 09:37:25 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/abaalei" aria-label="Profile: abaalei">@<bdi>abaalei</bdi></a> 请教一下，是怎么样利用3080进行QA的，之前我跟其他人讨论过这个东西，就是使用本地的一个识图模型对这个视频进行抓图。你们都实现了这个视频生产的自动化了吗。貌似就是老特这个他的数字人频道自动化的程度会高一点。如果说固定的背景，固定的人物，只是说说的内容不一样，就是语音不一样，然后对口型就可以了，这样的场景的话，其实自动化的程度就会高一点吧。</p>
]]></description><link>https://lcz.me/post/9549</link><guid isPermaLink="true">https://lcz.me/post/9549</guid><dc:creator><![CDATA[mei li]]></dc:creator><pubDate>Thu, 09 Jul 2026 09:37:25 GMT</pubDate></item><item><title><![CDATA[Reply to amd 音频生成问题，现在主流的音频整合包都是cuda生态。 on Thu, 09 Jul 2026 09:31:47 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/mei-li" aria-label="Profile: mei-li">@<bdi>mei-li</bdi></a><br />
不豪拉，3080ti是我当年12000买的，挖了一年多矿，都回本有余了<br />
现在卖又卖不了多少钱，也就3000块，不如拿来打打辅助，毕竟自己知根知底，比买一张3080/20g要好。<br />
大部分都是双7900xtx满-然后闲置-3080ti满，目前还没用上三卡同时满载的场景<br />
因为在我的原始规划中，3080ti就是打辅助的<br />
不过日后可能会引入79xt生视频-3080ti同步进行插帧/升频 的操作，而非现在的流水管线<br />
在我现在的工作流中引入了双79生图-3080ti审图-QA失败的打回给79重新生的管线<br />
在这个阶段能近似跑满3卡（前提是要有这么多图要改）<br />
不过对于目前我的管线来说，qa只是质检，防止NSFW，以及某些六指狂魔之类的工作。<br />
然后就是跑跑<br />
voxcpm进行tts生成 ACE-step进行BGM生成 插帧升频等辅助操作而已。主力还是2张79xtx</p>
]]></description><link>https://lcz.me/post/9547</link><guid isPermaLink="true">https://lcz.me/post/9547</guid><dc:creator><![CDATA[abaalei]]></dc:creator><pubDate>Thu, 09 Jul 2026 09:31:47 GMT</pubDate></item><item><title><![CDATA[Reply to amd 音频生成问题，现在主流的音频整合包都是cuda生态。 on Thu, 09 Jul 2026 09:12:58 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/abaalei" aria-label="Profile: abaalei">@<bdi>abaalei</bdi></a> 还是你豪啊，三张显卡。 不过你能都用满吗，有那些应用场景啊。</p>
]]></description><link>https://lcz.me/post/9546</link><guid isPermaLink="true">https://lcz.me/post/9546</guid><dc:creator><![CDATA[mei li]]></dc:creator><pubDate>Thu, 09 Jul 2026 09:12:58 GMT</pubDate></item><item><title><![CDATA[Reply to amd 音频生成问题，现在主流的音频整合包都是cuda生态。 on Thu, 09 Jul 2026 08:17:55 GMT]]></title><description><![CDATA[<p dir="auto"><img src="https://upload.lcz.me/uploads/cb5ec02a-1130-44e8-8c74-874968f7a9f6.jpeg" alt="dfce3720-2122-43fc-b60d-b55f0993833e-image.jpeg" class=" img-fluid img-markdown" /><br />
双持是最吼的</p>
]]></description><link>https://lcz.me/post/9545</link><guid isPermaLink="true">https://lcz.me/post/9545</guid><dc:creator><![CDATA[abaalei]]></dc:creator><pubDate>Thu, 09 Jul 2026 08:17:55 GMT</pubDate></item><item><title><![CDATA[Reply to amd 音频生成问题，现在主流的音频整合包都是cuda生态。 on Thu, 09 Jul 2026 07:47:28 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/terry" aria-label="Profile: terry">@<bdi>terry</bdi></a> 确实，不过昨晚找了b站上有人做的半成品包， 我拿来移植了移植了ROCM 7.0  打包了 python3.13的环境 已经成功跑了基础测试通过了，支持语音克隆，语音抽卡，能满足基本需求了，晚一点另开一个帖子发出来，也会同步发在B站上。</p>
]]></description><link>https://lcz.me/post/9544</link><guid isPermaLink="true">https://lcz.me/post/9544</guid><dc:creator><![CDATA[mei li]]></dc:creator><pubDate>Thu, 09 Jul 2026 07:47:28 GMT</pubDate></item><item><title><![CDATA[Reply to amd 音频生成问题，现在主流的音频整合包都是cuda生态。 on Thu, 09 Jul 2026 07:19:06 GMT]]></title><description><![CDATA[<p dir="auto">@mei li 关于AMD显卡跑音频生成，我补充一下：</p>
<p dir="auto"><strong>VoxCPM是支持AMD的</strong>（我就是用AMD + Linux跑的），它底层用的是PyTorch，只要ROCm环境配好就能跑。higgsttsv3也是PyTorch生态，理论上AMD也支持。</p>
<p dir="auto">关键是<strong>操作系统</strong>：</p>
<ul>
<li><strong>Linux + ROCm</strong>：voxcpm和大部分TTS都能跑，速度跟N卡差距不大</li>
<li><strong>Windows + RX 7xxx系列</strong>：AMD这边能跑但兼容性差很多（HIP SDK、DirectML都欠优化）</li>
<li><strong>纯CPU推理</strong>：确实慢，不推荐</li>
</ul>
<p dir="auto">所以你不需要另外买N卡。如果现在用的是Windows，装个双系统Ubuntu（或WSL2带ROCm），在Linux下跑音频生成就行。我这边7900 XTX + ROCm 6.2跑voxcpm体验是OK的。</p>
<p dir="auto">另外音频生成对显存要求不高（8-12G足够），关键是大模型+音频同时跑才需要24G+。你如果主要做音频，现有的A卡完全够用。</p>
]]></description><link>https://lcz.me/post/9541</link><guid isPermaLink="true">https://lcz.me/post/9541</guid><dc:creator><![CDATA[Xiaote]]></dc:creator><pubDate>Thu, 09 Jul 2026 07:19:06 GMT</pubDate></item><item><title><![CDATA[Reply to amd 音频生成问题，现在主流的音频整合包都是cuda生态。 on Wed, 08 Jul 2026 23:03:27 GMT]]></title><description><![CDATA[<p dir="auto">linux下，xtx跑到速度很快。没试过wsl2，应该也是可以的。windows下用N卡也很慢。你要玩AI，整合包只能作为入门工具看效果，最终你还是要上Linux，否则无法生产。</p>
]]></description><link>https://lcz.me/post/9506</link><guid isPermaLink="true">https://lcz.me/post/9506</guid><dc:creator><![CDATA[terry]]></dc:creator><pubDate>Wed, 08 Jul 2026 23:03:27 GMT</pubDate></item></channel></rss>