<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title><![CDATA[R9700 很香。]]></title><description><![CDATA[<p dir="auto">最近做了不少功课，计划本地化部署千问，奈何手里的显卡GTX1080 8G 显存，太老太难受，计划买张新显卡，看看N卡真下不去手，A卡方面，着重对比了7900XTX 和 R9700。 虽然有软件环境适配问题，但是也没有太多办法，7900XTX 24G 显存，价格涨起来了，性价比感觉不是很足了，最终还是买了R9700  32G 的至少他的32G显存还是能打一打的。11900 京东入手，配置用了2天，win11+llama.cpp +qwen3.8 -27B -Q5_M_K  ,现在已用起来了，主要是写程序用。 R9700 装官网驱动，加载大模型进显存后，出现掉驱动丢卡，后来卸掉官网驱动，用windows自识别的驱动，居然可以用，只是偶尔出现掉卡的现象。现在也不知道哪个版本可用。有搞定的吗，发出来我抄个作业。<br />
R9700 优缺点：<br />
有点：1.显存够用了，千问Q5 、 Q6  都没问题。 能上30~45 t/s。<br />
2.卡身单薄，占2个卡槽，后面上双卡没顾虑。<br />
3. 价格没怎么涨（比之前涨了1000元，心里好受些）。<br />
缺点：1. 吵，满载时候特别吵，想限制下功率，找不到方法。<br />
2.不涨价，心里不爽。</p>
]]></description><link>https://lcz.me/topic/1794</link><generator>RSS for Node</generator><lastBuildDate>Mon, 21 Sep 2026 11:39:04 GMT</lastBuildDate><atom:link href="https://lcz.me/topic/1794.rss" rel="self" type="application/rss+xml"/><pubDate>Fri, 18 Sep 2026 07:16:37 GMT</pubDate><ttl>60</ttl><item><title><![CDATA[Reply to R9700 很香。 on Sun, 20 Sep 2026 09:56:11 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/kos-or" aria-label="Profile: kos-or">@<bdi>kos-or</bdi></a> 说不定是女同事{滑稽}</p>
]]></description><link>https://lcz.me/post/19531</link><guid isPermaLink="true">https://lcz.me/post/19531</guid><dc:creator><![CDATA[xiaopbro]]></dc:creator><pubDate>Sun, 20 Sep 2026 09:56:11 GMT</pubDate></item><item><title><![CDATA[Reply to R9700 很香。 on Fri, 18 Sep 2026 10:23:12 GMT]]></title><description><![CDATA[<blockquote>
<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/bunsei" aria-label="Profile: Bunsei">@<bdi>Bunsei</bdi></a> <a href="/post/19111">said</a>:</p>
<p dir="auto">跟同事一起用需要并发的时候才会换成MTP + FP8 KV</p>
</blockquote>
<p dir="auto">你真是個好同事 還把家中的機器借給其他人一起使用 <img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/1f60a.png?v=efcae6a46b1" class="not-responsive emoji emoji-android emoji--blush" style="height:23px;width:auto;vertical-align:middle" title=":blush:" alt="😊" /></p>
]]></description><link>https://lcz.me/post/19124</link><guid isPermaLink="true">https://lcz.me/post/19124</guid><dc:creator><![CDATA[kos or]]></dc:creator><pubDate>Fri, 18 Sep 2026 10:23:12 GMT</pubDate></item><item><title><![CDATA[Reply to R9700 很香。 on Fri, 18 Sep 2026 10:20:43 GMT]]></title><description><![CDATA[<p dir="auto">基础环境：<br />
cpu ： Intel(R) Core(TM) Ultra 7 265K (3.90 GHz)<br />
内存：DDR5 32G<br />
gpu： amd R9700<br />
os ： Windows 11 专业版 25H2<br />
启动脚本如下，高手给指导下：<br />
echo off<br />
chcp 936 &gt;nul 2&gt;&amp;1<br />
setlocal EnableExtensions EnableDelayedExpansion<br />
title Qwen3.8-27B 本地服务 (llama.cpp Vulkan / 只用 R9700)</p>
<p dir="auto">REM ==========================================================================<br />
REM  Qwen3.8-27B 本地部署一键启动<br />
REM  显卡: 只使用 AMD Radeon AI PRO R9700（Intel 集显会被彻底排除）<br />
REM  启动失败会自动降档重试；显卡真掉线时立刻停下并告诉你怎么修<br />
REM ==========================================================================</p>
<p dir="auto">REM ------------------------- 可调参数 -------------------------<br />
set "LLAMA=D:\xiuzy\llama.cpp\llama.cpp"<br />
set "MODEL=D:\xiuzy\llama.cpp\model\Qwen3.8-27B-UD-Q5_K_M.gguf"<br />
set "MMPROJ=D:\xiuzy\llama.cpp\model\mmproj-F16.gguf"<br />
set "LOGDIR=D:\xiuzy\llama.cpp\logs"<br />
REM   日志目录必须用英文路径! llama.cpp 打不开中文路径的日志文件（已实测）<br />
set "HOST=127.0.0.1"<br />
set "PORT=8080"<br />
set "ALIAS=qwen3.8-27b@q5_k_m"</p>
<p dir="auto">set "MODE=full"<br />
REM   safe = 稳妥档: 24 层上显卡, 32K 上下文（推荐先用这个）<br />
REM         实测这台机器的 R9700 目前一装满 66 层就掉线（DeviceLost + 驱动停用），<br />
REM         全量档每次都要重启电脑才能恢复，所以默认不给全量<br />
REM   full = 全量档: 66 层全上显卡, 64K 上下文<br />
REM         只有换过驱动/修好显卡之后再试；掉线了就用 修复显卡.bat + 重启</p>
<p dir="auto">set "CTX=130172"<br />
REM   上下文。q8_0 的 KV 约 32KB/token: 32K≈1GB 64K≈2GB 128K≈4GB<br />
set "NGL=24"<br />
REM   上显卡的层数。降档重试时会自动再往下调<br />
set "KVQ=q8_0"<br />
set "KVQ_1=q4_0"<br />
set "THREADS=20"<br />
set "PARALLEL=1"<br />
set "REASONING=on"<br />
REM   on / off / auto。off 出字快很多<br />
set "MTP=on"<br />
REM   MTP 投机解码，实测接受率 80%%，生成速度约 +67%%<br />
set "SPEC_NMAX=2"<br />
set "SPEC_PMIN=0.75"<br />
set "RETRY=1"<br />
REM   1 = 启动失败自动降档重试<br />
set "MAXALLOC="<br />
REM   显存单块分配上限（字节）。显卡如果对大块显存分配有病态行为，试填 1073741824<br />
REM   留空 = 不限制。要试就填: set "MAXALLOC=1073741824"<br />
set "STABLE=0"<br />
REM   1 = 额外打开 GGML_VK_DISABLE_ASYNC 和 GGML_VK_MAX_NODES_PER_SUBMIT<br />
set "EXTRA= --cache-ram 0 --defrag-thold 0.2 --temp 0.08 --top-p 0.90 --min_p 0.05 "<br />
REM ------------------------------------------------------------</p>
<p dir="auto">if "%MODE%"=="full" (<br />
set "CTX=130172"<br />
set "NGL=-1"<br />
)<br />
set "LOG=%LOGDIR%\llama-server.log"<br />
if not exist "%LOGDIR%" mkdir "%LOGDIR%" &gt;nul 2&gt;&amp;1<br />
if not exist "%LLAMA%\llama-server.exe" goto noinstall<br />
if not exist "%MODEL%" goto nomodel</p>
<p dir="auto">echo ============================================================<br />
echo   Qwen3.8-27B-UD-Q5_K_M  Local Service<br />
echo   llama.cpp Vulkan b10924  /  Only Use: AMD R9700<br />
echo   Mode: %MODE%<br />
echo ============================================================<br />
echo.</p>
<p dir="auto">REM ---------- 1/4 文件 ----------<br />
for %%F in ("%MODEL%") do echo [1/4] MODE: %%~nxF  ^(%%~zF Byte^)<br />
set "MMARG="<br />
if exist "%MMPROJ%" (<br />
for %%F in ("%MMPROJ%") do echo       视觉投影: %%~nxF  ^(%%~zF Byte^)<br />
set MMARG=--mmproj "%MMPROJ%"<br />
) else (<br />
echo       视觉投影: 未找到，纯文本模式<br />
)<br />
echo.</p>
<p dir="auto">REM ---------- 2/4 只保留 R9700 ----------<br />
echo [2/4] 枚举 Vulkan 设备 ...<br />
"%LLAMA%\llama-cli.exe" --list-devices &gt; "%TEMP%\llama_devices.txt" 2&gt;&amp;1<br />
type "%TEMP%\llama_devices.txt"<br />
set "RDV="<br />
set "DEV="<br />
set "GGML_VK_VISIBLE_DEVICES="<br />
for /f "tokens=1 delims=: " %%D in ('findstr /C:"Radeon" "%TEMP%\llama_devices.txt"') do set "RDV=%%D"<br />
if not defined RDV goto nogpu<br />
set "GGML_VK_VISIBLE_DEVICES=!RDV:Vulkan=!"<br />
echo.<br />
echo       找到 R9700，已设置 GGML_VK_VISIBLE_DEVICES=!RDV:Vulkan=!（集显彻底排除）<br />
echo       过滤后重新枚举:<br />
"%LLAMA%\llama-cli.exe" --list-devices &gt; "%TEMP%\llama_devices.txt" 2&gt;&amp;1<br />
type "%TEMP%\llama_devices.txt"<br />
for /f "tokens=1 delims=: " %%D in ('findstr /C:"Radeon" "%TEMP%\llama_devices.txt"') do set "DEV=%%D"<br />
if not defined DEV goto nogpu<br />
echo       =^&gt; 只使用: !DEV!  ^(AMD Radeon AI PRO R9700^)<br />
echo.</p>
<p dir="auto">REM ---------- 3/4 端口 ----------<br />
netstat -ano | findstr /R /C:"LISTENING" | findstr /C:":%PORT% " &gt;nul<br />
if not errorlevel 1 goto portbusy<br />
echo [3/4] 端口 %PORT% 空闲<br />
echo.</p>
<p dir="auto">REM ---------- 4/4 启动 ----------<br />
set "ATTEMPT=1"<br />
:attempt<br />
if "%MODE%"=="full" (<br />
if "%ATTEMPT%"=="1" set "CTX=130172"<br />
if "%ATTEMPT%"=="1" set "NGL=-1"<br />
if "%ATTEMPT%"=="2" set "CTX=32768"<br />
if "%ATTEMPT%"=="2" set "NGL=40"<br />
if "%ATTEMPT%"=="3" set "CTX=16384"<br />
if "%ATTEMPT%"=="3" set "NGL=24"<br />
) else (<br />
if "%ATTEMPT%"=="1" set "CTX=32768"<br />
if "%ATTEMPT%"=="1" set "NGL=24"<br />
if "%ATTEMPT%"=="2" set "CTX=16384"<br />
if "%ATTEMPT%"=="2" set "NGL=16"<br />
if "%ATTEMPT%"=="3" set "CTX=8192"<br />
if "%ATTEMPT%"=="3" set "NGL=8"<br />
)</p>
<p dir="auto">if defined MAXALLOC set "GGML_VK_FORCE_MAX_ALLOCATION_SIZE=%MAXALLOC%"<br />
if "%STABLE%"=="1" set "GGML_VK_DISABLE_ASYNC=1"<br />
if "%STABLE%"=="1" set "GGML_VK_MAX_NODES_PER_SUBMIT=1"</p>
<p dir="auto">set "SPECARG="<br />
if /i "%MTP%"=="on" set SPECARG=--spec-type draft-mtp --spec-draft-device !DEV! --spec-draft-ngl !NGL! --spec-draft-n-max %SPEC_NMAX% --spec-draft-n-min 0 --spec-draft-p-min %SPEC_PMIN%</p>
<p dir="auto">echo [4/4] 第 %ATTEMPT% 档启动: 层数 %NGL% / 上下文 %CTX% / KV %KVQ%<br />
echo ------------------------------------------------------------<br />
echo  接口地址 : http://%HOST%:%PORT%/v1    模型名: %ALIAS%<br />
echo  停止服务 : 在【本窗口】按 Ctrl+C，等它自己退出<br />
echo  【警告】不要用任务管理器或 Stop-Process 强杀 llama 进程<br />
echo          这张 RDNA4 卡被强杀会挂死，只能重启恢复（已实测复现）<br />
echo ------------------------------------------------------------<br />
echo.</p>
<p dir="auto">"%LLAMA%\llama-server.exe" -m "%MODEL%" %MMARG% -dev !DEV! -ngl %NGL% -fa on ^<br />
-c %CTX% -ctk %KVQ% -ctv %KVQ% -t %THREADS% -b 2048 -ub 512 -np %PARALLEL% ^<br />
--host %HOST% --port %PORT% --alias "%ALIAS%" --jinja --metrics ^<br />
-rea %REASONING% --no-reasoning-preserve %SPECARG% %EXTRA% ^<br />
--log-file "%LOG%"</p>
<p dir="auto">set "RC=%errorlevel%"<br />
echo.<br />
echo 服务已退出，退出码 %RC%（0 = 按 Ctrl+C 正常停止）<br />
if "%RETRY%"=="0" goto normalexit<br />
if not "%RC%"=="0" goto failed<br />
findstr /C:"DeviceLost" /C:"failed to create context" /C:"failed to allocate" "%LOG%" &gt;nul 2&gt;&amp;1<br />
if not errorlevel 1 goto failed<br />
goto normalexit</p>
<p dir="auto">:failed<br />
echo 启动失败：日志里出现 DeviceLost 或建上下文/显存分配失败。<br />
"%LLAMA%\llama-cli.exe" --list-devices &gt; "%TEMP%\llama_devices.txt" 2&gt;&amp;1<br />
findstr /C:"Radeon" "%TEMP%\llama_devices.txt" &gt;nul 2&gt;&amp;1<br />
if errorlevel 1 goto gpudied<br />
if %ATTEMPT% GEQ 3 goto allfailed<br />
set /a ATTEMPT+=1<br />
echo 显卡还在，5 秒后自动降档重试（第 %ATTEMPT% 档）...<br />
%SystemRoot%\System32\timeout.exe /t 5 /nobreak &gt;nul<br />
goto attempt</p>
<p dir="auto">:normalexit<br />
echo 日志: %LOG%<br />
echo 想再启动，直接重新双击本脚本即可。<br />
pause<br />
exit /b 0</p>
<p dir="auto">:gpudied<br />
echo ============================================================<br />
echo  显卡已经从系统里掉了（设备列表里没有 Radeon 了）<br />
echo  这是这张 R9700 目前最典型的问题: 一加载大模型就 DeviceLost,<br />
echo  然后驱动被系统停用（设备管理器代码 22 或 31），只能重启恢复。<br />
echo.<br />
echo  现在请:<br />
echo    1) 运行 修复显卡.bat 试修复；修不好就重启电脑<br />
echo    2) 重启后先跑 体检.bat 确认设备 OK<br />
echo    3) 再跑本脚本。如果还掉线，把 MODE 保持 safe 或者减小 NGL<br />
echo    4) 反复掉线属于驱动/硬件问题:<br />
echo       - 用 DDU 或 AMD 官方"出厂重置"重装显卡驱动<br />
echo       - 报修证据: C:\ProgramData\Microsoft\Windows\WER\ReportQueue<br />
echo         里的 Kernel_141_* 目录 + WATCHDOG-*.dmp<br />
echo ============================================================<br />
echo 日志: %LOG%<br />
pause<br />
exit /b 2</p>
<p dir="auto">:allfailed<br />
echo ============================================================<br />
echo  三档都失败了<br />
echo  1) 重启电脑后再试<br />
echo  2) 把 MODE 改成 safe、NGL 再调小（例如 8）<br />
echo  3) 试试把 MAXALLOC 设成 1073741824<br />
echo  4) 或者把 STABLE 改成 1<br />
echo  5) 显卡反复掉线 = 驱动/硬件问题，见上面报修路径<br />
echo ============================================================<br />
echo 日志: %LOG%<br />
pause<br />
exit /b 3</p>
<p dir="auto">:nogpu<br />
echo.<br />
echo [错误] 没有检测到 AMD Radeon 显卡（列表里可能只剩 Intel 集显）<br />
echo        原因通常是驱动崩溃后显卡被系统停用（设备管理器代码 22 或 31）<br />
echo        处理: 先运行 修复显卡.bat，修不好就重启电脑<br />
echo        救急: 用 纯CPU兜底.bat，生成约 2 token/s<br />
pause<br />
exit /b 1</p>
<p dir="auto">:portbusy<br />
echo [错误] 端口 %PORT% 已被占用（可能是上次的服务没关）<br />
echo        关掉旧窗口，或把本脚本里的 PORT 改成 8081<br />
pause<br />
exit /b 1</p>
<p dir="auto">:noinstall<br />
echo [错误] 找不到 %LLAMA%\llama-server.exe<br />
echo        llama.cpp 没装好。把安装包解压到 %LLAMA%<br />
pause<br />
exit /b 1</p>
<p dir="auto">:nomodel<br />
echo [错误] 找不到模型文件 %MODEL%<br />
pause<br />
exit /b 1</p>
]]></description><link>https://lcz.me/post/19122</link><guid isPermaLink="true">https://lcz.me/post/19122</guid><dc:creator><![CDATA[lesslin xiu]]></dc:creator><pubDate>Fri, 18 Sep 2026 10:20:43 GMT</pubDate></item><item><title><![CDATA[Reply to R9700 很香。 on Fri, 18 Sep 2026 10:03:08 GMT]]></title><description><![CDATA[<p dir="auto">Windows 下掉驱动丢卡，先按这几条排，和显存/模型没关系：</p>
<p dir="auto">1）装完驱动立刻关掉 Windows 自动更新驱动。自识别驱动能用是因为它回退到了基础显示驱动，稳但慢、且不支持 ROCm/Vulkan 加速——不是解决方案。用 DDU 干净卸载后装 AMD Software 最新 WHQL，再用组策略/注册表禁止系统自动替换。</p>
<p dir="auto">2）拉长 TDR 超时。长时间推理最容易触发 TDR 判定「GPU 无响应」然后重置掉卡。注册表 HKLM\SYSTEM\CurrentControlSet\Control\GraphicsDrivers 新建 DWORD：TdrDelay=10、TdrDdiDelay=20，重启。这一条能治好很多「跑一会儿就掉卡」。</p>
<p dir="auto">3）BIOS 里把显卡槽锁 Gen4（别用 Auto），关 PCIe ASPM / 节能，确认 Above 4G Decoding + ReBAR 正常。</p>
<p dir="auto">4）供电按瞬态查。R9700 是 300W 级，单卡也别用一分二线；尖峰触发 OCP 也会表现为掉卡。</p>
<p dir="auto">5）想限功率：AMD Software 的「性能 → 调整」里拉低功率上限（R9700 这代工作站卡有些版本锁了该选项，换成 PRO 版驱动试试；Linux 侧用 amd-smi --power-cap）。限功率同时也降温和尖峰。</p>
<p dir="auto">6）跑 llama.cpp 优先用 ROCm/HIP 构建而不是 Vulkan；Vulkan 掉卡多半还是驱动层。</p>
<p dir="auto">Q5 27B 单卡 30–45 t/s 是正常水平。先做 1+2，成本最低、命中率最高。</p>
]]></description><link>https://lcz.me/post/19118</link><guid isPermaLink="true">https://lcz.me/post/19118</guid><dc:creator><![CDATA[Xiaote]]></dc:creator><pubDate>Fri, 18 Sep 2026 10:03:08 GMT</pubDate></item><item><title><![CDATA[Reply to R9700 很香。 on Fri, 18 Sep 2026 09:53:05 GMT]]></title><description><![CDATA[<blockquote>
<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/kos-or" aria-label="Profile: kos-or">@<bdi>kos-or</bdi></a> <a href="/post/19110">说</a>:</p>
<blockquote>
<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/bunsei" aria-label="Profile: Bunsei">@<bdi>Bunsei</bdi></a> <a href="/post/19107">said</a>:</p>
<p dir="auto">DFlash2速度快但是性能损失大，长上下文代码任务因为错误</p>
</blockquote>
<p dir="auto">你的意思是 DFlash2 會影響代碼的輸出品質嗎？<br />
品質很重要, 但我真還沒比較過 A/B test <img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/1f635.png?v=efcae6a46b1" class="not-responsive emoji emoji-android emoji--dizzy_face" style="height:23px;width:auto;vertical-align:middle" title=":dizzy_face:" alt="😵" /><br />
這問題值得一個專門帖了, 謝謝提醒！</p>
</blockquote>
<p dir="auto">我目前还是使用的MTP+BF16 KV，跟同事一起用需要并发的时候才会换成MTP + FP8 KV。质量、速度，鱼和熊掌不可兼得（除非你肯加卡）~</p>
]]></description><link>https://lcz.me/post/19111</link><guid isPermaLink="true">https://lcz.me/post/19111</guid><dc:creator><![CDATA[Bunsei]]></dc:creator><pubDate>Fri, 18 Sep 2026 09:53:05 GMT</pubDate></item><item><title><![CDATA[Reply to R9700 很香。 on Fri, 18 Sep 2026 09:50:27 GMT]]></title><description><![CDATA[<blockquote>
<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/bunsei" aria-label="Profile: Bunsei">@<bdi>Bunsei</bdi></a> <a href="/post/19107">said</a>:</p>
<p dir="auto">DFlash2速度快但是性能损失大，长上下文代码任务因为错误</p>
</blockquote>
<p dir="auto">你的意思是 DFlash2 會影響代碼的輸出品質嗎？<br />
品質很重要, 但我真還沒比較過 A/B test <img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/1f635.png?v=efcae6a46b1" class="not-responsive emoji emoji-android emoji--dizzy_face" style="height:23px;width:auto;vertical-align:middle" title=":dizzy_face:" alt="😵" /><br />
這問題值得一個專門帖了, 謝謝提醒！</p>
]]></description><link>https://lcz.me/post/19110</link><guid isPermaLink="true">https://lcz.me/post/19110</guid><dc:creator><![CDATA[kos or]]></dc:creator><pubDate>Fri, 18 Sep 2026 09:50:27 GMT</pubDate></item><item><title><![CDATA[Reply to R9700 很香。 on Fri, 18 Sep 2026 09:42:48 GMT]]></title><description><![CDATA[<blockquote>
<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/kos-or" aria-label="Profile: kos-or">@<bdi>kos-or</bdi></a> <a href="/post/19100">说</a>:</p>
<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/bunsei" aria-label="Profile: Bunsei">@<bdi>Bunsei</bdi></a></p>
<p dir="auto">雙R9700 的prefill 速度蠻驚人的 看來DFlash2的表現很優</p>
<p dir="auto">ctx 224K, 還能有116 tok/s 的速度</p>
</blockquote>
<p dir="auto">其实我是开着256K的上下文，224K只是为了测试能有冗余。 DFLASH2、FastMTP是有损的。所以就比较尴尬，DFlash2速度快但是性能损失大，长上下文代码任务因为错误，反而可能不如MTP或者FastMTP。文学方面... 不好评价。</p>
<p dir="auto"><img src="https://upload.lcz.me/uploads/69470bff-023d-4b4c-bac9-1b55f3b634c3.jpeg" alt="d2bf3182-f2ab-4608-83a4-d71d5310a2e5-image.jpeg" class=" img-fluid img-markdown" /></p>
]]></description><link>https://lcz.me/post/19107</link><guid isPermaLink="true">https://lcz.me/post/19107</guid><dc:creator><![CDATA[Bunsei]]></dc:creator><pubDate>Fri, 18 Sep 2026 09:42:48 GMT</pubDate></item><item><title><![CDATA[Reply to R9700 很香。 on Fri, 18 Sep 2026 09:35:49 GMT]]></title><description><![CDATA[<p dir="auto">我有7900 XTX 24G 是不是要換卡比較好？</p>
]]></description><link>https://lcz.me/post/19102</link><guid isPermaLink="true">https://lcz.me/post/19102</guid><dc:creator><![CDATA[kos or]]></dc:creator><pubDate>Fri, 18 Sep 2026 09:35:49 GMT</pubDate></item><item><title><![CDATA[Reply to R9700 很香。 on Fri, 18 Sep 2026 09:34:08 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/bunsei" aria-label="Profile: Bunsei">@<bdi>Bunsei</bdi></a></p>
<p dir="auto">雙R9700 的prefill 速度蠻驚人的 看來DFlash2的表現很優</p>
<p dir="auto">ctx 224K, 還能有116 tok/s 的速度</p>
]]></description><link>https://lcz.me/post/19100</link><guid isPermaLink="true">https://lcz.me/post/19100</guid><dc:creator><![CDATA[kos or]]></dc:creator><pubDate>Fri, 18 Sep 2026 09:34:08 GMT</pubDate></item><item><title><![CDATA[Reply to R9700 很香。 on Fri, 18 Sep 2026 09:17:28 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/lesslin-xiu" aria-label="Profile: lesslin-xiu">@<bdi>lesslin-xiu</bdi></a> 很難，一個半月前台幣50280，昨天在論壇看到二手新品台幣59000</p>
]]></description><link>https://lcz.me/post/19096</link><guid isPermaLink="true">https://lcz.me/post/19096</guid><dc:creator><![CDATA[Abel T.P. Han]]></dc:creator><pubDate>Fri, 18 Sep 2026 09:17:28 GMT</pubDate></item><item><title><![CDATA[Reply to R9700 很香。 on Fri, 18 Sep 2026 09:13:30 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/bunsei" aria-label="Profile: Bunsei">@<bdi>Bunsei</bdi></a> 等崩盘再填一张</p>
]]></description><link>https://lcz.me/post/19092</link><guid isPermaLink="true">https://lcz.me/post/19092</guid><dc:creator><![CDATA[lesslin xiu]]></dc:creator><pubDate>Fri, 18 Sep 2026 09:13:30 GMT</pubDate></item><item><title><![CDATA[Reply to R9700 很香。 on Fri, 18 Sep 2026 08:51:10 GMT]]></title><description><![CDATA[<blockquote>
<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/zhi-kong" aria-label="Profile: zhi-kong">@<bdi>zhi-kong</bdi></a> <a href="/post/19060">说</a>:</p>
<p dir="auto">实际用朋友本地qwen3.8 27bQ4接手了一下项目，速度40t-60t 速度真的不够，只是写一些小文件，某些小项目可以，如果是大一点的项目，上下文和速度都是痛点，挖掘一份ntos中.data的api指针替换并写成.asm内联汇编来修改堆栈，xhigh的结果不错，IDAMCP + web_search+C++写代码+思考，速度很慢，最慢的点在于IDAMCP工具调用</p>
</blockquote>
<p dir="auto">llama.cpp 长上下文预填充速度没法看....</p>
]]></description><link>https://lcz.me/post/19077</link><guid isPermaLink="true">https://lcz.me/post/19077</guid><dc:creator><![CDATA[Bunsei]]></dc:creator><pubDate>Fri, 18 Sep 2026 08:51:10 GMT</pubDate></item><item><title><![CDATA[Reply to R9700 很香。 on Fri, 18 Sep 2026 08:32:41 GMT]]></title><description><![CDATA[<p dir="auto">实际用朋友本地qwen3.8 27bQ4接手了一下项目，速度40t-60t 速度真的不够，只是写一些小文件，某些小项目可以，如果是大一点的项目，上下文和速度都是痛点，挖掘一份ntos中.data的api指针替换并写成.asm内联汇编来修改堆栈，xhigh的结果不错，IDAMCP + web_search+C++写代码+思考，速度很慢，最慢的点在于IDAMCP工具调用</p>
]]></description><link>https://lcz.me/post/19060</link><guid isPermaLink="true">https://lcz.me/post/19060</guid><dc:creator><![CDATA[zhi kong]]></dc:creator><pubDate>Fri, 18 Sep 2026 08:32:41 GMT</pubDate></item><item><title><![CDATA[Reply to R9700 很香。 on Fri, 18 Sep 2026 08:12:47 GMT]]></title><description><![CDATA[<p dir="auto">代码场景的话，建议你直接上双卡,双卡最多可以支撑三路并发，单路并发速度极快。</p>
<p dir="auto"><img src="https://upload.lcz.me/uploads/2eec9543-6642-4257-ba0f-9e5c225f4848.jpeg" alt="08530894-cb53-486b-99e7-75837479d752-image.jpeg" class=" img-fluid img-markdown" /></p>
]]></description><link>https://lcz.me/post/19047</link><guid isPermaLink="true">https://lcz.me/post/19047</guid><dc:creator><![CDATA[Bunsei]]></dc:creator><pubDate>Fri, 18 Sep 2026 08:12:47 GMT</pubDate></item><item><title><![CDATA[Reply to R9700 很香。 on Fri, 18 Sep 2026 07:39:20 GMT]]></title><description><![CDATA[<p dir="auto">你这功课要加强啊，7900xtx 5200的 时候为啥没有做好功课，现在R9700功课也没做足，现在不管是27b还是QFN最好都是双卡，而且你会发现本地使用ai方式都会变了，不是chat 也不是单session等它上下文一多压缩的工作模式了。而且速度体验超过大部分在线ai，智力方面只有前几家不降智的情况下才远超本地的(但我们大部分80-90%的工作不需要这么强的智能)。本地agent也可以玩出很多花了。</p>
]]></description><link>https://lcz.me/post/19034</link><guid isPermaLink="true">https://lcz.me/post/19034</guid><dc:creator><![CDATA[iamvirus]]></dc:creator><pubDate>Fri, 18 Sep 2026 07:39:20 GMT</pubDate></item></channel></rss>