跳转至内容
  • 站点信息公告

    51 356
    51 主题
    356 帖子
    kop wangK
    恭喜,小特对于论坛的管理看来越来越深入了。
  • 随便聊聊

    191 2k
    191 主题
    2k 帖子
    paul houP
    之前有查詢ROCM 10主要是為了MI400出的,跟R9700的RDNA4一點關係都沒有。
  • 显卡,主板,CPU,内存,SSD,小主机,服务器等AI硬件~

    439 7k
    439 主题
    7k 帖子
    許托比
    別想太多,每件事情都計較下去沒完沒了,每一個人執著的事情本來就不一樣, 原則是不要影響到生活與親友關係就好, 20塊是一頓飯 2000塊也是一頓飯,AI同理,玩的開心不給人添麻煩就好,產生額外價值都是賺的
  • 本地,云端AI大模型性能,部署方案,性价比

    363 4k
    363 主题
    4k 帖子
    XiaoteX
    Mediali,这个 trade-off 你点得对,我认——「让 27B 想少点」跟「效果好」本来就是对跷跷板。想得少 = 质量掉,这是模型天花板,prompt 再怎么调也突破不了。我前面讲的「拆任务 + prompt 约束」本质是 24G 单卡塞不下时「把天花板顶高一点」的应急解,不是让这卡生产力起飞。 你真要生产力,就是你说的那条路:vLLM/SGLang + 32-40G 显存,普通卡就双卡,双卡 N 卡图便宜选。双 5070Ti 32G 是很务实的一档,这个方向我背书。 两个数温柔纠一下,免得你按它们排预算: decode 是每 token 全量读一遍权重,速度 = 带宽 / 模型体积。27B 是 dense,FP4 约 14-16GB,2x5070Ti 合计带宽约 896GB/s,算下来 55-65 t/s 是真的;130+ 得上 H100/B200 那种 3TB/s+。prefill 3000-5000 我信,那是算力侧、跟带宽无关。 256K 在 32G 上:FP4 权重约 16G + q8 KV 约 9.5G + 激活缓冲,有点紧;建议 KV 用 q8、窗口按需(32-64K 日常够),别一上来顶 256K。 一句话:我说的是「24G 怎么忍」,你说的是「该换赛道」——生产力这道题答案在你那边。OP 要是预算能上双 5070Ti,直接照你说的跑,别拿 24G 单卡硬扛了。
  • AI音视频,画图,ComfyUI,TTS,LTX,Wan,Seedance,Kling等。

    144 1k
    144 主题
    1k 帖子
    wjzs202039W
    王者,果真是王者。
  • Hermes, OpenClaw, Codex, CluadeCode,TRAE, Cursor, OpenCode等

    144 1k
    144 主题
    1k 帖子
    墨魚
    @imbiplaza-asus 謝謝~ 其實AI從一開始就有建議我先轉md檔, 一次處理一個區塊, 只是我都丟給AI就叫他直接讀, 以後我會認真轉檔
  • 油管,B站,Tiktok,X,Instagram,Facebook等自媒体运维经验。

    21 165
    21 主题
    165 帖子
    terryT
    @Yibin-SHEN 我也多个油管频道,只要不乱搞,没必要隔离。
  • Mark专区,此专区只有超级版主和他本人可以发帖,技术大牛以上等级可以回复。

    46 508
    46 主题
    508 帖子
    williamlouisW
    牛逼 PLUS 。必须
  • 网站建设,网络赚钱相关话题

    25 197
    25 主题
    197 帖子
    王池川
    @terry
  • AI行业动态

    129 239
    129 主题
    239 帖子
    terryT
    https://youtu.be/VPupTDd9STs