@terry 我在锤哥的帖子中看到的是“两张消费卡配高端主板TP是不错”,这是不是就等于说,X99之流的洋垃圾就别这么玩了?!?
-
3090x2 nvlink 翻车 -
关于DeepSeek-V4-flash的调用和费用的闲扯昨天一整天全部调用在线deepseek的使用量:

共计消费:¥7.28

-
關於去馬賽克@九龙杨生 应该是有新的模型的,我有大半年没有玩comfyui,不了解最新的技术了。
-
大热的3090风冷改造方案 大幅降温稳定AI大脑 -
關於去馬賽克@kos-or 生成图片3060 12G算力足够了,我说的是视频,3060只能说能跑,没有任何效率可言
我曾经尝试过的comfyui工作流是这样的:
首先将视频导入拆帧的节点,然后会将视频拆成一组图片,每一帧是一张图;
然后,循环读取这些图片,采用重绘的技术,将每一帧中的马赛克去除。
最后将重绘的图再组合成一个视频。我用3060跑过480p1分钟的视频,大概要跑3个小时。
你说的那么高清的没有试过。还有,重绘需要抽卡,这个也很费时的。
-
关于DeepSeek-V4-flash的调用和费用的闲扯7月2日写了一个系统优化方案,再加上实施这个方案的消耗

-
關於去馬賽克 -
關於去馬賽克@怪物 去找一下comfyui的重绘工作流,然后去C站找相对应的lora(针对你要重绘的部位有不同的lora),然后丢给comfyui跑就好了~
-
在线调用的最大无奈原计划是要用deepseek-v4 flash验证本地模型写的代码有没有bug,确实发现了隐藏的bug

但是再做下一步任务的时候报错了:

重试几次都是同样的问题,重启gateway还是错误依旧
换成本地模型就好了,哎......
晒一下deepseek的调用情况:

-
RTX 3090 24G 最佳 27B模型? 测试cHunter789/Qwen3.6-27B-i1-IQ4_KS-GGUF这时再跑一个简单的问答题,速率降到了53T/S
我觉得这个速度在3090上是正常的。

我用的模型和启动参数:
unsloth\Qwen3.6-27B-MTP-GGUF\Qwen3.6-27B-unslothMTP-Q4_K_M.gguf
--reasoning off ^ --n-gpu-layers -1 ^ --ctx-size 131072 ^ --batch-size 4096^ --ubatch-size 2048 ^ --flash-attn on ^ --cache-type-k q4_0 ^ --cache-type-v q4_0 ^ --spec-type draft-mtp ^ --spec-draft-n-max 3 ^ --spec-draft-n-min 1 ^ --temp 0.7 ^ --parallel 1 ^ --kv-unified ^ --mlock ^ --jinja ^ --threads 16 ^ --threads-batch 16 ^ --no-warmup华南金牌洋垃圾主板和CPU
-
两块5070TI 16G 能部署什么样的本地模型,分别提供给2个人使用,相互不影响?我现在的用法:
实例1(GPU 0):
Qwen3.6-27B-MTP-GGUF\Qwen3.6-27B-unslothMTP-Q4_K_M.gguf实例2(GPU 1):
REM 仅使用 RTX 3060 (12G VRAM)
set CUDA_VISIBLE_DEVICES=1REM 请替换为你的实际路径
set SERVER_PATH=.\llama-server.exeset MODEL_PATH=D:\MyModels\unsloth\gemma-4-12b-it-GGUF\gemma-4-12B-it-qat-UD-Q4_K_XL.gguf
set MMProj_PATH=D:\MyModels\unsloth\gemma-4-12b-it-GGUF\mmproj-gemma-4-12B-it-F16.gguf
set MTP_PATH=D:\MyModels\unsloth\gemma-4-12b-it-GGUF\mtp-gemma-4-12B-it.ggufHermes agent中qwen3.6做主模型、gemma-4做辅助模型(主要用于知识库文档识别时多模态)
给不同的人用,我觉得可以做参考,llama-server起两个服务运行在不同的端口,使用者通过端口来区分调用
-
5月新购京东4090D 48G闲置出售 21000@pilipala 本人也在上海,请问显卡多少钱出?¥24474?
-
关于华南金牌X99-CD3主板MOS风扇降噪我买的是X99-CD4,没有吵的问题。反而是我桌面上的小风扇很吵,我准备换个静音的
-
我最近对AI有点顿悟了,发现架构能力和判断能力是最重要的!大佬的感悟我是深有体会的,我本人因为工作需要有很多重复繁杂的工作,用AI写一些小工具是我个人最迫切的需求,同时,因为工作关系(金融单位),数据敏感,因此只能是自己本地搞。
但是最大的好处是,不用担心AI搞出来的东西只有demo级别,本来我也就是给自己用的,demo级别够用了

-
关于DeepSeek-V4-flash的调用和费用的闲扯
我是从前天才开始拆分任务,将部分本地效果不是很好的任务丢给DeepSeek。
昨天就做了一轮分析,然后干掉2千5百万的tokens,还好是便宜,不然真扛不住。

想到Mark大佬的tokens消耗量,我这种小卡拉米已经深有感触了..... -
新手小白求助大神指点@mei-li 3090就没有不是二手的卡,而且绝大多数都是矿卡改的。
但是我还是买的3090

-
玩转ai绘图,一张图告诉你选什么卡@imbiplaza-ASUS 我相信等等党会赢

-
【实测】X99 PCIe 4.0 是真是假?用实际带宽测试拆穿华强北黑魔法 -
玩转ai绘图,一张图告诉你选什么卡 -
豆包开始收费了,最低80元一个月,最高500元一个月豆包并不聪明,拼什么收钱?!~
App用deep seek免费不香吗......