跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(不使用皮肤)
  • 不使用皮肤
折叠
品牌标识

抡锤者

J

joker_chang

@joker_chang
德高望重 劳动模范
取消关注 关注
关于
帖子
80
主题
5
分享
0
群组
2
粉丝
0
关注
1

帖子

最新 最佳 有争议的

  • 3090x2 nvlink 翻车
    J joker_chang

    @terry 我在锤哥的帖子中看到的是“两张消费卡配高端主板TP是不错”,这是不是就等于说,X99之流的洋垃圾就别这么玩了?!?

    AI硬件 rtx3090

  • 关于DeepSeek-V4-flash的调用和费用的闲扯
    J joker_chang

    昨天一整天全部调用在线deepseek的使用量:

    57e929b2-7cd2-4f8b-8e1e-4be38e698bac-image.jpeg

    共计消费:¥7.28
    40d9f421-da48-4e86-83b4-00962e9a89c5-image.jpeg

    随便聊聊 deepseek

  • 關於去馬賽克
    J joker_chang

    @九龙杨生 应该是有新的模型的,我有大半年没有玩comfyui,不了解最新的技术了。

    随便聊聊

  • 大热的3090风冷改造方案 大幅降温稳定AI大脑
    J joker_chang

    @张老师 我认为是

    我的机器就在办公桌下面,我明显能感觉到桌下风扇风的温度变化😄

    cuda在运算的时候,风都是热的

    AI硬件 rtx3090

  • 關於去馬賽克
    J joker_chang

    @kos-or 生成图片3060 12G算力足够了,我说的是视频,3060只能说能跑,没有任何效率可言

    我曾经尝试过的comfyui工作流是这样的:

    首先将视频导入拆帧的节点,然后会将视频拆成一组图片,每一帧是一张图;
    然后,循环读取这些图片,采用重绘的技术,将每一帧中的马赛克去除。
    最后将重绘的图再组合成一个视频。

    我用3060跑过480p1分钟的视频,大概要跑3个小时。
    你说的那么高清的没有试过。

    还有,重绘需要抽卡,这个也很费时的。

    随便聊聊

  • 关于DeepSeek-V4-flash的调用和费用的闲扯
    J joker_chang

    7月2日写了一个系统优化方案,再加上实施这个方案的消耗

    97d39238-4dbe-4f80-bdd3-4b14bfeb2bed-image.jpeg

    随便聊聊 deepseek

  • 關於去馬賽克
    J joker_chang

    @kos-or 楼主有RTX pro 6000这种怪兽,性能问题不大的。

    我的3060都能跑,就是慢。

    视频拆帧,comfyui有节点的,简单好用。

    随便聊聊

  • 關於去馬賽克
    J joker_chang

    @怪物 去找一下comfyui的重绘工作流,然后去C站找相对应的lora(针对你要重绘的部位有不同的lora),然后丢给comfyui跑就好了~

    随便聊聊

  • 在线调用的最大无奈
    J joker_chang

    原计划是要用deepseek-v4 flash验证本地模型写的代码有没有bug,确实发现了隐藏的bug
    bb3b5da6-2a60-4ee8-b062-ef46202d10c4-image.jpeg

    但是再做下一步任务的时候报错了:
    25632d2a-9ec4-4e0a-91f9-21331f9b0c82-image.jpeg

    重试几次都是同样的问题,重启gateway还是错误依旧

    换成本地模型就好了,哎......

    晒一下deepseek的调用情况:
    e148f2dd-c36d-4574-9809-d42153c16abd-image.jpeg

    随便聊聊

  • RTX 3090 24G 最佳 27B模型? 测试cHunter789/Qwen3.6-27B-i1-IQ4_KS-GGUF
    J joker_chang

    @stxpnet 说:

    这时再跑一个简单的问答题,速率降到了53T/S

    我觉得这个速度在3090上是正常的。

    cfb0851a-4714-4153-8aed-5ae853d9628f-image.jpeg

    我用的模型和启动参数:

    unsloth\Qwen3.6-27B-MTP-GGUF\Qwen3.6-27B-unslothMTP-Q4_K_M.gguf

    --reasoning off ^
    --n-gpu-layers -1 ^
    --ctx-size 131072 ^
    --batch-size 4096^
    --ubatch-size 2048 ^
    --flash-attn on ^
    --cache-type-k q4_0 ^
    --cache-type-v q4_0 ^
    --spec-type draft-mtp ^
    --spec-draft-n-max 3 ^
    --spec-draft-n-min 1 ^
    --temp 0.7 ^
    --parallel 1 ^
    --kv-unified ^
    --mlock ^
    --jinja ^
    --threads 16 ^
    --threads-batch 16 ^
    --no-warmup
    

    华南金牌洋垃圾主板和CPU

    LLM讨论区 rtx3090

  • 两块5070TI 16G 能部署什么样的本地模型,分别提供给2个人使用,相互不影响?
    J joker_chang

    我现在的用法:
    实例1(GPU 0):
    Qwen3.6-27B-MTP-GGUF\Qwen3.6-27B-unslothMTP-Q4_K_M.gguf

    实例2(GPU 1):
    REM 仅使用 RTX 3060 (12G VRAM)
    set CUDA_VISIBLE_DEVICES=1

    REM 请替换为你的实际路径
    set SERVER_PATH=.\llama-server.exe

    set MODEL_PATH=D:\MyModels\unsloth\gemma-4-12b-it-GGUF\gemma-4-12B-it-qat-UD-Q4_K_XL.gguf
    set MMProj_PATH=D:\MyModels\unsloth\gemma-4-12b-it-GGUF\mmproj-gemma-4-12B-it-F16.gguf
    set MTP_PATH=D:\MyModels\unsloth\gemma-4-12b-it-GGUF\mtp-gemma-4-12B-it.gguf

    Hermes agent中qwen3.6做主模型、gemma-4做辅助模型(主要用于知识库文档识别时多模态)

    给不同的人用,我觉得可以做参考,llama-server起两个服务运行在不同的端口,使用者通过端口来区分调用

    LLM讨论区

  • 5月新购京东4090D 48G闲置出售 21000
    J joker_chang

    @pilipala 本人也在上海,请问显卡多少钱出?¥24474?

    AI硬件

  • 关于华南金牌X99-CD3主板MOS风扇降噪
    J joker_chang

    我买的是X99-CD4,没有吵的问题。反而是我桌面上的小风扇很吵,我准备换个静音的

    AI硬件 x99

  • 我最近对AI有点顿悟了,发现架构能力和判断能力是最重要的!
    J joker_chang

    大佬的感悟我是深有体会的,我本人因为工作需要有很多重复繁杂的工作,用AI写一些小工具是我个人最迫切的需求,同时,因为工作关系(金融单位),数据敏感,因此只能是自己本地搞。

    但是最大的好处是,不用担心AI搞出来的东西只有demo级别,本来我也就是给自己用的,demo级别够用了😄

    Mark专区

  • 关于DeepSeek-V4-flash的调用和费用的闲扯
    J joker_chang

    965d8b16-23b8-4f23-af24-b10ab12ac694-image.jpeg

    我是从前天才开始拆分任务,将部分本地效果不是很好的任务丢给DeepSeek。

    昨天就做了一轮分析,然后干掉2千5百万的tokens,还好是便宜,不然真扛不住。
    bd89264f-1a23-4cce-b2ff-2f1fe9c0af6e-image.jpeg
    想到Mark大佬的tokens消耗量,我这种小卡拉米已经深有感触了.....

    随便聊聊 deepseek

  • 新手小白求助大神指点
    J joker_chang

    @mei-li 3090就没有不是二手的卡,而且绝大多数都是矿卡改的。

    但是我还是买的3090😄

    AI硬件

  • 玩转ai绘图,一张图告诉你选什么卡
    J joker_chang

    @imbiplaza-ASUS 我相信等等党会赢😄

    AI硬件

  • 【实测】X99 PCIe 4.0 是真是假?用实际带宽测试拆穿华强北黑魔法
    J joker_chang

    @abaalei 说:

    当然,单卡推理完全没所谓——模型加载到显存后,PCIe 只做偶尔的数据传输,瓶颈在算力和显存带宽上。

    看到这里我就放心,我的华南金牌X99-CD4的第1槽插了3090Ti(三风扇版本)后,第2槽位被挡住了,3060只能插在第3槽。

    还好,我两张卡是分配跑不同的模型😄

    AI硬件 x99

  • 玩转ai绘图,一张图告诉你选什么卡
    J joker_chang

    @imbiplaza-ASUS 为啥不是5070Ti super呢?

    我还一直犹豫要不要搞一张,等着以后华强北出魔改,可以低成本扩显存😄

    参照锤哥视频中说过的等5090魔改96G显存~

    AI硬件

  • 豆包开始收费了,最低80元一个月,最高500元一个月
    J joker_chang

    豆包并不聪明,拼什么收钱?!~
    App用deep seek免费不香吗......

    Mark专区
  • 登录

  • 没有帐号? 注册

  • 登录或注册以进行搜索。
  • 第一个帖子
    最后一个帖子
0
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组