跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(不使用皮肤)
  • 不使用皮肤
折叠
品牌标识

抡锤者

Botio KuoB

Botio Kuo

@Botio Kuo
取消关注 关注
关于
帖子
17
主题
2
分享
0
群组
0
粉丝
0
关注
0

帖子

最新 最佳 有争议的

  • 东方算芯发布DF1000存算一体芯片,14nm制程超越7nm新能
    Botio KuoB Botio Kuo

    @terry 寿命本身就是跟制程挂勾的,相同的制程下如果要达到不同算力 肯定会有超频的问题,超频就是减少寿命。这不是什么常识性错误,是常识。 今天都已经知道是用旧制程堆出来的算力来说,本身寿命就是常态性比较低,当然这还跟产品良率挂勾跟良率产品本身的体质,我不觉得我一个前IC PCB工程师 会没有这类的知识跟常识。今天如果你不是要跟我说同样算力的前提下,我不会觉得低端制程的芯片寿命会比较短。另外堆出来的算力就是容易积热 不然不会有人一直创新研发散热这块,超频下来出来的算力要长时间跑就是要更强的散热,而且寿命还是会变短,不管是超频还是堆,寿命都是比高端制程同算力的产品短,这点是常识。

    真要讲常识:我就问 为啥大家都在追求高端制程?跟高端制程的产品? 如果低端制程真的那么够用 搞高端制程 良率又低 的人是不是傻子?

    不要什么都要战,新闻稿看看就好,内行的都知道里面一堆细节没讲。。。搞不懂我都说了低段制程堆出来的也没啥不好的 还有啥不能理解的 嘴别人常识不足 这点真没必要。。。

    资讯

  • 东方算芯发布DF1000存算一体芯片,14nm制程超越7nm新能
    Botio KuoB Botio Kuo

    有一说一,制程还要讨论功耗跟热能,用低阶制程堆上去的算力是没有对比性来说,也不是说低阶制程就不好,主要能耗比跟散热成本也是要考量的,另外这种低阶制程堆出来的芯片寿命应该也不高。。。任何调度什么芯片设计技术都逃不掉能耗比跟散热问题,就对比性来说 要在相同实验条件下才有参考性

    资讯

  • 請教 CPU 散片 / RAM / SSD 推薦購買店家
    Botio KuoB Botio Kuo

    @paul-luo 你的AI用途是什麼? 這才是挑選硬件的重點,另外你本身有組裝PC的經驗嗎?還是說你只是想在其他地區轉賣?

    如果是一般對話 LLM 來說,MAC studio 競爭力很不錯,如果沒有PC設備的相關技能,你買 MAC STUDIO 就非常夠用。

    AI 也不一定要全新的PC才能跑 主要還是 VRAM 跟 顯卡,你可以看看版主的視頻,他也有用筆電跑AI

    AI硬件

  • 关于 Hermes 干活的, 严!重!警!告!!!
    Botio KuoB Botio Kuo

    NAS用RAID不是最基本的吗? 有不用RAID的NAS吗? RAID 也要知道被删掉的资料在哪一颗硬碟才能救援,快照或是 RAID 可靠性来说 还要搭配备份时间段去考虑救援方式,我觉得是非常麻烦的,不然就是两个NAS 或是 行动硬盘拷贝重要陈年档案,我自己行动硬盘是非常多个 分配不同的重要资料 不用担心联网隐私安全问题

    AI Agent hermes

  • 关于 Hermes 干活的, 严!重!警!告!!!
    Botio KuoB Botio Kuo

    有一说一,重要资料一定要123备份,不能只依靠单一NAS,最少要有异地备份或是云端,更何况还是让AI有权限来说。。。有些回忆找不回来 是真的会哭死。。。

    AI Agent hermes

  • 想请问各位大神关于VRAM共用的问题,comfyUI + llamacpp 想共用一张3090
    Botio KuoB Botio Kuo

    @Q-maria 那个 comfyui 在LINUX跑 可以用其他主机 (mac也可以 我目前就这样)安装 comfyui desktop 当作GUI去使用,就可以观察实际状况,但配置还是可以丢给 hermes 用 SSH 处理

    上面 @wwcd2016 大神说的应用 我刚好都有使用 obsidian cli (当作 LLM WIKI),确实 comfyui 使用的频率比较低,我是比较好奇自动切换的部分,可能要让 hermes 写个 SKILL 试试 但确实是个好思路 感谢

    AI音视频画图 rtx3090 comfyui llama.cpp

  • 想请问各位大神关于VRAM共用的问题,comfyUI + llamacpp 想共用一张3090
    Botio KuoB Botio Kuo

    @terry 这个想法好像有戏,我也在考虑上面大神说的方式 多一张AI PRO R9700卡,主要目前硬体配置来说电源W数有点紧,不然搞个PVE去直通两张卡不同工作这件事情是蛮简单的,因为我本来就有闲置的 AMD 1950x CPU 之前是跑k8s 多NODE,但都是吃电怪兽。。。

    另外一个现实的问题是,目前没有用这些设备创立营收的话,AI PRO R9700 也是不小的开销

    不过谢谢各位大神的意见

    AI音视频画图 rtx3090 comfyui llama.cpp

  • 想请问各位大神关于VRAM共用的问题,comfyUI + llamacpp 想共用一张3090
    Botio KuoB Botio Kuo

    补充说明一下: llamacpp 主要是跑 QWEN 36,本身是内网给其他电脑的hermes做调用,如果说要给多台电脑同时调用肯定不太实际

    AI音视频画图 rtx3090 comfyui llama.cpp

  • 想请问各位大神关于VRAM共用的问题,comfyUI + llamacpp 想共用一张3090
    Botio KuoB Botio Kuo

    想请问各位大神关于VRAM共用的问题,comfyUI + llamacpp 想共用一张3090的问题

    我知道这个问题有点奇怪,就是关于资源调用这部份,有没有可能设定优先顺序或是更优化的安排让 显卡 榨干价值?

    这问题我问过 hermes (deepseek) 主要是建议我 两个服务都使用 各半的 VRAM 虽然说听起来很美好,但我总觉得怪怪的,牺牲上下文长度不说,感觉生成出来的效果也会不好。

    想请教看看各位大神有没有其他解法可以参考 谢谢

    AI音视频画图 rtx3090 comfyui llama.cpp

  • 和hermes对线的日常
    Botio KuoB Botio Kuo

    @moocher8745 啥 MODEL 也要说一下吧?

    AI音视频画图 hermes

  • 有人在UBANTU上搞定刘悦的LTX2.3数字人无线时长工作流的吗
    Botio KuoB Botio Kuo

    @Q-maria 你的HERMES是用哪个MODEL???
    不是说 HERMES 配 垃圾MODEL 也能搞定阿。。。 你要找一个能 CODING的。。。
    DEEPSEEK v4 FLASH 可以DEBUG 但可能要多试几次

    AI音视频画图 ltx 刘悦大神

  • 双3090 本地AI,大家现在还用消费级平台,还是已经转 TRX40 了?
    Botio KuoB Botio Kuo

    除非目前有VRAM大于 24gb 的选择,不然目前想搞AI还是显卡实在,一堆共用内存的设计还不是完美的主流方案,可能跑跑对话可以,但如果你的需求不只有对话跟写码,3090还是非常高CP的选择

    AI硬件 rtx3090

  • ubuntu 2604 / RTX3090 跑 刘悦大神的LTX 2.3
    Botio KuoB Botio Kuo

    @williamlouis
    有一说一阿,WINDOWS 方便其实是因为有整合包,不然效能根本比不上LINUX,另外省TOKEN 跟 集显跟独显这部份我完全看不懂? 本来就是跑本地来说。。。为何会有TOKEN问题? 因为助理LLM不会跟视频的显卡抢资源,是不同的电脑配置比较合理

    Linux Distro 选择的部分 是因为 ubuntu 对于 nvidia 的支援度很高,毕竟 NVIDIA 自己的机器也是搭配 ubuntu 完全沒必要折腾其他的 Distro ,LINUX最困难的部分应该是 显卡驱动安装而已

    看您个人主页 是有在提供相关服务的 不应该阿。。。

    AI音视频画图 rtx3090 ltx ubuntu

  • ubuntu 2604 / RTX3090 跑 刘悦大神的LTX 2.3
    Botio KuoB Botio Kuo

    @abaalei 我後來發現這樣處理還是有弊端,最好是讓AGENT 去分析劉悅大神的整合包 之後 套用到 ubuntu + 3090 的設定會比較好,插件的版本號差異很大。。。 真的一堆BUG需要 DE。。。不過我週末才有時間嘗試就是了,這次可能會用 omp.sh 處理 感覺會省一點 token

    AI音视频画图 rtx3090 ltx ubuntu

  • ubuntu 2604 / RTX3090 跑 刘悦大神的LTX 2.3
    Botio KuoB Botio Kuo

    @exe127 可以的,只要是可以SSH連線上 主機B 並給予權限 都可以操作
    Hermes 對權限要求比較嚴謹,如果說還有時間 可以試試 OMP.sh 去進行編碼相關的處理會更快一點

    Hermes 比較像是個人助理,可以跟 omp.sh 同時安裝在主機A 並使用同一個MODEL 實測沒問題

    AI音视频画图 rtx3090 ltx ubuntu

  • ubuntu 2604 / RTX3090 跑 刘悦大神的LTX 2.3
    Botio KuoB Botio Kuo

    首先是因为刷到了版主的视频才想说把家里闲置的3090显卡拿出来加热

    所以安装了 ubuntu 26.04 + Comfy (生产机)
    Hermes Agent + deepseek v4 flash(opencode zen free) (ARM小机器 当助理儿子使用 远端SSH 控制生产机)
    刘悦大神的 整合包 就依照 @john8686 大大说的方式 转移重要的文件到 ubuntu 的 ComfyUI 文件夹下

    后面就是 hermes 的事情了 , 一直出错 一直叫AGENT儿子处理
    但有一说一。。。 事是真的多
    转移到ubuntu环境 真的疯狂暴错 希望有大神能讲讲更实用的转移方式

    过程中重启 comfy 数十次 才总算把 ltx 2.3 工作流安排进去!
    c88b6fa0-b153-4823-b6cf-8f0cfc0336e5-image.jpeg

    AI音视频画图 rtx3090 ltx ubuntu
  • 登录

  • 没有帐号? 注册

  • 登录或注册以进行搜索。
  • 第一个帖子
    最后一个帖子
0
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组