跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(不使用皮肤)
  • 不使用皮肤
折叠
品牌标识

抡锤者

jenaflexJ

jenaflex

@jenaflex
超级版主
取消关注 关注
关于
帖子
72
主题
4
分享
0
群组
1
粉丝
1
关注
0

帖子

最新 最佳 有争议的

  • 这个新发布的RTX Pro 5000感觉是个坑啊
    jenaflexJ jenaflex

    前几天MicroCenter还是$5000,今天一看突然涨价到$6000了

    Screenshot_20260604-234545.png

    Screenshot_20260610-003848.png

    AI硬件 rtxpro5000

  • R9700 Proxmox VE 懶人部署兩週運行心得
    jenaflexJ jenaflex

    好贴,和我想法一致。我也是R9700,也是正想把R9700直通给Proxmox的虚拟机使用,这样方便快照,和维持几个不同的测试环境。
    最近太忙,还没来得及搞。

    其实很想知道 baremetal(也就是不搞虚拟机的用法)和proxmox直通,有没有性能损失。
    以前我测过打游戏和blender渲染,大约5%左右的损失。

    AI硬件 r9700

  • intel 新顯卡~~480GB
    jenaflexJ jenaflex

    @pofu-lin
    内容不错,但下次不要拷贝粘贴AI生成的新闻。
    下不为例

    版主jenaflex

    随便聊聊 intel

  • 「疑问」这样子的温度不会有问题吗?
    jenaflexJ jenaflex

    对着显卡 加个前置的机箱风扇,防止机箱内积热就行

    AI硬件

  • 「疑问」这样子的温度不会有问题吗?
    jenaflexJ jenaflex

    对着显卡 加个前置的机箱风扇,防止机箱内积热就行

    AI硬件

  • 新手不要碰DGX Spark(重要事情说三遍)
    jenaflexJ jenaflex

    NV的APU N1X连同笔记本电脑发布了。我说的没错吧,这货和DGX Spark就是一个东西,是AI Max395的竞品,但被Arm Windows这个猪队友拖累了

    随便聊聊 dgxspark gb10

  • 4080&4090不同模型token性能测试
    jenaflexJ jenaflex

    @Michael-Zhou 哇塞,自带拆分,那的确不错,捡到宝了

    LLM讨论区

  • 4080&4090不同模型token性能测试
    jenaflexJ jenaflex

    @Michael-Zhou 对大家(lsp)得口味把握精准 哈哈哈哈
    你得oculink卡是内置PLX拆分芯片,还是利用BIOS的Bifurcation?
    好像记得Intel商用机工作站主板很少支持Bifurcation的,AMD EPYC主板支持的比较多

    LLM讨论区

  • 买7900XTX 还是9700XT
    jenaflexJ jenaflex

    @sirwang 我个人觉得AI Max 395或者其马甲,玩具成分多一点,如果不贵,想玩可以搞,大不了以后AI性能更不上了,内存大可以跑很多PVE虚拟机。
    最好是能直接出一个带x8 PCIE插槽得版本,插块4090 48GB就可以all-in-one了

    AI硬件 7900xtx

  • 新手不要碰DGX Spark(重要事情说三遍)
    jenaflexJ jenaflex

    @LeonZhao 去nv自己的community论坛 还有reddit看一下。
    个人觉得,nv永远是服务大客户的,对爱好者和community基本不关心。
    那么有大量的大客户用的东西(并且margin大的),才是nv会投下大量精力去迭代优化的东西。
    嵌入式,还是在nv的portfolio太小了。

    随便聊聊 dgxspark gb10

  • 一年前听说E2666V3是神U,无聊随便花30多买了个
    jenaflexJ jenaflex

    @Fisher-J 可能是需要ddr4服务器内存(比较贵)
    ddr3内存基本不受内存涨价影响

    AI硬件

  • 大佬们,中小企业自建本地大模型有没有什么可行的方案?
    jenaflexJ jenaflex

    @mark 对,有时侯没有实操业务能力的领导会拍脑袋。一定要和领导多对齐,落实到书面。

    现在好像做微软的PowerPoint,我没看到有什么好方案。 微软自家收费的M365 copilot我工作中也在用,有agent mode,能帮我把现有ppt里的图片排序、统一字体等简单功能,但是非常非常慢(感觉比vibe coding的反馈速度慢5-10倍。我工作当中都是尽量用markdown+mermaid流程图,挺美观的。
    ppt除非微软开放它的文件标准和api,本身就不适合通过AI编程实现自动做ppt的。

    能不能先租带GPU的VPS(能确保数据安全,不外溢的),先试一下效果,demo一下,看下是不是领导和员工想要的?

    另外,如果真的成为生产力刚需了,个人觉得最好要有两台相同的服务器做High Availability和load balancing,一台有故障、回需要软件维护的时候,自动迁移到另一台上。

    LLM讨论区

  • [申请精华帖]秀一下刚到的R9700,以及初步配置llama.cpp
    jenaflexJ jenaflex

    @johnnybegood
    等我有空测一下。
    写一更的时候,llama.cpp还没mtp,mtp上周才正式merge的

    AI硬件 amd rocm r9700

  • [申请精华帖]秀一下刚到的R9700,以及初步配置llama.cpp
    jenaflexJ jenaflex

    看到最近两个配置R9700的都遇到了问题,我来顶一下自己的帖子吧。

    首先问AI要用对的提示词,问对的方向。如果告诉AI的初始信息的方向不对,很容易被它越带越偏。比如你问的AI的时候,先问AI它需要说明系统信息,让它给你一些命令行去打印当前的系统信息(软件、硬件版本),然后再黏贴、反馈给它。

    ​建议新手R9700,先直接抄我这个成功的作业(大方向肯定可行),然后把帖子发给AI,让它对比你跟我在软硬件配置上的不同,针对性地帮你重新调整出一套方案(比如命令行需要怎么改)

    新手拿到硬件,可以按照以下步骤:

    1. 下载Ubuntu 24.04 或者 Linux Mint 22.3(Ubuntu变种)的iso镜像,用 Etcher或Rufus烧写到空u盘
    2. 启动引导到u盘,Ubuntu和Mint的Live USB,都是能加载u盘上的系统的。用终端命令行(Terminal),
      输入
    lspci | grep -i "amd"
    

    (或者nvidia,Intel等关键词),看你的显卡是否被正确识别。
    3. 正常安装Ubuntu或者Mint到你的系统盘SSD。安装完毕,按提示拔u盘,重启
    4. 重启到新安装的系统,用lspci和inxi -G命令确保显卡被识别
    5. N卡需要安装正确版本的Linux驱动(可以问AI)
    比如我之前折腾老的 Tesla P100,AI说装535驱动,但最终还是得装580驱动+手动编译llama.cpp才行。N卡,如果是P100、V100这些计算卡(虽然不推荐),建议用官方dcgmi工具跑测试显存。
    6. AMD的卡,包括绝大部分其他硬件,只要不是特别新,驱动都是被“收录”集成在了Linux kernel。如果kernel太老,那要么没驱动、要么驱动太老。
    7. 升级Linux kernel到你当前系统支持的最新,比如我在LinuxMint22.3里能选的最新Linux kernel是6.17(你的情况可能不一定完全一样)
    918f34eb-feea-4316-b80e-562452d4ba39-image.jpeg

    下图是AMD官方说明,GA=GeneralAvailability,HWE=Hardware Enablement
    如果看Ubuntu 24.04的话,HWE的最低版本是6.14(我个人选择和建议是:升到新一点的kernel,这样驱动也新一些)

    AI Pro R9700的系统支持
    f64fe843-ac3b-4220-95b7-542f2e110765-image.jpeg

    ROCM软件的系统支持
    8083467c-da12-42a4-b92a-f90f61f7b0d8-image.jpeg

    1. 接着按照我上面说的吧。
      由于llama.cpp Rocm的预编译好的runtime里面,很可能没有R9700的支持(我当时就没有;并且显卡编号欺骗大法也不管用,load model卡在了97%),所以需要自己编译。7900xtx比较老,我记得用预编译好的llama.cpp Rocm的runtime就行(偷懒可以直接用lm studio搞定)。
    AI硬件 amd rocm r9700

  • 我来简单一次说清楚Resizeable BAR吧
    jenaflexJ jenaflex

    @laobenxiong 老哥说的原理透彻。
    你觉得论坛里有两位x99+R9700开rebar花屏是什么原因?

    AI硬件 resizeablebar x99 bios

  • 论坛版主申请帖子
    jenaflexJ jenaflex

    申请“AI硬件”版主,谢谢老特和大伙信任

    站点公告

  • 自已的装机心得,AMD AI PRO R9700
    jenaflexJ jenaflex

    @terry
    他刚又发了个AI总结的洋洋洒洒的文章。
    特么还是误导其他人用 Linux 6.8内核+Rcom 7.1.1,真是无语了。

    AI硬件 amd r9700

  • Hermes Agent webui 原生 Windows 支持 ,被官方采纳合并代码了.
    jenaflexJ jenaflex

    牛逼啊!火钳刘明

    Mark专区 hermes

  • 自已的装机心得,AMD AI PRO R9700
    jenaflexJ jenaflex

    @ping-lin
    那你也别大段大段的把 AI总结的不对的东西都贴上来啊

    我这之前不是有作业可以抄嘛,然后你把这些步骤不懂的部分,再让AI给你解答。

    https://lcz.me/topic/67/申请精华帖-秀一下刚到的r9700-以及初步配置llama.cpp

    AI是,你问的方向不对,它完全有可能给你越带越偏。
    所以你可以先抄一个已经成功的作业,大致方向是可行的,然后让AI帮你解决你硬件和软件匹配和我这个不一样的地方。

    你可以让AI读我这个帖子,然后找出硬件配置和你不同的地方,然后让AI重新给你生成一套方案。

    另外免费版ChatGPT很拉,我都用付费版Gemini或者DeepSeek免费版

    AI硬件 amd r9700

  • 我来简单一次说清楚Resizeable BAR吧
    jenaflexJ jenaflex

    @terry 说:

    @jenaflex 哥你这信息是AI告诉你的吗?华南金牌新板子都只支持above 4G 和rebar,我今年春节买的,默认就支持,不需要手动刷。

    不是啊,我手写的,让AI润色了下。另外,我自己去B站看视频的。还有这个reddit老外,也是被迫关了rebar
    https://www.reddit.com/r/LocalLLaMA/comments/1j1k2uz/tensor_parallel_bottlenecks_cpu_resizable_bar/?show=original

    论坛里不是有两个帖子都说,开了rebar花屏么?就怀疑他们买到的板子的BIOS有可能不对。一些妖板或早期华擎主板,就是会有些BIOS选项开在那里,但实际无效的。

    AI硬件 resizeablebar x99 bios
  • 登录

  • 没有帐号? 注册

  • 登录或注册以进行搜索。
  • 第一个帖子
    最后一个帖子
0
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组