跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(LCZ-Blue)
  • 不使用皮肤
  • LCZ-Green
  • LCZ-Blue
  • LCZ-Black
折叠
品牌标识

抡锤者

首页 版块 标签 硬件 AI 广场
AGIA

AGI

@AGI
技术大牛 劳动模范
取消关注 关注
关于
帖子
133
主题
2
分享
0
群组
2
粉丝
1
关注
0

帖子

最新 最佳 有争议的

  • 运营油管对IP有要求吗?
    AGIA AGI

    @williamlouis

    @williamlouis 说:

    @kukudelaodie 静态IP的速度不如vps.你运营视频频道最好还是vps吧。静态IP的速度都不会很happy。20-50M是快的。我用的都是5M多点。我不需要大流量。美国静态 18元一个月。不限流量,限制速度小于50M。
    https://ping0.cc/ip/204.1.88.0
    2f945c57-b897-4d7e-9187-3924c3e2cd65-image.jpeg
    https://ping0.cc/
    目前最精准的IP测试工具。分享给大家。

    你在开玩笑吗?这个就是个玩具,ipdata.co很准确,我用美帝家宽,第一天评判100%家宽,一个月后,骑的人多了,分数一直下降。

    自媒体 自媒体

  • Codex ChatGPT 5.5 (Medium) 被它驚艷到
    AGIA AGI

    @566656661 claude完全政治化了,希望国产模型能给力。我05年本科毕业的,专业CS,毕业论文是自己写一个操作系统OS从启动到进入16位模式,我当时对操作系统非常痴迷。阅读了毛德操老师的linux kernel 2.4内核的著作,受益匪浅,还有同济大学一位老师的linux kernel 0.01源码分析。物是人非,孩子明年都该高考了。现在从事完全不相干的工作,对AI仅仅是自己的爱好。98年我就开始用VB写程序了,感觉像是昨天。

    作者名字刚才写错了,然后翻了下书柜,居然还在

    2ZCMckewDomLfzYXxYP9PzYOAlQg5L1h.webp

    AI Agent codex gpt

  • 多一個ai agent可以用了,# 終極省錢秘笈:如何用 Gemini Advanced (Pro) $20/月訂閱,暢玩 Gemini Antigravity `agy` CLI 介面
    AGIA AGI

    这个claude模型,一个用的超了,所有claude模型都需要冷却!我去年白嫖了15个月pro,上个月月初让我续订,给我的价格是1.99美元一个月,能用一年,再送三个月。感觉不错,就续订了。

    但是gemini模型实在太拉!有急事用claude,但额度少的可怜。

    我订阅的有X 普通 premium ,现在用的最多的是grok cli,效果很好。

    AI Agent gemini

  • 多一個ai agent可以用了,# 終極省錢秘笈:如何用 Gemini Advanced (Pro) $20/月訂閱,暢玩 Gemini Antigravity `agy` CLI 介面
    AGIA AGI

    @CHIA-AN-YANG 千万别这样用,违反谷歌TOS的。谷歌对反代api是0容忍,我的所有模型使用权限被谷歌封了半个月,后来超多的用户都抱怨,因为当时tos没有写,所以特赦了一批。后来再反代的,都直接封杀。

    AI Agent gemini

  • 几个建议
    AGIA AGI

    打tag就行吧,板块多了,帖子不一定多。

    随便聊聊

  • Codex官方支持接入任何模型
    AGIA AGI

    https://x.com/i/status/2067181377028538431

    OpenAI也在逐渐的open

    资讯 codex

  • 洋垃圾的回乡路 —— 2x3090 + X99 + 2x2680v4
    AGIA AGI

    折腾硬件很是麻烦。两年前买的Dell T5810,没有买华南散件,因为dell的质量的确很牛,二是因为放到家里当homelab的,不需要显卡。没想到两年后,显卡和电源成了制约因素。所以前几天买了蓝宝石7900xtx和1000w电源套装,电源专供显卡供电,还需要买一个同步启动器,拼多多10块钱,只能这样凑合着,想入第二块7900xtx,还放不下了,不想外置。
    机箱盖子无法正常盖好,也挺好,llm满载的时候,把盖子挪走,温度降低10度...

    d0c6a0e8b727829c66648fdf292a9fe0.jpeg
    68bcbaad0c6426dd144aa99c4687a95a.jpeg

    AI硬件 x99 rtx3090

  • 看目前這社區越來越多人買7900XTX了,大家為了一個爽度token無限發與反應速度,這幾天折騰的過程分享給大家(win11+vulkan & ubuntu +rocm)
    AGIA AGI

    @CHIA-AN-YANG

    /usr/local/bin/llama-server \
        -m ./models/Qwen3.6-27B-Uncensored-HauhauCS-Balanced-MTP-Q5_K_P.gguf \
        --mmproj ./models/mmproj-Qwen3.6-27B-Uncensored-HauhauCS-Aggressive-f16.gguf \
        -c 131072 \
        --parallel 1 \
        -b 2048 \
        -ub 512 \
        -fa 1 \
        -ngl 99 \
        -t 16 \
        --spec-type draft-mtp \
        --cache-type-k q5_0 \
        --cache-type-v q4_1 \
        --no-mmap \
        --temp 0.4 \
        --spec-draft-n-max 3 \
        --top-p 0.95 \
        --top-k 20 \
        --host 0.0.0.0 \
        --port 8080 \
        --tools all
    
    root@ailab:~# llama-server --version
    version: 236 (d5376cf5d)
    built with GNU 13.3.0 for Linux x86_64
    

    856683c4-bd41-4a0a-8cdd-3785b06a5bec-image.jpeg

    LLM讨论区 7900xtx rocm ubuntu

  • 7900 XTX 单卡 llama.cpp MTP 优化小记:从 47 到 51 tok/s
    AGIA AGI

    @kop-wang 这个帖子质量很高!感谢

    @terry

    命令参数如下:

    llama-server \
        -m ./models/Qwen3.6-27B-Uncensored-HauhauCS-Balanced-MTP-Q5_K_P.gguf \
        --mmproj ./models/mmproj-Qwen3.6-27B-Uncensored-HauhauCS-Aggressive-f16.gguf \
        -c 131072 \
        --parallel 1 \
        -b 2048 \
        -ub 512 \
        -fa 1 \
        -ngl 99 \
        -t 16 \
        --cache-type-k q5_0 \
        --cache-type-v q4_1 \
        --no-mmap \
        --temp 0.4 \
        --spec-draft-n-max 3 \
        --top-p 0.95 \
        --top-k 20 \
        --host 0.0.0.0 \
        --port 8080
    

    精度提高,默认显存占用降低,上下文提高到了128k,通过了https://lcz.me/post/4295 的测试,答案都正确,上下文还剩余不到点一半。

    甜点级别的参数了相当于,后续还会测试。

    截屏2026-06-17 19.03.19.png

    按照下面这个顺序测试:
    截屏2026-06-17 19.00.47.png

    @kop-wang 这个帖子质量很高!感谢

    @terry

    命令参数如下:

    llama-server \
        -m ./models/Qwen3.6-27B-Uncensored-HauhauCS-Balanced-MTP-Q5_K_P.gguf \
        --mmproj ./models/mmproj-Qwen3.6-27B-Uncensored-HauhauCS-Aggressive-f16.gguf \
        -c 131072 \
        --parallel 1 \
        -b 2048 \
        -ub 512 \
        -fa 1 \
        -ngl 99 \
        -t 16 \
        --spec-type draft-mtp
        --cache-type-k q5_0 \
        --cache-type-v q4_1 \
        --no-mmap \
        --temp 0.4 \
        --top-p 0.95 \
        --top-k 20 \
        --host 0.0.0.0 \
        --port 8080
    

    精度提高,默认显存占用降低,上下文提高到了128k,通过了https://lcz.me/post/4295 的测试,答案都正确,上下文还剩余不到点一半。

    甜点级别的参数了相当于,后续还会测试。

    截屏2026-06-17 19.03.19.png

    按照下面这个顺序测试:
    截屏2026-06-17 19.00.47.png

    LLM讨论区 amd 7900xtx

  • GPT Plus 比API划算得多, GPT6/5.6 Luna/Terra使用感受分享,要自由还得订阅Pro,DeepSeek V4 Flash 和 Qwen 27B真香!
    AGIA AGI

    gpt根本用不起了,用的最低档,20分钟后提示我还有8%额度,把对话发给gemini 3.8, 让它继续,我还是心里没底。但是这个gemini 3.8 flash的用量好像几乎是无限的,随便用。

    LLM讨论区 gpt

  • 请教大神,如何让Hermes可以群聊?
    AGIA AGI

    我理解的你说的他们互相沟通,就是两个的上下文,必须要给第三个,然后第三个的上下文必须能装得下,然后由第三个给出结论?我去年正价同时订阅了chatgpt和claude,用github上的项目这么做过,效果很好,相当于左右互搏。有两个repo你参考下,都是基于mcp协议的,但是都好久没有更新了:
    https://github.com/RaiAnsar/claude_code-multi-AI-MCP
    https://github.com/BeehiveInnovations/pal-mcp-server
    应该有更好的,两个不同ai左右互搏,这种想法很好。

    AI Agent hermes

  • 发一个我的7900xtx + qwen 3.8 27B的启动参数
    AGIA AGI
    /opt/llama.cpp/b10451/llama-b10451/llama-server \
      -m ./models/Qwen3.8-27B-Q5_K_M.gguf \
      --mmproj ./models/mmproj-F16.gguf \
      --ctx-size 131072 \
      --parallel 1 \
      --device Vulkan0 \
      --gpu-layers all \
      --flash-attn on \
      --threads 16 \
      --batch-size 512 \
      --ubatch-size 512 \
      --cache-type-k q5_0 \
      --cache-type-v q5_0 \
      --fit off \
      --load-mode none \
      --warmup \
      --spec-type draft-mtp \
      --spec-draft-ngl all \
      --spec-draft-n-max 3 \
      --spec-draft-p-min 0.1 \
      --spec-draft-type-k q8_0 \
      --spec-draft-type-v q8_0 \
      --temperature 1.0 \
      --top-p 0.95 \
      --top-k 20 \
      --min-p 0 \
      --presence-penalty 0 \
      --repeat-penalty 1 \
      --reasoning on \
      --reasoning-effort xhigh \
      --reasoning-preserve \
      --image-min-tokens 1024 \
      --host 0.0.0.0 \
      --port 8080 \
      --metrics \
      --log-timestamps
    

    抛砖引玉,希望大家也测试下,有哪些地方还能继续优化的。Screenshot 2026-08-16 at 7.04.04 AM.png

    LLM讨论区 7900xtx qwen-27b

  • Ubuntu 24 系统与 llama.cpp 服务器 健康度 · 功耗 · 温度控制 综合检查报告 (小白慢慢补图,我先报告完供大神审阅指正,谢谢!)
    AGIA AGI

    7900xtx待机时候功耗不到20w,一般15w以下。环境 proxmox + Ubuntu 26.04 server VM。还跑着其他VMs,总体待机功耗70左右。

    其他配置: 2696 V4 + 4x64G DDR4 + 1T SATA SSD+ 18T HDD.

    这几天北方降温,我机箱盖子因为各种原因,盖不住,温度满负载不到70度,显卡功耗最高300w。平时待机就是30多度的温度

    随便聊聊 ubuntu llama.cpp 服务器

  • 7900xtx qwen3.8 27b 63t/s
    AGIA AGI

    这个会oom? 上下文是不是太长了点?128k一般够用了。
    mtp设置为2也可以。

    kv缓存用--cache-type-k q5_0
    --cache-type-v q4_1 \ 试试看呢?这样应该能跑q5精度的模型

    LLM讨论区 7900xtx qwen-27b

  • 7900 XTX + Qwen3.6-27B:Ubuntu + ROCm / Vulkan / MTP 64/128/256K 全部實測整理
    AGIA AGI

    截屏2026-06-07 10.29.48.png
    运行radeontop -c显示的显存占用

    LLM讨论区 7900xtx mtp rocm

  • 买7900XTX 还是9700XT
    AGIA AGI

    先买一个7900xtx,不够用了,就再买一个,显存48g,价格和r9700一样

    AI硬件 7900xtx

  • 15 年老平台 + 单张 RX 7900 XTX 跑 Qwen3.8-27B:本地 Coding Agent 实测
    AGIA AGI

    Vision可以加载到内存当中,cpu处理,速度不慢

    AI硬件 7900xtx qwen-27b 本地模型

  • 7900 XTX + Qwen3.6-27B:Ubuntu + ROCm / Vulkan / MTP 64/128/256K 全部實測整理
    AGIA AGI

    @566656661 结果如下,让codex替我跑的:
    截屏2026-06-07 12.26.20.png

    LLM讨论区 7900xtx mtp rocm

  • 看目前這社區越來越多人買7900XTX了,大家為了一個爽度token無限發與反應速度,這幾天折騰的過程分享給大家(win11+vulkan & ubuntu +rocm)
    AGIA AGI

    @CHIA-AN-YANG 说:

    Vulkan 版在 Linux 上 MTP 幾乎無效(GitHub issue #22842)

    有效果啊,接受率70%+

    LLM讨论区 7900xtx rocm ubuntu

  • 我这样的需求,有必要折腾本地7900XTX主机吗?
    AGIA AGI

    工作上没必要,个人喜欢的话,就上,折腾这是一种享受,

    LLM讨论区 7900xtx
  • 登录

  • 登录或注册以进行搜索。
  • 第一个帖子
    最后一个帖子
0
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组