跳转至内容
  • 首页
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(不使用皮肤)
  • 不使用皮肤
折叠
品牌标识

抡锤者

Hank WangH

Hank Wang

@Hank Wang
取消关注 关注
关于
帖子
27
主题
3
分享
0
群组
0
粉丝
0
关注
0

帖子

最新 最佳 有争议的

  • 24B左右的模型推荐,其实没必要删帖,本来就是讨论,不讨论怎么分得出对错好坏
    Hank WangH Hank Wang

    这帖子确实垃圾,啥玩意。

    LLM讨论区

  • 我用Trae接入Deepseek的API居然失败?Why?
    Hank WangH Hank Wang

    没必要死磕。直接上claude或者pi Agent。支持都很好。

    AI Agent trae deepseek

  • 用AWS Sagemaker LoRA 垂直模型,下载下来本地推理,性价比最高
    Hank WangH Hank Wang

    不知所云
    不知所云

    LLM讨论区

  • 你们Hermes 接入Agnes模型没有?不要钱
    Hank WangH Hank Wang

    这网站跟我毫无关系,如果收费了就别用了。免费那还是可以的。

    AI Agent hermes

  • 你们Hermes 接入Agnes模型没有?不要钱
    Hank WangH Hank Wang
    版主注:非知名模型API,请坛友注意信息、隐私安全,合理使用。
    

    不要钱,那必须得用用啊。deepseek的钱又可以省省了。
    https://platform.agnes-ai.com/settings/apiKeys 这里生成新key。
    然后把这段话发给heremes让它自己搞

    hermes config set model.provider custom
    hermes config set model.base_url https://apihub.agnes-ai.com/v1
    hermes config set model.api_key 你的key
    hermes config set model.default agnes-2.0-flash

    hermes可能需要让它自己重启,或者你帮它重启一下。用新模型Agnes
    目前我切换到这上面了,先试试,反正不要钱。

    893d892f-2648-451b-8ffc-a8320ccd0abf-image.jpeg

    AI Agent hermes

  • 我今天终于干了个大活。震惊了我的同事。
    Hank WangH Hank Wang

    你要是老板就好。你要是打工的就没那么好😂

    AI Agent

  • R9700 ai pro 32G 跑大模型还是很给力的,速度也不错
    Hank WangH Hank Wang

    35b没有意义,a3b可能跟4b或者9b能力差不多。写的代码基本都是无法运行的。看着生成一大堆代码,一堆错,调试能力更是没有。假装一顿调试,结果出更多bug。27b明显能力高出一截,经常是正确代码,有错也勉强能自己调式

    AI硬件 amd r9700

  • VSCode官方放开了模型的自定义配置功能,可以在Copilot中配置自定义模型供应商API了
    Hank WangH Hank Wang

    我试试。第一眼是慢。再看看

    AI Agent

  • Qwen3.6-35B Q8_K_P量化配合CC搞出的八卦页面也不错
    Hank WangH Hank Wang

    CC在这里起作用没有?

    LLM讨论区

  • 从纯游戏机改成游戏+AI双用机,Qwen 3.6 27B MTP 速度只有 37 t/s,求大神指点怎么升级
    Hank WangH Hank Wang

    对。楼上言之有理。卖掉慢卡,上5090

    AI硬件 nvidia rtx5080

  • 5090 + vLLM + Qwen3.6-27B 成功分享
    Hank WangH Hank Wang

    要搞到110,否则就浪费了这个卡

    LLM讨论区 rtx5090 vllm

  • codex 现在额度大减,问了一个项目方案问题,然后让他帮我找本地电脑文件,5个小时额度就没有了。
    Hank WangH Hank Wang

    啥时候开始减的?

    AI Agent codex

  • 需要理解怎么搬运Windows下的wan2.2到Linux
    Hank WangH Hank Wang

    能实现。接网线ssh上去就可以了。网页在另一台机器访问。但是意义不大。桌面显存占用300m左右。除非你真差这一点

    AI音视频画图 wan linux

  • RTX 3080 20GB 上以 256k / ~45 tk/s 运行 Qwen3.6-35B-A3B-Q4-K-M(ubuntu)
    Hank WangH Hank Wang

    45 每秒太慢了.需要调。接Agent让它自动测试最高速度。

    LLM讨论区 rtx3080 ubuntu

  • M5pro 64G LLM性能参考.
    Hank WangH Hank Wang

    不错。这机器不便宜。能跑27b的都不错。

    AI硬件 mac

  • 两张5060ti 16g想部署qwen3.6 27b用来写代码
    Hank WangH Hank Wang

    4080s 32g 跑27b肯定可以跑。双卡不是3090的话估计意义不大。
    其他机器貌似也跑不太动27b, 64g的Mac估计能跑,但是估计很慢。建议4080s

    LLM讨论区

  • 4060Ti 8G显存还能部署本地大模型吗?玩玩Hermes
    Hank WangH Hank Wang

    应该跑35b。8g显存绝对够了。token应该26每秒以上

    AI硬件 rtx4060 hermes

  • 求指导:谁快来把我打醒
    Hank WangH Hank Wang

    买苹果吧。不想玩了跌价不会太大。A卡这显存也不快,感觉不划算。

    AI硬件

  • 更新一下近况,再请教一下懂Qwen 3.6 35B A3B的3090卡友
    Hank WangH Hank Wang

    35b显然开256k。8g显存我都开256k

    LLM讨论区 rtx3090

  • AMD 780M小主机,64G内存跑Qwen 3.6 35B,需要优化建议。
    Hank WangH Hank Wang

    这种情况我建议跑benchmark。另外,建议接Codex cli自动分析。

    AI硬件 amd
  • 登录

  • 没有帐号? 注册

  • 登录或注册以进行搜索。
  • 第一个帖子
    最后一个帖子
0
  • 首页
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组