跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(LCZ-Blue)
  • 不使用皮肤
  • LCZ-Green
  • LCZ-Blue
  • LCZ-Black
折叠
品牌标识

抡锤者

首页 版块 标签 硬件 AI 广场
Tony Xu 0T

Tony Xu 0

@Tony Xu 0
取消关注 关注
关于
帖子
8
主题
2
分享
0
群组
0
粉丝
0
关注
0

帖子

最新 最佳 有争议的

  • 真实大型 Python 仓库上的自治软件工程全本地化Agent实验载荷
    Tony Xu 0T Tony Xu 0

    最近agent工具和底层模型层出不穷,为了搞清楚每个工具最适合做什么,好早日实现标准化大型仓库的全本地化工作流,做了一个跨工具/模型控制变量实验探索各个工具/模型相比其他可选项的特点,主要集中在Qwen3.6-27B/Qwen3.8-27B,Hermes 0.16/Hermes 0.20,Deepseek Harness rc07。收获一些心得,特此分享,实验文档做了脱敏,不影响核心实验结论输出

    点此下载:agent_harness_controlled_experiment_report.pdf

    AI Agent hermes qwen-27b

  • rtx pro 6000 max-q配合qwen3.6 MTP开到20收获前所有见的效率
    Tony Xu 0T Tony Xu 0

    @kos-or 说:

    @Tony-Xu-0 said:

    Avg generation throughput: 241.9 tokens/s

    MTP = 20 可以高達這個速度嗎?

    是的,但是要优化输出结构,实际之后又试了MTP=30/40,请求处理跑起来以后生成速度稳定上350 tokens/s,但是效率收益递减,没再开

    AI硬件 rtxpro6000 qwen-27b
  • 登录

  • 登录或注册以进行搜索。
  • 第一个帖子
    最后一个帖子
0
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组