一天消耗了80M的deepseek token
-
@Hudson-Wong 你如果整理书籍,无论如何tokens消耗都高,因为输入很多,而且每次都不同内容,没有缓存命中。这种机械工作建议你使用openrouter上的免费英伟达模型。
@terry
hi 站长,我是你的忠实粉丝,你是我的学习对象。
你说的很对,类似论坛这种交流模式,是和所谓的on time交流是不一样的。
可以把事情说清楚。
虽然我不是AI之类的相关,不过每次看你的视频,让我对事情都有多方位的看法。
果然是写作高手,捏手就来。关于整理书籍
问题是我都还没有开始处理书籍,可能就处理了1本。
其他很多时候就是捣鼓那些工具,里面的设定,都觉得很恐怖了。顺便一问,我如果把openrouter的免费模型来干这个货呢?
我一丢给hermes deepseek,他就立刻解析了。我自己有一张8gb显卡,想装一个守门员,路由模型,类似qwen 9b之类的,不过站长说过那些模型基本上是智障,所以向问问你我的情况,9b够用吗
-
@terry
hi 站长,我是你的忠实粉丝,你是我的学习对象。
你说的很对,类似论坛这种交流模式,是和所谓的on time交流是不一样的。
可以把事情说清楚。
虽然我不是AI之类的相关,不过每次看你的视频,让我对事情都有多方位的看法。
果然是写作高手,捏手就来。关于整理书籍
问题是我都还没有开始处理书籍,可能就处理了1本。
其他很多时候就是捣鼓那些工具,里面的设定,都觉得很恐怖了。顺便一问,我如果把openrouter的免费模型来干这个货呢?
我一丢给hermes deepseek,他就立刻解析了。我自己有一张8gb显卡,想装一个守门员,路由模型,类似qwen 9b之类的,不过站长说过那些模型基本上是智障,所以向问问你我的情况,9b够用吗
-
@Hudson-Wong 这些模型都是弱智,没啥用处,不是说了openrouter有免费模型,你让hermes设置,最后估计会给你返回一个120b的模型,那个模型分析文档足够了,其它的不行。
你需要明白,整理文档需要一定的知识面,最少27b-35b才算基础过关,要有足够长的上下文,最好256k,上下文不够怎么整理。
另外别动不动就粉别人,都是出来混口饭吃的,信息对你有用你就采纳下,对你没用你就忽视。解答了你就感谢下,没解答不要动气,也感谢下,基本礼貌就行了。
@terry
明白的版主,果然是实在人。我尝试下,用groq免费api之类的。我研究下。
-
@terry
明白的版主,果然是实在人。我尝试下,用groq免费api之类的。我研究下。
-
@Hudson-Wong 提了很多次了,你直接使用openrouter上的hermes,它用量足够,你模型够大,groq有很多都是小模型,和弱智没啥区别。
@terry
好的,我openrouter 一直碰到409 error,groq不会,我还以为groq比较好。
我i现在就试试看。 -
@九龙杨生 你开发卫星了?
-
更新一下我最近情况。
之前用openrouter碰壁就是因为没有充值个usd 10,
充了进去单日request 可以到1000,就够用了。
然后也用agnes 2.5 flash 免费AI现在用小红书的开源dots3, 基本上满足日常需求,
不过需要配置东西的时候,也是要deepseek v4 flash才成功 -
更新一下我最近情况。
之前用openrouter碰壁就是因为没有充值个usd 10,
充了进去单日request 可以到1000,就够用了。
然后也用agnes 2.5 flash 免费AI现在用小红书的开源dots3, 基本上满足日常需求,
不过需要配置东西的时候,也是要deepseek v4 flash才成功 -
@Hudson-Wong 免费模型很蠢,尤其英伟达的,和特么智障一样,但是基础运维没问题。
@terry
是的,那个Lighting模型很好的演示了,什么叫做很快,不过全错。
还有那个ultra 3, 简直愧对了他550b moe的模型。哈哈。
希望下次有些国内的好模型可以在openrouter薅薅羊毛。我现在看看小红书的dots3如何,暂时看起来比nemotron聪明。
我基本上都是做个人agent,和用来给老婆小孩做做记录等等。
