-
,
T terry 将此主题从 随便聊聊 移至此处
-
这要多大的显存才能用?
-
@Tony-Wang 现在的主力是qwen3.8 27b-udq8xl,用了395+3090,等过几天llama.cpp支持新模型,我就试试双机和单机+3090两种方案
-
@Tony-Wang 现在的主力是qwen3.8 27b-udq8xl,用了395+3090,等过几天llama.cpp支持新模型,我就试试双机和单机+3090两种方案
-
@stxpnet 这两张卡连起来不是很正常吗?3090显卡坞,雷电4/5,Oculink都行,系统lInux,驱动Vulkan,很多框架可以直接认出两张卡,分层计算。
况且他的帖子,根本没说协同工作,或许它就是分开跑的.....
-
对啊,就看它优化得如何了。 我一直的设想是,这种MOE是文科生,回答问题速度快,多轮下来,直击一个问题的各个方面,然后最后进行一个大总结,速度快,角度全。应该和同等价值硬件能跑稠密模型有得一拼,然而事实却总是打脸。 我最后还是会选择稠密,宁愿久一点,都不要错一点。
-
@Bunsei max5 ultra 你值得拥有
-
下载中

-
我剛剛丟給AI了....她生成好 llama啟動指令,我明早起來驗收
-
https://huggingface.co/Baekpica/Qwen3.8-Flash-Next-Mixed-Quant-GGUF
這裡有大神在測試Gdx Spark,打算拿板凳等他。
