» 您尚未登录:请 登录 | 注册 | 标签 | 帮助 | 小黑屋 |


发新话题
打印

[电脑] 中年人给自己的六位数的玩具,也算圆个梦

Qwen3.8-Flash-Next 出来了,qwen团队无敌了
又再加了128G ddr5 6000,凑满256G内存
显存+内存到了400G,终于全配
总计投资179500


TOP

引用:
原帖由 realsquall 于 2026-8-27 09:02 发表


抢不到,要买到等几个月,而且跑稠密模型一样不行,不能多并发。
1.2T带宽不差的
至于说多发,每个会话都要有提供独立容量存上下文,储存容量不够搞并发只是token高,智商可不高。



TOP

美滋滋,12并发
附件: 您所在的用户组无法下载或查看附件


TOP

用十天了,我只能说,真他娘的太爽了,爽爆炸了

TOP

posted by wap, platform: iPhone
吹了半天,做出啥牛逼东西了?发个看看

TOP

posted by wap, platform: Firefox
引用:
原帖由 @累了  于 2026-9-9 15:23 发表
吹了半天,做出啥牛逼东西了?发个看看
前几天我弄了个本地Qwen3.8-27B q6量化,5090d跑的。
速度倒是挺快,不过写代码能力一泡污,不如codex一根毛。

TOP

???Qwen3.8-27B只要20gb显存就能放下了,系统内存你加到1tb也毫无用处。真要用你这套系统的系统内存来放模型的话结果就是慢得没法用。同时27b的模型也是傻得没法用。

TOP

posted by wap, platform: Android
引用:
原帖由 @realsquall  于 2026-8-27 04:54 发表
Qwen3.8FlashNext 出来了,qwen团队无敌了
又再加了128G ddr5 6000,凑满256G内存
显存+内存到了400G,终于全配
总计投资179500
加这么大内存做什么,同时跑27b模型跟视频模型128G内存足够了吧。

TOP

引用:
原帖由 任天狗 于 2026-9-9 22:42 发表
posted by wap, platform: Android
加这么大内存做什么,同时跑27b模型跟视频模型128G内存足够了吧。
热加载,因为同时会用很多模型,所以很多模型卸载后进内存,设置路由,如果要用直接再进显存,大概2秒就可以加载完毕。内存贵有内存贵的道理。
如果你从ssd加载要花很多倍时间。我现在的hermes和opencode都可以直接这样自动设置,爽到爆炸。
有krea2 turbo,bgm,tts,comflyui,h3,27b,35b,70b,flash next这些fp8,fp16动不动50G 70G,等等就可以轮流用,近乎无缝切换。你说为什么要大内存?
还有4k的视频如果生成需要多少内存和显存。。。 不要把买内存的人当傻子呀。。。ai时代内存和显存真就是王道。。。现在是8x pcie5.0 gpu直达cpu,ddr5 6000 c40 4*64G,运气还可以,一般四根到不了6000,基本上都拉满了。再上去就是服务器主板了。

[ 本帖最后由 realsquall 于 2026-9-10 17:21 编辑 ]

TOP

引用:
原帖由 累了 于 2026-9-9 15:23 发表
posted by wap, platform: iPhone
吹了半天,做出啥牛逼东西了?发个看看
爽到爆炸,你爽不到自然不能理解

TOP

操作        日志原文        实测区间
卸载到内存(sleep)        It took X seconds to fall asleep        1.189 ~ 1.239s,平均 ≈1.21s
恢复到显存(wake)        It took X seconds to wake up tags {'weights', 'kv_cache'}        1.234 ~ 1.288s,平均 ≈1.25s
释放/回补量        Sleep mode freed 65.36 GiB memory,其中 28.97 GiB 备份到 CPU 内存、34.23 GiB KV 直接丢弃        —
为什么这么快:权重是热备在系统内存里的,恢复就是 PCIe 一次拷贝(~29GB 权重),不是从硬盘重新读。对照硬盘冷启动:8~14 分钟。

TOP

引用:
原帖由 realsquall 于 2026-9-10 17:34 发表
操作        日志原文        实测区间
卸载到内存(sleep)        It took X seconds to fall asleep        1.189 ~ 1.239s,平均 ≈1.21s
恢复到显存(wake)        It took X seconds to wake up tags {'weights', 'kv_cache'}        1.234 ~ 1.288s, ...
我的27b是fp8的去审核版,开到1M上下文可以跑60-70token,flash next更快一点。日常80%用fp8和flash next就足够了。20%交给gpt5.6terra和sol
27b其实已经非常够用了,前提是要fp8。

TOP

posted by wap, platform: Android
双卡得HEDT平台呀,多卡跑大模型都靠PCIE了。

TOP

引用:
原帖由 zhufigo 于 2026-9-10 18:58 发表
posted by wap, platform: Android
双卡得HEDT平台呀,多卡跑大模型都靠PCIE了。
主板,ecc内存,芯片,就要超过我整机价格,别说再弄几张pro6000了,现在基本这些机器都60万+ 还是pci5.0又不是nvlink。

TOP

我这台电脑昨天看了下市场价格jd已经是22.5万了。比我购入价格已经高了4.5万了,近期显卡内存又是一轮暴涨。

TOP

发新话题