每日签到 地址发布 老王说明书 宣传中心 繁/简
讨论怎么用ai搞涩涩
查看: 4|回复: 0
收起左侧

[硬核教程] 【token自由!】【破限版无审查Qwen 3.8 flash next本地部署版】

[复制链接]
发表于 前天 10:40 | 显示全部楼层 |阅读模式

马上注册,结交更多好友,享用更多功能,让你轻松玩转社区。

您需要 登录 才可以下载或查看,没有帐号?免费注册

x
免审查破限版Qwen3.8-Flash-Next文本大模型千亿参数24gb可运行!!!

Qwen3.8-Flash-Next 这几天在网上爆了,原因是真有点离谱:
-✅ 1250 亿参数的大模型,稀疏 MoE 架构,每次推理只激活 60 亿参数
-✅ Strata将上面模型运行到4090D 24gb的显卡上面来了
-✅ 以前125B 这种体量的模型上数十万的服务器,这条铁律算是被打破了。
-✅ 实测4090D 24gb的显卡跑80+ tok/s

使用教程:
1.注册仙宫云:https://www.xiangongyun.com/register/AXVQII
2.搜索镜像:【Token自由!】Qwen 3.8 flash next破限无审核版本地部署
3.选择4090显卡,最便宜的那个就够用!(由于本模型刚需4090显卡和48G内存,32G内存亲测不够,因为专家团加载到内存里,至少要占用33G内存,所以48G内存是底线了,就不提供小白本地部署教程了,能有这个配置的,应该也不用我教!去github上拉取Strata项目即可)
95eba9dd-a95a-4d63-ab1a-2c42349e3361.png
QQ_1791474730999.png
921567be70987e6008e6b9ba96142122.png


回复

使用道具 举报

您需要登录后才可以回帖 登录 | 免费注册
点击进行验证

本版积分规则

我们不生产资源,只做资源的搬运工。

广告合作-tags标签-app下载-Archiver-小黑屋-