PrismML发布Bonsai 2:Qwen3.8模型压缩至5.9GB
AI实验室PrismML发布新一代模型Bonsai 2,基于阿里Qwen3.8 27B压缩而成。通过“外部权重”技术将内存占用减少9-10倍至5.9GB,基准匹配率达98%,旨在让大模型在PC和手机端本地免费运行。
共 2 篇相关文章
AI实验室PrismML发布新一代模型Bonsai 2,基于阿里Qwen3.8 27B压缩而成。通过“外部权重”技术将内存占用减少9-10倍至5.9GB,基准匹配率达98%,旨在让大模型在PC和手机端本地免费运行。
PrismML推出基于Qwen3.8的Ternary Bonsai 2 27B,采用三元量化技术将模型压缩至5.9GB。该模型保留全精度98.2%性能,支持多模态与长上下文,在RTX 5090上可达143 token/s,显著降低本地部署门槛。