PrismML发布Ternary Bonsai 2:5.9GB本地运行27B模型
PrismML推出基于Qwen3.8的Ternary Bonsai 2 27B,采用三元量化技术将模型压缩至5.9GB。该模型保留全精度98.2%性能,支持多模态与长上下文,在RTX 5090上可达143 token/s,显著降低本地部署门槛。
共 1 篇相关文章
PrismML推出基于Qwen3.8的Ternary Bonsai 2 27B,采用三元量化技术将模型压缩至5.9GB。该模型保留全精度98.2%性能,支持多模态与长上下文,在RTX 5090上可达143 token/s,显著降低本地部署门槛。