数码之家

 找回密码
 立即注册

QQ登录

只需一步,快速开始

搜索
查看: 37|回复: 0

[科技] PrismML再出手:Bonsai 2 27B以1/9内存占用保留基模98%性能

[复制链接]
发表于 昨天 22:14 | 显示全部楼层 |阅读模式

爱科技、爱创意、爱折腾、爱极致,我们都是技术控

您需要 登录 才可以下载或查看,没有账号?立即注册

x
IT之家 9 月 18 日消息,人工智能实验室 PrismML 今年早些时候推出了微调模型 Bonsai 27B,以显著更低的内存占用实现了 Qwen3.6 27B 基础模型 95% 的性能。
而在当地时间 27 日,PrismML 宣布推出三值量化版本的 Bonsai 2 27B。该模型将基础模型升级至 Qwen3.8 27B,推理、编程、视觉、长程智能体性能全面提升,以不到 1/9 的内存占用在综合基准测试中得到了基础模型 98.2% 的分数,整体表现甚至好于 Qwen3.6 27B。
PrismML 表示,Bonsai 2 27B 足以在本地承担编程智能体循环、计算机使用工作流、私有文档解析、多模态调试、混合编排等“真正的知识工作”,仅在需要时才调用云端 API。

                               
登录/注册后可看大图
Bonsai 2 27B 三值量化采用 FP16 分组缩放,每个权重的有效比特为 1.76,模型总大小为 5.9GB,支持 262K 上下文窗口。
其在 NVIDIA GeForce RTX 5090 上拥有 143TPS 的词元吞吐量,在 Apple Silicon M5 Max 上则可达 46.8TPS。这款模型在 GeForce RTX 4090 上的能效为 0.714mWh / Token,比全精度 8B 模型低 40%。
Bonsai 2 27B 可通过 CUDA 在 NVIDIA GPU 上运行,也可通过 MLX 在 Apple 设备上运行;其以 Apache 2.0 许可证开放权重。

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

APP|手机版|小黑屋|关于我们|联系我们|法律条款|数码之家-技术知识分享平台

闽公网安备35020502000485号

闽ICP备2021002735号-2

GMT+8, 2026-9-19 00:17 , Processed in 0.093600 second(s), 6 queries , Gzip On, Redis On.

Powered by Discuz!

© MyDigit.Net Since 2006

快速回复 返回顶部 返回列表