PrismML 发布 Bonsai 27B,基于 Qwen3.6 27B 做端到端低比特量化,提供两个版本:三值权重版 5.9 GB 保留 95% 原始性能,1 比特版只有 3.9 GB,首次让 27B 级模型跑进 iPhone 17 Pro。它保留了完整多模态能力和 262K 上下文,支持工具调用和计算机操作循环,数学基准从 95.3 只降到 91.7,在 RTX 5090 上能跑出每秒 163 token。
点评:本地模型的竞争正从参数规模转向他们提出的智能密度,也就是每 GB 体积能装下多少能力。数学和工具调用这两项 Agent 关键能力在量化后保持得最好,说明选型经过仔细权衡。短板同样明显,视觉任务从 72.6 掉到 59.6,多模态场景还是建议用三值版。