2026/08/21oQ 量化:在 Mac 上把大模型装进更小的内存从 MLX、mlx-lm 和 oMLX 的关系讲起,解释 oQ 如何用校准数据测量层敏感度,再用混合精度分配模型的量化预算。note#大模型#量化#Mac#MLX#oMLX