MLX
开发框架/库 2.8w 免费MLX 是 Apple 官方推出、专为 Apple 芯片优化的数组计算与机器学习框架
搭配玩法
3Ollama 0.31 中 Gemma 4 借多 token 预测在编码智能体基准上提速近 90%
Gemma 4 内置草稿模型与主模型并行预测 token,Ollama 自动调节草稿长度并动态验证,MLX 内核加速批量验证
✓ 默认开启且不改变模型输出✓ 无需任何配置即可获得加速 ✕ 草稿过长时 MTP 可能比普通解码更慢✕ 收益很大程度上取决于具体负载
在 Mac 上以 NVFP4 量化格式运行模型,输出速度更快、质量损失更低
MLX 框架利用 Apple Silicon 统一内存与 Metal GPU,Ollama 引擎集成 NVFP4 以降低量化精度损失
✓ 在保持性能的同时将量化质量损失近乎减半✓ NVFP4 生成速度比 q4_K_M 快
产品简介
MLX 是 Apple 官方推出、专为 Apple 芯片优化的数组计算与机器学习框架