Ollama Blog·· 2026-06-11精选AI 评分62
Ollama MLX引擎在Apple Silicon上性能再提升,支持NVFP4与快照系统
Ollama's highest performance on Apple Silicon yet with MLX
AI 导读
Ollama更新MLX引擎,在Apple Silicon上最高提速20%,并新增对NVIDIA NVFP4格式的支持,使模型量化质量损失约为q4_K_M的一半。Ollama推出快照系统,在Agent多子Agent切换、思考模型推理和分支重试时保存模型状态,避免重复处理上下文。用户可下载最新版Ollama后运行gemma4:12b-mlx模型,或通过ollama launch在编码Agent中使用。
推荐理由
Ollama在Apple Silicon上通过MLX引擎支持NVFP4格式并引入快照系统,读者可据此评估本地Agent工作流的性能提升与跨端部署可能性。
来源:Ollama Blog · ollama.com