Ollama 再次迎来版本更新,本次发布的 0.3.7 与 0.3.8 版本不仅带来了多款全新模型,还修复了若干影响实际使用的关键问题。接下来先介绍新增模型,再梳理更新亮点。
新增模型详解
Hermes 3:作为 Nous Research 旗下旗舰系列 Hermes 的最新成员,该模型原生支持工具调用,能够高效处理各类辅助任务。

Phi 3.5:一款仅 38 亿参数的轻量级模型,却在性能上实现了越级表现,能够抗衡甚至超越众多同参数量级乃至更大体量的竞品,堪称小身材大能量的典范。
SmolLM:一系列针对资源受限场景设计的小模型,参数规模涵盖 1.35 亿、3.6 亿和 17 亿,全部基于全新构建的高质量数据集训练,兼顾效率与效果。
更新内容一览
修复了 Windows 系统上升级 Ollama 后命令行界面(CLI)无法正常识别路径的匹配问题。
新增 CUDA 12 支持,在较新的 NVIDIA GPU 上能够释放最高 10% 的性能提升。
ollama pull 与 ollama push 的传输性能得到改进,尤其在网络缓慢的环境中,提速效果更为显著。
修复了一个长期存在的痛点:之前设置 OLLAMA_NUM_PARALLEL 后,若系统 VRAM 较低,模型会反复重新加载,现在该问题已得到彻底解决。
Linux 平台的发布方式也进行了调整:现在以 tar.gz 压缩包形式提供,其中直接包含 ollama 二进制文件及所需的库文件,部署更加便捷。
