Ollama 0.1.38版本现已发布,本次更新不仅带来了两款备受关注的开源大语言模型,还新增了提升使用效率的实用命令,并重点修复了多个已知问题。接下来,让我们一起详细了解此次更新的核心内容。
全新支持的模型

Falcon 2:由阿联酋技术创新研究院(TII)团队最新推出。该模型采用高效的纯因果解码器架构,参数量为11亿,并在高达5万亿词元的庞大数据集上进行了训练。对于寻求轻量化、高性能推理解决方案的用户来说,Falcon 2是一个非常值得尝试的选择。
Yi 1.5:作为零一万物Yi系列模型的重大升级版,Yi 1.5以Apache 2.0开源许可证发布,展现了极大的开放诚意。该系列提供了6亿、9亿和34亿三种参数规格,用户可以根据自身对模型性能与资源消耗的平衡需求进行灵活选择和部署。
新增功能特性
ollama ps 命令
本次更新引入了一个极为实用的新命令:ollama ps。该命令用于实时监控Ollama的运行状态,可以清晰展示当前已加载的模型列表、各模型占用的内存大小、计算资源分配情况(使用GPU还是CPU),以及模型的剩余存活时间。执行命令后的输出示例如下:
% ollama ps
NAME ID SIZE PROCESSOR UNTIL
mixtral:latest 7708c059a8bb 28 GB 47%/53% CPU/GPU Forever
llama3:latest a6990ed6be41 5.5 GB 100% GPU 4 minutes from now
all-minilm:latest 1b226e2802db 585 MB 100% GPU 4 minutes from now
通过该命令,用户可以一目了然地掌握资源消耗大户、识别即将被自动卸载的模型,从而更高效地进行资源管理。
/clear 命令
在交互式使用 ollama run 命令与模型对话时,若需要清空当前会话的上下文历史记录,现在只需直接输入 /clear 指令即可:
>>> /clear
Cleared session context
这一功能使得对话重置变得简单快捷,无需退出当前会话再重新进入,大大提升了交互的流畅性。
关键问题修复
Windows模型切换卡顿:修复了在Windows操作系统上,切换已加载的模型时可能出现的长时间卡顿问题。现在模型切换速度已恢复正常,体验更加流畅。
模型保存会话终止:修复了当使用
/save命令并指定了不正确的模型名称时,会导致当前聊天会话意外终止的问题。修复后,会话稳定性得到显著提升。API端点返回值:修正了
/api/tags这个API端点的行为。此前,若未传递模型参数,该端点会返回空值;现在已调整为正确返回一个空列表[],使其行为更符合开发者预期,增强了API的健壮性。
总体而言,Ollama 0.1.38是一次注重实用性与稳定性的增量更新。新增的 ollama ps 监控命令和 /clear 会话控制命令切实提升了日常使用效率,而多项错误修复则进一步增强了软件在不同环境下的可靠性。建议所有Ollama用户升级至此版本,以获得更优的本地大模型部署与管理体验。
