这是一款针对 Ollama 本地大模型 的辅助工具,主要解决两个问题:
- 提前加载模型到显存 / 内存,减少首次对话时的等待时间
- 手动卸载模型,快速释放 GPU 显存和系统内存
程序本身不负责聊天和推理,只负责模型的加载与卸载。
仅适用于 Ollama,默认基于
11434端口。 如果你使用 LM Studio、vLLM 等其他工具,或者修改过 Ollama 默认端口,建议忽略本程序。

使用注意
- 使用前需要确保 Ollama 服务已经正常运行
- 模型预加载完成后,仍需要在聊天客户端中选择对应模型
- 预加载不会提升模型推理速度,只是减少第一次调用时的加载等待
- 默认采用长期驻留模式,需要释放显存时手动卸载即可
本版本主要优化
1. Ollama 服务管理
新增 Ollama 运行状态检测,可以直接在程序中启动或停止服务,同时显示当前 Ollama 版本。
2. 模型分类
支持对本地模型进行自定义分类,模型较多时查找更加方便。
3. 模型别名与介绍
可以给模型设置自定义名称,并添加用途、显存占用、参数规模等说明。
启用别名的模型会带有 ☆ 标记,同时仍可查看真实模型名称。
4. 右键快速操作
主页选中模型后,可以直接右键:
- 预加载模型
- 查看模型介绍
操作更加方便。
核心用途
简单来说,这个工具只做两件事:
|
|
比较适合经常使用 Ollama、多模型切换,或者对显存占用比较敏感的本地 AI 用户。







PREVIEW / RAR
SOFTWARE & TOOLS
SOFTWARE & TOOLS RESOURCE / CURATED BY US
Ollama 模型预加载与显存释放工具
Software & Tools
RAR
28.1 MNo password
ACCESS STATUS
ONLINE / VERIFIED
NO PASSWORD