<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
    <channel>
        <title>Ollama on 拾光集</title>
        <link>https://www.tood.win/tags/ollama/</link>
        <description>Recent content in Ollama on 拾光集</description>
        <generator>Hugo -- gohugo.io</generator>
        <language>zh</language>
        <lastBuildDate>Thu, 27 Aug 2026 12:53:55 +0800</lastBuildDate><atom:link href="https://www.tood.win/tags/ollama/index.xml" rel="self" type="application/rss+xml" /><item>
            <title>Ollama 模型预加载与显存释放工具</title>
            <link>https://www.tood.win/posts/ollama-mo-xing-yu-jia-zai-yu-xian-cun-shi/</link>
            <pubDate>Fri, 14 Aug 2026 20:40:00 +0800</pubDate>
            <guid>https://www.tood.win/posts/ollama-mo-xing-yu-jia-zai-yu-xian-cun-shi/</guid>
            <description>&lt;p&gt;这是一款针对 &lt;strong&gt;Ollama &lt;a class=&#34;link&#34; href=&#34;https://www.tood.win/tags/%e6%9c%ac%e5%9c%b0%e5%a4%a7%e6%a8%a1%e5%9e%8b/&#34; &gt;本地大模型&lt;/a&gt;&lt;/strong&gt; 的辅助工具，主要解决两个问题：&lt;/p&gt;&#xA;&lt;ul&gt;&#xA;&lt;li&gt;&lt;strong&gt;提前加载模型&lt;/strong&gt;到显存 / 内存，减少首次对话时的等待时间&lt;/li&gt;&#xA;&lt;li&gt;&lt;strong&gt;手动卸载模型&lt;/strong&gt;，快速释放 GPU 显存和系统内存&lt;/li&gt;&#xA;&lt;/ul&gt;&#xA;&lt;p&gt;程序本身不负责聊天和推理，只负责模型的加载与卸载。&lt;/p&gt;&#xA;&#xA;    &lt;blockquote&gt;&#xA;        &lt;p&gt;&lt;strong&gt;仅适用于 Ollama，默认基于 &lt;code&gt;11434&lt;/code&gt; 端口。&lt;/strong&gt;&#xA;如果你使用 LM Studio、vLLM 等其他工具，或者修改过 Ollama 默认端口，建议忽略本程序。&lt;/p&gt;&#xA;&#xA;    &lt;/blockquote&gt;&#xA;&lt;p&gt;&lt;img alt=&#34;Ollama 模型预加载与显存释放工具&#34; loading=&#34;lazy&#34; sizes=&#34;(max-width: 767px) calc(100vw - 30px), (max-width: 1023px) 700px, (max-width: 1279px) 950px, 1232px&#34; src=&#34;https://www.tood.win/uploads/2026/08/f54df230-9996-4167-b152-1559525df093-255b9c34.webp&#34;&gt;&lt;/p&gt;&#xA;&lt;h2 id=&#34;使用注意&#34;&gt;使用注意&#xA;&lt;/h2&gt;&lt;ol&gt;&#xA;&lt;li&gt;使用前需要确保 &lt;strong&gt;Ollama 服务已经正常运行&lt;/strong&gt;&lt;/li&gt;&#xA;&lt;li&gt;模型预加载完成后，仍需要在聊天客户端中选择对应模型&lt;/li&gt;&#xA;&lt;li&gt;预加载不会提升模型推理速度，只是减少第一次调用时的加载等待&lt;/li&gt;&#xA;&lt;li&gt;默认采用长期驻留模式，需要释放显存时手动卸载即可&lt;/li&gt;&#xA;&lt;/ol&gt;&#xA;&lt;h2 id=&#34;本版本主要优化&#34;&gt;本版本主要优化&#xA;&lt;/h2&gt;&lt;h3 id=&#34;1-ollama-服务管理&#34;&gt;1. Ollama 服务管理&#xA;&lt;/h3&gt;&lt;p&gt;新增 Ollama 运行状态检测，可以直接在程序中启动或停止服务，同时显示当前 Ollama 版本。&lt;/p&gt;&#xA;&lt;h3 id=&#34;2-模型分类&#34;&gt;2. 模型分类&#xA;&lt;/h3&gt;&lt;p&gt;支持对本地模型进行自定义分类，模型较多时查找更加方便。&lt;/p&gt;&#xA;&lt;h3 id=&#34;3-模型别名与介绍&#34;&gt;3. 模型别名与介绍&#xA;&lt;/h3&gt;&lt;p&gt;可以给模型设置自定义名称，并添加用途、显存占用、参数规模等说明。&lt;/p&gt;&#xA;&lt;p&gt;启用别名的模型会带有 &lt;code&gt;☆&lt;/code&gt; 标记，同时仍可查看真实模型名称。&lt;/p&gt;&#xA;&lt;h3 id=&#34;4-右键快速操作&#34;&gt;4. 右键快速操作&#xA;&lt;/h3&gt;&lt;p&gt;主页选中模型后，可以直接右键：&lt;/p&gt;&#xA;&lt;ul&gt;&#xA;&lt;li&gt;预加载模型&lt;/li&gt;&#xA;&lt;li&gt;查看模型介绍&lt;/li&gt;&#xA;&lt;/ul&gt;&#xA;&lt;p&gt;操作更加方便。&lt;/p&gt;&#xA;&lt;h2 id=&#34;核心用途&#34;&gt;核心用途&#xA;&lt;/h2&gt;&lt;p&gt;简单来说，这个工具只做两件事：&lt;/p&gt;&#xA;&lt;div class=&#34;highlight&#34;&gt;&lt;div class=&#34;chroma&#34;&gt;&#xA;&lt;table class=&#34;lntable&#34;&gt;&lt;tr&gt;&lt;td class=&#34;lntd&#34;&gt;&#xA;&lt;pre tabindex=&#34;0&#34; class=&#34;chroma&#34;&gt;&lt;code&gt;&lt;span class=&#34;lnt&#34;&gt;1&#xA;&lt;/span&gt;&lt;span class=&#34;lnt&#34;&gt;2&#xA;&lt;/span&gt;&lt;span class=&#34;lnt&#34;&gt;3&#xA;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/td&gt;&#xA;&lt;td class=&#34;lntd&#34;&gt;&#xA;&lt;pre tabindex=&#34;0&#34; class=&#34;chroma&#34;&gt;&lt;code class=&#34;language-text&#34; data-lang=&#34;text&#34;&gt;&lt;span class=&#34;line&#34;&gt;&lt;span class=&#34;cl&#34;&gt;需要使用模型 → 提前加载 → 减少首次等待&#xA;&lt;/span&gt;&lt;/span&gt;&lt;span class=&#34;line&#34;&gt;&lt;span class=&#34;cl&#34;&gt;&#xA;&lt;/span&gt;&lt;/span&gt;&lt;span class=&#34;line&#34;&gt;&lt;span class=&#34;cl&#34;&gt;暂时不用模型 → 手动卸载 → 快速释放显存&#xA;&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/td&gt;&lt;/tr&gt;&lt;/table&gt;&#xA;&lt;/div&gt;&#xA;&lt;/div&gt;&lt;p&gt;比较适合经常使用 Ollama、多模型切换，或者对显存占用比较敏感的本地 &lt;a class=&#34;link&#34; href=&#34;https://www.tood.win/tags/ai/&#34; &gt;AI&lt;/a&gt; 用户。&lt;/p&gt;&#xA;&lt;p&gt;&lt;img alt=&#34;Ollama 模型预加载与显存释放工具&#34; loading=&#34;lazy&#34; sizes=&#34;(max-width: 767px) calc(100vw - 30px), (max-width: 1023px) 700px, (max-width: 1279px) 950px, 1232px&#34; src=&#34;https://www.tood.win/uploads/2026/08/QQ20260814-204118-cc7a58fd.png&#34;&gt;&lt;/p&gt;&#xA;&lt;p&gt;&lt;img alt=&#34;Ollama 模型预加载与显存释放工具&#34; loading=&#34;lazy&#34; sizes=&#34;(max-width: 767px) calc(100vw - 30px), (max-width: 1023px) 700px, (max-width: 1279px) 950px, 1232px&#34; src=&#34;https://www.tood.win/uploads/2026/08/QQ20260814-204152-822dae5c.png&#34;&gt;&lt;/p&gt;&#xA;&lt;p&gt;&lt;img alt=&#34;Ollama 模型预加载与显存释放工具&#34; loading=&#34;lazy&#34; sizes=&#34;(max-width: 767px) calc(100vw - 30px), (max-width: 1023px) 700px, (max-width: 1279px) 950px, 1232px&#34; src=&#34;https://www.tood.win/uploads/2026/08/QQ20260814-204202-25b996ca.png&#34;&gt;&lt;/p&gt;&#xA;&lt;p&gt;&lt;img alt=&#34;Ollama 模型预加载与显存释放工具&#34; loading=&#34;lazy&#34; sizes=&#34;(max-width: 767px) calc(100vw - 30px), (max-width: 1023px) 700px, (max-width: 1279px) 950px, 1232px&#34; src=&#34;https://www.tood.win/uploads/2026/08/QQ20260814-204211-67e77215.png&#34;&gt;&lt;/p&gt;&#xA;&lt;p&gt;&lt;img alt=&#34;Ollama 模型预加载与显存释放工具&#34; loading=&#34;lazy&#34; sizes=&#34;(max-width: 767px) calc(100vw - 30px), (max-width: 1023px) 700px, (max-width: 1279px) 950px, 1232px&#34; src=&#34;https://www.tood.win/uploads/2026/08/QQ20260814-204222-aa2618ef.png&#34;&gt;&lt;/p&gt;&#xA;&lt;p&gt;&lt;img alt=&#34;Ollama 模型预加载与显存释放工具&#34; loading=&#34;lazy&#34; sizes=&#34;(max-width: 767px) calc(100vw - 30px), (max-width: 1023px) 700px, (max-width: 1279px) 950px, 1232px&#34; src=&#34;https://www.tood.win/uploads/2026/08/QQ20260814-204234-417e0559.png&#34;&gt;&lt;/p&gt;&#xA;</description>
        </item></channel>
</rss>
