文 | AI 唱反调
四个月前被一招封死的功能,换了个姿势回来了。
近期,Ollama 在 v0.33.0 版本里悄悄上线了一个新实现:为 Claude Desktop 提供专用本地代理。8 月 26 日,官方博客正式官宣—— Claude Desktop 可以把 Ollama 配置为 " 第三方网关提供商 ",Qwen、DeepSeek、Kimi、GLM 这些开放模型,从此能直接在 Anthropic 自家应用的界面里跑。

四月发生了什么:门开着,但门卫查身份证
先复盘上一次失败。把这条时间线拉长看,猫鼠游戏的节奏很清晰:
1 月:Ollama 支持 Anthropic Messages API,Claude Code 可以指向 Ollama 跑本地或云端模型——终端这条路先通了;
4 月:Anthropic 在 Claude Desktop 里悄悄加了一个开发者设置,允许连接第三方推理网关。Ollama 立刻跟进,推出 ollama launch claude-desktop 命令,一键把桌面应用接到自己身上;
数日后:集成被封杀,Ollama 下架功能;
8 月 21 日:v0.33.0 携本地代理方案回归。
中间那几天发生了什么?
Claude Desktop 一次更新后,用户发现:网关照常接受连接,但拒绝所有非 Anthropic 的模型 ID。GitHub 上有用户贴出了当时的日志——网关的 /v1/models 接口明明返回了 39 个模型,可用数却是 0;应用发消息时固执地调用 claude-sonnet-4-6,然后报错 " 模型不存在或无权访问 "。
Anthropic 关门的姿势很讲究:接口照开,协议照通,只在模型名单上动手脚。Ollama 随后下架功能,承认 Claude Desktop 的第三方集成已 " 仅限 Anthropic 模型使用 "。
本地代理怎么解的题:请求还没出门,就被换了引擎
v0.33.0 的新方案,把绕行点从网关配置挪到了本机。Ollama 起了一个专用本地代理(源码在 internal/proxy/claude_desktop.go),Claude Desktop 的请求先落到这个代理上,再由它转发给 Ollama 托管的任何模型。
Mermaid

为什么本地代理能解开四月的死结?关键在信任边界的位置。四月的方案里,Claude Desktop 直连网关,模型名单的校验权握在应用手里,它看到陌生模型 ID 就拒付。新方案中,应用连接的是本机回环地址上的代理,对 Claude Desktop 来说,对话对象看起来就是一个 " 合法 " 的本地端点;请求出了应用之后往哪走、由哪个模型承接,全部由 Ollama 在本机决定。校验的那一关,被搬到了攻击者——准确说是用户自己——可控的一侧。

这套 " 界面不动、底座换掉 " 的做法,在 Claude Code 生态里其实早有先例:LiteLLM、Bifrost 这类网关可以把 Sonnet、Opus、Haiku 三个槽位重映射到任意提供商,开发者圈已经玩得很熟。Ollama 这次是把同一套思路从终端搬进了图形界面,顺手把配置门槛压到了一键。
隐私层面,Ollama 明确了两条:遥测默认关闭,所有模型和服务执行零数据保留政策——提示词不会发给 Anthropic,也不会被 Ollama 存下。
为什么有人要在 Claude 里跑别的模型
X 上被问最多的问题就是这个:既然有 Claude,何必绕一圈?
Ollama 给的答案是四个词:成本、速度、可移植性、自定义。本地模型零调用成本、无网络延迟;用自有数据微调过的模型可以塞进日常工作流;重活交给 Ollama Cloud 的大模型,轻活本地跑,随时切回 Anthropic 前沿模型。
还有一层它没明说但开发者都懂的理由:数据不出机。敏感代码、内部文档、客户资料,走本地模型意味着整条链路留在自己机器上,配合零数据保留政策,这对企业里那些 " 想用 AI 又怕合规 " 的场景有实际吸引力。
也有人困惑这和 Claude Code 接 Ollama 有什么区别。差别在场景:Claude Code 是终端里的编程智能体,主要服务开发者;这次集成把同样的能力带进了图形化的桌面应用——对话、研究、写作、文档处理这类非终端场景,第一次可以整条链路不离开 Claude Desktop。Ollama 想覆盖的显然是更大的那群人。
目前该功能仅限 Mac 版 Ollama,Windows 支持按官方在 X 上的暗示已在规划中。
信号:前端壳和模型引擎正在解耦
把这件事放进产业坐标系,几组公开事实值得并排看。
7 月,Ollama 完成 6500 万美元 B 轮融资,CEO Jeffrey Morgan 当时就把话说得很满:"AI 的未来,是开放模型在工作发生的每一处地方运行。" 同期,Ollama 还在推进 Apple MLX 原生支持,提升 Mac 本地推理性能。Claude Desktop 集成是这条战略线的最新一环:用户留在自己熟悉的应用里,Ollama 在底层供模型。
合理推演有两层。其一,这类 " 壳与引擎解耦 " 的玩法会扩散—— Claude Code 生态里早就有了 LiteLLM、Bifrost 等网关把 Sonnet/Opus/Haiku 三个槽位重映射到任意模型的成熟实践,桌面应用只是下一个被解耦的界面。其二,猫鼠游戏未必结束。Anthropic 四月已经演示过一次 " 协议放行、名单拦截 ",公开资料中没有看到 Anthropic 对本次集成的任何表态;如果它再次在应用层收紧校验,Ollama 的本地代理能扛多久,仍是一个开放问题。

回头看这条产品线,Ollama 的打法已经成形:本地运行时打底,云端服务补算力,再逐个敲开开发者已经在用的工具——终端、IDE、桌面应用。它不试图说服任何人换界面,只做一件事:让开放模型出现在工作正在发生的地方。
接下来值得盯的,一是 Windows 版本何时落地,二是 Anthropic 会不会再次出手。四月的封杀和八月的回归证明了一件事:在模型这件事上," 默认选项 " 的争夺,已经打到了别人的应用里。