Claude Desktop被"偷梁换柱":Opus 5槽位里跑着Kimi K3,Ollama一个本地代理绕开了Anthropic的围墙?

AI唱反调·2026年09月02日 10:43
第三方模型绕过限制入驻 Claude
Anthropic
C+轮海外2019-02
人工智能安全和研究公司
我要联系

四个月前被一招封死的功能,换了个姿势回来了。

近期,Ollama 在 v0.33.0 版本里悄悄上线了一个新实现:为 Claude Desktop 提供专用本地代理。8 月 26 日,官方博客正式官宣——Claude Desktop 可以把 Ollama 配置为"第三方网关提供商",Qwen、DeepSeekKimi、GLM 这些开放模型,从此能直接在 Anthropic 自家应用的界面里跑。

这件事的看点不在"又多了个集成",而在于它怎么绕过了 Anthropic 四个月前亲手关上的那扇门。

四月发生了什么:门开着,但门卫查身份证

先复盘上一次失败。把这条时间线拉长看,猫鼠游戏的节奏很清晰:

1 月:Ollama 支持 Anthropic Messages API,Claude Code 可以指向 Ollama 跑本地或云端模型——终端这条路先通了;

4 月:Anthropic 在 Claude Desktop 里悄悄加了一个开发者设置,允许连接第三方推理网关。Ollama 立刻跟进,推出 ollama launch claude-desktop 命令,一键把桌面应用接到自己身上;

数日后:集成被封杀,Ollama 下架功能;

8 月 21 日:v0.33.0 携本地代理方案回归。

中间那几天发生了什么?

Claude Desktop 一次更新后,用户发现:网关照常接受连接,但拒绝所有非 Anthropic 的模型 ID。GitHub 上有用户贴出了当时的日志——网关的 /v1/models 接口明明返回了 39 个模型,可用数却是 0;应用发消息时固执地调用 claude-sonnet-4-6,然后报错"模型不存在或无权访问"。

Anthropic 关门的姿势很讲究:接口照开,协议照通,只在模型名单上动手脚。Ollama 随后下架功能,承认 Claude Desktop 的第三方集成已"仅限 Anthropic 模型使用"。

本地代理怎么解的题:请求还没出门,就被换了引擎

v0.33.0 的新方案,把绕行点从网关配置挪到了本机。Ollama 起了一个专用本地代理(源码在 internal/proxy/claude_desktop.go),Claude Desktop 的请求先落到这个代理上,再由它转发给 Ollama 托管的任何模型。

Mermaid

配置被压成了一次点击:打开 Ollama 应用,选 Claude,打开开关,Ollama 自动写好 Claude Desktop 的第三方网关配置;Mac 菜单栏常驻一个"使用 Ollama 模型"的切换;关掉之后,原有 Claude 设置原样恢复。

为什么本地代理能解开四月的死结?关键在信任边界的位置。四月的方案里,Claude Desktop 直连网关,模型名单的校验权握在应用手里,它看到陌生模型 ID 就拒付。新方案中,应用连接的是本机回环地址上的代理,对 Claude Desktop 来说,对话对象看起来就是一个"合法"的本地端点;请求出了应用之后往哪走、由哪个模型承接,全部由 Ollama 在本机决定。校验的那一关,被搬到了攻击者——准确说是用户自己——可控的一侧。

最有意思的设计是槽位重映射。Claude Desktop 的界面围绕 Anthropic 自家模型构建,模型选择器里是 Opus、Sonnet 这些名字。Ollama 干脆允许用户自定义每个槽位背后的真实模型:选"Opus 5",请求路由到 Kimi K3;选"Sonnet 5",实际跑的是 DeepSeek V4 Pro。界面还是那个界面,引擎已经换了。Claude Desktop 内置的 Auto mode(应用自行决定是否征求用户许可)也被完整保留。

这套"界面不动、底座换掉"的做法,在 Claude Code 生态里其实早有先例:LiteLLM、Bifrost 这类网关可以把 Sonnet、Opus、Haiku 三个槽位重映射到任意提供商,开发者圈已经玩得很熟。Ollama 这次是把同一套思路从终端搬进了图形界面,顺手把配置门槛压到了一键。

隐私层面,Ollama 明确了两条:遥测默认关闭,所有模型和服务执行零数据保留政策——提示词不会发给 Anthropic,也不会被 Ollama 存下。

为什么有人要在 Claude 里跑别的模型

X 上被问最多的问题就是这个:既然有 Claude,何必绕一圈?

Ollama 给的答案是四个词:成本、速度、可移植性、自定义。本地模型零调用成本、无网络延迟;用自有数据微调过的模型可以塞进日常工作流;重活交给 Ollama Cloud 的大模型,轻活本地跑,随时切回 Anthropic 前沿模型。

还有一层它没明说但开发者都懂的理由:数据不出机。敏感代码、内部文档、客户资料,走本地模型意味着整条链路留在自己机器上,配合零数据保留政策,这对企业里那些"想用 AI 又怕合规"的场景有实际吸引力。

也有人困惑这和 Claude Code 接 Ollama 有什么区别。差别在场景:Claude Code 是终端里的编程智能体,主要服务开发者;这次集成把同样的能力带进了图形化的桌面应用——对话、研究、写作、文档处理这类非终端场景,第一次可以整条链路不离开 Claude Desktop。Ollama 想覆盖的显然是更大的那群人。

目前该功能仅限 Mac 版 Ollama,Windows 支持按官方在 X 上的暗示已在规划中。

信号:前端壳和模型引擎正在解耦

把这件事放进产业坐标系,几组公开事实值得并排看。

7 月,Ollama 完成 6500 万美元 B 轮融资,CEO Jeffrey Morgan 当时就把话说得很满:"AI 的未来,是开放模型在工作发生的每一处地方运行。"同期,Ollama 还在推进 Apple MLX 原生支持,提升 Mac 本地推理性能。Claude Desktop 集成是这条战略线的最新一环:用户留在自己熟悉的应用里,Ollama 在底层供模型。

合理推演有两层。其一,这类"壳与引擎解耦"的玩法会扩散——Claude Code 生态里早就有了 LiteLLM、Bifrost 等网关把 Sonnet/Opus/Haiku 三个槽位重映射到任意模型的成熟实践,桌面应用只是下一个被解耦的界面。其二,猫鼠游戏未必结束。Anthropic 四月已经演示过一次"协议放行、名单拦截",公开资料中没有看到 Anthropic 对本次集成的任何表态;如果它再次在应用层收紧校验,Ollama 的本地代理能扛多久,仍是一个开放问题。

对开放模型阵营来说,意义更直接:Qwen、DeepSeekKimi、GLM 第一次集体出现在 Anthropic 自家应用的模型选择器里。围墙还在,但墙上多了一扇别人装的门。

回头看这条产品线,Ollama 的打法已经成形:本地运行时打底,云端服务补算力,再逐个敲开开发者已经在用的工具——终端、IDE、桌面应用。它不试图说服任何人换界面,只做一件事:让开放模型出现在工作正在发生的地方。

接下来值得盯的,一是 Windows 版本何时落地,二是 Anthropic 会不会再次出手。四月的封杀和八月的回归证明了一件事:在模型这件事上,"默认选项"的争夺,已经打到了别人的应用里。

+1
2

好文章,需要你的鼓励

参与评论
评论千万条,友善第一条
后参与讨论
提交评论0/1000

36氪AI测评

选靠谱AI,看真实评测
查看
36氪AI测评官方交流社区
加入

36氪项目推荐

咨询项目审核和入驻
联系
36氪项目推荐订阅号
关注

报道的项目

Anthropic
我要联系
人工智能安全和研究公司

下一篇

难赌的新爆款,难找的“接班人”

15分钟前

36氪APP让一部分人先看到未来
36氪
鲸准
氪空间

推送和解读前沿、有料的科技创投资讯

一级市场金融信息和系统服务提供商

聚焦全球优秀创业者,项目融资率接近97%,领跑行业