Claude Code 免费吗?价格、选项和模型 locaux
Claude Code 免费吗?不,至少标准版本不是:Anthropic 的代码代理可以免费安装,但只能配合付费订阅或按用量计费的 API 账户运行。本指南详细说明哪些部分免费、哪些不免费,比较订阅与按令牌计费,然后回顾真正可以少花钱的方案,包括通过 Ollama 接入本地模型。技术配置则在另一篇教程中介绍。
#Claude Code 免费吗:简短回答
Claude Code 是一个代码代理:它是一个命令行程序,并提供 VS Code 和 JetBrains IDE 扩展,可以读取您的仓库、修改文件、运行命令并纠正错误。程序本身可以免费下载安装。但它无法独立工作:每个操作都要通过托管在 Anthropic 的 Claude 模型完成,付费的正是对该模型的访问权限。
Claude.ai 的免费套餐可以访问网页版聊天,但不能使用 Claude Code。要使用该代理,必须拥有付费订阅(Pro、Max、Team 或 Enterprise),或者在 Anthropic Console 中使用按消耗 token 数量计费的 API 账户。目前不存在搭配 Claude 模型的 Claude Code 永久免费版本。
- 软件
- 免费。可以通过 npm、脚本或编辑器扩展安装,无需付费。
- Claude 模型
- 付费。要么包含在有使用限制的订阅中,要么通过 API 按 token 计费。
- Claude.ai 的免费套餐
- 不涵盖 Claude Code。它用于浏览器或应用中的聊天。
- 用本地模型替代 Claude
- 可行且无需订阅:Claude Code 接受兼容服务器,Ollama 提供了这样的服务器。质量不及 Claude 模型。
#Anthropic 的免费与付费内容
Anthropic 以两种不同方式提供其模型的访问权限,Claude Code 可以依赖其中任意一种。这一区别很重要,因为根据所选路径不同,账单的形式会完全不同。
- Claude.ai 免费套餐
- 浏览器和应用中的聊天功能受限。无法访问 Claude Code,也无法访问 API。
- Pro 和 Max 订阅
- 面向个人的月度套餐。套餐包含 Claude Code,但使用量有上限,会按数小时的时间窗口进行刷新,并设有每周上限。Max 是 Pro 的更高档位,用量高出数倍。
- Team 和 Enterprise 订阅
- 逻辑相同,按席位计费,并提供集中管理。Claude Code 是否可用取决于合同选项。
- 通过 Anthropic Console 使用 API
- 没有套餐:每读取一百万个令牌、每生成一百万个令牌分别付费。价格取决于模型(小模型比大模型便宜),而输出令牌比输入令牌更贵。
一个常令人意外的事实是:使用订阅时,账户与 Claude.ai 使用的是同一个账户。您在 Claude Code 中使用 Claude 凭据登录,代理消耗的用量会与您在聊天中的对话共享。使用 API 时,您在 Console 中创建密钥、充值,然后每个 Claude Code 会话都会从这笔余额中扣费。
#订阅还是 API:哪一种更便宜?
答案取决于用量。代码代理消耗的令牌远多于聊天:每一轮都会将对话历史、读取的文件内容和命令结果重新发送给模型。在中等规模的代码仓库中,单次重构任务轻易就会产生数十万输入令牌。按令牌计费时,这一用量会直接反映在账单上;在订阅中,则会在达到窗口限额前由套餐覆盖。
- 偶尔使用
- 每周使用几次,处理个人项目:入门套餐通常就足够了,其额度上限可以避免意外支出。
- 高强度日常使用
- 代理全天运行:订阅费用仍然可预测,但窗口限制会逐渐显现。Max 或 API 将成为需要根据您自身用量进行比较的两个选项。
- 团队版
- Team 或 Enterprise 用于席位管理和统一计费;API 用于共享的内部工具。
- 自动化
- 脚本、持续集成、Agent SDK:这些用法通过 API 和密钥实现,而不是通过个人订阅。
使用 API 时,Claude Code 会显示当前会话的开支。使用订阅时,它会显示额度限制状态。在设法降低成本之前,这两条命令是首先要做的检查:只有测量过的成本,才能真正有效地降低。
#在不离开 Claude Code 的情况下减少账单
在更换工具之前,调整一些设置即可降低令牌消耗,从而降低 API 成本,或延缓订阅达到限额的速度。这些调整无需安装任何东西。
- 01根据任务选择模型Claude 模型的价格各不相同。重命名变量、编写单元测试或解释函数,不需要使用最昂贵的模型。对于这些任务,请使用 /model 切换到最小的模型;处理架构或困难的调试时,再切回大型模型。
- 02限制代理读取的内容每个读取的文件都会进入上下文,并一直保留到会话结束。请给出明确指令(“只修改支付模块”),避免在没有限定范围的情况下让代理运行于庞大的代码仓库上,并保持 CLAUDE.md 文件简短:它会在每轮对话中注入。
- 03清理会话在两个无关任务之间运行 /clear;长对话持续进行时运行 /compact。每条消息都重新发送两小时的历史记录,是首要的开销来源。
- 04使用规律时优先选择订阅套餐可以限定开支。如果您发现 API 的月度账单高于订阅价格,就切换到订阅。反过来也一样:不常用时,按 token 付费更便宜。
- 05通过已经签约的云服务商Claude Code 官方支持由 Amazon Bedrock、Google Vertex AI 和 Microsoft Foundry 提供的 Claude 模型。如果您的企业已经在其中一家拥有额度或签有协议,账单会计入该账户,并遵循服务商的条件。
- 06将部分工作委托给本地模型这是最彻底的选项:交给本地模型的任务无需任何订阅。它也有局限性,下一节会详细说明。
#Claude Code 搭配本地模型:会有什么变化
Claude Code 通过 Anthropic 的 Messages API 与其模型通信。在较新的版本中,Ollama 提供了兼容该格式的 API,而 Claude Code 可以通过环境变量 ANTHROPIC_BASE_URL 接受备用服务器地址。结果是:您保留 Claude Code 的界面、命令和工作方式,但负责响应的模型变成了下载到您机器上的开放权重模型。不会有任何 token 发送给 Anthropic,也不需要订阅。
Ollama 的文档还介绍了通过环境变量手动配置的方法,适用于脚本或别名。我们的教程 Ollama 在 Claude Code 和 Cursor 中详细介绍了该方法,以及模型选择和上下文设置;这里不再重复。
- 您会获得什么
- 交给本地模型的任务无需订阅,不会向第三方发送任何数据,可离线运行,也没有上下文窗口限制。
- 您会失去什么
- Claude 模型在长链推理、数十万令牌的上下文以及对最新库的了解方面的质量。
- 您仍然需要支付的部分
- 硬件和电费。显卡持续满载数小时会反映在能源账单上,即使其数量级仍远低于订阅费用。
- 模型必须能够处理工具
- Claude Code 依赖工具调用(读取、编辑、执行)。不具备这一能力的模型会使代理无法使用。本网站针对代码列出的 Qwen3-Coder、Devstral、gpt-oss 和 GLM Flash 系列都支持该能力。
在硬件方面,本网站的参考标准仍然适用:一款 Q4 量化的 7B 模型大约占用 5 GB 显存,14B 模型约占用 9 GB,32B 模型约占用 19 GB,不包括上下文。12 GB 的 RTX 3060 是代码代理的实用起点;16 至 24 GB 的显卡或统一内存 Mac 可以运行 24 至 30B 模型,在代理模式下会轻松得多。代理需要较大的上下文,即 32,000 个令牌及以上,才能读取多个文件;上下文会在模型之外额外消耗内存。
#兼容的供应商:无需硬件即可降低成本
在 Anthropic 订阅和本地模型之间,还存在第三条路:继续使用 Claude Code,但将其接入 Anthropic 以外的另一台远程服务器。供应商大致分为三类,它们提供的保障差异很大。
- 官方支持的云服务
- Amazon Bedrock、Google Vertex AI 和 Microsoft Foundry 提供真正的 Claude 模型。Claude Code 原生支持这些服务;费用计入云账户。质量相同,账单不同,有时还可以选择数据存储位置。
- 开放权重模型托管商
- 多家开放模型厂商(例如 Z.ai 的 GLM、Moonshot 的 Kimi、DeepSeek、MiniMax 等)提供 Anthropic 格式的 API,并记录了如何将其与 Claude Code 配合使用,价格通常更低。此时响应的已不再是 Claude:质量取决于所选模型,而且服务器通常位于欧盟以外。
- 企业网关
- 将 LiteLLM 之类的代理置于多个供应商之前,可以把每个请求路由到满足需求的最低价模型,并按团队跟踪成本。Claude Code 可以像连接任何兼容服务器一样连接到它。
在将代码交给兼容的供应商之前,请核查五点:是否真正兼容 Messages API 和工具调用、接受的上下文大小、托管国家以及数据使用条款、输入和输出每百万令牌的价格,以及是否存在支出上限。没有上限的低价仍然是一种风险。
#Claude Code 的免费替代方案
如果目标是获得一个无需订阅的代码代理,而不一定非要使用 Claude Code,那么开放工具配合本地模型也能完成同样的工作。严格来说,它们是免费的:没有许可证费,也没有套餐费。剩下的成本是硬件。
- OpenCode + Ollama
- 终端中的代码代理,开源,在使用方式上与 Claude Code 非常接近。Ollama 可以直接使用本地模型启动它。请参阅我们的 OpenCode + Ollama 指南。
- Cline + Ollama
- VS Code 中的代码代理,支持计划模式和执行模式。我们的 Cline + Ollama 指南详细介绍了配置方法,以及根据显存选择合适的模型。
- Copilot 的本地替代方案
- 对于编辑器中的代码补全,Tabby 和 CodeGeeX 可以补充 Cline。请参阅我们的 Copilot 免费替代方案指南。
- 带配额的免费 API
- 一些供应商提供有限的免费用量,有时会以使用您的数据为代价。我们的免费 LLM API 对比介绍了它们的限制,以及何时使用本地方案更为稳妥。
“免费”一词需要进一步说明。在一张 12 GB 显卡上运行本地代理无需任何月度支出,但会消耗电力,而且前提是已有配备相应硬件的电脑。如果需要购买显卡,请先将其价格与数年的订阅费用进行比较再做决定;休闲使用和日常专业使用的计算方式并不相同。
#哪个选项适合您:决策表
- 您想免费试用 Claude Code
- 安装它,并通过 Ollama 接入一个 9 到 14B 的代码模型。您可以了解代理的界面和工作方式,但不能据此判断 Claude 的质量。
- 独立开发者,定期使用
- 先使用 Pro 订阅,如果限制造成困扰,再升级到 Max。同时使用本地模型处理简单任务和离线工作。
- 机密代码或受保密协议约束的客户代码
- 这个仓库使用本地模型,Claude Code 或 OpenCode 二选一。其他内容则使用云端。
- 多人团队
- Team 或 Enterprise,或者使用已经签约的云服务(Bedrock、Vertex、Foundry)并将 Claude Code 接入其中。如果希望按项目跟踪成本,还可以使用网关。
- 小预算,12 GB 显卡
- 接受其限制,使用 Q4 量化的 9B 模型运行本地代理。在项目需要更强能力的月份购买入门订阅。
- 无显卡
- 订阅,或在核实条件后使用兼容的服务商。仅使用处理器运行本地模型,对于代码代理来说速度太慢。
#常见问题
Claude Code 免费吗?+
可以免费试用 Claude Code 吗?+
Claude Code 多少钱?+
使用 Ollama 的 Claude Code,真的免费吗?+
本地模型在 Claude Code 中能否媲美 Claude?+
Claude Code 可以离线运行吗?+
#深入了解
现在您已经知道哪些免费、哪些付费,也知道哪种选项适合自己的情况。接下来自然是进行配置,相关内容将在后续指南中介绍。
- 在 Claude Code 和 Cursor 中使用 Ollama:分步配置指南
- OpenCode + Ollama:终端中的开源代码代理
- Cline + Ollama:VS Code 中的 100% 本地编程智能体
- 本地免费 Copilot:Cline、Tabby 和 CodeGeeX
- 免费 LLM API:真正的对比以及本地方案
- Ollama Cloud:价格、评价和限制
指南编写于 2026 年 10 月 10 日。访问规则(不含 Claude Code 的免费套餐、订阅或 API)与 Anthropic 文档一致;这里不抄录金额,因为金额会变化,官方价格页面才是准确信息。通过 Ollama 进行接入的方法遵循 Ollama 文档中的集成页面,而其中的命令会随版本变化。
有反馈、发现了错误,或想补充说明?请告诉我们,让这份指南对每个人都更有帮助。