入门 9 分钟IDE

Claude Code 免费吗?价格、选项和模型 locaux

Claude Code 免费吗?不,至少标准版本不是:Anthropic 的代码代理可以免费安装,但只能配合付费订阅或按用量计费的 API 账户运行。本指南详细说明哪些部分免费、哪些不免费,比较订阅与按令牌计费,然后回顾真正可以少花钱的方案,包括通过 Ollama 接入本地模型。技术配置则在另一篇教程中介绍。

作者: Thomas P.·更新于 2026-10-10·已在 Windows、macOS 和 Linux 上测试

#Claude Code 免费吗:简短回答

Claude Code 是一个代码代理:它是一个命令行程序,并提供 VS Code 和 JetBrains IDE 扩展,可以读取您的仓库、修改文件、运行命令并纠正错误。程序本身可以免费下载安装。但它无法独立工作:每个操作都要通过托管在 Anthropic 的 Claude 模型完成,付费的正是对该模型的访问权限。

Claude.ai 的免费套餐可以访问网页版聊天,但不能使用 Claude Code。要使用该代理,必须拥有付费订阅(Pro、Max、Team 或 Enterprise),或者在 Anthropic Console 中使用按消耗 token 数量计费的 API 账户。目前不存在搭配 Claude 模型的 Claude Code 永久免费版本。

软件
免费。可以通过 npm、脚本或编辑器扩展安装,无需付费。
Claude 模型
付费。要么包含在有使用限制的订阅中,要么通过 API 按 token 计费。
Claude.ai 的免费套餐
不涵盖 Claude Code。它用于浏览器或应用中的聊天。
用本地模型替代 Claude
可行且无需订阅:Claude Code 接受兼容服务器,Ollama 提供了这样的服务器。质量不及 Claude 模型。
i
本指南涵盖的内容
价格问题以及降低成本的选项。我们专门的教程介绍了在 Claude Code 中逐步配置 Ollama 的方法,链接位于页面末尾。本指南也不比较各个代码代理。

#Anthropic 的免费与付费内容

本地编程副驾驶套件

本指南带你上手模型。工具包则帮你用上能在你的编辑器中编写代码的编程助手。

  • 在线空间,终身可用
  • PDF + 文件
  • 终身更新

Anthropic 以两种不同方式提供其模型的访问权限,Claude Code 可以依赖其中任意一种。这一区别很重要,因为根据所选路径不同,账单的形式会完全不同。

Claude.ai 免费套餐
浏览器和应用中的聊天功能受限。无法访问 Claude Code,也无法访问 API。
Pro 和 Max 订阅
面向个人的月度套餐。套餐包含 Claude Code,但使用量有上限,会按数小时的时间窗口进行刷新,并设有每周上限。Max 是 Pro 的更高档位,用量高出数倍。
Team 和 Enterprise 订阅
逻辑相同,按席位计费,并提供集中管理。Claude Code 是否可用取决于合同选项。
通过 Anthropic Console 使用 API
没有套餐:每读取一百万个令牌、每生成一百万个令牌分别付费。价格取决于模型(小模型比大模型便宜),而输出令牌比输入令牌更贵。
!
金额会发生变化:请阅读官方页面
我们特意不在这里抄录价格。Anthropic 会修改价格、增加档位,并且不提前通知就调整模型列表。只有指南末尾链接的 Anthropic 价格页面,才是您做决定当天的准确信息。作为数量级参考,我们在 Ollama + Claude Code 指南中已经提过:入门订阅每月约二十美元。价格以美元显示,不含税;增值税会根据您所在的国家/地区另行加收。

一个常令人意外的事实是:使用订阅时,账户与 Claude.ai 使用的是同一个账户。您在 Claude Code 中使用 Claude 凭据登录,代理消耗的用量会与您在聊天中的对话共享。使用 API 时,您在 Console 中创建密钥、充值,然后每个 Claude Code 会话都会从这笔余额中扣费。

#订阅还是 API:哪一种更便宜?

答案取决于用量。代码代理消耗的令牌远多于聊天:每一轮都会将对话历史、读取的文件内容和命令结果重新发送给模型。在中等规模的代码仓库中,单次重构任务轻易就会产生数十万输入令牌。按令牌计费时,这一用量会直接反映在账单上;在订阅中,则会在达到窗口限额前由套餐覆盖。

偶尔使用
每周使用几次,处理个人项目:入门套餐通常就足够了,其额度上限可以避免意外支出。
高强度日常使用
代理全天运行:订阅费用仍然可预测,但窗口限制会逐渐显现。Max 或 API 将成为需要根据您自身用量进行比较的两个选项。
团队版
Team 或 Enterprise 用于席位管理和统一计费;API 用于共享的内部工具。
自动化
脚本、持续集成、Agent SDK:这些用法通过 API 和密钥实现,而不是通过个人订阅。

使用 API 时,Claude Code 会显示当前会话的开支。使用订阅时,它会显示额度限制状态。在设法降低成本之前,这两条命令是首先要做的检查:只有测量过的成本,才能真正有效地降低。

在 Claude Code 会话中
/cost     # dépense de la session (facturation API)
/usage    # limites restantes de l'abonnement
/compact  # résume la conversation pour alléger le contexte
/model    # change de modèle (un modèle plus petit coûte moins cher)
→
提示缓存会帮助您
Anthropic API 对已经发送并缓存的输入令牌收取更低的费用。Claude Code 会自动在会话历史中利用这一点。具体来说,只要对话保持在合理范围内,在同一会话中连续执行任务的成本会低于在相同上下文中冷启动代理。

#在不离开 Claude Code 的情况下减少账单

在更换工具之前,调整一些设置即可降低令牌消耗,从而降低 API 成本,或延缓订阅达到限额的速度。这些调整无需安装任何东西。

  1. 01
    根据任务选择模型
    Claude 模型的价格各不相同。重命名变量、编写单元测试或解释函数,不需要使用最昂贵的模型。对于这些任务,请使用 /model 切换到最小的模型;处理架构或困难的调试时,再切回大型模型。
  2. 02
    限制代理读取的内容
    每个读取的文件都会进入上下文,并一直保留到会话结束。请给出明确指令(“只修改支付模块”),避免在没有限定范围的情况下让代理运行于庞大的代码仓库上,并保持 CLAUDE.md 文件简短:它会在每轮对话中注入。
  3. 03
    清理会话
    在两个无关任务之间运行 /clear;长对话持续进行时运行 /compact。每条消息都重新发送两小时的历史记录,是首要的开销来源。
  4. 04
    使用规律时优先选择订阅
    套餐可以限定开支。如果您发现 API 的月度账单高于订阅价格,就切换到订阅。反过来也一样:不常用时,按 token 付费更便宜。
  5. 05
    通过已经签约的云服务商
    Claude Code 官方支持由 Amazon Bedrock、Google Vertex AI 和 Microsoft Foundry 提供的 Claude 模型。如果您的企业已经在其中一家拥有额度或签有协议,账单会计入该账户,并遵循服务商的条件。
  6. 06
    将部分工作委托给本地模型
    这是最彻底的选项:交给本地模型的任务无需任何订阅。它也有局限性,下一节会详细说明。

#Claude Code 搭配本地模型:会有什么变化

Claude Code 通过 Anthropic 的 Messages API 与其模型通信。在较新的版本中,Ollama 提供了兼容该格式的 API,而 Claude Code 可以通过环境变量 ANTHROPIC_BASE_URL 接受备用服务器地址。结果是:您保留 Claude Code 的界面、命令和工作方式,但负责响应的模型变成了下载到您机器上的开放权重模型。不会有任何 token 发送给 Anthropic,也不需要订阅。

使用较新的 Ollama 的快速方法
ollama launch claude
# Ollama propose un modèle, puis démarre Claude Code branché dessus

Ollama 的文档还介绍了通过环境变量手动配置的方法,适用于脚本或别名。我们的教程 Ollama 在 Claude Code 和 Cursor 中详细介绍了该方法,以及模型选择和上下文设置;这里不再重复。

!
这不是 Claude
一个拥有 9 到 30 billion 个参数、采用 Q4 量化的本地模型,在长时间代理任务上达不到 Claude 模型的水平:连续执行十次相互依赖的工具调用、在整个代码仓库中保持上下文、修复细微错误。它能够很好地完成短小且范围明确的任务。承诺两者等效是不正确的;正确的用法是混合使用。
您会获得什么
交给本地模型的任务无需订阅,不会向第三方发送任何数据,可离线运行,也没有上下文窗口限制。
您会失去什么
Claude 模型在长链推理、数十万令牌的上下文以及对最新库的了解方面的质量。
您仍然需要支付的部分
硬件和电费。显卡持续满载数小时会反映在能源账单上,即使其数量级仍远低于订阅费用。
模型必须能够处理工具
Claude Code 依赖工具调用(读取、编辑、执行)。不具备这一能力的模型会使代理无法使用。本网站针对代码列出的 Qwen3-Coder、Devstral、gpt-oss 和 GLM Flash 系列都支持该能力。

在硬件方面,本网站的参考标准仍然适用:一款 Q4 量化的 7B 模型大约占用 5 GB 显存,14B 模型约占用 9 GB,32B 模型约占用 19 GB,不包括上下文。12 GB 的 RTX 3060 是代码代理的实用起点;16 至 24 GB 的显卡或统一内存 Mac 可以运行 24 至 30B 模型,在代理模式下会轻松得多。代理需要较大的上下文,即 32,000 个令牌及以上,才能读取多个文件;上下文会在模型之外额外消耗内存。

i
Ollama 的“云端”模型并非本地模型
Ollama 的选择器还会提供名称以 cloud 结尾的模型。它们运行在 Ollama 的服务器上,先提供有限的免费档位,然后是付费方案。适合尝试非常大的模型,但您的数据会发送到外部,费用也会产生。我们的指南详细介绍了 Ollama Cloud 的限制。

#兼容的供应商:无需硬件即可降低成本

在 Anthropic 订阅和本地模型之间,还存在第三条路:继续使用 Claude Code,但将其接入 Anthropic 以外的另一台远程服务器。供应商大致分为三类,它们提供的保障差异很大。

官方支持的云服务
Amazon Bedrock、Google Vertex AI 和 Microsoft Foundry 提供真正的 Claude 模型。Claude Code 原生支持这些服务;费用计入云账户。质量相同,账单不同,有时还可以选择数据存储位置。
开放权重模型托管商
多家开放模型厂商(例如 Z.ai 的 GLM、Moonshot 的 Kimi、DeepSeek、MiniMax 等)提供 Anthropic 格式的 API,并记录了如何将其与 Claude Code 配合使用,价格通常更低。此时响应的已不再是 Claude:质量取决于所选模型,而且服务器通常位于欧盟以外。
企业网关
将 LiteLLM 之类的代理置于多个供应商之前,可以把每个请求路由到满足需求的最低价模型,并按团队跟踪成本。Claude Code 可以像连接任何兼容服务器一样连接到它。

在将代码交给兼容的供应商之前,请核查五点:是否真正兼容 Messages API 和工具调用、接受的上下文大小、托管国家以及数据使用条款、输入和输出每百万令牌的价格,以及是否存在支出上限。没有上限的低价仍然是一种风险。

!
机密代码:请阅读相关条款
更便宜的供应商可能会保留您的请求,或将其用于训练模型。对于受保密协议约束或受 GDPR 约束的代码,唯一不传输数据的选项是本地模型;否则,就选择在欧洲托管且合同条款明确的云服务。

#Claude Code 的免费替代方案

如果目标是获得一个无需订阅的代码代理,而不一定非要使用 Claude Code,那么开放工具配合本地模型也能完成同样的工作。严格来说,它们是免费的:没有许可证费,也没有套餐费。剩下的成本是硬件。

OpenCode + Ollama
终端中的代码代理,开源,在使用方式上与 Claude Code 非常接近。Ollama 可以直接使用本地模型启动它。请参阅我们的 OpenCode + Ollama 指南。
Cline + Ollama
VS Code 中的代码代理,支持计划模式和执行模式。我们的 Cline + Ollama 指南详细介绍了配置方法,以及根据显存选择合适的模型。
Copilot 的本地替代方案
对于编辑器中的代码补全,Tabby 和 CodeGeeX 可以补充 Cline。请参阅我们的 Copilot 免费替代方案指南。
带配额的免费 API
一些供应商提供有限的免费用量,有时会以使用您的数据为代价。我们的免费 LLM API 对比介绍了它们的限制,以及何时使用本地方案更为稳妥。

“免费”一词需要进一步说明。在一张 12 GB 显卡上运行本地代理无需任何月度支出,但会消耗电力,而且前提是已有配备相应硬件的电脑。如果需要购买显卡,请先将其价格与数年的订阅费用进行比较再做决定;休闲使用和日常专业使用的计算方式并不相同。

#哪个选项适合您:决策表

您想免费试用 Claude Code
安装它,并通过 Ollama 接入一个 9 到 14B 的代码模型。您可以了解代理的界面和工作方式,但不能据此判断 Claude 的质量。
独立开发者,定期使用
先使用 Pro 订阅,如果限制造成困扰,再升级到 Max。同时使用本地模型处理简单任务和离线工作。
机密代码或受保密协议约束的客户代码
这个仓库使用本地模型,Claude Code 或 OpenCode 二选一。其他内容则使用云端。
多人团队
Team 或 Enterprise,或者使用已经签约的云服务(Bedrock、Vertex、Foundry)并将 Claude Code 接入其中。如果希望按项目跟踪成本,还可以使用网关。
小预算,12 GB 显卡
接受其限制,使用 Q4 量化的 9B 模型运行本地代理。在项目需要更强能力的月份购买入门订阅。
无显卡
订阅,或在核实条件后使用兼容的服务商。仅使用处理器运行本地模型,对于代码代理来说速度太慢。

#常见问题

Claude Code、价格与免费使用
Claude Code 免费吗?+
软件免费,但使用不免费。Claude Code 只能搭配付费的 Claude 订阅(Pro、Max、Team、Enterprise)或按 token 计费的 API 账户使用。Claude.ai 的免费套餐无法提供访问权限。
可以免费试用 Claude Code 吗?+
目前没有记录显示 Claude Code 搭配 Claude 模型提供永久免费试用;如有促销活动,Anthropic 会在其网站上公布。免费测试该界面的方式,是通过 Ollama 将 Claude Code 连接到本地模型。
Claude Code 多少钱?+
这取决于使用路径:订阅对应按月付费的套餐,API 对应按 token 数量计费的账单。金额会发生变化;应以 Anthropic 的定价页面为准。对于规律使用,订阅通常更容易预测。
使用 Ollama 的 Claude Code,真的免费吗?+
从不再需要订阅或按 token 计费的意义上说,是的:Ollama 和开放权重模型都是免费的。您需要支付硬件和电费,并且在长任务上会失去 Claude 模型的质量。
本地模型在 Claude Code 中能否媲美 Claude?+
不可以。采用 Q4 量化的 9 到 30B 模型能够处理简短且范围明确的任务,但无法胜任大型代码仓库上的长时间代理会话。合理的用法是混合使用:日常任务和机密内容使用本地模型,困难任务使用 Claude。
Claude Code 可以离线运行吗?+
只有使用本地模型时可以。连接到 Ollama 后,代理无需任何网络连接。使用订阅或 API 时,每个操作都会经过 Anthropic 的服务器。

#深入了解

现在您已经知道哪些免费、哪些付费,也知道哪种选项适合自己的情况。接下来自然是进行配置,相关内容将在后续指南中介绍。

指南编写于 2026 年 10 月 10 日。访问规则(不含 Claude Code 的免费套餐、订阅或 API)与 Anthropic 文档一致;这里不抄录金额,因为金额会变化,官方价格页面才是准确信息。通过 Ollama 进行接入的方法遵循 Ollama 文档中的集成页面,而其中的命令会随版本变化。

这份指南对您有帮助吗?

有反馈、发现了错误,或想补充说明?请告诉我们,让这份指南对每个人都更有帮助。