动手之前:先确认你走的是哪条合规路径
这篇 SOP 回答一个具体问题:Claude Sonnet 5.5 怎么调用,以及从零开始到第一次 API 返回,每一步该做什么、该看到什么结果。但在发出第一条请求之前,必须先解决一个比代码更重要的问题——你的开通路径是否合规。这一节是全文最重要的部分,请务必读完再动手。
先把口径说清楚:Anthropic 官方未对中国大陆地区个人直接开放 claude.ai 注册与 API 密钥申领。本文不提供、也不会教授任何绕过地区限制的方法,不涉及代理、虚拟卡、接码之类的绕路手段,也不会暗示这些手段可行。本文能给你的,是三条正路。
第一条,官方直连。如果你的所在地区在 Anthropic 官方支持列表内,可以直接走 Anthropic 官方平台注册并申领 API 密钥。支持地区列表以 Anthropic 官方页面实时显示为准,本文不转录、不猜测,因为这类列表会更新,过时的转录比不写更误事。
第二条,三大云企业合规路径。AWS Bedrock、Google Cloud Vertex AI、Microsoft Azure 三朵云与 Anthropic 官方平台同步上线了 claude-sonnet-5-5,这是官方公布的可用渠道。企业用户按各云自身的企业协议、账号体系与计费规则开通,走的是云厂商的合规通道,不需要也不应该寻找额外捷径。
第三条,国内开发者的合法替代路径。如果你在中国大陆且没有企业云资源,合法的选择是开源与国产模型:智谱 GLM 系列、月之暗面 Kimi 系列的开放权重与 API 都可以经 ModelScope 等平台或官方渠道合法获取。GLM 旗舰的能力拆解见本站 GLM-5.3 深度解析。对很多个人开发者来说,这条路的综合成本低于任何灰色手段,而且风险为零。
本文后续所有步骤,以第一条与第二条路径为前提。如果你的目标是第三条,可以直接跳到文末常见问题,以及上面这条内链。
时间线再对齐一句:claude-sonnet-5-5 于美东时间 2026 年 9 月 28 日发布,是 Claude 5.5 系列第二款模型,前作 Opus 5.5 于一周多前发布。本文所有口径截至 2026 年 10 月 5 日,全部价格为快照口径,以官方页面为准。
认识 claude-sonnet-5-5:模型 ID、定价与官方定位
调用一个模型,先记住它的身份证。API 里的模型 ID 是 claude-sonnet-5-5,全部小写、用连字符,不是 claude-sonnet-5.5,也不是 sonnet-5.5。在官方平台与三朵云上,模型 ID 的写法以各家模型目录页显示为准——云厂商有时会在官方 ID 基础上附加版本或区域后缀,调用前先到对应云的模型目录页核对一遍,这是最容易踩的拼写坑。
定价方面,官方快照口径:每百万 token 输入 2 美元、输出 10 美元、缓存读取 0.2 美元,与 Sonnet 5 持平。单价没涨,但官方口径称输出速度比 Sonnet 5 提升超过 30%,多数工作每任务成本最高降低 30%——省的是 token 用量,不是单价。这个价格放在当前编程模型市场里处于什么位置、和谁一组,本站 9 月底编程模型价格横评 已经做过完整的性价比对比,本篇不重复横评,只解决怎么调用。
能力口径挑调用者最需要的说:Terminal-Bench 4.0 得分 70.6%,而 Sonnet 5 只有 10.3%;CursorBench 4.0 得 55.5%,与 Opus 5.5 的 57.8% 接近;OSWorld 2.1 从 57.0% 升至 80.1%。翻译成调用者的语言:真跑在终端里的编程任务,这代 Sonnet 的完成率上了一个台阶;作为编程 agent 的骨干模型,它与自家旗舰的差距已经缩小到日常感知不出来的程度。发布背景与基准明细,见本站 Claude Sonnet 5.5 发布解读。
官方定位口径一句话:它是 Opus 5.5 的更快、更低成本互补,适合范围明确的日常任务、修 bug、做文档、幻灯片和表格。这句话直接决定你在第四步怎么给两个模型分工。
第一步:按你的身份选定开通入口
三条正路对应三类入口,先选定一个,再进入第二步。
- 官方直连,适合官方支持地区的个人与团队。入口是 Anthropic 官方平台的控制台。操作:注册账号、完成身份与支付信息、在控制台申领 API 密钥。预期结果:控制台显示你的 API 密钥,通常只显示一次,立即妥善保存,账户页显示当前额度与限流档位。
- AWS Bedrock,适合企业。入口是 AWS 控制台里的 Bedrock 服务。操作:用企业 AWS 账号登录,在 Bedrock 的模型目录中找到 Anthropic 模型,按页面提示为你的账号或区域申请开通访问权限。预期结果:模型目录中 Anthropic 模型状态变为可用,模型详情页显示你所在区域的接入方式。具体菜单名称与流程以 AWS 官方文档为准,本文不编控制台细节。
- Google Cloud Vertex AI,适合企业。入口是 Google Cloud 控制台的 Vertex AI 服务,模型位于 Model Garden。操作:登录企业 Google Cloud 账号,在 Model Garden 中搜索 Claude,按提示为项目启用。预期结果:模型详情页显示可启用状态,项目绑定完成。
- Microsoft Azure,适合企业。入口是 Azure AI Foundry 的模型目录。操作:登录企业 Azure 账号,在模型目录中找到 Claude 系列,按页面提示创建部署。预期结果:你获得该模型的部署资源,可以进入调用环节。
三个共同提醒。一,三朵云的开通都走云厂商自身的账号体系与企业协议,资质要求、区域可用性、计费方式各不相同,动手前先读对应云的官方页面。二,claude-sonnet-5-5 在三朵云与官方平台同步上线是官方口径,但各云各区域的上架节奏可能不同,模型目录里暂时搜不到,就等官方公告,不要找野路子。三,绝对不要通过第三方渠道购买来路不明的 API 密钥,密钥来源不合规的风险,远大于省下的那点钱。
第二步:跑通第一次 API 调用
拿到密钥或云端部署之后,这一步的目标是走通请求进、回答出的最小闭环,不追求优雅。
- 安装官方 SDK。直连用户装 Anthropic 官方 SDK,Python 用 anthropic 包,Node 生态有对应包;三朵云用户用对应云的 SDK 或兼容接口,具体包名以各云文档为准。预期结果:开发环境安装完成,import 不报错。
- 配置凭证。直连用户把 API 密钥放进环境变量,不要写死在代码里,更不要提交进版本库。三朵云用户按云的标准方式配置凭证。预期结果:程序运行时能读到凭证。
- 发出最小请求。模型参数填 claude-sonnet-5-5。直连用户的最小请求如下:
from anthropic import Anthropic
client = Anthropic() # 从环境变量读取 ANTHROPIC_API_KEY
resp = client.messages.create(
model="claude-sonnet-5-5",
max_tokens=1024,
messages=[{"role": "user", "content": "用一句话解释什么是API缓存"}],
)
print(resp.content[0].text)预期结果:终端打印出一句话回答。如果报模型不存在或无权限,先核对模型 ID 拼写,再核对密钥所属账号或区域是否已开通该模型,最后核对 SDK 版本是否过旧。
- 检查响应结构。Messages API 的返回中,正文在 content 数组里,token 用量在 usage 字段。预期结果:你能从 usage 中读出本次输入与输出的 token 数,乘以官方单价,就是这次调用的成本。养成每次看 usage 的习惯,账单失控都是从不好好看 usage 开始的。
- 建立你自己的基线。用同一条请求测一次简单问答,再测一次你真实业务的问题,记录耗时与 token 数。预期结果:你有了自己场景下的第一手基线数据,后面判断缓存值不值、要不要升级到 Opus,都用得上它。
错误处理记两个高频点:429 是限流,说明你触发了速率限制,按官方文档的退避建议等待重试,不要并发硬冲;400 类错误优先检查 messages 格式与 max_tokens 取值,九成是请求体写错了。
第三步:把缓存与零数据保留用进成本账
官方定价表里那个 0.2 美元的缓存读取价,是很多调用者漏掉的钱包出口。
缓存的适用场景很明确:长而重复的前缀。系统提示词、大段知识库文本、agent 的工具定义,这些每次请求都一样的内容,写入缓存后,后续请求按缓存读取价计费,只有标准输入价的十分之一。agent 与批处理场景里,缓存命中率直接决定月账单的量级;配合官方口径的每任务成本最高降 30%,长会话应用的省钱幅度相当可观。实操要点:把不变的内容放在提示词最前面,把每次变化的内容放在末尾,缓存才吃得满。
零数据保留选项是这次官方明确提供的能力:开通后,你的输入与输出不用于模型训练、不留存,对有合规要求的企业是硬需求。注意两点:一,它属于协议层面的选项,需要通过 Anthropic 官方平台或所购云的开通流程申请,具体入口与适用范围以官方页面为准;二,走三朵云的企业,数据治理条款同时受云厂商协议约束,两边的文档都要读。
想横向对照别家旗舰的调用体验与输出上限,本站 百万 token 输出横评 对比了当前几款模型的长任务表现,GPT-6.1 Sol API 上手 则是另一家旗舰的完整调用路径,两篇配合本篇读,选型判断会更完整。
第四步:在 Sonnet 5.5 与 Opus 5.5 之间做场景分工
官方定位口径给出了清晰的分工线:范围明确的日常任务、修 bug、做文档、幻灯片、表格,交给 Sonnet 5.5,它更快、每任务更便宜;复杂的长任务与更高难度的推理,交给 Opus 5.5。
两个决策参考。一,CursorBench 4.0 上 55.5% 对 57.8% 的接近程度说明,多数日常编程任务里两者差距已经很小,按预算选不亏;GDPval-AA 上 Sonnet 5.5 仅比 Opus 5.5 低 2 分,同一方向再佐证一次。二,如果你用 Claude Code,它已与 Sonnet 5.5 同日整合,订阅用户在客户端里直接选用,不必自己写调用代码;API 用户则在请求参数里选模型。一个务实策略:主力跑 Sonnet 5.5,个别卡壳的任务升级 Opus 5.5 重试,这是官方定位下最省钱的组合。
另外一句给企业选型者:这代 Sonnet 首次配上了与 Opus 同级的网络安全防护机制,高风险网络安全请求可自动回退到 Sonnet 5,并新增了防推理提取的安全分类器。对要把模型接进生产流程的团队,这类安全口径值得写进评估表。
如果你的存量代码还在跑旧一代 Claude 模型,本站 Claude Fable 5.1 API 迁移 SOP 覆盖的是旧模型迁移的完整检查单——那篇解决从旧模型搬过来的问题,本篇解决从零上手 5.5 的问题,两篇分工不同,按你的起点选读即可。
常见问题
**Q1:**中国大陆个人开发者能直接注册 Anthropic 的 API 吗? A1:不能。Anthropic 官方未对中国大陆地区个人直接开放注册与 API 申领,本文不提供任何绕过方法。正路有三条:企业走三大云合规开通;个人开发者考虑 GLM、Kimi 等开源或国产模型的合法 API;身处官方支持地区的用户按官方页面正常注册。合法路径的成本与风险都优于灰色手段。
**Q2:**claude-sonnet-5-5 和旧的 claude-sonnet-5 在调用上有什么区别? A2:模型 ID 不同;价格持平,输入 2 美元、输出 10 美元、缓存 0.2 美元每百万 token;官方口径速度提升超 30%,每任务成本最高降 30%。旧模型 ID 是否继续可用、何时退役,以官方公告为准,迁移前不要假设旧 ID 长期有效。
**Q3:**三朵云上的价格和官方一样吗?选哪家更便宜? A3:2 美元、10 美元、0.2 美元是 Anthropic 官方快照口径。三朵云各有自己的计价、折扣与企业协议,实际价格以各云模型目录页为准。本文不做云间比价,企业采购建议按实际用量与协议条款谈,个人项目按所在云的按量计费先跑小额验证。
**Q4:**零数据保留选项在哪里开通? A4:它是协议层面的企业选项,通过 Anthropic 官方平台或所购云的开通流程申请,不在普通控制台菜单里。具体入口、适用范围与审核要求以官方页面为准,本文不编操作细节。
**Q5:**不想写代码,能用上 Sonnet 5.5 吗? A5:可以。Claude Code 已在同日整合该模型,订阅用户在客户端里直接选用,官方定位里的日常编程任务、修 bug、写文档正是它的舒适区;API 通道更适合要把模型接进自家产品的开发者。
互动
你走的是三朵云里的哪一条,还是官方直连?第一次调用踩了什么坑,缓存给你的账单省了多少?欢迎在评论区留下你的开通路径与成本数据,给后来的读者当参照。如果你在 Sonnet 5.5 与其他旗舰之间还没选定型,先读前面提到的价格横评与百万输出横评再动手,按需求选型比追新省钱。
参考来源
- Anthropic 官网与透明度页面(一手口径):发布时间、模型 ID、定价、三云同步上线、Claude Code 同日整合、零数据保留选项、安全机制、官方支持地区口径
- Reuters(2026-09-28):发布报道与企业客户占比背景
- TechNews 台湾(2026-09-29)、INSIDE、机器之心:发布口径与基准数据转述
本文基于官方口径与媒体报道整理(截至 2026-10-05),非官方合作推广。全部价格为快照口径,开通条件、地区列表、模型可用性与实时价格均以 Anthropic 及各云厂商官方页面实时显示为准。