sale/claude-haiku-5-5

sale/claude-haiku-5-5

[限时8.5折] Anthropic 家族中高速、低成本的轻量级大模型
2026-10-09
语言大模型
Model capability: imageModel capability: thinkingModel capability: function_call
缓存写入:
$0.1063/1M tokens起
缓存读取:
$0.0085/1M tokens起
输入:
$0.085/1M tokens起
输出:
$0.425/1M tokens起
大额采购联系客户经理享专属优惠

API介绍

特价版来自于AWS/官方/Azure/Vertex混合云,纯净API无逆向。


Claude Haiku 5.5 是 Anthropic 家族中速度最快、成本极低的高吞吐轻量级大模型。作为 Claude 5.5 世代的极致性价比模型,Haiku 5.5 的 API 输入价格相比前代大幅下调,直接对标 OpenAI 的 GPT-6 Luna。模型首次在 Haiku 级别引入了自适应思考机制,在保持毫秒级首字延迟(TTFT)与极高 TPS 的同时,大幅提升了对复杂指令的遵循能力与多步骤逻辑判别准确率。Haiku 5.5 支持高达 1M 的上下文窗口,非常适合作为子 Agent 执行高并发的轻量级任务。

───────────────────────────────────────────────────────────────────

核心能力

冰点成本与高吞吐: 输入单价低至 $0.10 / 1M Tokens,相比前代降价幅度巨大,是批量部署高并发 AI 应用的极致性价比选择。

首次支持自适应 Reasoning Effort: 继承了 5.5 世代的自适应思考能力,可根据任务需要开启并调节 Low / Medium / High 推理深度,在极低延迟与深层逻辑之间自由切换。

首屈一指的 Subagent 协作单元: 极适合与 Opus 5.5 或 Fable 5.1 等高阶模型搭配,作为长工作流中的并行子 Agent 执行具体的子任务。

1M 超长上下文与 512-Token 极低缓存门槛: 默认支持 1M Tokens 超长上下文窗口,原生支持 Prompt Caching 提示词缓存。

Playground

登录后,探索更多精彩功能! 点击登录

API统计

API列表 (7)

API描述接口地址请求方法稳定性参数说明
Chat(聊天)
POST
稳定
查看详情
Chat(分析图片)
POST
稳定
查看详情
Chat(函数调用)
POST
稳定
查看详情
Messages(原始格式)
POST
稳定
查看详情
Messages(函数调用)
POST
稳定
查看详情
Messages(思考模式)
POST
稳定
查看详情
Messages(Claude Code专用)
POST
稳定
查看详情

API价格表

$¥ 円 ₽
模型说明上下文官网原价302.AI价格官网价差

claude-haiku-5-5

≤ 100K Tokens
100000

缓存写入$0.125 / 1M tokens
缓存读取$0.01 / 1M tokens
输入$0.1 / 1M tokens
输出$0.5 / 1M tokens

缓存写入$0.1063 / 1M tokens
缓存读取$0.0085 / 1M tokens
输入$0.085 / 1M tokens
输出$0.425 / 1M tokens

15%

claude-haiku-5-5

> 100K Tokens
1000000

缓存写入$0.625 / 1M tokens
缓存读取$0.05 / 1M tokens
输入$0.5 / 1M tokens
输出$2.5 / 1M tokens

缓存写入$0.53125 / 1M tokens
缓存读取$0.0425 / 1M tokens
输入$0.425 / 1M tokens
输出$2.125 / 1M tokens

15%