RikkaHub Claude 模型目录与能力发现实践:Model ID、Models API 与 Adaptive Thinking 的权威落地指南

发布时间:2026/9/27 9:03:20
RikkaHub Claude 模型目录与能力发现实践:Model ID、Models API 与 Adaptive Thinking 的权威落地指南
人工智能大模型AI 应用移动开发交互助手【免费下载链接】rikkahubRikkaHub is an Android APP that supports for multiple LLM providers.项目地址https://gitcode.com/gh_mirrors/ri/rikkahub点击查看免费下载本文以 RikkaHub 仓库内置的 Claude API 技能文档.agents/skills/claude-api/shared/models.md为骨架系统讲解 Claude 模型 ID 的权威来源、Models API 的程序化能力发现方式并结合仓库中 ClaudeProvider.kt 的真实实现说明一个多 LLM 提供商 Android 客户端如何消费这份模型目录、把effort与自适应思考等能力映射到请求参数上。读完本文你将掌握如何避免模型 ID 拼写错误、如何按能力视觉 / 思考 / effort / 结构化输出在运行时筛选模型、以及 RikkaHub 如何用同一套目录驱动 Claude 提供商。一、为什么必须使用精确的模型 IDClaude 模型的 API 调用以精确模型 ID为第一前置条件。RikkaHub 的 Claude 技能文档开宗明义只能使用文档中列出的精确模型 ID绝不猜测或拼接——错误的 ID 会直接导致 API 报错。正确做法是优先使用别名Alias如claude-opus-4-8、claude-sonnet-5、claude-haiku-4-5不要为别名追加日期后缀如写成claude-opus-4-6-20251101会 404需要最新数据时WebFetchshared/live-sources.md中的官方 Models Overview 页面或直接调用 Models API见下文程序化模型发现。这一约束在仓库源码中同样成立ClaudeProvider的请求体把params.model.modelId原样写入model字段见 ClaudeProvider.kt模型 ID 的合法性完全依赖模型目录的正确维护。二、程序化模型发现通过 Models API 获取实时能力数据缓存的表格可能滞后于线上发布。当用户询问某模型的上下文窗口是多少是否支持视觉 / 思考 / effort哪些模型支持某能力或希望在运行时按能力选模型时应查询 Models API而非依赖缓存表。Python SDK 方式m client.models.retrieve(claude-opus-4-8) m.id # claude-opus-4-8 m.display_name # Claude Opus 4.8 m.max_input_tokens # context window (int) m.max_tokens # max output tokens (int) # capabilities 是未类型化的嵌套 dict —— 用括号访问检查叶子节点的 [supported] caps m.capabilities caps[image_input][supported] # vision caps[thinking][types][adaptive][supported] # adaptive thinking caps[effort][max][supported] # effort: max另有 low/medium/high caps[structured_outputs][supported] caps[context_management][compact_20260112][supported] # 遍历全部模型做能力过滤 —— 直接迭代 page 对象自动分页不要用 .data [m for m in client.models.list() if m.capabilities[thinking][types][adaptive][supported] and m.max_input_tokens 200_000]要点顶层字段id、display_name、max_input_tokens、max_tokens是类型化属性可直接点访问capabilities是dict必须用括号访问而非属性访问API 会对每个模型返回完整的能力树每个叶子节点都是supported: true/false因此括号链访问是安全的无需.get()兜底TypeScript SDK 方法名相同迭代同样自动分页。Raw HTTP 方式curl https://api.anthropic.com/v1/models/claude-opus-4-8 \ -H x-api-key: $ANTHROPIC_API_KEY \ -H anthropic-version: 2023-06-01返回示例{ id: claude-opus-4-8, display_name: Claude Opus 4.8, max_input_tokens: 1000000, max_tokens: 128000, capabilities: { image_input: {supported: true}, structured_outputs: {supported: true}, thinking: {supported: true, types: {enabled: {supported: false}, adaptive: {supported: true}}}, effort: {supported: true, low: {supported: true}, …: {}, max: {supported: true}}, …: {} } }仓库佐证RikkaHub 的ClaudeProvider.listModels()正是按这套响应结构实现的——请求${baseUrl}/models携带x-api-key与anthropic-version: 2023-06-01源码中的ANTHROPIC_VERSION常量解析data数组逐条取出id与display_name构造成Model见 ClaudeProvider.kt。也就是说RikkaHub 客户端在模型列表页面展示的就是这个 Models API 的实时结果与技能文档中的目录互为印证。三、当前模型目录推荐使用Friendly NameAlias请使用此 IDFull ID上下文窗口最大输出状态Claude Fable 5claude-fable-5—1M128KActiveClaude Mythos 5claude-mythos-5—1M128KActive仅 Project GlasswingClaude Opus 4.8claude-opus-4-8—1M128KActiveClaude Opus 4.7claude-opus-4-7—1M128KActiveClaude Opus 4.6claude-opus-4-6—1M128KActiveClaude Sonnet 5claude-sonnet-5—1M128KActiveClaude Sonnet 4.6claude-sonnet-4-6—1M128KActiveClaude Haiku 4.5claude-haiku-4-5claude-haiku-4-5-20251001200K64KActive注意Fable 5 / Mythos 5 / Opus 4.x / Sonnet 5 及 4.6 均无公开的日期后缀 Full ID—表示别名即官方 ID只有 Haiku 4.5 保留了20251001的完整 ID 形态。模型定位速览Claude Fable 5—— Anthropic 目前广泛发布的最强模型面向最苛刻的推理与长周期 Agent 工作。API 表面与 Opus 4.7/4.8 一致但有一处破坏性变更显式传thinking: {type: disabled}会返回 400应直接省略thinking参数思考始终开启原始思维链永不返回如需摘要可传display: summarized。与 Opus 4.8 共用同一 tokenizertoken 计数与 4.7/4.8 大致持平。安全分类器可能返回stop_reason: refusal不支持 assistant prefill要求 30 天数据留存不适用于 ZDR 模式定价 $10/$50 每 MTok默认 1M 上下文、128K 最大输出。迁移路径见 .agents/skills/claude-api/shared/model-migration.md。Claude Mythos 5—— 能力、定价、限额与 API 行为与 Fable 5 完全一致仅模型 ID 不同。仅通过 Project Glasswing 提供是邀请制claude-mythos-preview的继任者只有组织参与了 Project Glasswing 才使用否则一律用claude-fable-5。Claude Opus 4.8—— Opus 梯队最强模型高度自主在长周期 Agent 工作、知识工作与记忆任务上表现突出写作更清晰、更温暖。API 表面与 4.7 相同仅自适应思考budget_tokens与采样参数均已移除。1M 上下文按标准 API 定价无长上下文溢价。Claude Opus 4.7—— 上一代 Opus高度自主长周期 Agent、知识工作、视觉与记忆均强。仅自适应思考采样参数与budget_tokens已移除1M 上下文。Claude Opus 4.6—— 较老一代 Opus支持自适应思考推荐128K 最大输出大输出需开启流式1M 上下文。Claude Sonnet 5—— Sonnet 梯队中速度与智能结合最好的模型编码与 Agent 工作接近 Opus 质量。默认开启自适应思考省略thinking即运行 adaptive手动budget_tokens已移除非默认采样参数会被拒绝。effort支持low/medium/high/xhigh/max。新 tokenizer同样文本比 Sonnet 4.6 多约 30% token。高分辨率视觉2576px。1M 上下文、128K 最大输出。Claude Sonnet 4.6—— 上一代 Sonnet支持自适应思考推荐1M 上下文128K 最大输出。Claude Haiku 4.5—— 简单任务中最快、最具成本效益的模型。四、模型状态分级Legacy / Deprecated / RetiredLegacy 模型仍在服务Friendly NameAliasFull ID状态Claude Opus 4.5claude-opus-4-5claude-opus-4-5-20251101ActiveClaude Opus 4.1claude-opus-4-1claude-opus-4-1-20250805Deprecated2026-08-05 退役请迁移至claude-opus-4-8Claude Sonnet 4.5claude-sonnet-4-5claude-sonnet-4-5-20250929ActiveDeprecated 模型即将退役Friendly NameAliasFull ID状态退役时间Claude Sonnet 4claude-sonnet-4-0claude-sonnet-4-20250514DeprecatedTBDClaude Opus 4claude-opus-4-0claude-opus-4-20250514DeprecatedTBDClaude Haiku 3—claude-3-haiku-20240307Deprecated2026-04-19Retired 模型已不可用请求将 404Friendly NameFull ID退役时间Claude Sonnet 3.7claude-3-7-sonnet-202502192026-02-19Claude Haiku 3.5claude-3-5-haiku-202410222026-02-19Claude Opus 3claude-3-opus-202402292026-01-05Claude Sonnet 3.5claude-3-5-sonnet-202410222025-10-28Claude Sonnet 3.5claude-3-5-sonnet-202406202025-10-28Claude Sonnet 3claude-3-sonnet-202402292025-07-21Claude 2.1claude-2.12025-07-21Claude 2.0claude-2.02025-07-21已经退役的模型返回 404必须立即更新。对应的替换方案如claude-3-opus-20240229→claude-opus-4-8、claude-3-5-haiku-20241022→claude-haiku-4-5收录在 .agents/skills/claude-api/shared/model-migration.md 的 Retired Model Replacements 表中。五、按用户表述解析模型 ID文档提供了一张用户说什么 → 用哪个模型 ID的映射表是对话式应用如 RikkaHub 的 AI 助手做模型选择时的直接依据用户说…应使用的模型 IDfable、最强大的模型claude-fable-5most powerfulclaude-fable-5mythos、mythos 5claude-mythos-5仅 Project Glasswing 参与者否则用claude-fable-5mythos previewclaude-mythos-5claude-mythos-preview的继任者见迁移指南opusclaude-opus-4-8opus 4.8claude-opus-4-8opus 4.7claude-opus-4-7opus 4.6claude-opus-4-6opus 4.5claude-opus-4-5opus 4.1claude-opus-4-1已废弃2026-08-05 退役——建议claude-opus-4-8opus 4、opus 4.0claude-opus-4-0已废弃——建议claude-opus-4-8sonnet、balancedclaude-sonnet-5sonnet 5claude-sonnet-5sonnet 4.6claude-sonnet-4-6sonnet 4.5claude-sonnet-4-5sonnet 4、sonnet 4.0claude-sonnet-4-0已废弃——建议claude-sonnet-5sonnet 3.7已退役——建议claude-sonnet-5sonnet 3.5已退役——建议claude-sonnet-5haiku、fast、cheapclaude-haiku-4-5haiku 4.5claude-haiku-4-5haiku 3.5已退役——建议claude-haiku-4-5haiku 3已废弃——建议claude-haiku-4-5六、仓库落地RikkaHub 如何消费这份模型目录6.1 模型列表实时拉取 Models APIClaudeProvider.listModels()直接请求${baseUrl}/models用x-api-keyanthropic-version: 2023-06-01认证解析响应的data数组把每个元素的id/display_name映射为Model见 ClaudeProvider.kt。这与文档第三节表格的数据同源目录是快照Models API 是实时两者互相校验。6.2 请求构造模型 ID 自适应思考 effortbuildMessageRequest()把params.model.modelId写入请求体model字段ClaudeProvider.kt默认max_tokens 64_000。更重要的是它对思考能力的映射——源码注释明确写道Anthropic 新 APIadaptive 模式 output_config.effort 控制强度旧的 typeenabled budget_tokens 在 Opus 4.7 上已不支持与模型目录中 Opus 4.7/4.8 的描述完全一致ReasoningLevel.OFF→thinking: {type: disabled}ReasoningLevel.AUTO→thinking: {type: adaptive, display: summarized}其余档位 → 同样开启 adaptive summarized并追加output_config: {effort: 档位}6.3 档位到 effort 的映射RikkaHub 在 Reasoning.kt 中定义了完整的推理档位枚举每个档位同时携带budgetTokens兼容旧式思考预算与effort新式强度ReasoningLevelSerialNamebudgetTokenseffortOFFoff0noneAUTOauto-1autoLOWlow1,000lowMEDIUMmedium2,000mediumHIGHhigh8,000highXHIGHxhigh16,000xhighMAXmax32,000max其中XHIGH16K 预算 /xhigh正是模型目录中 Sonnet 5 与 Opus 4.7 引入的档位RikkaHub 的枚举与之对齐。此外还有fromBudgetTokens()兼容函数把历史遗留的budget_tokens数值就近归入上述档位便于旧配置平滑迁移。6.4 能力标签与内置工具模型目录提到的能力视觉、思考、结构化输出等在 RikkaHub 中被抽象为ModelAbility枚举TOOL与REASONING见 Model.kt。ClaudeProvider依据ModelAbility.REASONING决定是否写thinking参数依据ModelAbility.TOOL决定是否装配 tools内置的BuiltInTools.Search在 Claude 侧被翻译为{type: web_search_20250305, name: web_search}ClaudeProvider.kt。6.5 Anthropic 兼容端点RikkaHub 默认提供商中的 MiniMax 即配置为 Anthropic 兼容协议端点https://api.minimaxi.com/anthropic/v1见 DefaultProviders.kt说明同一份 Claude 模型目录与请求构造逻辑也可以服务第三方兼容网关——这正是多 LLM 提供商架构的价值模型 ID 目录与协议实现解耦新增兼容端点只需一条 Provider 配置。6.6 流式与 pause_turn对于 128K 级大输出目录强调流式是必须的。RikkaHub 的streamText()使用 OkHttp SSE 走/messages流式接口配合ClaudeStreamDecoder解析事件同时实现pause_turn续写逻辑generateClaudeWithPauseTurn/streamClaudeWithPauseTurn最多 5 次续写并在合并多次响应时对 server tool 的 content block index 做重定基rebase保证多轮工具调用回放顺序正确ClaudeProvider.kt。七、配套文档与获取最新信息的路径模型迁移指南.agents/skills/claude-api/shared/model-migration.md覆盖各代模型的破坏性变更budget_tokens→ adaptive、采样参数移除、prefill 400、effort档位选择、thinking.display默认值变化、tokenizer 更新带来的 token 计数差异等以及退役模型的逐项替换表是升级模型 ID 时的完整检查清单。实时文档源.agents/skills/claude-api/shared/live-sources.md收录官方 Models Overview、Migration Guide、Pricing、Extended/Adaptive Thinking、Effort 等主题的 WebFetch 地址与提取提示。当缓存数据疑似过期、用户要求最新信息、或文档未覆盖的新功能出现时应优先从中获取实时资料再与本文目录交叉验证。八、小结一份可靠的 Claude 模型目录需要同时具备三个要素精确且可解析的 ID别名优先、不拼接日期后缀、可实时验证的能力数据Models API 的能力树按需查询、以及明确的状态生命周期Active / Deprecated / Retired 分层管理。RikkaHub 的做法给出了一个可复用的工程范式技能文档维护目录快照供 Agent 离线决策客户端代码直接消费 Models API 提供实时视图再把effort、adaptive thinking、能力标签等概念映射为统一的内部抽象ReasoningLevel、ModelAbility最终让同一套模型目录服务于第一方 API 与第三方 Anthropic 兼容网关。对于任何接入 Claude API 的客户端或 Agent遵循这份目录的 ID 规范与能力查询路径都能避免绝大多数因模型 ID 错误或能力误判引发的线上故障。赞分享人工智能大模型AI 应用移动开发交互助手【免费下载链接】rikkahubRikkaHub is an Android APP that supports for multiple LLM providers.项目地址https://gitcode.com/gh_mirrors/ri/rikkahub点击查看免费下载相关推荐在 RikkaHub 中集成 Claude API模型选型、Thinking、提示缓存、流式输出与工具调用的工程实践在 RikkaHub 中集成 Claude API模型选型、Thinking、提示缓存、流式输出与工具调用的工程实践 导读 Claude APIAnthro人工智能大模型AI 应用移动开发交互助手Claude Managed Agents 四拍上手指南从任务描述到可运行会话的落地全流程RikkaHub claude-api 技能库实践Claude Managed Agents 四拍上手指南从任务描述到可运行会话的落地全流程RikkaHub claude api 技能库实践 本文基于仓库人工智能大模型AI 应用移动开发交互助手scientific-agent-skills 之 generate-imageOpenRouter 图像模型目录models.md权威参考与实践指南scientific agent skills 之 generate imageOpenRouter 图像模型目录models.md权威参考与实践指南 在AI 技能科研生物信息学数据科学上一篇从安装到部署create-llama一站式LlamaIndex开发教程下一篇PingFangSC字体深度解析揭秘苹果级中文显示背后的技术奥秘创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考