你需要使用无限续杯还是 API 直连?

无限续杯

在有效期内无限使用全站模型(非中转站)。

无限续杯套餐最低 1.9 元起/天,无限额度使用

需要使用续杯工具

去使用无限续杯

API 直连

创建指定 API Key 进行模型调用。

API 无限套餐比无限续杯贵 20%

去使用 API 直连
无限续杯:有效期内全站模型无限用 去看看
Model Square · 模型广场

模型广场

聚合全球主流大模型,按品牌分类浏览。点击模型名旁「复制」可复制完整模型名,用于 API 调用。

上新

GPT-6-Astra-max

1M 上下文推理函数调用视觉理解网页搜索文件搜索提示缓存结构化输出MCP

GPT-6 Astra 是 OpenAI 首款 6 系列模型,于 2026 年 9 月 3 日发布,面向软件开发、浏览器操作、研究和专业应用中的复杂端到端工作。模型 ID 为 GPT-6-Astra-max。它结合可配置推理、Computer Use 能力和 1.05M token 上下文窗口,适合长时间运行、工具密集型工作流。

上新

claude-fable-5-1-thinking-max

1M 上下文最新fable自适应思考长周期自主 Agent高阶软件工程高精度多模态视觉百万级上下文极限推理预算多路径交叉验证

Fable-5.1 极限推理档位,拉满思考预算,支持多路径并行推演与交叉复盘,推理准确率拉满,耗时更高,专为零容错硬核难题、高风险终审决策设计,安全策略与标准版一致。

上新

Claude-Opus-5.5-Thinking-Max

1M 上下文原生全模态复杂软件工程任务代码生成

Claude Opus 5.5 是 Anthropic 于 2026 年 9 月 22 日发布的模型,面向长期软件工程、自主 Agent 和专业知识工作。在宇天AI 上使用的模型 ID 为 claude-opus-5.5-Thinking-Max。该模型结合 1M Token 上下文窗口与始终开启的自适应思考能力。

上新

GPT-6-Sol-MAX

1M 上下文函数调用视觉理解网页搜索文件搜索提示缓存结构化输出MCP

GPT-6 Sol 是 OpenAI 于 2026 年 9 月 22 日发布的 GPT-6 模型,面向复杂软件工程与 Agent 工作流,并兼顾能力与成本。模型 ID 为 GPT-6-Sol-MAX,支持可配置推理、视觉输入和 1,050,000 Token 上下文窗口。

Claude-Fable-5-Thinking-Max

1M 上下文自适应思考长周期自主 Agent高阶软件工程高精度多模态视觉百万级上下文极限推理预算多路径交叉验证

Fable-5 极限推理档位,拉满思考预算,支持多路径并行推演与交叉复盘,推理准确率拉满,耗时更高,专为零容错硬核难题、高风险终审决策设计,安全策略与标准版一致。

Claude-Fable-5-Thinking-High

1M 上下文自适应思考长周期自主 Agent高阶软件工程高精度多模态视觉百万级上下文

公开版神话级旗舰,常驻自适应思考,全能型强推理、编码、多模态模型,带企业安全护栏,适配长流程、高复杂度企业级任务与长周期 Agent 自动化

Claude-Opus-5-Thinking-Max

1M 上下文继承 Opus-5 全部标签增强推理深度多方案校验高精度输出

Opus-5 的高算力推理档位,提升思考深度与自检强度,输出精度更高、容错率更低,适用于高严谨度、低容错的专业任务场景,响应耗时更长。

GPT-5.6-Sol-Max-Fast

1M 上下文推理函数调用视觉理解网页搜索文件搜索提示缓存结构化输出MCP

GPT-5.6 家族旗舰,适合高难度编码、深度推理和长时程 Agent。Max 是最深推理档,Fast 是同一模型优先加速,不改上下文。

Claude-Opus-5-Thinking-High

1M 上下文深度逻辑推理全栈编码能力、专业多模态解析企业级安全合规长链路任务编排

新一代 Opus 旗舰模型,推理深度与编码能力全面升级,稳定性与可靠性拉满,适配高要求企业级复杂推理、专业研发与深度分析场景。

Kimi-K3

1M 上下文旗舰3T开源原生视觉视频强制深度推理长时程编程知识工作自动缓存

Kimi 最强旗舰,2.8T 参数、全球首个开源 3T 级。面向长时程编程、知识工作和深度推理。思考必须开,推理档 low / high / max,默认 max。

Claude-Opus-4.8-Thinking-Max

1M 上下文极限深度思考多路径交叉验证全链路复盘纠错高精度编码推理严格安全合规零容错任务适配

Opus-4.8 的极限思考档位,拉满全局思考预算,支持多方案并行推演、全流程复盘校验,推理精度为 4.8 系列天花板,响应耗时显著增加,专为高严谨度、低容错的专业硬核任务设计。

Claude-Opus-4.8-Thinking-High

1M 上下文深度思考推理多步自检纠错稳定编码能力基础多模态支持严格安全策略高可靠复杂任务

Opus-4.8 的高阶思考档位,内置长链路深度思考过程,对复杂任务自动分步拆解、中途自检纠错,推理准确率与稳定性优于标准版,响应耗时更长,适配中等以上难度的严谨推理、研发与分析场景。

Claude-Opus-4.7-Thinking-Max

1M 上下文极限深度思考多路径交叉验证全链路复盘纠错高精度编码推理标准安全合规

Opus-4.7 的极限思考档位,拉满全局思考预算,支持多方案并行推演与全流程复盘校验,推理精度为 4.7 系列天花板,响应耗时显著增加,适用于高严谨度、低容错的专业任务场景。

Claude-Opus-4.7-Thinking-High

1M 上下文深度思考推理分步自检纠错常规编码支持多模态基础能力标准安全防护

Opus-4.7 的高阶思考档位,内置长链路深度思考过程,自动拆解复杂任务并中途自检纠错,推理准确率优于标准版,响应耗时更长,适配中等难度的严谨推理、研发与分析场景。

Kimi-K2.7-Code

256K 上下文专用编程强制思考长上下文跟指令少过度思考图视工具调用可开高速档

imi 专用编程模型。比 K2.6 更跟指令、长时程编码成功率更高,过度思考约少 30%。思考必须开且保留思考;另有高速版约 180 token/s。

Claude-Opus-4.6-Thinking-Max

1M 上下文无约束极限思考多路径推演验证全链路复盘纠错高精度数理推理长文档深度处理标准安全合规

Opus 4.6 系列最高思考档位,拉满无约束思考预算,通过多路径推演、结果复盘校验实现该版本最高推理精度;为旧版扩展思考模式,响应耗时显著增加,原生输出长度有限,适合短链路高严谨度的专业推理、复杂问题求解场景。

Claude-Opus-4.6-Thinking-High

1M 上下文扩展深度思考分步自检纠错高阶逻辑推理专业编码支持长文档处理标准安全防护

基于 Opus 4.6 原生扩展思考模式的高阶档位,固定 high 级思考预算,自动分步拆解任务、中途自检纠错,推理准确率显著优于标准版;支持测试版百万上下文,不支持穿插式思考与工具联动,适配中等难度的严谨推理、长文档分析与常规编码任务。

Claude-Opus-4.5-Thinking-Max

1M 上下文极限深度思考多路径推演校验初代旗舰推理基础编码能力初代视觉解析基础安全合规

Opus 4.5 系列最高思考档位,拉满官方思考预算,通过多路径并行推演与结果复盘校验达到该版本推理精度上限;响应耗时显著增加,原生输出长度较短,仅适合短链路高严谨度的复杂问题求解与深度推理场景。

Claude-Opus-4.5-Thinking-High

1M 上下文顶级智能水平强大视觉理解长上下文处理复杂系统分析高端科研分析初代旗舰推理

Opus 4.5 的高阶思考档位,基于官方原生扩展思考机制,固定高阶思考预算,通过任务分步拆解与中途自检纠错提升推理准确率;为早期思考增强实现,原生输出长度有限,适配短链路、中等复杂度的严谨推理与基础分析场景。

GPT-5.5-Extra-High

1M 上下文原生全模态复杂软件工程任务代码生成

GPT-5.5 是 OpenAI 于 2026 年 4 月 23 日发布的最强模型,内部代号为 “Spud”。它是自 GPT-4.5 以来首个完整重新训练的基础模型,此前所有 GPT-5 版本都属于在同一基础模型上的后训练迭代。GPT-5.5 采用原生全模态架构,支持 100 万 token 上下文窗口,并在发布时领跑 14 项基准测试。

Claude-Sonnet-5-Thinking

1M 上下文自适应思考(默认启用)前沿推理编程电脑操作智能体编排工具调用视觉(文本+图像)长上下文多语言

Anthropic 当前最强 Sonnet。Adaptive Thinking 默认启用、无需配置;自动判断何时深入推理。编程、工具使用、代理规划全面升级,性能接近 Opus 4.8 但价格更低。

Claude-Sonnet-4.6-Thinking

1M 上下文自适应思考扩展思考(已弃用)前沿推理编程电脑操作智能体编排上下文感知工具调用视觉(文本+图像)多语言

混合推理 Sonnet。支持 Adaptive Thinking(推荐)和 Extended Thinking;1M 上下文、上下文压缩。编码、长文档推理、智能体长视野规划的平衡选择。

Kimi-K2.6

256K 上下文通用多模态思考可开关保留式思考长时程编码指令自纠错Agent执行

通用多模态模型,长时程编码、指令遵循和自纠错比 K2.5 更稳。思考默认可关,并支持保留式思考,适合对话、视觉理解和 Agent。

Claude-Sonnet-4.5-Thinking

200K 上下文基础深度思考分步逻辑拆解日常编码支持标准多模态高性价比高吞吐量

Claude Sonnet 4.5 是 Anthropic 推出的平衡型 AI 模型,在接近旗舰级智能的同时提供更低成本,是企业规模化部署 AI 的理想选择。

Kimi-K2.5

256K 上下文开源通用SoTA图文视频输入思考可开关Agent任务无保留式思考

开源期 Agent、代码、视觉理解曾达 SoTA 的通用多模态模型。思考默认可关,不支持保留式思考。K3 上线后新用户不可用,平台将于 8 月 31 日下线。

Qwen3.8-Max

1M 上下文2.4T旗舰原生视觉视频超长自主编程专业任务交付长视频解析闭环迭代

通义迄今最强旗舰,2.4T MoE,原生视觉。官方称可自主编程十数天交付完整项目,并覆盖法律、金融、设计等专业交付。

GPT-5.6-Terra-Max-Fast

1M 上下文智力成本折中日常专业工作常规Agent编码多步工具使用更快更省

GPT-5.6 中档,对应早期 mini,智力接近日常主力、价格低于 Sol,适合常规专业开发和多步 Agent。Max 拉满思考,Fast 只加速排队。

MiniMax-M3

1M 上下文原生多模态百万上下文Agent推理前沿编码长视频理解桌面操作

最新 M 系旗舰,官方称开源里首个同时具备前沿编码、百万上下文和原生多模态。MSA 稀疏注意力,思考可开 / 自适应 / 关闭。

GPT-5.4-Nano-Medium

1M 上下文廉价高吞吐分类抽取排序轻量子代理结构化任务中等推理

GPT-5.4 是 OpenAI 于 2026 年 3 月 5 日发布的前沿模型。它是首个将推理(Reasoning)、编程(源自 GPT-5.3-Codex)和计算机操作(Computer Use)统一到单一架构中的主流模型。该模型支持高达 1,050,000 token 的上下文窗口以及 128,000 token 的最大输出,适合高级、广覆盖的复杂任务场景。

MiniMax-M2.7-highspeed

204K 上下文同性能加速约100tps真实工程精确重构低延迟

与 M2.7 同能力的高速档,官方约 100 tps(标准档约 60)。结果一致、更敏捷,适合要速度的工程和 Agent。

MiniMax-M2.5-highspeed

200K 上下文同性能加速约100tps复杂任务性价比多语言编码低延迟

与 M2.5 同能力的高速档,官方约 100 tps。性能不变、推理更快,适合复杂编码和重构的低延迟场景。

Grok-4.6-Extra-High-Fast

500K 上下文长时程Agent超高推理指令跟随知识工作交互视觉Fast优先加速

Cursor 与 SpaceXAI 联合的前沿模型,面向复杂编码、知识工作和长时程 Agent。Extra High 是官方 xhigh,最深推理、延迟更高;Fast 只加速排队,默认在 Pro 及以上。

GLM-5.3

1M 上下文文本模型旗舰极速代码生成

近前沿智能的最快模型,低成本高并发实时场景。

Qwen3.7-Max

1M 上下文智能体旗舰长周期自主办公生产力函数调用联网搜索上下文缓存

3.7 系列最大最强 Max,智能体时代旗舰。强在编程、办公生产和长周期自主。当前主别名按官方为纯文本(等同 2026-05-20 快照)。

gpt-5.2-Medium-Fast

400K 上下文上一代前沿复杂专业工作可配置推理中等推理Fast优先加速

GPT-5.2 是 OpenAI 的一款大语言模型,重点优化了多模态处理速度与复杂任务执行效率。在 5.1 的基础上,它进一步提升了多模态处理表现与复杂流程的执行效率,适合高要求的专业使用场景。

Grok-4.5-Extra-High-Fast

500K 上下文长时程Agent超高推理指令跟随知识工作交互视觉Fast优先加速

Cursor 与 SpaceXAI 联合的前沿模型,面向复杂编码、知识工作和长时程 Agent。Extra High 是官方 xhigh,最深推理、延迟更高;Fast 只加速排队,默认在 Pro 及以上。

Gemini-3.7-Flash

1M 上下文最强干活马软件工程网页开发思考分档文档理解生产级代码

Google 自称迄今最聪明的 Flash 干活马。相对 3.6 强化软件工程、知识工作和网页开发;思考分 low / medium / high。

Qwen3.6-Max

256K 上下文Max预览纯文本Vibe Coding高效Coding Agent前端开发长尾知识

官方现为 qwen3.6-max-preview,3.6 最大最强 Max 预览,目前纯文本。相对 3.6-Plus 强化 vibe coding、Coding Agent 和前端,长尾知识更好。

Gemini-3.5-Flash

1M 上下文子代理调度多步工作流长时程规模化多模态输入思考搜索接地

Google Flash 干活档,强调子代理部署、多步工作流和规模化长时程任务,适合快速 Agent 循环和反复改代码。

gemini-3.6-flash

1M 上下文代码生成Agent执行空间推理多模态输入思考计算机使用预览

2026 年 7 月更新的 Flash,官方强调代码生成、Agent 执行和空间推理,仍走高速低成本的真实任务路线。

GPT-5.6-Luna-Max-Fast

1M 上下文最低成本高并发低延迟轻量子代理高吞吐额度

GPT-5.6 最低成本档,对应早期 nano,为高并发、低延迟和轻量子任务准备,额度高于 Sol/Terra。Max 拉满思考,Fast 只加速排队。

Claude-Haiku-4.5

200K 上下文超低延迟混合推理 / Extended Thinking编程电脑操作智能体 / 子智能体工具调用视觉(文本+图像)上下文感知多语言

Anthropic 最快、最省成本的小型混合推理模型。默认快速作答,可开 Extended Thinking;编程、电脑操作和智能体任务接近 Sonnet 4,适合低延迟、高并发和并行子智能体。

GLM-5.1

200K 上下文八小时自主长时程Agent工程闭环优化工具调用思考可开关结构化输出

智谱长时程旗舰,单任务可自主跑到 8 小时。编码总体对齐 Claude Opus 4.6,强在持续执行、闭环优化和工程交付。

GLM-5.2

1M 上下文扎实百万上下文长时程编码思考档可调开源编码SOTA项目级交付

智谱首个扎实 1M 上下文的长时程旗舰,开源编码当时领先。思考分 High / Max,用 IndexShare 把超长上下文做成可落地工程能力。

Qwen3.5-Plus

1M 上下文原生多模态混合高效架构均衡Plus函数调用内置工具结构化输出

通义 3.5 原生视觉 Plus,线性注意力加稀疏 MoE。图文视频输入,适合编码智能体和高吞吐;最大输出低于后续 Max。

MiniMax-M2.7

200K 上下文递归自改进真实工程交付办公套件技能遵循工具调用

MiniMax 自称开启递归自改进。强在真实软件工程、办公套件交付和复杂环境交互,标准输出约 60 tps。仅文本与工具,不支持图视频输入。

DeepSeek-V4-Flash

1M 上下文快捷经济百万上下文思考可开关工具调用JSON输出MoE高效

DeepSeek-V4 更快更便宜的经济档,284B 总参、13B 激活。世界知识弱于 Pro,推理接近 Pro;简单 Agent 相当,高难度仍有差距。思考可开关。

Hy3

256K 上下文高性价比MoE可关思考Agent工具稳定抗幻觉多轮意图跟踪办公生产力

腾讯 295B MoE(激活 21B)推理与 Agent 模型,体量小于旗舰、效用接近更大开源盘。默认可关思考,适合编码、办公和生产力任务。

MiniMax-M2.5

200K 上下文高峰性价比驾驭复杂代码生成重构多语言编程工具调用

官方定位「高峰性能、极致性价比、驾驭复杂」。偏代码生成与重构,标准输出约 60 tps。仅文本与工具,不支持图视频输入。

YT-plus3.2-Opus-5-Thinking

1M 上下文宇天科技本地大型服务器部署能力接近Opus-5

基于opus底座微调企业训练模型,全能模型

YT-puls3.1-Opus-4.8-Thinking

1M 上下文宇天科技本地大型服务器部署能力接近Opus-4.8

基于opus底座微调企业训练模型,全能模型

YT-Pro2.8-Thinking

1M 上下文宇天科技本地大型服务器部署自训全能模型能力平替sonnet-4.6

基于sonnet底座微调企业训练模型,全能模型

YT-Pro2.5-Thinking

1M 上下文宇天科技本地大型服务器部署自训全能模型能力平替sonnet-4.5

基于sonnet底座微调企业训练模型,全能模型

公告 · Notice

模型广场使用说明

  • 平台聚合全球主流大模型,一处浏览、按需选用,能力与上下文各有侧重。
  • 点击模型名旁「复制」即可获取「完整模型名」,用于 API 调用。
  • 需要开通使用或商务合作,点击「在线客服」即可即时沟通。
在线客服