安全与加速
聚合AI

你要的聚合 AI,这里都有

汇聚全球主流 AI 模型,致力于为开发者提供高效、便捷的 AI 能力接入服务

BaseURL: https://api.xingchiyun.com/v1
模型服务商
模型类型

MiniMax-H3-Max

视频

MiniMax-H3-Max 是 MiniMax 与 fal.ai 联合推出、基于 H3 基座做后训练优化的极速视频生成模型,面向快速迭代、草稿批量生成场景

输入长度:- 输出长度:-
查看详情

GLM-5.3-Flash

文本 流式 JSON

GLM-5.3-Flash 是智谱(Z.ai / BigModel 开放平台)GLM-5 系列中首个原生多模态模型,总参数量 320B、激活参数量 18B,采用稀疏/线性注意力混合架构,在大幅降低单 Token 计算量与 KV 缓存占用的同时,实现超越 GLM-5.2 的编码与智能体(Agent)能力,可原生理解图片、视频、文件等输入并生成可交互代码。模型支持 1M 上下文窗口、最大输出 128K Tokens,强制启用深度思考并可通过 reasoning_effort(low/high/max)调节推理强度,同时支持 Function Calling、结构化 JSON 输出、上下文缓存与流式输出。定价约为 GLM-5.3 的 1/10(限时折扣期内为 1/20),主打“前沿智能、Flash 成本”的高性价比定位,权重以 MIT 协议开源。

输入长度:1M 输出长度:128K
查看详情

Qwen3.8-Max

文本 JSON 工具调用

2.4万亿参数MoE旗舰,编程与办公能力全面跃升,可自主编程十数天交付完整项目。胜任法律、金融、设计等数百种专业任务,一次对话端到端交付生产级成果。原生视觉理解贯穿规划、执行与验证全流程,支持超长文档与长视频的深度语义解析。长程任务中自主规划与闭环迭代,持续进化。

输入长度:991.8K 输出长度:131.1K
查看详情

MiniMax-H3

视频

通过多模态 content 数组输入(文本 / 图片 / 视频 / 音频),支持文生视频、图生视频(首尾帧)、多模态参考生视频,2K 直出。

输入长度:- 输出长度:-
查看详情

GLM-5

文本 流式 工具调用

GLM-5 是智谱(Z.ai / BigModel 开放平台)于 2026 年 2 月发布的基座大模型,面向 Agentic Engineering(智能体工程)打造,能够在复杂系统工程与长程 Agent 任务中提供可靠生产力,在 Coding 与 Agent 能力上取得开源 SOTA 表现。官方文档标称上下文窗口 200K、最大输出 128K,输入输出模态均为文本,支持思考模式、流式输出、Function Calling(工具调用)与上下文缓存。API 按输入长度阶梯计费(国内站,元/百万 Tokens),2026 年 2 月起国内 0–32K 档输入 4 元、输出 18 元每百万 Tokens。

输入长度:200K 输出长度:128K
查看详情

Kimi K2.7 Code

文本 流式 工具调用

Kimi K2.7 Code 是月之暗面(Moonshot AI)推出的面向代码场景的开源编程智能体模型,基于 Kimi K2.6 构建,采用 1 万亿总参数、320 亿激活参数的 MoE 架构,支持 256K(262,144)tokens 上下文窗口。该模型在长上下文中更可靠地遵循指令,能以更高的成功率完成编程任务,同时支持文本、图片与视频输入,仅支持思考模式,支持多步工具调用与推理,思考 token 消耗较 K2.6 平均降低约 30%。

输入长度:262.1K 输出长度:32.8K
查看详情

MiniMax M2.7

文本 流式 工具调用

MiniMax M2.7 是 MiniMax 推出的新一代 Agent 文本大模型,官方定位为“开启模型的自我迭代”,强调模型自我进化与复杂 Agent 能力,可面向编程、推理、工具调用和长文本任务等生产力场景。

输入长度:204.8K 输出长度:204.8K
查看详情

MiniMax-M2.5

文本 流式 工具调用

MiniMax-M2.5 是 MiniMax 于2026年2月发布的开源大语言模型,在数十万个复杂真实环境中经过大规模强化学习训练,在编程、智能体工具调用与搜索、办公等真实生产力场景中达到或刷新 SOTA 水平(SWE-Bench Verified 80.2%)。模型为 MoE 架构(约230B总参数、10B激活参数),支持工具调用与交错思维链,上下文窗口 204,800 tokens,面向智能体与真实世界生产力任务提供极致性价比。

输入长度:204.8K 输出长度:131.1K
查看详情

Qwen3.7-Flash

文本 流式 JSON

Qwen3.7原生视觉语言系列Flash模型,相较3.6-Flash全面提升多模态理解与Agent执行能力。重点强化多模态基础能力、万物识别能力更强,真实世界感知与空间智能进一步提升,Search Agent、CI Agent等多模态Agent场景能力显著升级、端到端任务执行更稳定,多模态Coding能力优化、vibe coding 体验更加流畅。

输入长度:991.8K 输出长度:131.1K
查看详情

GLM 5.3

文本 流式 JSON

智谱最新旗舰模型,1M上下文,支持思考长度控制

输入长度:1K 输出长度:128
查看详情

Hy3

文本 流式 JSON

Hy3 是腾讯混元研发的快慢思考融合大语言模型,采用 MoE 架构,总参数 295B、激活参数 21B、MTP 层参数 3.8B,支持 256K 上下文长度(最大输入 192K、最大输出 128K)。模型于 2026 年 7 月 6 日正式发布并以 Apache 2.0 协议开源,基于真实业务场景打磨,强化 Coding、长文、推理与 Agent 能力,支持深度思考(reasoning_effort 调节)、工具调用(Function Calling)、结构化输出与流式调用。

输入长度:192K 输出长度:128K
查看详情
限时9折

Doubao-Seed-2.1-turbo

文本 流式 JSON

Doubao-Seed-2.1 是面向 Coding 和 Agent 时代打造的新一代大模型,提供 Pro 和 Turbo 两个版本,分别面向高复杂度任务探索和规模化生产场景。相较上一代版本,Seed 2.1 在 Coding 工程交付、Agent 长链路任务执行和多模态理解三大方向上全面升级,以更强的自主规划与动态修复能力,胜任真实研发与高价值生产任务。

输入长度:262.1K 输出长度:262.1K
查看详情
限时9折

Doubao-Seed-2.1-pro

文本 流式 JSON

迈向生产级智能的新一代大模型,全面升级 Coding、Agent 与多模态能力,以更强的自主规划、长链路执行和动态修复能力,胜任企业真实复杂任务。支持深度思考与视觉理解。

输入长度:256K 输出长度:256K
查看详情
限时9折

Doubao-Seed-2.0-mini

文本 流式 JSON

Doubao-Seed-2.0-mini 是豆包家族首款轻量级全模态理解模型,能够同时输入并理解视频、图片、语音和文本四种模态,并进行跨模态联合推理。支持音画协同、视频深度解构、音频全解析,面向低时延、高并发与成本敏感场景提供极致推理速度。

输入长度:229.4K 输出长度:131.1K
查看详情

Doubao-Seedance-2.0-mini

视频

Seedance 2.0 mini 是面向更广泛视频生成需求推出的新一代高性价比视频生成模型。在保持竞争力效果的同时,将视频生成能力带入更低门槛、更高频、更规模化的应用场景

输入长度:- 输出长度:-
查看详情

MiniMax-M3

文本 工具调用

MiniMax M3 凭借业界领先的 Coding 与 Agentic 能力、1M 超长上下文窗口以及原生多模态特性,可出色胜任企业级长文档理解、高质量内容生成、代码编写、Bug 修复及原生应用构建等任务;强大的 Agentic 能力端到端贯通工作流,原生多模态更带来流畅自然的图文混合交互体验。

输入长度:1M 输出长度:128K
查看详情
限时9折

Doubao-Seed-2.0-pro

文本 流式 JSON

Doubao-Seed-2.0-pro 是面向 Agent 时代复杂推理与长链路任务执行打造的旗舰级全能通用模型,重点强化多模态理解、长上下文推理、结构化生成和工具增强执行能力。模型在复杂指令处理和多约束任务执行方面表现出色,能够稳定应对多步骤复杂规划、高难度图文推理、视频内容理解和复杂分析等场景。

输入长度:229.4K 输出长度:131.1K
查看详情
限时9折

Doubao-Seed-2.0-lite

文本 流式 工具调用

豆包大模型家族首款全模态理解模型,支持视频、图像、音频、文本原生统一理解,同时升级Agent、Coding与GUI能力。

输入长度:229.4K 输出长度:131.1K
查看详情
限时9折

Doubao-Seed-2.0-Code

文本 流式 工具调用

Doubao-Seed-2.0-Code 面向企业级编程需求优化,在 Seed 2.0 优秀的 Agent、VLM 能力基础上,特别增强了代码能力,不仅前端能力表现出众,也对企业常见的多语言编码需求做了特别优化,适合接入各种 AI 编程工具使用。

输入长度:229.4K 输出长度:131.1K
查看详情

Doubao-Seedream-5.0-lite

图片

字节跳动 Doubao-Seedream-5.0 系列图像生成模型,支持文生图与图生图。

输入长度:- 输出长度:-
查看详情

Qwen3.6-Plus

文本 流式 JSON

Qwen3.6原生视觉语言系列Plus模型,展现出与当前顶尖前沿模型相媲美的卓越性能,模型效果相较3.5系列显著提升。模型在Agentic coding、前端编程、Vibe coding等代码能力、多模态万物识别、OCR、物体定位等能力上显著增强。

输入长度:991.8K 输出长度:65.5K
查看详情

HappyHorse-1.1-I2V

视频

HappyHorse-1.1-I2V支持图生视频,进一步提升画面质感、动态表现与跨片段一致性。模型能够更精准地理解输入图像并延续创作意图,在人物皮肤质感、ID跨片段保持、动作流畅度、文字渲染稳定性以及音画同步上带来显著改善,输出更真实自然、细节丰富且一致性更高的高质量视频。

输入长度:- 输出长度:-
查看详情

HappyHorse-1.1-T2V

视频

HappyHorse-1.1-T2V支持文生视频,进一步提升文本语义理解、镜头调度与动态生成表现。模型能够更精准地还原创作意图,在人物动作、场景氛围、视觉美感和物理运动上生成更流畅自然、细节丰富且一致性更高的高质量视频。

输入长度:- 输出长度:-
查看详情

HappyHorse-1.1-R2V

视频

HappyHorse-1.1-R2V支持参考生视频,进一步提升主体、场景风格与画面一致性的稳定保持。模型最多支持9张参考图片输入,能够更精准理解并延续创作意图,在人物、场景、风格和镜头表现上带来更强的可控性与表现力。

输入长度:- 输出长度:-
查看详情

HappyHorse-1.0-Video-Edit

视频

HappyHorse-1.0-Video-Edit支持视频编辑,自然语言指令编辑视频,可参考最多5张图片局部或全局编辑视频元素,能够精准复刻视频动态过程,实现更强表现能力。

输入长度:- 输出长度:-
查看详情

GLM-5.2

文本 流式 JSON

GLM-5.2 是面向长任务时代的旗舰模型。支持真正可用的1M 上下文,实测可承载项目级工程上下文,长程任务执行更稳定、工程规范遵循更可靠,开发场景成功率进一步提升。

输入长度:1M 输出长度:128K
查看详情

qwen3.7-plus

文本 流式 视觉

Qwen3.7系列中高性价比Plus模型,在强大文本能力的基础上全面升级了视觉-语言能力,同时保持了在编码、工具使用和生产力工作流方面的完整智能体能力。其核心特色为多模态交互混合智能体能力,能够感知真实世界场景、读取屏幕并操作 GUI、基于视觉参考生成代码、端到端导航移动应用。

输入长度:991K 输出长度:64K
查看详情

qwen3.7-max

文本 流式 视觉

Qwen3.7 系列中规模最大、综合能力最强的 Max 模型,当前开放纯文本模型能力供体验。Qwen3.7 是面向智能体时代的新一代旗舰模型,核心优势在于智能体能力的广度与深度:在编程、办公与生产力、长周期自主执行方面均能出色胜任各项任务。

输入长度:991K 输出长度:64K
查看详情

qwen3.6-flash

文本 流式 视觉

qwen3.6-flash(即Qwen3.6-35B-A3B)是阿里通义千问团队推出的轻量高效混合专家模型,总参数350亿、激活参数仅30亿。该模型原生支持多模态,具备卓越的智能体编程、深度推理、视觉理解与空间智能能力,适用于文本生成、代码辅助及复杂多模态任务。

输入长度:991K 输出长度:64K
查看详情

qwen-image-2.0

图片

Qwen-Image-2.0是阿里巴巴通义实验室于2026年2月发布的图像生成与编辑一体化模型,支持1K token超长中文提示词和2K高分辨率输出,具备强大的中文汉字渲染能力与复杂构图理解能力。该模型在AI Arena文生图和图生图评测中分别获得1029分和1034分,适用于PPT、海报、信息图等专业场景。

输入长度:- 输出长度:-
查看详情

Kimi-K2.6

文本 流式 视觉

kimi-k2.6 是 Kimi 最新最智能的模型,具备更强更稳的长程代码编写能力,指令遵循和自我纠错能力显著提升,同时支持文本、图片与视频输入,思考与非思考模式,对话与 Agent 任务。

输入长度:224K 输出长度:16K
查看详情

GLM-5.1

文本 JSON 工具调用

GLM-5.1 是智谱AI发布的国产最强开源大模型,面向长程任务设计,支持单任务连续8小时自主工作,具备从代码生成到工程级交付的闭环能力。其在SWE-Bench Pro等真实开发评测中超越Claude Opus 4.6,成为全球开源模型中的新标杆。

输入长度:202K 输出长度:128K
查看详情

doubao-seedance-2-0-fast-260128

视频

Seedance 2.0 fast是豆包大模型团队推出的新一代多模态视频创作模型,它继承了Seedance 2.0模型的核心功能和优势,生成速度更快。 Seedance 2.0 fast支持图片、视频、音频等多模态素材参考生成视频,同时具备视频编辑与延长能力,使生视频工具进入可精准生成、可复用迭代的工业化新阶段。模型对物理规律的理解持续深化、更贴合真实世界,意图理解能力显著提升,能严格遵循指令细节约束,从而保障专业级叙事的可信度。

输入长度:- 输出长度:-
查看详情

doubao-seedance-2-0-260128

视频

豆包大模型团队推出的新一代专业级多模态创作视频模型 Seedance 2.0,支持图像、视频、音频等多模态作为参考输入生成视频,还具备视频编辑、延长等能力,能高精度还原各类细节并稳定角色特征,具备极致拟真的视听稳定性,深度适配商业广告、影视制作与社交媒体营销等各大核心场景

输入长度:- 输出长度:-
查看详情

doubao-seedance-1-5-pro-251215

视频

豆包 Seedance 1.5 Pro 是字节跳动推出的新一代视频生成大模型,支持文生视频、图生视频等功能,具备卓越的视频生成质量、物理规律遵循能力和音视频同步能力。

输入长度:- 输出长度:-
查看详情

DeepSeek-V4-Pro

文本 JSON 工具调用

DeepSeek-V4-Pro 是 DeepSeek 系列的旗舰开源混合专家(MoE)大模型,总参数量达 1.6 万亿,激活参数 490 亿,原生支持百万 token 上下文。该模型在编程、数学、复杂推理及智能体任务方面表现卓越,支持思考模式切换,在多项基准测试中位居开源模型前列。

输入长度:1M 输出长度:384K
查看详情

DeepSeek-V4-Flash

文本 流式 JSON

DeepSeek-V4-Flash 是深度求索于2026年4月发布的高效轻量化大模型,总参数量284B、激活参数13B,支持百万token上下文长度。该模型定位为更快捷、经济的推理选项,在简单任务上接近Pro版性能,适合高频高并发场景。

输入长度:1M 输出长度:384K
查看详情

共 37 个模型