探索我们的制作准备 人工智能模型

浏览涵盖文本、图像、音频、视频、3D等多种模型的完整目录。

车型目录

AI建模基于一个兼容OpenAI的API。

浏览文本、图片、视频、音频、3D、搜索和代理端点,价格pay-as-you-go。交互式目录从EmpirioLabs加载当前可用性,这些模型文档无需客户端JavaScript即可爬取。

开放模型文档

New & Featured

Save up to 47%
原生推理

Meta Open 30B 代理模型,具备图像理解、128K 上下文、工具调用、结构化输出和可控推理强度。

发布日期 2026年8月10日128K 上下文

Seedance 2.5

ByteDance
专有端点

用于连贯剪辑长达30秒的长式视频模型,最多50个参考图像,视频,以及音频剪辑,原声,编辑,扩展.

Malaysia发布日期 2026年8月7日
专有端点

Meta更新的前沿推理模型有1,048,576个托肯上下文,图像,视频,音频,和PDF理解,网络搜索,以及工具调用.

发布日期 2026年8月5日1M 上下文

Qwen Image 3.0

Alibaba Cloud
专有端点

Quen图像生成和编辑与Base和Pro变体,多语种打字法,多图像参考,以及可控1K或2K输出.

Singapore发布日期 2026年7月21日

MiniMax H3

MiniMax
专有端点

生成最多2K的4至15秒剪辑带原声立体声,跟随文字,图像,视频,音频引用在一个请求中.

Singapore发布日期 2026年7月31日
Save up to 18%

Qwen3.8 Max

Alibaba Cloud
专有端点

Trillion规模的MOE旗舰用于编码,长视距代理,以及专业工作,其图像和视频理解跨越1M-token背景.

Singapore发布日期 2026年8月3日1M 上下文
China发布日期 2026年8月3日1M 上下文

文本生成66

Save up to 21%
专有端点

1M令牌上下文的理性和编码模型,128K输出,可调整的推理努力,本土网络搜索,以及工具调用.

Singapore发布日期 2026年6月16日1M 上下文
Germany发布日期 2026年6月16日1M 上下文

Kimi K3

Moonshot AI
专有端点

Kimi K3是Moonshot的旗舰推理模型,带有1M标志性上下文,始终在思考,本土网络搜索,以及文本,图像,视频输入.

International发布日期 2026年7月15日1M 上下文
专有端点

Meta更新的前沿推理模型有1,048,576个托肯上下文,图像,视频,音频,和PDF理解,网络搜索,以及工具调用.

发布日期 2026年8月5日1M 上下文
Save up to 7%

Kimi K2.7 Code

Moonshot AI
专有端点

Kimi K2.7 (韩语) 代码是Monshot的万亿参数的代理编码模型,其上下文为256K,总是进行推理,以及文字,图像,和视频输入.

International发布日期 2026年6月16日256K 上下文
Germany发布日期 2026年6月16日256K 上下文
专有端点

Meta边疆推理模型,包含1,048,576个上下文外加图像,视频,音频,和PDF理解,网络搜索,以及工具调用.

发布日期 2026年7月9日1M 上下文
专有端点

更新了用于硬推理,编码,和研究的多代理导体,具有显著的最大努力,1M上下文,图像输入,以及网页搜索.

发布日期 2026年7月23日1M 上下文

图像生成14

Save up to 39%

FLUX.2 Klein 4B

Black Forest Labs
原生推理

阿帕奇牌4B FLUX.2 Klein 图像生成和编辑模式带有 text-to-image,参考图像编辑,以及创意工作流程支持.

发布日期 2026年1月15日
专有端点

图像生成和编辑模型从文本或图像输入中创建和修改图像,并带有涂装,虚拟尝试,样式控制.

发布日期 2024年12月3日
专有端点

Open-source text-to-image 型号为多式混合实验架构,具有光现实性细节和强多语言文本渲染.

发布日期 2025年9月28日
专有端点

Janus Pro 7B模型上的自动递减框架,统一了一种架构中的多式联运理解和图像生成.

发布日期 2025年1月27日

Qwen Image 2.0

Alibaba Cloud
专有端点

统一的图像生成和编辑模型,具有类引导复合体 Chinese/English 文本渲染,现实的纹理,以及多图像聚变.

Singapore发布日期 2026年3月3日

Qwen Image 3.0

Alibaba Cloud
专有端点

Quen图像生成和编辑与Base和Pro变体,多语种打字法,多图像参考,以及可控1K或2K输出.

Singapore发布日期 2026年7月21日

视频生成23

专有端点

Text-to-video和 image-to-video 带有同步的本土音频,在720p或1080p时为3至15秒,具有宽比和即时控制.

发布日期 2026年6月17日
专有端点

视频生成模型从文本和可选图像中产生最多2分钟的多镜头视频,其质量和一致性都有提高。

发布日期 2025年4月7日

HappyHorse 1.0

Alibaba Cloud
专有端点

视频模式提供Text-to-Video,Image-to-Video,Reference-to-Video,以及视频编辑模式,具有高真实度,运动流畅的输出.

Singapore发布日期 2026年5月6日
Save up to 19%
原生推理

8.3B参数的视频模型,原生输出720p(可扩展至1080p),强运动一致性,双语快速理解可达10s.

发布日期 2025年11月20日

Kling O3

Kling AI
专有端点

以标准或Pro模式制作的视频模型有Text至Video,Image至Video,Reference-toVideo,编辑,原声,以及多景过渡.

发布日期 2026年2月5日

音频生成14

Save up to 17%
原生推理

开源音乐生成模式用于 text-to-song 和lyric-guided音频,快速8步XL Turbo推论用于可控歌曲迭代.

发布日期 2026年4月2日
Save up to 12%

TTS 2

Inworld
专有端点

实时语音模型,采用纯英语语音指导,跨100+语言实现统一语音身份,且流媒体time-to-first-audio低于200毫秒。

发布日期 2026年5月5日
Save up to 30%
专有端点

sub-130ms TTFB语音合成,配有271+语音,跨越15种语言,表现性prosody,以及用于低纬度语音代理的实时SSE流.

发布日期 2026年1月21日
Save up to 15%
专有端点

广播质量语音合成,具有丰富的表达式音标,271+语音跨越15种语言,实时SSE流传每字时间戳.

发布日期 2026年1月21日
专有端点

低纬度 text-to-speech 使用单声道和多声道语音,并具有可控风格,口音,以及制作应用的表达语调.

发布日期 2025年5月20日
专有端点

高质量TTS预览播客,音频书,以及客户支持,具有23+语言的表达式多语言语音.

发布日期 2025年5月20日

译名4

专有端点

使用Nova-3模式进行语音对文字的转录,提供多种语言支持和先进的定制的制作工作量设置。

发布日期 2025年2月12日
专有端点

Whisper-1 speech-to-text 在多语种监督音频上训练的转录,每个文件有25 MB上传限制.

发布日期 2022年9月21日
Save up to 17%
原生推理

受控Whisper Large v3 Turbo转录,支持多语言ASR、翻译、VAD、时间戳、字幕、热词和解码控制。

发布日期 2024年10月1日
专有端点

StepFun 流式语音识别模型,用于中英音频转录。

International发布日期 2026年4月24日

研究和搜索13

专有端点

对一个自然语言问题的快速 LLM 风格的回答,基于新的 Exa 网络搜索结果,并带有内含引用和源链接.

专有端点

AI有动力的网络搜索有详细的综述和答案,比"深度搜索"更快. OpenAI SimpleQA基准上的排名#1.

100K 上下文

三维生成1

Save up to 90%

TRELLIS.2 4B

Microsoft
原生推理

TRELLIS.2 图像到-3D模型,将参考图像转化为有文本的GLB资产,具有分辨率,种子,网格,纹理和导出控制.

嵌入3

Text Embedding v4

Alibaba Cloud
专有端点

多语言文本嵌入可选择输出维度(64–2048). 每个输入最高可达8,192个令牌.

Singapore发布日期 2025年6月4日8K 上下文
专有端点

Speed-optimised multimodal embedding, same shape as Vision-Plus, 3× cheaper image/video tokens.

Singapore发布日期 2025年9月23日1K 上下文

重新排序键1

Qwen3 Rerank

Alibaba Cloud
专有端点

语义文档重排. 每个查询按相关性排序最多500名考生,支持100+语言,接受自定义排序指令.

Singapore发布日期 2025年6月5日4K 上下文

工具代理(A)2

GPTZero

GPTZero
专有端点

深度学习探测器,标出部分可能是人工智能和人类生成的文本,将内容归类为完全人为的,人工智能,或混合的.

Manus

Manus
专有端点

自主AI代理将高级提示转换为子任务,调用工具和API,并交付 end-to-end 结果而无需手动协调.

未找到任何物品。
未找到任何物品。
未找到任何物品。
未找到任何物品。
未找到任何物品。
未找到任何物品。
未找到任何物品。
未找到任何物品。
未找到任何物品。
未找到任何物品。
未找到任何物品。
未找到任何物品。
未找到任何物品。

准备好使用更好的终端了吗?

查看我们的定价,或者如果你想将自己的模型部署到我们的堆栈中,请联系我们。