Vynix 模型目录

为你的下一个创意找到合适的 AI 模型。

浏览 Vynix 中用于图像、视频、音频和对话创作的 127 个活跃模型。

127 个模型

视频

BRIA Video Background Remove

使用先进AI从视频中去除背景,实现专业级绿幕效果。

能力
Video Background Removal
视频

BRIA Video Upscale

利用AI驱动的放大和修复技术提升视频分辨率。

能力
Video UpscaleVideo Restore
视频

Flux 3

通过文字提示、图片分镜或源视频创建带同步音频的视频。

能力
Text to VideoImage to VideoVideo to VideoExtend VideoFrame to VideoReference to Video
视频

Google Veo 3.1

Google 最先进的AI视频生成,支持音频和电影级画质。

能力
Text to Video
视频

Google Veo 3.1 Extend

使用AI生成的内容和音频扩展和续接现有视频。

能力
Extend Video
视频

Google Veo 3.1 Fast

快速经济的 Google Veo 视频生成,支持音频。

能力
Text to Video
视频

Google Veo 3.1 Fast Extend

使用 Google Veo 3.1 快速且经济地扩展视频。

能力
Extend Video
视频

Google Veo 3.1 Fast Frame-to-Video

从首尾帧图像快速生成视频。

能力
Image to VideoFrame to Video
视频

Google Veo 3.1 Fast Image-to-Video

使用 Google Veo 3.1 快速将图像制作成动画。

能力
Image to Video
视频

Google Veo 3.1 Frame-to-Video

从首尾帧图像生成带音频的电影级视频。

能力
Image to VideoFrame to Video
视频

Google Veo 3.1 Image-to-Video

以电影级画质将图像制作成动画,并生成AI音频。

能力
Image to Video
视频

Google Veo 3.1 Reference-to-Video

根据参考图像生成主体一致的视频。

能力
Image to VideoReference to Video
视频

Grok I2V

使用 xAI 的 Grok Imagine Video 模型将任意图像转化为流畅高质量视频。

能力
Image to Video
视频

Grok Imagine Video

xAI 的一站式视频生成模型。从文本、图像、帧、参考或现有视频创建视频。

能力
Text to VideoImage to VideoFrame to VideoReference to VideoVideo to Video
视频

Grok Imagine Video 1.5

将源图片转换为支持同步音频的短视频。

能力
Image to Video
视频

Grok Video

使用 xAI 的 Grok Imagine Video 模型从文本描述创建精彩视频。

能力
Text to Video
视频

Hailuo 2.3 Pro

MiniMax 专业1080p视频生成,自动优化提示词以达到电影级画质。

能力
Text to Video
视频

Hailuo 2.3 Pro Image-to-Video

使用 MiniMax 的 Hailuo AI 以专业1080p画质将图像制作成动画,并自动优化提示词。

能力
Image to Video
视频

Happy Horse 1.0

从文本创建视频,或添加第一张图片来引导运动。

能力
Text to VideoImage to Video
视频

Hunyuan Video 1.5

腾讯先进的文生视频AI,自动增强提示词以获得更好的运动效果和细节。

能力
Text to Video
视频

Hunyuan Video 1.5 Image-to-Video

使用腾讯AI将图像制作成动画,自动增强提示词以实现自然流畅的运动效果。

能力
Image to Video
视频

Kling 3.0 4K (I2V)

生成支持原生音频的电影感视频。

能力
Image to Video
视频

Kling 3.0 4K (T2V)

生成支持原生音频的电影感视频。

能力
Text to Video
视频

Kling 3.0 I2V

将静态图像转化为长达15秒的动态电影级视频,支持原生音频合成和可选结束帧控制。

能力
Image to Video
视频

Kling 3.0 I2V (Pro)

高级版图像转视频,提供最高品质输出、长达15秒时长、原生音频合成和结束帧控制。

能力
Image to Video
视频

Kling 3.0 Pro (I2V)

生成支持原生音频的电影感视频。

能力
Image to Video
视频

Kling 3.0 Pro (T2V)

生成支持原生音频的电影感视频。

能力
Text to Video
视频

Kling 3.0 R2V

使用参考图像生成具有一致角色外观的电影级视频。

能力
Reference to Video
视频

Kling 3.0 R2V (Pro)

高级版参考图转视频,提供最高品质输出和精确的主体一致性。

能力
Reference to Video
视频

Kling 3.0 Standard (I2V)

生成支持原生音频的电影感视频。

能力
Image to Video
视频

Kling 3.0 Standard (T2V)

生成支持原生音频的电影感视频。

能力
Text to Video
视频

Kling 3.0 T2V

新一代AI视频生成,动作质量、提示词遵循和原生音频合成显著提升。

能力
Text to Video
视频

Kling 3.0 T2V (Pro)

新一代AI视频生成高级版,具有卓越的动作质量、增强的提示词遵循和原生音频合成。

能力
Text to Video
视频

Kling 3.0 V2V

使用AI转换现有视频。上传源视频并描述所需更改。在提示中以@Video1引用视频。

能力
Video to Video
视频

Kling 3.0 V2V (Pro)

高级版视频编辑,提供最高品质输出。使用AI转换现有视频,保留原始音频。

能力
Video to Video
视频

Kling 3.0 V2V Ref

使用参考视频生成具有一致风格和动作的新视频。

能力
Reference to Video
视频

Kling 3.0 V2V Ref (Pro)

高级版视频参考生成,提供最高品质输出。从参考视频生成具有一致风格的新视频。

能力
Reference to Video
视频

Kling Lip Sync

Kling AI 快速精准的唇形同步,唇部动作自然流畅。

能力
Lip Sync
视频

Kling Video 2.6 Pro

专业AI视频生成,原生音频合成支持对话、音效和环境音。

能力
Text to Video
视频

Kling Video 2.6 Pro (I2V)

将静态图像转化为动态电影级视频,原生音频合成支持对话和音效。

能力
Image to Video
视频

Kling Video 2.6 Pro (Motion)

将参考视频中的动作迁移到角色图像上。完美适用于舞蹈动作、手势和复杂编舞。

能力
Motion Control
视频

LatentSync

字节跳动高品质唇形同步,潜空间同步技术实现专业效果。

能力
Lip Sync
视频

LivePortrait

使用视频驱动的面部动作迁移为任何肖像照片添加动画。

能力
Reference to Video
视频

Luma Ray 2 I2V

电影级图生视频,支持起止帧控制和1080p输出。

能力
Image to VideoFrame to Video
视频

OmniHuman

从参考图像生成全身动画,包含自然手势和表情。

能力
Talking HeadReference to Video
视频

Pixverse 6

用时长、分辨率和音频控制将图片动画化为视频。

能力
Image to Video
视频

PixVerse Lipsync

热门唇形同步,150万次运行,配音一致性经过验证。

能力
Lip Sync
视频

Runway Gen 4.5

Runway 最先进的视频生成模型,可制作具有卓越质量的电影级视频。

能力
Text to VideoImage to VideoFrame to VideoReference to Video
视频

SadTalker

可靠的说话头像生成,230万次运行,支持面部增强选项。

能力
Talking HeadReference to Video
视频

Seedance 1.5 Pro

文生视频,完整摄像机控制、音频和多角色对话。

能力
Text to Video
视频

Seedance 2.0 (I2V)

将源图片动画化为可带音频的视频。

能力
Image to Video
视频

Seedance 2.0 (R2V)

使用参考图片、视频或音频引导视频生成。

能力
Image to VideoVideo to VideoReference to Video
视频

Seedance 2.0 (T2V)

使用可选音频和灵活控制从文本创建视频。

能力
Text to Video
视频

Seedance 2.5 (I2V)

将源图片转换为带原生音频和电影感运动的视频。

能力
Image to Video
视频

Seedance 2.5 (R2V)

使用参考图片、视频和音频引导生成带原生音频的视频。

能力
Reference to Video
视频

Seedance 2.5 (T2V)

通过文本生成带原生音频的视频,具有连贯运动和电影级控制。

能力
Text to Video
视频

SeedVR2 Video

AI视频增强与修复,放大和提升视频品质。

能力
Video UpscaleVideo Restore
视频

Sync Lipsync 2 Pro

最佳品质唇形同步,支持4K和多语言配音。

能力
Lip Sync
视频

Topaz Video Upscale

专业视频放大,AI驱动的细节增强和伪影去除。

能力
Video Upscale
视频

Video Retalking

经典唇形同步方案,230万次运行,性能可靠。

能力
Lip Sync
视频

Wan 3.0 Prime (I2V)

将源图片制作成带原生音频的高品质视频。

能力
Image to Video
视频

Wan 3.0 Prime (R2V)

使用参考图片、视频和音频引导创建视频。

能力
Reference to Video
视频

Wan 3.0 Prime (T2V)

通过文字提示生成带原生音频的高品质视频。

能力
Text to Video
图像

Aura SR

4倍图像超分辨率放大,画质卓越。

能力
Image Upscale
图像

BigColor Anime Colorization

专为动漫、漫画和插画优化的上色工具,色彩鲜艳风格化。

能力
Image Colorize
图像

BiRefNet

最高精度的背景去除,多种模式适用于不同使用场景。

能力
Image Background Removal
图像

BiRefNet V2

最高精度的背景去除,增强边缘检测和精细细节保留。

能力
Image Background Removal
图像

BRIA Background Replace

使用文本提示和AI生成场景替换图像背景,实现逼真合成效果。

能力
Image Background Replace
图像

BRIA Expand

AI外扩绘制,将图像扩展到原始边界之外,生成无缝衔接的内容。

能力
Expand Image
图像

BRIA Product Shot

生成专业电商产品摄影,配以影棚级品质背景。

能力
Image Product Shot
图像

BRIA RMBG 2.0

商业级背景去除,90%精度,适用于产品、人像和复杂场景。

能力
Image Background Removal
图像

Clarity Upscaler

最受欢迎的AI放大器,支持创意增强和HDR效果。

能力
Image Upscale
图像

CodeFormer Face Restore

高级人脸修复,精确保真度控制。比GFPGAN有更好的品质控制。

能力
Image Restore
图像

DDColor Photo Colorization

使用双解码器技术为黑白照片上色,品质最佳。

能力
Image Colorize
图像

Face Swap

最受欢迎的换脸模型。两张照片间无缝换脸,高品质逼真效果。

能力
Image Face Swap
图像

Face Swap Pro

高级换脸模型,增强画质并更好地保留面部特征。

能力
Image Face Swap
图像

Face-to-Many

将面部转化为各种艺术风格,包括表情包、像素画、3D渲染等。

能力
Face Stylization
图像

FLUX 1.1 Pro

更快更好的 FLUX Pro,出色的提示词遵循度和图像质量。

能力
Text to Image
图像

FLUX 1.1 Pro Ultra

4倍高分辨率 FLUX,Raw模式带来自然、未过度处理的美学效果。

能力
Text to Image
图像

FLUX 2 Max

Black Forest Labs 最高保真度的图像模型,细节卓越,支持多图输入。

能力
Text to ImageImage to Image
图像

FLUX PuLID

角色一致性与身份保持。生成图像时在不同场景中保持角色身份的一致性。

能力
Character Consistency
图像

FLUX.1 Schnell

超快速图像生成,1秒内完成,画质出色。

能力
Text to Image
图像

FLUX.2 Pro

最新 FLUX 模型,支持8张参考图像和4MP输出。

能力
Text to ImageImage to ImageReference to Image
图像

GFPGAN Face Restore

修复和增强旧照片或AI生成图像中的人脸,达到最先进的人脸修复水平。

能力
Image Restore
图像

GPT Image 1.5

OpenAI 的 GPT Image 1.5 能从文本描述生成令人惊叹的超真实图像,支持透明背景。

能力
Text to Image
图像

GPT Image 2

根据详细文本提示创建高质量图片。

能力
Text to Image
图像

GPT Image 2

使用 GPT Image 2 创建或编辑图片。

能力
Text to ImageImage to Image
图像

GPT Image 2 (Edit)

使用简单文本说明编辑一张或多张图片。

能力
Image to Image
图像

Ideogram V3 Quality

最高品质文生图,令人惊叹的真实感和50多种艺术风格预设。

能力
Text to Image
图像

Ideogram V3 Turbo

快速文生图,50多种艺术风格预设和 Magic Prompt 优化。

能力
Text to Image
图像

Imagen 4 Ultra

Google 最先进的图像生成模型,超高画质、卓越的照片级真实感和出色的文字渲染。

能力
Text to Image
图像

Nano Banana 2

Google 新一代 Gemini 图像模型,具备更高质量、更多细节和更好的文字渲染。

能力
Text to Image
图像

Nano Banana 2

Google 快速图像生成模型,支持对话式编辑、多图融合和角色一致性。

能力
Text to ImageImage to Image
图像

Nano Banana 2 Edit

Google 新一代 Gemini 图像编辑,具备更高质量和多图融合功能。

能力
Image to ImageReference to Image
图像

Nano Banana Pro

Google Gemini 驱动的模型,具备语义理解和业界领先的文字渲染能力。

能力
Text to Image
图像

Nano Banana Pro

Google 最先进的图像生成模型,出色的文字渲染和多图合成能力。

能力
Text to ImageImage to Image
图像

Nano Banana Pro Edit

Google Gemini 驱动的图像编辑,具备语义理解和多图融合功能。

能力
Image to ImageReference to Image
图像

PhotoMaker

ID保持肖像生成。创建个性化肖像,在不同风格中保持身份一致性。

能力
Portrait GenerationStyle Reference
图像

Professional Headshot

生成LinkedIn商务头像。将休闲照片转化为精致的企业风格肖像。

能力
Portrait Generation
图像

Real-ESRGAN

快速放大,支持动漫风格。3200万次以上运行。

能力
Image Upscale
图像

Recraft Crisp Upscale

锐利细节增强,专业级品质。

能力
Image Upscale
图像

Recraft V3

排名第一的文生图,最佳文字渲染和50多种艺术风格。

能力
Text to Image
图像

RemBG

快速免费的背景去除工具,快速输出透明PNG。

能力
Image Background Removal
图像

SAM Age Transform

年龄变换模型,可以让照片中的人脸变老或变年轻。以逼真效果查看不同年龄的自己。

能力
Age Transformation
图像

Seedream 4.5

字节跳动最新图像生成模型,卓越画质、风格控制和4K分辨率支持。

能力
Text to Image
图像

Seedream 4.5 Edit

字节跳动强大的图像编辑模型,支持多图融合和文本引导变换。

能力
Image to Image
图像

SeedVR2 Image

AI图像放大与修复,增强和提升图像品质。

能力
Image UpscaleImage Restore
图像

Z-Image Turbo

快速文生图,支持尺寸、种子和质量控制。

能力
Text to Image
音频

ACE-Step

音乐生成,支持人声、歌词和19种语言。

能力
Music Generation
音频

Google Lyria 2

使用 Google DeepMind 先进AI创作高保真48kHz音乐。

能力
Music Generation
音频

Kokoro 82M

轻量级文字转语音模型,44种自然语音,支持多种语言。

能力
Text to Speech
音频

Meta MusicGen

从文本描述生成高品质纯音乐,支持旋律引导。

能力
Music Generation
音频

Minimax Music

创作包含人声、歌词和专业伴奏的完整歌曲。

能力
Music Generation
音频

MiniMax Music 1.5

生成长达4分钟的歌曲,支持19种语言的人声。支持带结构标签的歌词,如[verse]、[chorus]、[bridge]。

能力
Music Generation
音频

MiniMax Speech 2.6 HD

排名第一的文字转语音模型,支持40多种语言和语音克隆。

能力
Text to SpeechVoice Clone
音频

MiniMax Speech 2.6 Turbo

快速实时TTS,支持情感控制和40多种语言。

能力
Text to Speech
音频

MiniMax Voice Clone

仅需10秒音频即可克隆任何声音。

能力
Voice Clone
音频

MiniMax Voice Design

通过文本描述设计定制声音。

能力
Voice Design
音频

Stable Audio 2.5

生成3分钟以上的高品质音频。支持音乐和音效,达到专业录音室品质。

能力
Music Generation
对话与文本

Claude Opus 4.6

Anthropic 最智能的模型,具有最先进的编程、推理和代理能力。

能力
ChatCompletionTranslationCode GenerationSummarization
对话与文本

DeepSeek V3.1

6710亿参数MoE模型,性能媲美 GPT-4o,成本仅为其一小部分。擅长编程、数学和分析任务。

能力
ChatCompletionTranslationCode GenerationSummarization
对话与文本

Gemini 3.1

Google 最智能的模型,具有改进的推理能力和可调节的思考深度。

能力
ChatCompletionTranslationCode GenerationSummarization
对话与文本

Llama 3.1 405B

Meta 最大的4050亿参数开源模型,在推理、编程和多语言任务上达到顶尖水平。

能力
ChatCompletionTranslationCode GenerationSummarization
对话与文本

Llama 4 Maverick

Meta 旗舰4000亿参数 Maverick 模型,卓越的编程、推理和多语言能力。

能力
ChatCompletionTranslationCode GenerationSummarization
对话与文本

Llama 4 Scout

1000万token上下文——分析整个代码库、书籍或大量文档,开源模型中最长的上下文窗口。

能力
ChatCompletionTranslationCode GenerationSummarization
对话与文本

OpenAI GPT-5.2

OpenAI 最佳编程、推理和智能体任务模型,支持可调推理力度。

能力
ChatCompletionTranslationCode GenerationSummarization
对话与文本

Qwen 3 235B

阿里巴巴2350亿参数MoE模型,220亿活跃参数。擅长推理、编程和多语言任务。

能力
ChatCompletionTranslationCode GenerationSummarization

使用 Vynix 创作

把创意付诸实践。

在一个移动应用中探索 AI 辅助的图像、视频、音频和文本创作流程。