跳到主内容

AI 模型目录

了解驱动这些工具的底层模型:厂商、模态、被哪些工具使用。先按厂商或模态浏览,再回到工具页核实官方文档。

GPT-4o

1 tools

OpenAI

OpenAI 的多模态旗舰模型,文本、图像与音频能力一体,延迟低、多语言表现均衡,是 ChatGPT 与大量第三方工具默认的主力模型。

textimageaudio

GPT-4

7 tools

OpenAI

OpenAI 第四代大模型,以推理与写作质量见长,被大量写作、编程与知识类工具作为默认引擎使用。

text

GPT-3.5

1 tools

OpenAI

OpenAI 早期主流模型,速度快、成本低,常用于对时延敏感、精度要求居中的对话与文本处理场景。

text

GPT 系列

26 tools

OpenAI

OpenAI 的 GPT 大模型家族统称,涵盖 GPT-4o、GPT-4 与 GPT-3.5 等版本,目录中多数文本类工具都建立在 GPT 系列之上。

textimage

DALL·E 3

2 tools

OpenAI

OpenAI 第三代文生图模型,提示词理解准确、文字渲染清晰,由 ChatGPT 与 Bing Image Creator 等产品内置。

image

DALL·E 2

1 tools

OpenAI

OpenAI 第二代文生图模型,支持图像编辑与变体生成,奠定了扩散模型商用化的基础。

image

DALL·E 系列

1 tools

OpenAI

OpenAI 的文生图模型家族统称,从 DALL·E 2 演进到 DALL·E 3,服务于对话式与独立图像创作场景。

image

Sora

1 tools

OpenAI

OpenAI 的视频生成模型,可根据文本或图像生成多镜头一致的高清视频,是文本到视频方向的代表性模型。

video

Claude 系列

20 tools

Anthropic

Anthropic 的 Claude 大模型家族,以长上下文、写作与编程能力著称,开发者与写作类工具广泛采用。

textimagecode

Claude 3.5 Sonnet

1 tools

Anthropic

Claude 3.5 系列的主力型号,推理、写作与编程均衡,是 Cursor、Windsurf 等编程工具的默认模型之一。

textcode

Claude 3.5

2 tools

Anthropic

Claude 3.5 代际统称,在长文档处理与代码理解上表现突出。

textcode

Claude 3 Opus

1 tools

Anthropic

Claude 3 系列的旗舰型号,面向最复杂的推理与创作任务。

text

Claude 3 Haiku

1 tools

Anthropic

Claude 3 系列的轻量型号,延迟低、成本低,适合高频次对话与分类任务。

text

Claude 3

1 tools

Anthropic

Claude 3 代际统称,首次引入视觉理解能力,覆盖 Haiku/Sonnet/Opus 三档。

textimage

Gemini 系列

3 tools

Google

Google 的原生多模态模型家族,覆盖 Ultra、Pro、Flash 与 Nano 各档,长上下文能力突出,与搜索和办公生态深度整合。

textimagevideoaudio

Gemini Pro

1 tools

Google

Gemini 系列的主力型号,文本与图像理解均衡,面向通用对话与创作。

textimage

Gemini Flash

1 tools

Google

Gemini 系列的高速型号,以低延迟与低成本服务高频请求。

textimage

Gemini Ultra

1 tools

Google

Gemini 系列的旗舰型号,面向最高难度的推理与创作任务。

textimage

Veo 3

1 tools

Google DeepMind

Google DeepMind 的视频生成模型,支持高分辨率、镜头语言控制与音画一体生成,画质与一致性处于第一梯队。

videoaudio

Llama 系列

2 tools

Meta

Meta 的开源大模型家族,权重开放、生态庞大,是本地部署与自托管方案的事实标准底座。

textcode

Grok 4

1 tools

xAI

xAI 第四代模型,强化推理与实时信息能力,与 X 平台数据深度整合。

textimage

Grok 3

1 tools

xAI

xAI 第三代模型,面向实时问答与直接风格的对答场景。

text

Mistral Large

1 tools

Mistral

Mistral 的旗舰模型,多语言与代码能力强,欧洲企业部署的热门选择。

textcode

Mistral Small

1 tools

Mistral

Mistral 的轻量型号,高效低成本,适合本地与边缘部署。

text

DeepSeek V3

1 tools

DeepSeek

深度求索的开源旗舰模型,推理与代码能力对标一线闭源模型,API 价格极具竞争力,开发者社区影响广泛。

textcode

DeepSeek V4

1 tools

DeepSeek

DeepSeek 新一代模型,在推理深度与长上下文上继续提升,面向专业开发与研究场景。

textcode

DeepSeek V4 Flash

1 tools

DeepSeek

DeepSeek V4 的高速变体,用更低成本与延迟服务高频调用,适合批量任务与实时场景。

textcode

DeepSeek 系列

1 tools

DeepSeek

DeepSeek 开源模型家族统称,V3/R1 系列在推理与代码任务上影响力大,国内外采用广泛。

textcode

Qwen Max

1 tools

阿里巴巴

通义千问的旗舰型号,中文理解与多模态能力强,企业商用部署广泛。

textimage

Qwen Plus

1 tools

阿里巴巴

通义千问的均衡型号,能力与成本平衡,适合大多数中文对话与写作场景。

text

Qwen Turbo

1 tools

阿里巴巴

通义千问的高速型号,低成本高吞吐,适合大规模文本处理任务。

text

Wan 2.x(通义万相)

1 tools

阿里巴巴

阿里巴巴开源的视频生成模型家族,文生视频与图生视频质量处于开源第一梯队,国内创作社区采用广泛。

videoimage

GLM-4 系列

1 tools

智谱 AI

智谱 AI 的大模型家族,代码、长文本与多模态能力均衡,国内企业与开发者生态成熟。

textcodeimage

文心大模型 4.x

1 tools

百度

百度知识增强大模型,中文知识理解与文生图能力完善,与百度搜索及办公生态联动。

textimage

混元大模型

1 tools

腾讯

腾讯自研大模型家族,对话、生图与文生视频能力开放,与微信、腾讯文档等生态打通。

textimagevideo

豆包大模型

3 tools

字节跳动

字节跳动的豆包大模型家族,覆盖对话、图像与语音,与飞书、剪映等生态联动。

textimageaudio

可灵 1.5

1 tools

快手

快手可灵的视频生成模型,物理模拟与大幅面运动表现出色,支持文生视频与图生视频。

video

可灵 1.0

1 tools

快手

可灵的第一代视频生成模型,奠定了国产视频生成的基础体验。

video

海螺视频模型

1 tools

MiniMax

MiniMax 的视频生成模型,人物动作自然、物理表现真实,中文指令理解出色。

video

Vidu 模型

1 tools

生数科技

生数科技的视频生成模型,擅长动漫与风格化视频,参考生视频(主体一致性)能力突出。

video

Kimi 模型

1 tools

月之暗面

月之暗面的长上下文模型,超长文本阅读与文件解析是招牌能力,研报精读与资料整理常用。

text

SDXL

10 tools

Stability AI

Stability AI 的开源旗舰文生图模型,本地部署与微调生态极其庞大,是 Civitai、ComfyUI 等社区的基础模型。

image

Stable Diffusion 1.5

4 tools

Stability AI

Stable Diffusion 的经典版本,模型体积小巧、ControlNet 生态成熟,本地部署入门首选。

image

SD Turbo

1 tools

Stability AI

Stability AI 的实时文生图模型,一步出图、延迟极低,适合实时画布与交互场景。

image

SVD(Stable Video Diffusion)

1 tools

Stability AI

Stability AI 的开源视频扩散模型,图生视频方向的代表,社区微调与集成广泛。

video

Stable Audio 2.x

1 tools

Stability AI

Stability AI 的音乐与音效生成模型,可生成可商用的音乐、采样与音效,并提供商用授权方案。

audio

FLUX 系列

8 tools

Black Forest Labs

Black Forest Labs 的图像生成模型家族,出图质量与文字渲染业界领先,Pro/Dev/Schnell 三档覆盖商用与开源自托管。

image

Flux Pro

1 tools

Black Forest Labs

FLUX 的商用旗舰档,出图质量最高,面向专业设计与营销制作。

image

Flux Dev

1 tools

Black Forest Labs

FLUX 的开发者档,权重开放、可本地微调,是开源自托管的主力选择。

image

Flux Schnell

1 tools

Black Forest Labs

FLUX 的高速档,Apache 2.0 开源、一步出图,适合实时与大规模生成。

image

Real-ESRGAN

1 tools

开源社区

开源的图像超分辨率模型,本地运行、完全免费,是 Upscayl 等放大工具的核心引擎。

image

Midjourney V6

1 tools

Midjourney

Midjourney 第六代模型,图像质感与艺术风格业界标杆,创意设计与概念艺术的首选。

image

Midjourney V5

1 tools

Midjourney

Midjourney 第五代模型,写实能力提升显著,社区作品量庞大。

image

Recraft V3

2 tools

Recraft

Recraft 的第三代模型,矢量图生成与品牌风格控制业界领先,设计师工作流专用。

image

Ideogram 2.0

1 tools

Ideogram

Ideogram 第二代模型,文字渲染准确,海报、logo 概念与排版图像生成可靠。

image

Ideogram 1.0

1 tools

Ideogram

Ideogram 第一代模型,开创了文生图中的可靠文字渲染能力。

image

Leonardo Phoenix

1 tools

Leonardo AI

Leonardo AI 的新一代基础模型,图像质量与提示词依从性大幅提升,游戏与创意资产常用。

image

Leonardo Diffusion

1 tools

Leonardo AI

Leonardo AI 早期的扩散模型系列,风格模板丰富,创意社区作品量庞大。

image

Firefly 3

1 tools

Adobe

Adobe 第三代 Firefly 模型,与 Photoshop、Illustrator 深度集成,商用版权清晰。

image

Firefly 2

1 tools

Adobe

Adobe 第二代 Firefly 模型,生成式填充与文字效果成熟,设计工作流内置。

image

Mystic

1 tools

Freepik

Freepik 的高保真图像生成模型,出图细节丰富,与其素材库和商用授权体系一体。

image

Magnific Upscaler

1 tools

Magnific AI

Magnific 的图像放大模型,以幻觉式细节重建著称,可把低分辨率图像放大为高细节作品。

image

Playground v2

1 tools

Playground

Playground 的画布式图像模型,支持生成、局部重绘与图层编辑一体。

image

Krea Realtime

1 tools

Krea

Krea 的实时生成模型,画布上草图即时渲染放大,概念设计迭代速度极快。

image

Runway Gen-3 Alpha

1 tools

Runway

Runway 第三代视频模型,文生视频质量与运动控制出色,专业视频创作的主力之一。

video

Runway Gen-2

1 tools

Runway

Runway 第二代视频模型,文生视频普及化的里程碑,生态与教程资源成熟。

video

Pika 2.0

1 tools

Pika

Pika 第二代视频模型,特效模板与角色一致性视频能力突出,社媒短视频常用。

video

Pika 1.0

1 tools

Pika

Pika 第一代视频模型,轻量上手快,社媒创意视频的热门选择。

video

Dream Machine 1.5

1 tools

Luma AI

Luma AI 的视频模型,自然物理运动与电影感镜头见长,支持关键帧控制与循环视频。

video

Luma Capture

1 tools

Luma AI

Luma 的捕捉与重建技术,从视频照片重建三维场景与高斯溅射资产。

3dvideo

Mochi 1

1 tools

Genmo

Genmo 开源的视频模型,可本地部署与自托管,是开源视频生成的重要里程碑。

video

LTX Video

1 tools

LTX Studio

LTX Studio 的视频模型,面向影视叙事的分镜、角色一致性与镜头控制整合。

video

Synthesia 数字人

1 tools

Synthesia

Synthesia 的数字人播报模型,140 多种语言口型同步,企业培训与营销视频的标准方案。

video

Vidnoz 数字人

1 tools

Vidnoz

Vidnoz 的数字人模型库,1500 多个虚拟主播与多语言配音模板,营销与在线课程常用。

video

D-ID 数字人

1 tools

D-ID

D-ID 的照片驱动数字人模型,一张人脸照片即可开口说话,API 适合客服与营销集成。

video

HeyGen AI

1 tools

HeyGen

HeyGen 的数字人模型,脚本一键转真人质感口播,视频翻译与口型同步能力强。

video

PixVerse 模型

1 tools

PixVerse

PixVerse 的视频模型,特效模板与角色视频丰富,移动端体验完善。

video

剪映 AI 模型

1 tools

字节跳动

剪映内置的 AI 模型集合,覆盖智能剪辑、自动字幕、AI 特效与数字人,中文生态模板最全。

video

InVideo 模型

1 tools

InVideo

InVideo 的文本成片模型,自动匹配素材、配音与字幕,营销团队无需剪辑经验即可批量产出。

video

Opus 模型

1 tools

Opus Clip

Opus Clip 的切片模型,按话题与爆款潜力自动把长视频剪成短视频并加字幕构图。

video

VEED AI

1 tools

VEED

VEED 的在线剪辑 AI 模型集合,覆盖自动字幕、AI 配音、降噪与数字人。

videoaudio

Submagic 字幕模型

1 tools

Submagic

Submagic 的字幕模型,自动花字字幕、卡点与表情匹配,竖屏口播短视频专用。

video

Zebracat 模型

1 tools

Zebracat

Zebracat 的文本转视频模型,博客文案一键转为带素材、配音与字幕的视频。

video

Media.io 模型

1 tools

Media.io

Media.io 的浏览器内 AI 模型集合,覆盖字幕、配音、数字人与模板成片。

videoaudio

Pictory 模型

1 tools

Pictory

Pictory 的内容二创模型,把长文与录像自动转为短视频并匹配素材字幕。

video

Suno V4

1 tools

Suno

Suno 第四代音乐模型,完整歌曲与人声一体生成,结构自然、音质出色。

audio

Suno V3

1 tools

Suno

Suno 第三代音乐模型,文生歌质量首次达到可发布水准,引爆 AI 音乐普及。

audio

Udio V2

1 tools

Udio

Udio 的高保真音乐模型,人声歌曲与多流派完整曲目见长,支持局部重生成与精细编辑。

audio

ElevenLabs TTS

1 tools

ElevenLabs

ElevenLabs 的语音合成模型家族统称,真实度与情感表现力业界标杆。

audio

Eleven Multilingual v2

1 tools

ElevenLabs

ElevenLabs 的多语言语音模型,29 种语言跨语种一致性出色。

audio

Eleven Turbo v2

1 tools

ElevenLabs

ElevenLabs 的低延迟语音模型,实时对话与直播配音场景专用。

audio

Murf Voice

1 tools

Murf

Murf 的配音模型库,120 多种声音覆盖 20 多种语言,企业培训与讲解视频常用。

audio

LOVO Genny

1 tools

LOVO

LOVO 的 Genny 配音模型,500 多种声音与情绪表达,配音与视频编辑一体。

audio

Resemble 模型

1 tools

Resemble

Resemble 的语音克隆与实时语音模型,情感控制精细,产品与游戏语音常用。

audio

PlayHT 2.0

1 tools

Play.ht

Play.ht 的语音合成模型,低延迟流式输出适合实时场景,声音库覆盖多语言。

audio

Speechify Voice

1 tools

Speechify

Speechify 的朗读模型,文档、网页与图书转自然语音,学习与无障碍场景常用。

audio

Kits Voice

1 tools

Kits.AI

Kits.AI 的声音模型训练平台,可克隆自己的声线或使用授权艺术家声音完成 demo。

audio

Voicemod 变声模型

1 tools

Voicemod

Voicemod 的实时变声模型,游戏与直播场景实时变声,桌面端体验成熟。

audio

Adobe Enhance

1 tools

Adobe

Adobe Podcast 的语音增强模型,一键把嘈杂录音变成录音棚级音质,免费可用。

audio

Phoenix 模型

1 tools

LALAL.AI

LALAL.AI 的 Phoenix 分轨模型,人声、伴奏与乐器分离精度业界领先。

audio

Moises 模型

1 tools

Moises

Moises 的音轨分离与练习模型,变调变速、和弦检测与练习伴奏一体。

audio

AIVA 模型

1 tools

AIVA

AIVA 的作曲模型,影视与游戏配乐方向,可按情绪与风格生成交响乐等古典类配乐。

audio

Soundraw 模型

1 tools

Soundraw

Soundraw 的免版税配乐模型,按情绪、时长与结构定制背景音乐。

audio

Boomy 模型

1 tools

Boomy

Boomy 的歌曲生成模型,几十秒生成完整歌曲并一键发布流媒体。

audio

Beatoven 模型

1 tools

Beatoven.ai

Beatoven.ai 的配乐模型,按情绪曲线为播客与视频生成背景音乐。

audio

Mubert 模型

1 tools

Mubert

Mubert 的免版税音乐生成模型,创作者 App、API 与企业授权三路并行。

audio

Musicfy 模型

1 tools

Musicfy

Musicfy 的翻唱与文生歌模型,歌声换任意授权声音,demo 与整活内容常用。

audio

Riffusion 模型

1 tools

Riffusion

Riffusion 的开源音乐模型,频谱图起家,支持风格混合与歌词控制,可自托管。

audio

Krisp 模型

1 tools

Krisp

Krisp 的实时降噪模型,一键消除背景噪音与回声,远程办公通话的音质保障。

audio

Meshy-2

1 tools

Meshy

Meshy 的第二代 3D 生成模型,文生 3D 与图生 3D 质量提升,游戏与电商资产常用。

3d

Meshy-1

1 tools

Meshy

Meshy 的第一代 3D 生成模型,文生 3D 入门门槛低。

3d

Tripo SR

1 tools

Tripo AI

Tripo AI 的 3D 生成模型,图生 3D 与文生 3D 速度快、拓扑质量持续提升。

3d

Rodin Gen-2

1 tools

Deemos

Deemos 的高保真 3D 生成模型,专注人像与角色的 photorealistic 资产,影视与虚拟人项目常用。

3d

Kaedim 模型

1 tools

Kaedim

Kaedim 的图转 3D 模型加人工质检管线,概念图直接转为游戏可用的三维资产。

3d

CSM 模型

1 tools

CSM

CSM 的图与文本转 3D 场景模型,API 接入与实时渲染导出完善。

3d

Polycam 模型

1 tools

Polycam

Polycam 的 3D 扫描重建模型,手机激光雷达或照片即可完成真实场景建模。

3d

Wonder 模型

1 tools

Wonder Dynamics

Wonder Studio 的自动动捕与合成模型,实拍视频中的真人自动替换为 CG 角色。

3dvideo

Move 模型

1 tools

Move AI

Move AI 的无标记动作捕捉模型,普通摄像机即可完成专业级动捕。

3d

Sloyd 生成器

1 tools

Sloyd

Sloyd 的参数化 3D 资产生成器,拓扑干净、可调参数丰富,独立游戏开发的资产加速器。

3d

Skybox 模型

1 tools

Blockade Labs

Blockade Labs 的 360° 全景生成模型,文本或草图生成天空盒与虚拟环境。

3dimage

Spline AI

1 tools

Spline

Spline 的浏览器内 3D 设计 AI,按提示生成场景与动效并直接嵌入网页。

3d

DeepL 翻译模型

1 tools

DeepL

DeepL 的翻译模型,译文自然流畅长期领先业界,商务与本地化团队标配。

text

QuillBot 模型

1 tools

QuillBot

QuillBot 的改写与语法模型,多模式改写、摘要与查重一体,学生与写作者常备。

text

Wordtune 模型

1 tools

Wordtune

Wordtune 的句子级重写模型,即时给出多种表达建议,适合非母语者打磨文案。

text

Writefull 语言模型

1 tools

Writefull

Writefull 的学术写作模型,专为科研出版语气设计,期刊格式与引文库齐全。

text

Grammarly AI

1 tools

Grammarly

Grammarly 的写作助手模型,语法纠错、语气调整与抄袭检测一体,覆盖浏览器与移动键盘。

text

Jasper AI

1 tools

Jasper

Jasper 的营销内容模型,品牌语气训练与多渠道文案模板,企业营销自动化代表。

text

Copy.ai 模型

1 tools

Copy.ai

Copy.ai 的 GTM 工作流模型,销售文案、潜客培育与内容生产自动化。

text

Writesonic 模型

1 tools

Writesonic

Writesonic 的全能写作模型,覆盖 SEO 文章、广告文案与聊天机器人搭建。

text

Rytr AI

1 tools

Rytr

Rytr 的轻量写作模型,40 多种使用场景与语气模板,价格亲民上手快。

text

Consensus AI

1 tools

Consensus

Consensus 的学术问答模型,基于同行评审论文给出带研究结论与引用质量标记的答案。

searchknowledge

Elicit 模型

1 tools

Elicit

Elicit 的文献筛选模型,从 1.25 亿篇论文中提取方法、样本与结论,自动做系统综述数据表。

searchknowledge

Exa 嵌入模型

1 tools

Exa

Exa 的语义搜索嵌入模型,返回语义相关的网页与文档结果,是 LLM 应用的检索层。

search

Pi 模型

1 tools

Inflection

Inflection 的陪伴型对话模型,自然的语气与情感支持见长。

text

Character AI

1 tools

Character.AI

Character.AI 的角色扮演对话模型,社区自建角色生态庞大,陪伴与娱乐类代表。

text

Copilot 模型

1 tools

Microsoft

Microsoft Copilot 背后的模型组合,深度整合 Windows 与 Office 工作流。

textimage

Tabnine 模型

1 tools

Tabnine

Tabnine 的企业级补全模型,支持全私有部署与团队代码库定制。

code

Amazon Q 模型

1 tools

Amazon

Amazon Q Developer 的编程模型,深度集成 AWS 服务与 IDE,云原生开发专用。

code

Supermaven 模型

1 tools

Supermaven

Supermaven 的低延迟补全模型,超大上下文窗口可参考整个仓库。

code

Augment 模型

1 tools

Augment Code

Augment Code 的上下文引擎模型,深度代码库索引服务大规模真实项目。

code

Devin 模型

1 tools

Cognition

Cognition 的自主软件工程模型,能独立规划并完成整个开发任务。

code

v0 模型

1 tools

Vercel

v0 的界面生成模型,文本生成基于 React 与 Tailwind 的前端组件与页面。

codeimage

Replit AI

1 tools

Replit

Replit 的编程模型,从提示词直接搭建可运行应用并完成部署。

code

CodiumAI / Qodo 模型

1 tools

Qodo

Qodo 的测试生成与代码审查模型,分析代码行为并生成边界用例。

code

Otter 模型

1 tools

Otter.ai

Otter.ai 的会议转写模型,实时转写 Zoom、Teams 与 Meet 会议并生成摘要与行动项。

audiotext

Fireflies 模型

1 tools

Fireflies.ai

Fireflies.ai 的会议记录与对话智能模型,话题追踪与说话人分析完善。

audiotext

tl;dv 模型

1 tools

tl;dv

tl;dv 的会议录像与摘要模型,30 多种语言转写与高光剪辑。

audiotext

Fathom 模型

1 tools

Fathom

Fathom 的会议记事模型,实时高光标注并在会后秒级生成结构化摘要。

audiotext

Motion 调度引擎

1 tools

Motion

Motion 的 AI 排程引擎,自动为任务安排时间块并动态调整优先级。

knowledge

Reclaim 调度引擎

1 tools

Reclaim.ai

Reclaim.ai 的日历协调引擎,自动安排会议与专注时间并与 Slack 深度集成。

knowledge

Glean 模型

1 tools

Glean

Glean 的企业搜索模型,连接公司内所有应用与文档,基于权限体系给出带出处的答案。

searchknowledge

Mem 模型

1 tools

Mem

Mem 的知识关联模型,自动把零散笔记建立关联并支持向自己的知识库提问。

knowledge

Napkin 模型

1 tools

Napkin AI

Napkin AI 的文本转图形模型,一键把内容转为可编辑的示意图与信息图。

textimage

ClickUp Brain

1 tools

ClickUp

ClickUp 的项目管理 AI 模型,自动写任务、总结文档并回答项目状态问题。

textknowledge

Zapier AI

1 tools

Zapier

Zapier 的自动化 AI 模型,把数千应用串联并支持 AI 步骤与智能决策。

knowledge

Make AI

1 tools

Make

Make 的可视化自动化 AI 模型,支持复杂分支与数据变换场景。

knowledge

Gamma AI

1 tools

Gamma

Gamma 的演示生成模型,从大纲或文档自动生成精美幻灯片与站点。

textimage

Beautiful AI

1 tools

Beautiful.ai

Beautiful.ai 的智能排版模型,幻灯片随内容自动对齐与重排。

textimage

Figma AI

1 tools

Figma

Figma AI 的设计模型,根据提示生成设计稿、自动重命名图层与填充内容。

imagetext

Photoroom 模型

1 tools

Photoroom

Photoroom 的抠图与背景生成模型,一键抠图与商品图批量处理的业内标杆。

image

remove.bg 模型

1 tools

remove.bg

remove.bg 的专业抠图模型,人像与商品图边缘处理成熟稳定。

image

Pebblely 模型

1 tools

Pebblely

Pebblely 的商品图背景生成模型,按主题与风格批量出电商主图。

image

Flair 模型

1 tools

Flair AI

Flair AI 的商品场景合成模型,拖拽场景元素生成商业级营销图。

image

Interior AI 模型

1 tools

Interior AI

Interior AI 的室内风格转换模型,房间照片秒变多种风格设计方案。

image

PromeAI 模型

1 tools

PromeAI

PromeAI 的设计渲染模型,草图渲染、场景转换与图生视频面向建筑与工业设计。

image

Photo AI 模型

1 tools

Photo AI

Photo AI 的个人模型训练管线,自拍照片批量生成影棚级人像写真。

image

Craiyon 模型

1 tools

Craiyon

Craiyon 的免费文生图模型,无需注册即可生成,入门体验友好。

image

Artbreeder 模型

1 tools

Artbreeder

Artbreeder 的基因混合模型,滑杆调节风格属性创作角色与场景图。

image

SeaArt 模型

1 tools

SeaArt

SeaArt 的绘画与视频模型,中文界面与本地化模型齐全,免费额度充足。

imagevideo

Topaz Photo AI 模型

1 tools

Topaz Labs

Topaz Photo AI 的本地增强模型,降噪、锐化与放大三合一,完全离线运行。

image

Topaz Video 模型

1 tools

Topaz Labs

Topaz Video AI 的本地视频增强模型,降噪、插帧与 8K 放大,老素材修复常用。

video

Scenario 定制模型

1 tools

Scenario

Scenario 的风格定制模型,游戏工作室训练自有美术风格并批量生成资产。

image

Descript AI

1 tools

Descript

Descript 的剪辑模型,像编辑文档一样剪辑音视频,转写驱动剪辑体验开创者。

audiovideo

本地模型

5 tools

开源生态

在用户本地设备上运行的模型统称,数据不出域、隐私可控,适合对数据安全要求高的场景。

textcodeimage

开源模型

2 tools

开源生态

权重与代码开放的模型统称,可自由商用部署与微调,是本地与私有化方案的基础。

textimageaudiovideocode3d

第三方模型

1 tools

多厂商

由第三方厂商提供、被工具集成的模型统称,具体能力以各厂商官方文档为准。

textimage

自定义模型

4 tools

用户自训练

用户用自己的素材微调或训练的模型,常见于 Civitai、Tensor.Art 等社区的 LoRA 生态。

image

自研模型

5 tools

多厂商

厂商为其产品自研、未公开的模型统称,能力范围以各厂商官方文档为准。

textimageaudiovideo

任意 LLM

1 tools

多厂商

支持接入任意大语言模型的工具配置,通常可通过 API 或本地推理服务自由选择模型。

text

Canva AI

1 tools

Canva

Canva 内置的 AI 模型集合,覆盖文生图、智能编辑、文案与演示生成,设计协作平台一体。

imagetext

Fliki Voice

1 tools

Fliki

Fliki 的配音模型库,2000 多种 AI 声音覆盖 80 多种语言,文本转视频配音专用。

audiovideo

Kayra

1 tools

NovelAI

NovelAI 的故事续写模型,长篇小说创作专用,风格保持与角色一致性好。

text

NAI Diffusion

1 tools

NovelAI

NovelAI 的动漫风图像模型,角色一致性与同人创作社区口碑好。

image

Captions AI

1 tools

Captions

Captions 的口播视频模型,自动字幕、眼神接触校正与背景替换一体。

video

相关模型

模型页能帮你做什么

工具页描述的是产品能力,模型页回答的是底层引擎:同一厂商的不同版本差在哪、你的候选工具用的是不是同一底座。选型时先看底座再比较工具层功能,能更快缩小范围。