AI 软件
买软件、装软件之前先查:要不要花钱、能不能填自己的 Key、开源还是收费、用的人多不多。
收录 3,606 款 · 数据来自 GitHub 和 App Store,每天更新 · 更新时间 2026 年 10 月 5 日
用 AI 生成或编辑图片、视频、音乐的工具。
怎么排的:我们整理的常用软件在前,按分类排,同一类里评分人数多的在前;其余按 GitHub 收藏数从多到少。
- ChatTTS UIjianchang512使用ChatTTS模型将文本合成为语音,支持WebUI操作及外部API推理调用。许可证需自行查看GitHub 收藏 7.7K近 7 天 +-3
- MeloTTSmyshell-ai多语言文本转语音(TTS)模型库,能语音合成推理与训练。免费开源 · MITGitHub 收藏 7.7K近 7 天 +2
- GLM-OCRzai-orgGLM-OCR 是专门面向复杂文档理解的多模态 OCR 模型及推理 SDK。免费开源 · Apache-2.0GitHub 收藏 7.5K近 7 天 +11
- MMagicopen-mmlabMMagic 是专注于图像/视频生成、编辑与修复的多模态 AIGC 工具箱。免费开源 · Apache-2.0GitHub 收藏 7.5K近 7 天 +2
- SD.Nextvladmandic核心产品为用于AI图像/视频生成与处理的全功能WebUI,直接运行扩散模型与多模态模型。免费开源 · Apache-2.0GitHub 收藏 7.4K近 7 天 +9
- Final2xEutropicAI跨平台图像超分辨率工具,核心功能依赖 PyTorch 与计算机视觉超分辨率模型处理图像。免费开源 · BSD-3-ClauseGitHub 收藏 7.3K近 7 天 +-3
- Stable Diffusion Webui DockerAbdBarho通过 Docker 部署运行 Stable Diffusion 及其 WebUI 进行文生图与图生图创作。许可证需自行查看GitHub 收藏 7.3K近 7 天 +1
- Auto Photoshop StableDiffusion PluginAbdullahAlfaraj在Photoshop中直接调用Stable Diffusion/ComfyUI实现文生图、图生图、扩图等AI图像生成工作流。免费开源 · MITGitHub 收藏 7.3K近 7 天 +2
- Infinite Canvasbasketikun核心产品为面向 AI 创作的开源无限画布工作台,深度集成生图、视频生成、Agent 助手与模型 API 接入工作流。免费开源 · MITGitHub 收藏 7.3K近 7 天 +167
- Civitaicivitai核心产品为 Stable Diffusion 等 AI 生态模型与定制化资产分享、训练与协作平台。免费开源 · Apache-2.0GitHub 收藏 7.3K近 7 天 +12
- ZonosZyphraZonos-v0.1 是开源多语种文本转语音(TTS)与声音克隆深度学习模型。免费开源 · Apache-2.0GitHub 收藏 7.2K
- BackgroundMattingV2PeterL1n仓库核心为高质量实时视频/图像抠图神经网络模型及推理训练开源代码。免费开源 · MITGitHub 收藏 7.2K
- DCGAN Tensorflowcarpedm20DCGAN深度卷积生成对抗网络的Tensorflow开源实现,核心功能即为深度学习生成模型的训练与图像生成。免费开源 · MITGitHub 收藏 7.2K近 7 天 +1
- InfographicantvisAI友好的声明式信息图生成与流式渲染引擎,深度集成Agent Skills及LLM生成工作流。免费开源 · MITGitHub 收藏 6.9K近 7 天 +60
- pix2pixHDNVIDIA基于条件生成对抗网络(cGAN)的高分辨率图像合成与编辑模型实现。许可证需自行查看GitHub 收藏 6.9K近 7 天 +-4
- Jaaz11cafe开源多模态画布创意AI助手,能一键图像/视频生成、对接GPT-4o/Kling/ComfyUI等多模态AI工作流。许可证需自行查看GitHub 收藏 6.7K近 7 天 +19
- Dramaclawdramaclaw端到端 AIGC 视频与短剧生成引擎。许可证需自行查看GitHub 收藏 6.7K近 7 天 +97
- JellyfishForget-C面向AI短剧制作的全流程工作台,直接集成剧本理解分镜、多模型管理及图像视频生成任务。免费开源 · Apache-2.0GitHub 收藏 6.6K近 7 天 +105
- Podcastfysouzatharsis核心功能即利用GenAI多模态大模型及TTS生成多语言播客对话音频,AI为产品主干业务。免费开源 · Apache-2.0GitHub 收藏 6.6K近 7 天 +9
- StyleTTS 2yl4579基于扩散模型与语音大模型的文本转语音(TTS)模型训练与推理系统。免费开源 · MITGitHub 收藏 6.4K近 7 天 +3
- FunClipmodelscopeFunClip 是基于 FunASR 语音识别、说话人分离与 LLM/多模态模型的自动化视频剪辑工具。免费开源 · MITGitHub 收藏 6.4K近 7 天 +10
- Orpheus TTScanopyai基于Llama-3b骨干构建的开源文本转语音(TTS)模型系统,包含预训练、微调与实时流式推理AI工作流。免费开源 · Apache-2.0GitHub 收藏 6.3K
- PedalboardspotifyPedalboard 由 Spotify 音频智能实验室开发,专门设计并深度集成于机器学习/TensorFlow 数据增强及音频 AI 训练与推理管线中。免费开源 · GPL-3.0GitHub 收藏 6.3K近 7 天 +7
- pyAudioAnalysistyiannak音频特征提取、机器学习分类、分割与回归(支持SVM等模型训练和推理)。免费开源 · Apache-2.0GitHub 收藏 6.3K近 7 天 +1