AI 软件
买软件、装软件之前先查:要不要花钱、能不能填自己的 Key、开源还是收费、用的人多不多。
收录 3,606 款 · 数据来自 GitHub 和 App Store,每天更新 · 更新时间 2026 年 10 月 5 日
用 AI 生成或编辑图片、视频、音乐的工具。
怎么排的:我们整理的常用软件在前,按分类排,同一类里评分人数多的在前;其余按 GitHub 收藏数从多到少。
ComfyUIComfy用拼积木的方式搭 AI 绘图和视频工作流的开源工具。免费开源 · GPL-3.0能接自己的 KeyGitHub 收藏 136.1K近 7 天 +779- Stable Diffusion web UIAUTOMATIC1111核心产品为基于Stable Diffusion的Web UI,核心工作流为txt2img与img2img等扩散模型图像生成与微调。免费开源 · AGPL-3.0GitHub 收藏 165.2K近 7 天 +48
- MoneyPrinterTurboharry0703一站式 AI 短视频生成工具。免费开源 · MITGitHub 收藏 128.4K近 7 天 +1.9K
- Open Designnexu-io开源Claude Design替代方案,核心工作流基于Coding Agent与大模型生成UI原型、幻灯片、图片与动效应物。免费开源 · Apache-2.0GitHub 收藏 99.4K近 7 天 +978
- Deep Live Camhacksider基于单张图片的实时人脸替换与视频深度伪造,深度依赖GFPGAN与inswapper等AI视觉模型推理。免费开源 · AGPL-3.0GitHub 收藏 96.9K近 7 天 +56
- OpenMontagecalesthio基于智能体的开源视频生成与制作系统,深度集成多模态视频/图像生成与TTS模型完成全流程制作。免费开源 · AGPL-3.0GitHub 收藏 63K近 7 天 +1.3K
- GPT SoVITSRVC-Boss基于Few-shot/Zero-shot的声音克隆与TTS语音合成模型与WebUI工具链。免费开源 · MITGitHub 收藏 62.3K近 7 天 +106
- Faceswapdeepfakes基于深度学习的人脸提取、模型训练与换脸合成工具。免费开源 · GPL-3.0GitHub 收藏 57.6K近 7 天 +10
- Hyperframesheygen-com专为 AI 智能体与 Coding Agent 设计的 HTML 视频生成框架,深度集成了 21 项 Agent skills 与多模态生成工作流。免费开源 · Apache-2.0GitHub 收藏 56.6K近 7 天 +2.8K
- VoiceStudiodebpalashVoiceStudio 是开源语音克隆与设计、视频配音及转录的多模态 AI 桌面应用。免费开源 · AGPL-3.0GitHub 收藏 53K近 7 天 +11.7K
- Supervisionroboflow计算机视觉工具库,提供目标检测/分割模型连接器、标注与数据集处理等AI视觉工作流。免费开源 · MITGitHub 收藏 51.1K近 7 天 +53
- Umi OCRhiroi-sora离线OCR文字识别与排版解析,内置PaddleOCR/RapidOCR等机器学习模型实现截图与文档识别工作流。免费开源 · MITGitHub 收藏 47.6K近 7 天 +57
- TTScoqui-ai基于深度学习的文本转语音 (TTS) 与声音克隆工具库及模型训练套件。免费开源 · MPL-2.0GitHub 收藏 46.1K近 7 天 +26
- ChatTTS2noise面向对话场景的生成式语音合成(TTS)模型与推理算法。免费开源 · AGPL-3.0GitHub 收藏 39.9K近 7 天 +13
- Tesseract.jsnaptha基于 Tesseract 封装的纯 JS/WebAssembly OCR 库,能图片多语言文字识别与深度学习 OCR 推理。免费开源 · Apache-2.0GitHub 收藏 38.8K近 7 天 +12
- VoxCPMOpenBMBVoxCPM2 是开源文本转语音(TTS)模型系统。免费开源 · Apache-2.0GitHub 收藏 38.3K近 7 天 +260
- OpenVoicemyshell-aiOpenVoice 是音频基础模型与即时声音克隆项目。免费开源 · MITGitHub 收藏 37.8K近 7 天 +63
- Real-ESRGANxinntao通用图像与视频超分辨率修复算法及PyTorch/NCNN模型推理与训练。免费开源 · BSD-3-ClauseGitHub 收藏 37K近 7 天 +49
- Diffusershuggingface用于图像、视频和音频生成的前沿扩散模型(Diffusion Models)核心开发与推理训练库。免费开源 · Apache-2.0GitHub 收藏 34.6K近 7 天 +26
- CLIPopenaiCLIP是OpenAI开源的多模态图文对比学习神经网络模型。免费开源 · MITGitHub 收藏 34.4K近 7 天 +30
- Awesome GPT Image 2freestylefly核心提供 GPT Image 提示词库、工业级模板、Agent Skill 及在线生图体验。免费开源 · MITGitHub 收藏 33.9K近 7 天 +286
- EasyOCRJaidedAIEasyOCR 是基于 PyTorch/CRAFT/CRNN 深度学习的光学字符识别 (OCR) 核心工具库,AI 视觉与模型推理为其首要功能与产品价值。免费开源 · Apache-2.0GitHub 收藏 30K近 7 天 +9
- Open Generative AIAnil-matcha核心产品为开源多模态AI创作工作台,支持图像/视频/音频生成、口型同步以及本地和云端模型推理工作流。免费开源 · MITGitHub 收藏 29.6K近 7 天 +280
- Pixelle-VideoATH-MaaSPixelle-Video核心工作流全自动调用LLM撰写文案、AI生图生视频与TTS合成。免费开源 · Apache-2.0GitHub 收藏 28.6K近 7 天 +151