AI 软件
买软件、装软件之前先查:要不要花钱、能不能填自己的 Key、开源还是收费、用的人多不多。
收录 3,606 款 · 数据来自 GitHub 和 App Store,每天更新 · 更新时间 2026 年 10 月 5 日
用 AI 生成或编辑图片、视频、音乐的工具。
怎么排的:我们整理的常用软件在前,按分类排,同一类里评分人数多的在前;其余按 GitHub 收藏数从多到少。
- Spleeterdeezer基于深度学习/TensorFlow的开源音频音轨分离库与预训练模型。免费开源 · MITGitHub 收藏 28.5K近 7 天 +2
- InvokeAIinvoke-ai核心产品为基于扩散模型的本地/WebUI图像生成与多模态创作工具。免费开源 · Apache-2.0GitHub 收藏 28.3K近 7 天 +33
- UltimatevocalremoverguiAnjok07使用深度神经网络与音源分离AI模型(如MDX-Net、Demucs等)从音频中分离提取人声与伴奏。免费开源 · MITGitHub 收藏 26.5K近 7 天 +70
- LLaVAhaotian-liuLLaVA是多模态大语言与视觉模型开源项目,提供端到端多模态模型训练、评测与推理服务代码。免费开源 · Apache-2.0GitHub 收藏 25.1K近 7 天 +12
- WhisperXm-bain基于 Whisper 与 forced alignment 的高精度语音识别与说话人分离,属于典型的语音 AI 推理与应用工具。免费开源 · BSD-2-ClauseGitHub 收藏 24.4K近 7 天 +88
- CosyVoiceQwenAudio多语言大模型语音合成与声音克隆系统(TTS),具备完整的模型训练、推理与部署工作流。免费开源 · Apache-2.0GitHub 收藏 23.8K近 7 天 +41
- Deepfaceserengil核心功能即为人脸识别与属性分析等深度学习视觉模型推理框架。免费开源 · MITGitHub 收藏 23.5K近 7 天 +31
- Video2xk4yt3x基于深度学习/ML模型(Real-ESRGAN、Real-CUGAN、RIFE等)实现的视频超分辨率与插帧处理。免费开源 · AGPL-3.0GitHub 收藏 22K近 7 天 +150
- HivisionIDPhotosZeyi-Lin基于 MODNet、RetinaFace 等 AI 视觉模型实现轻量级智能人像抠图与标准证件照生成工作流。免费开源 · Apache-2.0GitHub 收藏 21.6K近 7 天 +16
- FunASRmodelscopeFunASR 是端到端语音识别与音频处理工具包,核心提供 ASR、VAD、标点恢复和说话人分离等 AI 模型训练与推理管线。免费开源 · MITGitHub 收藏 20.6K近 7 天 +51
- Dianari-labs开源的1.6B参数高保真对话文本转语音(TTS)模型与推理代码。免费开源 · Apache-2.0GitHub 收藏 19.4K近 7 天 +-5
- Pyvideotransjianchang512音视频AI翻译、配音与转录工具。免费开源 · GPL-3.0GitHub 收藏 19.2K近 7 天 +51
- SpeechNVIDIA-NeMo用于自动语音识别(ASR)、文本转语音(TTS)和语音多模态大模型的AI训练与推理生成式框架。免费开源 · Apache-2.0GitHub 收藏 18.5K近 7 天 +28
- Janusdeepseek-aiJanus是DeepSeek开源的多模态理解与图像生成统一模型。免费开源 · MITGitHub 收藏 17.8K近 7 天 +-2
- Wan2.2Wan-Video开源大规模视频生成基础模型与推理套件。免费开源 · Apache-2.0GitHub 收藏 17.7K近 7 天 +67
- Toonflow AppHBAI-LtdToonflow 是开源 AI 短剧漫剧视频创作平台,深度集成剧本生成、角色三视图、AI 图像与视频模型生成及 Agent 工作流。免费开源 · MITGitHub 收藏 16.5K近 7 天 +322
- Stable Diffusion Webui Colabcamenduru基于 Google Colab 运行 Stable Diffusion WebUI 及各类图像/视频扩散模型生成工作流。免费开源 · UnlicenseGitHub 收藏 15.9K近 7 天 +6
- Bringing Old Photos Back To Lifemicrosoft基于深度学习的老照片修复算法与官方PyTorch实现。免费开源 · MITGitHub 收藏 15.7K近 7 天 +-1
- Banana SlidesAnionex核心产品为原生 AI PPT 生成工具,结合大模型实现大纲生成、局部重绘与智能排版等核心工作流。免费开源 · AGPL-3.0GitHub 收藏 15.7K近 7 天 +15
- First Order ModelAliaksandrSiarohinNeurIPS 论文开源代码,能利用深度学习生成模型实现图像驱动动画与动作迁移。免费开源 · MITGitHub 收藏 15K
- Palmier Propalmier-ioPalmier Pro 是专为 AI 设计的 macOS 视频编辑器,内置 Seedance/Kling 等多模态生成模型。免费开源 · GPL-3.0GitHub 收藏 14.5K近 7 天 +33
- MoneyPrinterFujiwaraChoki项目核心工作流使用本地 Ollama 模型自动化生成短视频文案脚本及元数据。免费开源 · MITGitHub 收藏 14K近 7 天 +10
- Diffusionbee Stable Diffusion UIdivamgupta为 macOS 平台构建的 Stable Diffusion 本地生图图形界面工具,核心功能全部围绕文生图、图生图、Inpainting 和 ControlNet 等 AI 视觉生成工作流展开。免费开源 · AGPL-3.0GitHub 收藏 13.6K近 7 天 +3
- Draw A UISawyerHood核心功能通过 tldraw 画布将线框图转为 PNG 并调用 GPT-4 Vision 模型生成 HTML/Tailwind 代码。免费开源 · MITGitHub 收藏 13.6K近 7 天 +-1