AI 软件
买软件、装软件之前先查:要不要花钱、能不能填自己的 Key、开源还是收费、用的人多不多。
收录 3,606 款 · 数据来自 GitHub 和 App Store,每天更新 · 更新时间 2026 年 10 月 5 日
用 AI 生成或编辑图片、视频、音乐的工具。
怎么排的:我们整理的常用软件在前,按分类排,同一类里评分人数多的在前;其余按 GitHub 收藏数从多到少。
- WhisperXm-bain基于 Whisper 与 forced alignment 的高精度语音识别与说话人分离,属于典型的语音 AI 推理与应用工具。免费开源 · BSD-2-ClauseGitHub 收藏 24.4K近 7 天 +88
- Index TTSindex-tts工业级零样本语音合成(Zero-Shot TTS)与音色/情感克隆。许可证需自行查看GitHub 收藏 24.3K近 7 天 +80
- Gaussian Splattinggraphdeco-inria核心为3D高斯泼溅辐射场实时渲染与优化的计算机视觉/深度学习实现,包含基于PyTorch与CUDA的模型训练与评估流程。许可证需自行查看GitHub 收藏 24.1K近 7 天 +87
- CosyVoiceQwenAudio多语言大模型语音合成与声音克隆系统(TTS),具备完整的模型训练、推理与部署工作流。免费开源 · Apache-2.0GitHub 收藏 23.8K近 7 天 +41
- Deepfaceserengil核心功能即为人脸识别与属性分析等深度学习视觉模型推理框架。免费开源 · MITGitHub 收藏 23.5K近 7 天 +31
- Video2xk4yt3x基于深度学习/ML模型(Real-ESRGAN、Real-CUGAN、RIFE等)实现的视频超分辨率与插帧处理。免费开源 · AGPL-3.0GitHub 收藏 22K近 7 天 +150
- HivisionIDPhotosZeyi-Lin基于 MODNet、RetinaFace 等 AI 视觉模型实现轻量级智能人像抠图与标准证件照生成工作流。免费开源 · Apache-2.0GitHub 收藏 21.6K近 7 天 +16
- FunASRmodelscopeFunASR 是端到端语音识别与音频处理工具包,核心提供 ASR、VAD、标点恢复和说话人分离等 AI 模型训练与推理管线。免费开源 · MITGitHub 收藏 20.6K近 7 天 +51
- Dianari-labs开源的1.6B参数高保真对话文本转语音(TTS)模型与推理代码。免费开源 · Apache-2.0GitHub 收藏 19.4K近 7 天 +-5
- Pyvideotransjianchang512音视频AI翻译、配音与转录工具。免费开源 · GPL-3.0GitHub 收藏 19.2K近 7 天 +51
- Hypithypit-ai借助 AI Agent 与多模态生成模型(如 Seedance、GPT Image 等)进行视频克隆、批量生成的自动化框架。许可证需自行查看GitHub 收藏 19.2K近 7 天 +2.1K
- LivePortraitKlingAIResearch基于深度学习模型的肖像动作驱动与视频生成动画算法(LivePortrait)。许可证需自行查看GitHub 收藏 19.2K近 7 天 +33
- SpeechNVIDIA-NeMo用于自动语音识别(ASR)、文本转语音(TTS)和语音多模态大模型的AI训练与推理生成式框架。免费开源 · Apache-2.0GitHub 收藏 18.5K近 7 天 +28
- CodeFormersczhou核心是基于 Codebook Lookup Transformer 的盲人脸修复与图像/视频增强算法与深度学习模型。许可证需自行查看GitHub 收藏 18.2K近 7 天 +5
- Janusdeepseek-aiJanus是DeepSeek开源的多模态理解与图像生成统一模型。免费开源 · MITGitHub 收藏 17.8K近 7 天 +-2
- Wan2.2Wan-Video开源大规模视频生成基础模型与推理套件。免费开源 · Apache-2.0GitHub 收藏 17.7K近 7 天 +67
- Instant NgpNVlabs神经辐射场(NeRF)等神经图形基元的训练与渲染。许可证需自行查看GitHub 收藏 17.6K近 7 天 +4
- Toonflow AppHBAI-LtdToonflow 是开源 AI 短剧漫剧视频创作平台,深度集成剧本生成、角色三视图、AI 图像与视频模型生成及 Agent 工作流。免费开源 · MITGitHub 收藏 16.5K近 7 天 +322
- Stable Diffusion Webui Colabcamenduru基于 Google Colab 运行 Stable Diffusion WebUI 及各类图像/视频扩散模型生成工作流。免费开源 · UnlicenseGitHub 收藏 15.9K近 7 天 +6
- Bringing Old Photos Back To Lifemicrosoft基于深度学习的老照片修复算法与官方PyTorch实现。免费开源 · MITGitHub 收藏 15.7K近 7 天 +-1
- Banana SlidesAnionex核心产品为原生 AI PPT 生成工具,结合大模型实现大纲生成、局部重绘与智能排版等核心工作流。免费开源 · AGPL-3.0GitHub 收藏 15.7K近 7 天 +15
- Duix Avatarduixcom基于多模态AI的数字人与声音克隆、离线视频生成及实时语音驱动虚拟形象。许可证需自行查看GitHub 收藏 15.6K近 7 天 +49
- Hunyuan3D 2Tencent-Hunyuan基于大规模 Hunyuan3D 扩散模型的 3D 资产生成与纹理合成系统。许可证需自行查看GitHub 收藏 15K近 7 天 +37
- First Order ModelAliaksandrSiarohinNeurIPS 论文开源代码,能利用深度学习生成模型实现图像驱动动画与动作迁移。免费开源 · MITGitHub 收藏 15K