AI 软件
买软件、装软件之前先查:要不要花钱、能不能填自己的 Key、开源还是收费、用的人多不多。
收录 3,606 款 · 数据来自 GitHub 和 App Store,每天更新 · 更新时间 2026 年 10 月 5 日
用 AI 生成或编辑图片、视频、音乐的工具。
怎么排的:我们整理的常用软件在前,按分类排,同一类里评分人数多的在前;其余按 GitHub 收藏数从多到少。
- Palmier Propalmier-ioPalmier Pro 是专为 AI 设计的 macOS 视频编辑器,内置 Seedance/Kling 等多模态生成模型。免费开源 · GPL-3.0GitHub 收藏 14.5K近 7 天 +33
- WaoowaoowaooAI全流程AI影视生产与创作工作台。许可证需自行查看GitHub 收藏 14.4K近 7 天 +47
- MoneyPrinterFujiwaraChoki项目核心工作流使用本地 Ollama 模型自动化生成短视频文案脚本及元数据。免费开源 · MITGitHub 收藏 14K近 7 天 +10
- Diffusionbee Stable Diffusion UIdivamgupta为 macOS 平台构建的 Stable Diffusion 本地生图图形界面工具,核心功能全部围绕文生图、图生图、Inpainting 和 ControlNet 等 AI 视觉生成工作流展开。免费开源 · AGPL-3.0GitHub 收藏 13.6K近 7 天 +3
- Draw A UISawyerHood核心功能通过 tldraw 画布将线框图转为 PNG 并调用 GPT-4 Vision 模型生成 HTML/Tailwind 代码。免费开源 · MITGitHub 收藏 13.6K近 7 天 +-1
- Braglatent-spaces专为Claude Code、Codex等Agent设计的视频生成技能,利用LLM生成脚本并结合Hyperframes合成宣传视频。免费开源 · MITGitHub 收藏 13.4K
- Speech To Speechhuggingface核心功能即为端到端语音 Agent 流水线(VAD->STT->LLM->TTS),全流程由 AI/大模型驱动,完全符合 AI 准入要求。免费开源 · Apache-2.0GitHub 收藏 13.4K近 7 天 +26
- Video Subtitle RemoverYaoFANGUK项目基于深度学习/AI算法模型(如STTN、LAMA、ProPainter、PP-OCRv4等)实现图片与视频硬字幕/水印去除与图像修复。免费开源 · Apache-2.0GitHub 收藏 13.1K近 7 天 +61
- CogVideozai-org开源文本/图像生成视频基础模型(CogVideo与CogVideoX)。免费开源 · Apache-2.0GitHub 收藏 13.1K近 7 天 +9
- Meshroomalicevision基于节点的3D计算机视觉与三维重建框架,内置和支持AI图像分割、单目深度估计、RoMa特征匹配等核心机器学习工作流。许可证需自行查看GitHub 收藏 13K近 7 天 +9
- Voice Proabus-aikorea音视频创作者提供完整的AI语音克隆、ASR转录与多语言TTS工作流,集成了Whisper、F5-TTS与CosyVoice等模型。免费开源 · GPL-3.0GitHub 收藏 13K近 7 天 +18
- CycleGANjunyanzCycleGAN 是经典的无配对图像到图像转换深度学习/GAN模型实现。许可证需自行查看GitHub 收藏 12.9K近 7 天 +1
- PaddleSpeechPaddlePaddle语音与音频深度学习工具包,涵盖ASR语音识别、TTS语音合成、音频分类与语音翻译等多项AI模型与推理服务。免费开源 · Apache-2.0GitHub 收藏 12.7K近 7 天 +2
- OpenCreatorkrillinai面向创作者的开源多模态 AI 工作区。免费开源 · Apache-2.0GitHub 收藏 12.6K近 7 天 +115
- HunyuanVideoTencent-Hunyuan腾讯混元开源的大型视频生成模型框架与权重。许可证需自行查看GitHub 收藏 12.6K近 7 天 +15
- ViMaxHKUDSViMax是端到端Agent视频生成系统,深度串联大模型、图像与视频生成模型进行剧本策划与视频制作。免费开源 · MITGitHub 收藏 12.5K近 7 天 +26
- Chandradatalab-to核心产品为自研 Chandra 2 复杂文档 OCR 视觉/语言模型,且提供基于 vLLM/Transformers 的完整推理工作流。免费开源 · Apache-2.0GitHub 收藏 12.4K近 7 天 +81
- Ian Xiaohei Illustrationshelloianneo专为 Codex 打造的 AI 配图生成 Skill,通过调用 AI 图像模型为中文文章生成特定视觉风格的手绘插画。免费开源 · MITGitHub 收藏 12.3K近 7 天 +158
- Edge TTSrany2调用微软Edge在线神经语音合成(TTS)服务进行语音生成,属于典型的AI多模态/语音合成应用与工具库。许可证需自行查看GitHub 收藏 12.2K近 7 天 +59
- Nerfstudionerfstudio-project神经网络辐射场(NeRF)的模块化开发与训练框架,提供完整的NeRF模型创建、训练与渲染AI工作流。免费开源 · Apache-2.0GitHub 收藏 12K近 7 天 +12
- Speechbrainspeechbrain基于PyTorch的语音与对话AI工具包。免费开源 · Apache-2.0GitHub 收藏 11.9K近 7 天 +10
- Korniakornia基于PyTorch的可微分计算机视觉库,提供几何视觉、数据增强及预训练AI模型(如LoFTR、SAM、RT-DETR等)核心算法工作流。免费开源 · Apache-2.0GitHub 收藏 11.4K近 7 天 +14
- DALLE2 PytorchlucidrainsDALL-E 2 文生图扩散模型的 PyTorch 复现与训练推理实现。免费开源 · MITGitHub 收藏 11.3K近 7 天 +-2
- NarratoAIlinyqh项目基于LLM和视觉大模型实现自动化影视解说、文案撰写、TTS配音及视频剪辑。免费开源 · MITGitHub 收藏 11.3K近 7 天 +53