AI 软件
买软件、装软件之前先查:要不要花钱、能不能填自己的 Key、开源还是收费、用的人多不多。
收录 3,606 款 · 数据来自 GitHub 和 App Store,每天更新 · 更新时间 2026 年 10 月 5 日
用 AI 生成或编辑图片、视频、音乐的工具。
怎么排的:我们整理的常用软件在前,按分类排,同一类里评分人数多的在前;其余按 GitHub 收藏数从多到少。
- MOSS Transcribe DiarizeOpenMOSS端到端开源语音识别与说话人分离模型及推理/字幕生成工作流。免费开源 · Apache-2.0GitHub 收藏 2.1K近 7 天 +14
- LocalMiniDramaxuanyustudio本地AI短剧生成工具。免费开源 · MITGitHub 收藏 1.9K近 7 天 +54
- CyberVerseLynpoint开源实时数字人与语音交互智能体框架,深度集成FlashHead、LiveAct等模型推理与LLM/RAG全链路交互流程。免费开源 · GPL-3.0GitHub 收藏 1.7K近 7 天 +6
- Video Podcast MakerAgents365-ai面向编码智能体的主题生成4K视频工作流。免费开源 · MITGitHub 收藏 1.6K近 7 天 +12
- AI Moive Studio869413421AI驱动的视频创作工作台,提供剧本拆解、分镜生成、文本/图片/视频节点连线生成成片的全流程AI创作工作流。免费开源 · Apache-2.0GitHub 收藏 1.6K近 7 天 +9
- AI Fusion VideoStonewuu基于Agent的全流程AI短剧/漫剧/视频创作平台。免费开源 · MITGitHub 收藏 1.6K
- Arcads Claude Codekrusemediallc核心功能即通过Claude Code/Cursor驱动Arcads及Sora/Veo/Kling/Seedance等多模态AI视频与图像生成API。免费开源 · MITGitHub 收藏 1.6K近 7 天 +26
- Fun-ASRQwenAudio通义实验室开源的端到端语音识别与多语言 ASR 模型套件,提供完整的模型权重、推理与微调工作流。免费开源 · Apache-2.0GitHub 收藏 1.6K近 7 天 +5
- Nightingalerzru核心功能深度依赖机器学习模型(UVR/Demucs 分轨与 WhisperX 歌词对齐),构成完整卡拉OK工作流。免费开源 · GPL-3.0GitHub 收藏 1.5K近 7 天 +7
- Portable Local Studiotechjarves跨平台本地多模态 AI 工作台,集成本地生图、LLM 对话、Whisper 语音转文字及 Kokoro 文本转语音工作流。免费开源 · MITGitHub 收藏 1.5K近 7 天 +32
- Ian Handdrawn Ppthelloianneo面向 Codex 的 AI Agent Skill。免费开源 · MITGitHub 收藏 1.5K近 7 天 +3
- Hand Drawn Stylesthreerocks为 AI Agent 与图像生成模型提供手绘画风提示词配方与结构化调用包。免费开源 · MITGitHub 收藏 1.4K近 7 天 +37
- 4DAnyoneant-research4DAnyone 核心功能为利用生成式扩散与去噪模型从单目视频生成多视角视频用于4DGS重建。免费开源 · Apache-2.0GitHub 收藏 1.4K近 7 天 +9
- ComfyUI Qwenmultianglejtydhr88用于多角度图像生成的ComfyUI自定义节点,输出适配Qwen多视角LoRA模型的结构化Prompt。免费开源 · MITGitHub 收藏 1.4K近 7 天 +7
- Irodori TTSAratako基于Flow Matching与Rectified Flow Diffusion Transformer的文本转语音(TTS)开源模型与推理/训练框架。免费开源 · MITGitHub 收藏 1.4K近 7 天 +47
- PireelpireelPireel 是面向视频剪辑用户的开源 AI 视频编辑器。免费开源 · AGPL-3.0GitHub 收藏 1.3K近 7 天 +21
- Reelmimicedenfunf由 Claude Code 或 Codex 多智能体协作解析参考视频风格、规划分镜、生成并审核 2D 动画视频。免费开源 · MITGitHub 收藏 1.3K
- Slides GrabNomaDamasClaude Code、Codex 等 AI 编程代理提供基于 HTML 的幻灯片生成、选区迭代与图像生成工作流。免费开源 · MITGitHub 收藏 1.2K近 7 天 +3
- ComfyUI H3 Motion ContextNikoDemon80专门针对MiniMax H3多模态视频/音频生成模型的ComfyUI自定义节点。免费开源 · GPL-3.0GitHub 收藏 1.2K近 7 天 +139
- MOVAOpenMOSS音视频同步生成的开源多模态基座模型,提供权重、推理、微调及评测全套AI流程。免费开源 · Apache-2.0GitHub 收藏 1.1K近 7 天 +1
- Open AI Canvasddcat-ai影策定位为开源AI影视与短剧创作工作台,核心流程集成多模态生成(文本、图片、视频、音频)、Agent工作流与模型渠道调度。免费开源 · MITGitHub 收藏 1.1K近 7 天 +54
- Infinite Canvastigerowo核心产品为开源 AI 多模态创作工作台。免费开源 · AGPL-3.0GitHub 收藏 1.1K近 7 天 +49
- Banana ClaudeAgriciDaniel为 Claude Code 提供的 Gemini 图像生成、编辑与提示词规划技能,AI 是主产品价值。免费开源 · MITGitHub 收藏 1.1K近 7 天 +5
- TongFlowtong-ioTongFlow 是模态优先的生成式 AI 工作流平台,原生集成多种文本、图像、音视频及 3D 大模型并提供多模型路由与画布编排。免费开源 · AGPL-3.0GitHub 收藏 1K近 7 天 +3