AI 软件
买软件、装软件之前先查:要不要花钱、能不能填自己的 Key、开源还是收费、用的人多不多。
收录 3,606 款 · 数据来自 GitHub 和 App Store,每天更新 · 更新时间 2026 年 10 月 5 日
用 AI 生成或编辑图片、视频、音乐的工具。
怎么排的:我们整理的常用软件在前,按分类排,同一类里评分人数多的在前;其余按 GitHub 收藏数从多到少。
- Flatkey CLIflatkey-ai用于图像、视频、音频和文本多模态 AI 生成与模型路由的 CLI 工具。免费开源 · MITGitHub 收藏 911
- InkloomInkloom-art面向品牌Logo设计的专业AI模型系统,涵盖品牌分析、字体、符号与排版生成工作流。许可证需自行查看GitHub 收藏 890
- AI Video EditorMartinDelophy基于浏览器和 WebGPU 的本地 AI 视频编辑器,深度集成了本地语音合成、AI 音乐生成、Whisper 字幕、画质修复及数字人等核心创作流。免费开源 · MITGitHub 收藏 888近 7 天 +12
- App.yumcut.comIgorShadurin开源AI短视频生成工具,端到端通过AI自动生成脚本、语音、视觉画面与字幕。许可证需自行查看GitHub 收藏 887近 7 天 +2
- OpenWorldLibOpenDCAI世界模型(World Models)的统一代码库,核心实现包含多模态理解、交互式视频生成、3D场景生成及VLA推理等AI模型工作流。免费开源 · Apache-2.0GitHub 收藏 878近 7 天 +1
- DenovaalfredxwDenova是面向小说写作与AI角色的创作平台,核心流程深度集成多Agent协作、自定义LLM/图像模型API调用与文本/插画生成。免费开源 · Apache-2.0GitHub 收藏 863近 7 天 +32
- Ima2 Genlidge-junima2-gen 核心功能为本地视觉生成运行环境与工作台,支持调用 OpenAI、Grok、Gemini 等多模型 API 及 OAuth 进行图像与视频生成。免费开源 · MITGitHub 收藏 855近 7 天 +22
- LibreYOLOLibreYOLO开源计算机视觉库,能目标检测、分割、姿态估计等本地深度学习模型的训练、推理与导出。许可证需自行查看GitHub 收藏 853近 7 天 +165
- Ecommerce Visual Copywriting Skillfeichanggege电商视觉与文案设计的 Agent Skill 规范与工作流,通过 AI 模型生成逐图视觉方案、图内文案及生图 Prompt。免费开源 · MITGitHub 收藏 842近 7 天 +24
- GameFactory 3AOpenDCAI利用AI与Coding Agent生成3D、动作、音频、CG视频及游戏代码资产。免费开源 · Apache-2.0GitHub 收藏 834近 7 天 +27
- Confucius4-TTSnetease-youdao基于大语言模型与语音编码器架构的多语言零样本文本转语音(TTS)系统。许可证需自行查看GitHub 收藏 825近 7 天 +4
- Capcut CLIrenezander030剪辑CLI/技能。免费开源 · MITGitHub 收藏 821近 7 天 +22
- ComfyUI MiniMaxH3 Easynkxx188面向 MiniMax H3 视频生成模型的 ComfyUI 自定义节点套件,核心工作流为文本/图像/参考视频生成与数字人合成。免费开源 · MITGitHub 收藏 807近 7 天 +17
- SOMA-XNVlabsSOMA-X 提供参数化人体与手部的可微表征、姿态反演及基于深度学习/数字人的核心模型管线,属于计算机视觉与数字人 AI 基础工具库。免费开源 · Apache-2.0GitHub 收藏 801近 7 天 +8
- Mlx Audio SwiftBlaizzy基于Apple Silicon MLX的Swift语音AI处理SDK,实现TTS、STT、语音活动检测等端侧AI模型推理工作流。免费开源 · MITGitHub 收藏 792近 7 天 +6
- Awesome Novel Agentmodoojunko核心产品为小说创作 AI Agent 协作框架,具备完整的设定、大纲、正文生成与反 AI 润色工作流。免费开源 · AGPL-3.0GitHub 收藏 780近 7 天 +9
- Aid Studiogzxx-2025开源AI漫剧与短剧创作平台。免费开源 · MITGitHub 收藏 778近 7 天 +175
- Topconf Paper Figure Galleryqwdwqfwq项目包含 FigureForge 工作流,结合本地 CLIP+BM25 检索和外部多模态/视觉 LLM 生成顶会论文主图初稿,具备实质 AI 功能。许可证需自行查看GitHub 收藏 762近 7 天 +201
- Cs BoardChenShuo2004通过本地音色克隆(IndexTTS)、文本模型拆解文案分镜和图片模型生成插画,全流程驱动白板动画视频制作。免费开源 · MITGitHub 收藏 757近 7 天 +91
- CozyClayNomaDamas浏览器端3D预演工作流。免费开源 · AGPL-3.0GitHub 收藏 753近 7 天 +21
- Nuyoah Xiezhen Promptnuyoah-ai-works专为人像与写真摄影设计的 Agent Skill,核心工作流为生成结构化生图提示词并结合生图模型进行复拍与画面控制。免费开源 · MITGitHub 收藏 753近 7 天 +6
- ClaudeAnimationBaseJohnHeibel核心工作流结合Claude大模型与p5.js代码库进行动画分镜、代码编写与多模态角色动画渲染生成。免费开源 · MITGitHub 收藏 752
- MOSS VLOpenMOSS专注于长视频与实时视频流理解的开源 11B 多模态视觉语言模型系列。免费开源 · Apache-2.0GitHub 收藏 752近 7 天 +12
- GPT Image Canvasmrslimslim基于 tldraw 构建的本地 AI 图像画布,核心功能包含文生图、图生图及 Agent 多步骤规划与 DAG 编排生成。免费开源 · MITGitHub 收藏 734近 7 天 +-2