Easy Dataset综合评价:一般

ConardLi · AI 应用

把文档处理成大模型微调和评测数据集的桌面与本地工具。

许可证需自行查看
GitHub 收藏15K近 7 天 +10
代码最近更新2026 年 5 月 1 日
许可证许可证需自行查看

主要用于将文档解析切分并生成问答数据集,同时支持模型评测和盲测打分。适合需要准备模型训练数据或评测模型的人使用。可以在电脑上直接下载客户端,或通过本地部署启动。

用起来难吗要填自己的模型 Key在哪用WindowsmacOSLinux网页自己部署

能做什么

  • 解析文档并切分文本
  • 自动生成单轮与多轮问答
  • 支持图片问答与蒸馏造数
  • 自动评测模型与双盲打分
  • 导出 Alpaca 等微调格式

怎么开始

  1. 下载对应系统的客户端安装包并安装打开
  2. 配置大模型接口地址与 Key 或连接本地模型
  3. 导入文档或主题并按需生成微调或评测数据集

选它,如果你……

  • 你需要把本地文档转换成微调所需的高质量问答
  • 你想用自动判卷或双盲测试对比不同模型的效果
  • 你想直接下载桌面软件在本地电脑上处理数据集

别选,如果你……

  • 你没有可用的大模型接口密钥或本地没有模型
  • 你只是想简单找个现成的 AI 聊天而不用做数据集

怎么用

需要在它自己的网站或应用里注册使用。

多少钱、在哪买

价格以官网为准。

综合评价:一般(更新放缓或问题处理差)

更新放缓近 90 天改代码 0 次;最近一次发版是 180 天前(1.7.3)
问题处理暂不评近 90 天只有 6 个新问题,太少不评
用的人多GitHub 收藏 1.5 万,近 7 天新增 10;37 人参与开发
用户口碑暂不计用过的人的评价满 5 条后才算进来

提醒:许可证有附加条件或没写清,拿去商用前先看清楚

数字取自 GitHub 的公开记录(2026/10/5), 用过的人的评价来自本页口碑。自己核对:项目主页、问题、外部提交的修改、发版记录。

怎么评的

只看公开、能核对的数据,不打分数,只给四档结论,每一项的依据都写在旁边。

  • 更新:近 90 天改了多少次代码、最近一次发版是哪天。7 天内有改动并且改得多或常发版,算「很活跃」;30 天内有改动算「活跃」;半年内算「放缓」;半年以上没动或者已经归档,算「停更」。
  • 问题处理:近 90 天新开的问题解决了几成、一般几天解决、外部提交的修改积压了多少。解决八成以上、一般一周内解决、积压不比合进去的多,算「好」;解决不到一半算「差」;其余算「一般」。新问题不到 10 个的不评。
  • 用的人:GitHub 收藏 5 万以上算很多,1 万以上算多,1 千以上算一般。旁边写近 7 天新增多少、多少人参与开发。
  • 用户口碑:用过的人的评价满 5 条才算进来(注册不满 7 天的账号不算);平均分在 2.5 分及以下,总评降一档。
  • 总评四档:还在更新、问题处理好、用的人多 → 推荐;还在更新 → 不错;更新放缓或问题处理差 → 一般;半年以上没更新 → 谨慎。许可证有附加条件、商用受限的,单独提醒,不影响总评。
  • 收费软件(ChatGPT、Cursor 这类)没有公开的问题记录,就看 App Store:最近一次更新在 30 天内算「活跃」,半年内算「放缓」,半年以上算「停更」;打分人数 10 万以上算很多,1 万以上算多,1 千以上算一般;评分 4 分以上算好,2.5 分及以下算差,打分不到 100 人不评。再加上用过的人的评价。

收藏数能刷,所以只占一项;更新和问题处理很难刷。数据每天更新,超过两周没更新的不评。

最近更新和热度

  1. 1.7.3

    内置支持 MiniMax,新增自动补齐思维链,修复蒸馏页面卡顿

  2. 1.7.2

    优化页面切换卡顿和数据加载速度,规范模型厂商图标展示

  3. 1.7.1

    上传限制提至 300MB,支持批量删文本块,加快大数据集导出

近 30 天 GitHub 收藏:+10
用过?说两句

用户口碑

用户评价

还没有评价

平均分和优缺点人数只统计说自己用过的评价。注册未满 7 天的账号暂不计分。参与计分不足 5 条时不显示平均分。

你用过吗
评分
评价公开可见,不要写账号密码、Key 或验证码。

用户提问

还没有提问

还没有人提问。可以问装在哪、要不要花钱、能不能接自己的 Key、中文好不好用。

提问公开可见,用过的人都能回答。

数据来源:GitHub,每天更新,更新时间 2026 年 10 月 6 日。 信息有误?告诉我们。

Easy Dataset:是什么、要不要花钱、怎么用 | 模真真