Randatum 是一款离线优先的桌面随机数据工作室。所有计算都在你的电脑本地完成,不联网、不上传数据。它能一键生成随机数字与颜色、批量造出结构化测试数据、按规范方法完成科研随机化,并为每一次运行保留可复现的记录。
1. 安装与启动
Randatum 支持 macOS 与 Windows 桌面端。
- macOS:打开安装包,将 Randatum 拖入「应用程序」文件夹,从启动台打开。
- Windows:运行安装程序(.exe),按向导安装后从开始菜单启动。
默认窗口大小 1280×800,可自由缩放(最小 900×600)。无需登录、无需联网即可使用全部免费功能。
2. 界面总览与快捷键
窗口左侧是固定导航栏,共六个工作区。窗口较窄时导航栏自动收起为图标模式(悬停显示名称)。
| 工作区 | 作用 | 快捷键 |
|---|---|---|
| 🎲 快速随机 | 快速生成随机数字或颜色 | ⌘1 / Ctrl+1 |
| 📊 数据工作室 | 生成多字段结构化测试数据 | ⌘2 / Ctrl+2 |
| 🔬 科研随机化 | 分组、抽样、重复模拟 | ⌘3 / Ctrl+3 |
| 🔖 模板 | 保存与复用生成方案 | ⌘4 / Ctrl+4 |
| 🕘 运行记录 | 查看历史任务元数据 | ⌘5 / Ctrl+5 |
| ⚙️ 设置 | 主题、版本与 Pro 功能 | ⌘6 / Ctrl+6 |
3. 快速随机(数字 / 颜色)
进入「快速随机」,顶部可在 数字 与 颜色 两种模式间切换。
3.1 随机数字
在左侧「生成参数」面板填写规则,点击 生成(或按 ⌘Enter / Ctrl+Enter),结果以标签形式显示在右侧。
| 参数 | 说明 |
|---|---|
| 最小值 / 最大值 | 整数范围,包含两端边界 |
| 数量 | 要生成多少个数 |
| 步长 | 数值间隔,如步长 2 只产出 …、2、4、6、… |
| 种子(可选) | 填入相同种子可复现同一批结果;留空则每次随机 |
| 排除值或区间 | 从结果中剔除指定数,格式如 3,7,10-20 |
| 不重复 | 勾选后同一批结果内不会出现重复数字 |
| 奇偶过滤 | 全部 / 仅奇数 / 仅偶数 |
| 排序 | 不排序 / 升序 / 降序 |
生成后,点击结果区右上角的 复制 按钮可一次性复制全部结果(以逗号分隔)。
3.2 随机颜色
设置颜色数量和可选的种子,点击生成即可得到一组 RGB 全色域的 HEX 色卡。点击任意色卡即可复制其 HEX 值(如 #3A7BD5)。填入相同种子可复现同一套色板。
4. 数据工作室
用于批量生成带多个字段的结构化测试数据,并可预览、查看列统计、导出为多种格式,或存成模板复用。
4.1 基本流程
- 点击 添加字段,为每个字段命名并选择类型;
- 点击字段可编辑其参数(范围、均值、概率等);
- 需要时开启数据污染(缺失 / 空串 / 高斯噪声)模拟真实脏数据;
- 点击 预览 查看样例数据;点击 统计 查看每列的数据质量摘要;
- 在底部选择导出格式并 导出,或将当前方案 存入模板库。
字段支持改名、复制、拖拽排序、删除。
4.2 支持的字段类型(共 17 种)
基础类型(免费):整数、浮点、布尔、字符串、UUID、日期时间(ISO-8601)、颜色(HEX)、IPv4、MAC、均匀分布。
高级分布与加权(Pro):加权枚举、正态分布、对数正态、指数分布、三角分布、泊松分布、二项分布。
4.3 数据污染
在干净数据上按比例注入缺失值、空字符串或高斯噪声(对数值列叠加正态噪声),用于测试程序对脏数据的容错能力。
4.4 导出格式
- CSV、TSV、JSON(免费)
- JSONL(Pro)
- 可复制 CSV 到剪贴板
大数据量采用流式导出,显示已写入行数,可随时取消。
5. 科研随机化
面向研究设计的独立入口:导入对象名单,按明确方法完成分组或抽样,并保留可复现的记录与方法学草稿。
⚠️ 输入顺序属于复现契约的一部分:调整对象顺序可能改变结果。
5.1 导入对象数据(CSV)
点击 导入 CSV 选择文件。首列必须为 id,其余列可作为分层变量。空 ID、重复 ID、列数不一致的行会被拒绝并提示。
5.2 三种方法
- 实验分组:简单随机分组(免费)→ 填写分组名称与分配比;置换区组与分层(Pro)。
- 总体抽样:简单随机抽样 SRS(免费)→ 设样本量与是否有放回;按比例分层抽样(Pro)。
- 重复模拟(Pro):对每次重复独立抽样,设定次数、样本量、正态参数。使用稳定子流保证各次重复相互独立且整体可复现。
运行后显示分配表/抽样结果、结果摘要,以及一份待研究者审核的方法学草稿(中英文)。
5.3 导出复现包
点击 导出复现包,Randatum 生成 randatum_research_<时间戳> 文件夹,包含:
result.tsv:分组/抽样结果数据randatum.meta.json:元数据(引擎、版本、种子、时间等)summary.json:结果统计摘要methods.zh.md/methods.en.md:中英文方法学草稿sha256.txt:各文件的 SHA-256 校验清单
6. 模板库与运行记录
模板:在数据工作室配置好字段后选择「存入模板库」保存。在模板工作区可重命名、复制、删除模板。支持导出为 template.json 文件或从文件导入。
运行记录:完成数据导出或科研随机化后,任务元数据自动登记(任务类型、规模、种子和执行时间),便于日后追溯。
7. 关于可复现性
Randatum 的核心承诺是「同样的输入 → 同样的输出」。
- 底层引擎采用 Philox4x32-10 计数器型随机源,配合稳定的 streamId 与 counter 分区。
- 固定种子后,整数、无偏有界整数、布尔、列表抽取、UUID 等仅依赖整数运算的字段可精确逐位复现。
- 使用数学函数的统计分布(正态、指数等)按版本化算法与公开容差复现。
8. 免费版与 Pro 版
Randatum 采用一次买断 · 终身有效 · 离线可用的方式,无订阅、无云依赖。
免费版
- 快速随机(数字、颜色)全部能力
- 10 种基础字段类型与均匀分布
- CSV / TSV / JSON 导出
- 简单随机分组与 SRS 抽样
- 固定种子与元数据
Pro 版(一次买断)
- 7 种高级统计分布与加权枚举
- JSONL 导出
- 置换区组、分层分组与抽样
- 重复模拟
- 完整复现包导出
在「设置 → Randatum Pro」中点击解锁按钮即可购买。换设备后通过「恢复购买」找回授权。
9. 设置
在「设置」工作区可以:
- 主题:跟随系统 / 浅色 / 深色
- Randatum Pro:查看版本状态、解锁 Pro、恢复购买
- 关于:查看版本信息
10. 常见问题
Q:我的数据会被上传吗?
不会。Randatum 离线优先,所有生成、导入、统计与导出都在本地完成。
Q:为什么两次生成的结果不一样?
因为没有填种子。填入相同的种子即可复现同一批结果。
Q:为什么导入 CSV 失败?
请确认首列列名为 id,且没有空 ID、重复 ID 或列数不一致的行。
Q:调整了对象顺序,结果变了?
这是预期行为。输入顺序是复现契约的一部分,改变顺序会改变随机分配结果。
Q:复现包里的 sha256.txt 有什么用?
用于校验各文件在传递过程中未被篡改或损坏。它证明的是来源与完整性,不是随机性或公平性的认证。
Q:换了电脑,Pro 还在吗?
在「设置」中点击「恢复购买」即可找回授权。
11. 重要声明
- Randatum 仅用于研究设计、预试验、教学、仿真与测试,不替代 IRT / RTSM / GxP 等监管级临床随机化系统。
- 方法学输出均为草稿,须由研究者审核后方可使用。
- 统计检查用于辅助判断,不得表述为「随机性认证」。
- SHA-256 清单仅验证来源与完整性,不等同于公平抽奖证明。
12. 意见反馈
遇到问题、发现 Bug 或有功能建议,欢迎邮件联系 selfren@163.com。
反馈时附上复现所用的种子、字段/分组配置,以及复现包中的 metadata,能更快定位问题。