Randatum 是一款离线优先的桌面随机数据工作室。所有计算都在你的电脑本地完成,不联网、不上传数据。它能一键生成随机数字与颜色、批量造出结构化测试数据、按规范方法完成科研随机化,并为每一次运行保留可复现的记录。
1. 安装与启动
Randatum 支持 macOS 与 Windows 桌面端。
- macOS:打开安装包,将 Randatum 拖入「应用程序」文件夹,从启动台打开。
- Windows:运行安装程序(.exe),按向导安装后从开始菜单启动。
默认窗口大小 1280×800,可自由缩放(最小 900×600)。无需登录、无需联网即可使用全部功能。
2. 界面总览与快捷键
窗口左侧是固定导航栏,共六个工作区。窗口较窄时导航栏自动收起为图标模式(悬停显示名称)。
| 工作区 | 作用 | 快捷键 |
|---|---|---|
| 🎲 快速随机 | 快速生成随机数字或颜色 | ⌘1 / Ctrl+1 |
| 📊 数据工作室 | 生成多字段结构化测试数据 | ⌘2 / Ctrl+2 |
| 🔬 科研随机化 | 分组、抽样、重复模拟 | ⌘3 / Ctrl+3 |
| 🔖 模板 | 保存与复用生成方案 | ⌘4 / Ctrl+4 |
| 🕘 运行记录 | 查看历史任务元数据 | ⌘5 / Ctrl+5 |
| ⚙️ 设置 | 主题、语言、关于与相关链接 | ⌘6 / Ctrl+6 |
3. 快速随机(数字 / 颜色)
进入「快速随机」,顶部可在 数字 与 颜色 两种模式间切换。
3.1 随机数字
在左侧「生成参数」面板填写规则,点击 生成(或按 ⌘Enter / Ctrl+Enter),结果以标签形式显示在右侧。
| 参数 | 说明 |
|---|---|
| 最小值 / 最大值 | 整数范围,包含两端边界 |
| 数量 | 要生成多少个数 |
| 步长 | 数值间隔,如步长 2 只产出 …、2、4、6、… |
| 种子(可选) | 填入相同种子可复现同一批结果;留空则每次随机 |
| 排除值或区间 | 从结果中剔除指定数,格式如 3,7,10-20 |
| 不重复 | 勾选后同一批结果内不会出现重复数字 |
| 奇偶过滤 | 全部 / 仅奇数 / 仅偶数 |
| 排序 | 不排序 / 升序 / 降序 |
生成后,点击结果区右上角的 复制 按钮可一次性复制全部结果(以逗号分隔)。
3.2 随机颜色
设置颜色数量和可选的种子,点击生成即可得到一组 RGB 全色域的 HEX 色卡。点击任意色卡即可复制其 HEX 值(如 #3A7BD5)。填入相同种子可复现同一套色板。
4. 数据工作室
用于批量生成带多个字段的结构化测试数据,并可预览、查看列统计、导出为多种格式,或存成模板复用。
4.1 基本流程
- 点击 添加字段,为每个字段命名并选择类型;
- 点击字段可编辑其参数(范围、均值、概率等);
- 需要时开启数据污染(缺失 / 空串 / 高斯噪声)模拟真实脏数据;
- 点击 预览 查看样例数据;点击 统计 查看每列的数据质量摘要;
- 在底部选择导出格式并 导出,或将当前方案 存入模板库。
字段支持改名、复制、拖拽排序、删除。
4.2 支持的字段类型(共 17 种)
基础类型:整数、浮点、布尔、字符串、UUID、日期时间(ISO-8601)、颜色(HEX)、IPv4、MAC、均匀分布。
高级分布与加权:加权枚举、正态分布、对数正态、指数分布、三角分布、泊松分布、二项分布。以上全部类型均为免费功能。
4.3 数据污染
在干净数据上按比例注入缺失值、空字符串或高斯噪声(对数值列叠加正态噪声),用于测试程序对脏数据的容错能力。
4.4 导出格式
- CSV、TSV、JSON、JSONL(全部免费)
- 可复制 CSV 到剪贴板
大数据量采用流式导出,显示已写入行数,可随时取消。
5. 科研随机化
面向研究设计的独立入口:导入对象名单,按明确方法完成分组或抽样,并保留可复现的记录与方法学草稿。
⚠️ 输入顺序属于复现契约的一部分:调整对象顺序可能改变结果。
5.1 导入对象数据(CSV)
点击 导入 CSV 选择文件。首列必须为 id,其余列可作为分层变量。空 ID、重复 ID、列数不一致的行会被拒绝并提示。
5.2 三种方法
- 实验分组:简单随机分组 → 填写分组名称与分配比;置换区组与分层分组。
- 总体抽样:简单随机抽样 SRS → 设样本量与是否有放回;按比例分层抽样。
- 重复模拟:对每次重复独立抽样,设定次数、样本量、正态参数。使用稳定子流保证各次重复相互独立且整体可复现。
运行后显示分配表/抽样结果、结果摘要,以及一份待研究者审核的方法学草稿(中英文)。
5.3 导出复现包
点击 导出复现包,Randatum 生成 randatum_research_<时间戳> 文件夹,包含:
result.tsv:分组/抽样结果数据randatum.meta.json:元数据(引擎、版本、种子、时间等)summary.json:结果统计摘要methods.zh.md/methods.en.md:中英文方法学草稿sha256.txt:各文件的 SHA-256 校验清单
6. 模板库与运行记录
模板:在数据工作室配置好字段后选择「存入模板库」保存。在模板工作区可重命名、复制、删除模板。支持导出为 template.json 文件或从文件导入。
运行记录:完成数据导出或科研随机化后,任务元数据自动登记(任务类型、规模、种子和执行时间),便于日后追溯。
7. 关于可复现性
Randatum 的核心承诺是「同样的输入 → 同样的输出」。
- 底层引擎采用 Philox4x32-10 计数器型随机源,配合稳定的 streamId 与 counter 分区。
- 固定种子后,整数、无偏有界整数、布尔、列表抽取、UUID 等仅依赖整数运算的字段可精确逐位复现。
- 使用数学函数的统计分布(正态、指数等)按版本化算法与公开容差复现。
8. 价格与权益
Randatum 全功能免费:无订阅、无内购、无账号、无云依赖,所有功能开箱即用。
- 快速随机(数字、颜色)全部能力
- 数据工作室全部 17 种字段类型与分布,以及数据污染
- 全部导出格式:CSV / TSV / JSON / JSONL
- 科研随机化的全部方法:简单 / 置换区组 / 分层分组、SRS / 按比例分层抽样、重复模拟
- 完整复现包导出,以及固定种子与算法 / 版本 / 参数元数据
应用内不存在任何购买、解锁或恢复购买入口。若未来引入付费能力,会在单独的版本中明确说明。
9. 设置
在「设置」工作区可以:
- 主题:跟随系统 / 浅色 / 深色
- 语言:跟随系统 / 简体中文 / English
- 使用手册:打开本手册
- 关于:查看版本信息,并可通过问号按钮提交问题、需求与建议
- 相关链接:技术支持与隐私政策
10. 常见问题
Q:我的数据会被上传吗?
不会。Randatum 离线优先,所有生成、导入、统计与导出都在本地完成。
Q:为什么两次生成的结果不一样?
因为没有填种子。填入相同的种子即可复现同一批结果。
Q:为什么导入 CSV 失败?
请确认首列列名为 id,且没有空 ID、重复 ID 或列数不一致的行。
Q:调整了对象顺序,结果变了?
这是预期行为。输入顺序是复现契约的一部分,改变顺序会改变随机分配结果。
Q:复现包里的 sha256.txt 有什么用?
用于校验各文件在传递过程中未被篡改或损坏。它证明的是来源与完整性,不是随机性或公平性的认证。
Q:Randatum 需要付费吗?
不需要。Randatum 全功能免费,无订阅、无内购、无账号,所有功能都可以直接使用。
11. 重要声明
- Randatum 仅用于研究设计、预试验、教学、仿真与测试,不替代 IRT / RTSM / GxP 等监管级临床随机化系统。
- 方法学输出均为草稿,须由研究者审核后方可使用。
- 统计检查用于辅助判断,不得表述为「随机性认证」。
- SHA-256 清单仅验证来源与完整性,不等同于公平抽奖证明。
12. 意见反馈
遇到问题、发现 Bug 或有功能建议,欢迎邮件联系 selfren@163.com。
反馈时附上复现所用的种子、字段/分组配置,以及复现包中的 metadata,能更快定位问题。