📖 用户手册

数铸 Randatum

Randatum 是一款离线优先的桌面随机数据工作室。所有计算都在你的电脑本地完成,不联网、不上传数据。它能一键生成随机数字与颜色、批量造出结构化测试数据、按规范方法完成科研随机化,并为每一次运行保留可复现的记录。

1. 安装与启动

Randatum 支持 macOSWindows 桌面端。

  • macOS:打开安装包,将 Randatum 拖入「应用程序」文件夹,从启动台打开。
  • Windows:运行安装程序(.exe),按向导安装后从开始菜单启动。

默认窗口大小 1280×800,可自由缩放(最小 900×600)。无需登录、无需联网即可使用全部功能。

2. 界面总览与快捷键

窗口左侧是固定导航栏,共六个工作区。窗口较窄时导航栏自动收起为图标模式(悬停显示名称)。

工作区作用快捷键
🎲 快速随机快速生成随机数字或颜色⌘1 / Ctrl+1
📊 数据工作室生成多字段结构化测试数据⌘2 / Ctrl+2
🔬 科研随机化分组、抽样、重复模拟⌘3 / Ctrl+3
🔖 模板保存与复用生成方案⌘4 / Ctrl+4
🕘 运行记录查看历史任务元数据⌘5 / Ctrl+5
⚙️ 设置主题、语言、关于与相关链接⌘6 / Ctrl+6

3. 快速随机(数字 / 颜色)

进入「快速随机」,顶部可在 数字颜色 两种模式间切换。

3.1 随机数字

在左侧「生成参数」面板填写规则,点击 生成(或按 ⌘Enter / Ctrl+Enter),结果以标签形式显示在右侧。

参数说明
最小值 / 最大值整数范围,包含两端边界
数量要生成多少个数
步长数值间隔,如步长 2 只产出 …、2、4、6、…
种子(可选)填入相同种子可复现同一批结果;留空则每次随机
排除值或区间从结果中剔除指定数,格式如 3,7,10-20
不重复勾选后同一批结果内不会出现重复数字
奇偶过滤全部 / 仅奇数 / 仅偶数
排序不排序 / 升序 / 降序

生成后,点击结果区右上角的 复制 按钮可一次性复制全部结果(以逗号分隔)。

3.2 随机颜色

设置颜色数量和可选的种子,点击生成即可得到一组 RGB 全色域的 HEX 色卡。点击任意色卡即可复制其 HEX 值(如 #3A7BD5)。填入相同种子可复现同一套色板。

4. 数据工作室

用于批量生成带多个字段的结构化测试数据,并可预览、查看列统计、导出为多种格式,或存成模板复用。

4.1 基本流程

  1. 点击 添加字段,为每个字段命名并选择类型;
  2. 点击字段可编辑其参数(范围、均值、概率等);
  3. 需要时开启数据污染(缺失 / 空串 / 高斯噪声)模拟真实脏数据;
  4. 点击 预览 查看样例数据;点击 统计 查看每列的数据质量摘要;
  5. 在底部选择导出格式并 导出,或将当前方案 存入模板库

字段支持改名、复制、拖拽排序、删除。

4.2 支持的字段类型(共 17 种)

基础类型:整数、浮点、布尔、字符串、UUID、日期时间(ISO-8601)、颜色(HEX)、IPv4、MAC、均匀分布。

高级分布与加权:加权枚举、正态分布、对数正态、指数分布、三角分布、泊松分布、二项分布。以上全部类型均为免费功能。

4.3 数据污染

在干净数据上按比例注入缺失值、空字符串或高斯噪声(对数值列叠加正态噪声),用于测试程序对脏数据的容错能力。

4.4 导出格式

  • CSV、TSV、JSON、JSONL(全部免费)
  • 可复制 CSV 到剪贴板

大数据量采用流式导出,显示已写入行数,可随时取消。

5. 科研随机化

面向研究设计的独立入口:导入对象名单,按明确方法完成分组或抽样,并保留可复现的记录与方法学草稿。

⚠️ 输入顺序属于复现契约的一部分:调整对象顺序可能改变结果。

5.1 导入对象数据(CSV)

点击 导入 CSV 选择文件。首列必须为 id,其余列可作为分层变量。空 ID、重复 ID、列数不一致的行会被拒绝并提示。

5.2 三种方法

  • 实验分组:简单随机分组 → 填写分组名称与分配比;置换区组与分层分组。
  • 总体抽样:简单随机抽样 SRS → 设样本量与是否有放回;按比例分层抽样。
  • 重复模拟:对每次重复独立抽样,设定次数、样本量、正态参数。使用稳定子流保证各次重复相互独立且整体可复现。

运行后显示分配表/抽样结果、结果摘要,以及一份待研究者审核的方法学草稿(中英文)。

5.3 导出复现包

点击 导出复现包,Randatum 生成 randatum_research_<时间戳> 文件夹,包含:

  • result.tsv:分组/抽样结果数据
  • randatum.meta.json:元数据(引擎、版本、种子、时间等)
  • summary.json:结果统计摘要
  • methods.zh.md / methods.en.md:中英文方法学草稿
  • sha256.txt:各文件的 SHA-256 校验清单

6. 模板库与运行记录

模板:在数据工作室配置好字段后选择「存入模板库」保存。在模板工作区可重命名、复制、删除模板。支持导出为 template.json 文件或从文件导入。

运行记录:完成数据导出或科研随机化后,任务元数据自动登记(任务类型、规模、种子和执行时间),便于日后追溯。

7. 关于可复现性

Randatum 的核心承诺是「同样的输入 → 同样的输出」。

  • 底层引擎采用 Philox4x32-10 计数器型随机源,配合稳定的 streamId 与 counter 分区。
  • 固定种子后,整数、无偏有界整数、布尔、列表抽取、UUID 等仅依赖整数运算的字段可精确逐位复现
  • 使用数学函数的统计分布(正态、指数等)按版本化算法与公开容差复现。

8. 价格与权益

Randatum 全功能免费:无订阅、无内购、无账号、无云依赖,所有功能开箱即用。

  • 快速随机(数字、颜色)全部能力
  • 数据工作室全部 17 种字段类型与分布,以及数据污染
  • 全部导出格式:CSV / TSV / JSON / JSONL
  • 科研随机化的全部方法:简单 / 置换区组 / 分层分组、SRS / 按比例分层抽样、重复模拟
  • 完整复现包导出,以及固定种子与算法 / 版本 / 参数元数据

应用内不存在任何购买、解锁或恢复购买入口。若未来引入付费能力,会在单独的版本中明确说明。

9. 设置

在「设置」工作区可以:

  • 主题:跟随系统 / 浅色 / 深色
  • 语言:跟随系统 / 简体中文 / English
  • 使用手册:打开本手册
  • 关于:查看版本信息,并可通过问号按钮提交问题、需求与建议
  • 相关链接:技术支持与隐私政策

10. 常见问题

Q:我的数据会被上传吗?
不会。Randatum 离线优先,所有生成、导入、统计与导出都在本地完成。

Q:为什么两次生成的结果不一样?
因为没有填种子。填入相同的种子即可复现同一批结果。

Q:为什么导入 CSV 失败?
请确认首列列名为 id,且没有空 ID、重复 ID 或列数不一致的行。

Q:调整了对象顺序,结果变了?
这是预期行为。输入顺序是复现契约的一部分,改变顺序会改变随机分配结果。

Q:复现包里的 sha256.txt 有什么用?
用于校验各文件在传递过程中未被篡改或损坏。它证明的是来源与完整性,不是随机性或公平性的认证。

Q:Randatum 需要付费吗?
不需要。Randatum 全功能免费,无订阅、无内购、无账号,所有功能都可以直接使用。

11. 重要声明

  • Randatum 仅用于研究设计、预试验、教学、仿真与测试,不替代 IRT / RTSM / GxP 等监管级临床随机化系统。
  • 方法学输出均为草稿,须由研究者审核后方可使用。
  • 统计检查用于辅助判断,不得表述为「随机性认证」。
  • SHA-256 清单仅验证来源与完整性,不等同于公平抽奖证明。

12. 意见反馈

遇到问题、发现 Bug 或有功能建议,欢迎邮件联系 selfren@163.com

反馈时附上复现所用的种子、字段/分组配置,以及复现包中的 metadata,能更快定位问题。