
全球首件丹尼索瓦人下肢骨现于台湾海峡:澎湖腿骨化石身高或近1.9米
2026年8月20日
行业新闻:古DNA与同位素证据揭示中国北方粟作农业的“第三种路径”
2026年8月22日OpenZupu:用开源代码“复活”竖排族谱的开源家谱平台
2026年7月的 OpenAI Build Week 黑客松(7月13—21日)上,一个名为 OpenZupu(开元族谱)的开源项目引发家谱数字化社区关注。这个由开发者 Joan Kuo 提交的项目,目标直指中国族谱传承的深层痛点:用开源代码构建一个能真正读懂竖排文言文族谱、连接地理迁徙与遗传谱系的数字化平台,并已通过 Devpost 向公众发布完整的技术说明与演示。

项目的灵感来自对传统族谱处境的观察:两千多年来,中国家庭以纸质族谱(族谱/家谱)保存家族传承,但这些实体册页极度脆弱——时间、战乱与环境损耗都可能让百年世系化为乌有;更重要的是,族谱以高度简省的文言文写成,采用传统竖排右起版式,并包含复杂的长幼排行与辈字(昭穆)系统,年轻一代几乎难以解读。
OpenZupu 的功能设计覆盖了族谱数字化的全链条。其一,交互式多风格谱系图:可动态生成苏式世系树(竖列式直系父系谱图)与欧式谱文(供印刷与存档的密集竖排文本),同时支持西式后代/祖先图与扇形图;其二,时空地理定位时间线与地图:从出生地、居住地与墓葬记录中提取信息,在地图上呈现数百年的家族迁徙轨迹;其三,遗传谱系映射:将父系 Y-STR/Y-SNP 与母系 mtDNA 突变单倍群映射到家族各分支,支持联邦式查询并计算最近共同祖先(MRCA);其四,自动化谱系完整性校验:通过规则引擎识别生物异常,如子女代年龄大于父母、代际空缺、排行辈字不匹配等;其五,通用可移植性:无缝导入导出标准 GEDCOM(.ged)、GraphML、CSV 与 JSON 备份。
在技术实现上,OpenZupu 采用解耦的单仓库架构:前端以 Next.js、React、TypeScript 构建,使用自定义 Tailwind CSS,并融入古羊皮纸纹理、思源宋体等传统视觉元素;后端由 NestJS 提供 RESTful 接口,配以 JWT 认证、自定义守卫与事务级审计日志;数据库层采用 PostgreSQL 与 Prisma ORM;OCR 环节使用 Tesseract.js(chi_tra 繁体中文模型)异步处理扫描档案的文本提取。整个系统可通过 Docker Compose 轻松自托管,无需依赖昂贵的商业 SaaS。
开发团队坦言了最具挑战性的部分:在 Next.js 中渲染传统中文竖排版式(writing-mode: vertical-rl)时,无限打印画布曾出现严重的横向文字裁切、列重叠与打印缺失,最终通过将动态列宽控制在160—400像素之间并重写打印 CSS 解决;预渲染与客户端导航的水合冲突,则通过将导航钩子封装在客户端边界内化解。
项目也拿出了几个值得骄傲的成果:为苏式、欧式竖排图编译生成可完美打印的 SVG 矢量图;实现带 UTF-8 BOM 的 Excel 兼容 CSV 导出,彻底解决传统汉字乱码问题;产出一套可直接生产的 Next.js + NestJS 代码库,任何地方宗族理事会都可自行部署。
OpenZupu 的路线图同样面向未来:团队计划深度集成 OpenAI GPT-4o 的视觉与结构化输出能力——用户上传竖排手写族谱照片后,AI 可直接转录、切分人名并输出结构化 JSON/GEDCOM 谱系树;将高度简省的文言文传记翻译为现代可读的叙述;并提供语义检索副驾(RAG),让用户直接提问如“我们家族哪一支在明末迁往福建”。
对遗传谱系研究者而言,OpenZupu 的独特价值在于它把传统谱牒与分子证据放进了同一个平台:族谱文本提供世系框架,地理时间线还原迁徙,Y-DNA 与 mtDNA 单倍群则提供血缘印证,三者协同可以显著提升家谱的可信度与可解释性。这也与当下多模态家谱档案的学术方向不谋而合——文本、空间与基因正在走向同一张家族网络。
作为开源项目,OpenZupu 的选择具有方法论意义:当族谱数据关乎家族隐私与自主权,“自托管、隐私优先”的路线让宗族组织不必把核心家谱数据托付给商业平台。项目已在 GitHub(github.com/yuancafe/openZupu)开放源码并提供在线演示。从纸质族谱到开源数字谱系,中国家族记忆的保存方式正在迎来新的可能。





