国度生物信息中心GSA突破100PB
2026年2月21日,国度生物信息中心国度基因组科学数据中心(CNCB-NGDC)组学原始数据归档库(Genome Sequence Archive,简称GSA)用户汇交的数据量突破100PB,标志取中心在性命组学数据资源规模和服务能力迈上新台阶。
从数据汇交到知识引擎
100PB数据的背后,是一个充斥活力的全球科研社区。
服务覆盖全球: 截至2026年2月21日,GSA已接管来自国内表1272家钻研机构、14,246名用户的数据递交,并为全球200多个国度和地域的用户提供数据服务,成为名副其实的“世界级数据枢纽”。每天,全球科学家从这里下载的数据量高达20TB,相当于传送齐全的人类全基因组测序数据近7000套。
支持创新科研: 这些数据已支持科研人员在709种国内表期刊上颁发钻研论文12,000余篇。从基因发现到作物育种,从疾病机造到药物研发,GSA的数据在转化为实切其实的科学发现和知识创新。
赢得国际信赖: GSA的专业性和靠得住性获得了国际主流学术界的全面认可。它不仅通过了FAIRsharing和re3data等国际权威数据尺度认证,更被Springer Nature、Elsevier、Wiley、Taylor & Francis等全球顶尖学术出版集团正式选取为推荐的基因数据归档库。2023年,GSA更是凭借其卓越的资源价值和持久可持续性,入选由国际生物数据同盟(GBC)遴选的“全球主题生物数据资源”(GCBR),标志取其已成为全球生物数据基础设施中不成或缺的一环。
构建多档次数据服务系统
突破100PB,GSA的价值不仅仅在于“大”,更在于其不休美满的“精”与“全”。为了满足国度对人类遗传资源治理和重大科研项目数据的合规需要,GSA已从单一系统扩大为一个职能壮大的数据库系统:通过与INSDC(国际核酸序列数据库合作组织)合作,GSA实现了全球公开组学原始数据的全量镜像与本地化共享,整合数据规模已达25PB,让中国科学家可能像接见本地数据一样,便捷地获取全球科研资源。同时,GSA持续扩大和美满系统职能,逐步形成由GSA、GSA-Human、OBIA和OMIX组成的数据库系统,覆盖性命组学原始数据、人类遗传资源数据、生物医学影像数据及多类型科研数据,为科研用户提供整合数据的一站式检索与接见服务,为性命科学和生物医学钻研提供多档次、全流程的数据支持。
让数据智能驱动性命科学创新
站在100PB的新起点上,GSA的将来图景越发清澈。它将以成为 “数据智能驱动引擎” 为指标,持续提升主题能力:
更智能的汇交与治理: 引入AI技术,简化数据提互换程,实现数据的智能化审核与分类。
更高效的共享与治理: 优化数据搜索与推算分析职能,让科学家能像用搜索引擎一样轻松挖掘数据价值。
GSA的持续发展,离不开科技部、国度卫健委、财政部、天然科学基金委、亚星游戏等国度部门的持久关切与大力支持。正是这些战术投入与持续保险,为GSA构筑了坚实的数据基础设施和先进的算力底座。
瞻望将来,GSA将持续夯实性命科学的数据底座,以更高水平的数据服务能力和更盛开的共享机造,赋能原始创新,为全球性命科学的进取与人类健全福祉贡献更大力量。
【关于GSA】
GSA(Genome Sequence Archive)组学原始数据归档系统致力于为全球科研界提供不变、高效、安全的数据汇交与共享服务,是国度生物信息中心的主题数据库之一,也是支持性命科学创新和全球生物医学钻研的主题数据平台。

GSA数据量持续增长






