国度生物信息中心组学原始数据归档库数据汇交量突破10PB
9月28日,亚星游戏(国度生物信息中心)国度基因组科学数据中心(CNCB-NGDC)组学原始数据归档库(Genome Sequence Archive,简称GSA)的用户汇交数据量突破10 PB(1 PB=1024 TB)。
为存好、管好、用好我国性命组学大数据,解决国内重要数据资源流失和性命组学数据孤岛等问题,提高数据共享率和利用率,北京基因组所于2015年10月成立了国内首个组学原始数据汇交、存储、治理与共享系统GSA,为国度重点研发打算、国度天然科学基金、中科院战术先导专项等国度重大、重点钻研打算及工作的科学数据安全治理和归档共享提供了重要支持。
GSA自上线以来,持续为全球性命科学钻研人员提供数据汇交和共享服务,尤其为我国科研人员提供了极风雅便。截止2021年9月28日,GSA数据库系统已接管国内表437家钻研机构1829名用户的数据递交,支持科研人员在250衷熠刊颁发钻研论文760余篇,为全球110多个国度/地域的用户提供数据服务,均匀每天数据下载量达到4 TB。目前 GSA已成为Springer Nature、Elsevier、Wiley、Taylor & Francis及Cell 等国际驰名出版集团指定/认可的核酸数据归档库。
随着组学数据的爆炸性增长和数据类型的多样化,面向国度人类遗传资源数据治理的特殊需要,GSA不休丰思满系统职能,形成了GSA数据库系统,蕴含GSA,GSA-Human和OMIX。
GSA-Human造订人类遗传资源组学数据安全治理机造,实现人类遗传资源数据的分级治理和受控接见,有效保险了国度人类遗传资源数据的安全治理和合理利用,为用户提供人类遗传资源数据受控接见服务;OMIX数据库存储非原始测序数据,如环境组、表型组、代谢组等,它作为上述两种数据资源库的重要补充,有效解决了用户提交除原始测序数据表的其它类型数据的需要。
GSA数据库的建设得到了科技部、中科院以及国度重点研发打算、中科院战术先导专项、信息化专项、国际同伴打算等项主张大力支持,GSA归档数据使用的大规模推算机硬件设施得到国度财政部改善科研前提专项的持久支持。

GSA数据量持续增长






