• 文献检索
  • 文档翻译
  • 深度研究
  • 学术资讯
  • Suppr Zotero 插件Zotero 插件
  • 邀请有礼
  • 套餐&价格
  • 历史记录
应用&插件
Suppr Zotero 插件Zotero 插件浏览器插件Mac 客户端Windows 客户端微信小程序
定价
高级版会员购买积分包购买API积分包
服务
文献检索文档翻译深度研究API 文档MCP 服务
关于我们
关于 Suppr公司介绍联系我们用户协议隐私条款
关注我们

Suppr 超能文献

核心技术专利:CN118964589B侵权必究
粤ICP备2023148730 号-1Suppr @ 2026

文献检索

告别复杂PubMed语法,用中文像聊天一样搜索,搜遍4000万医学文献。AI智能推荐,让科研检索更轻松。

立即免费搜索

文件翻译

保留排版,准确专业,支持PDF/Word/PPT等文件格式,支持 12+语言互译。

免费翻译文档

深度研究

AI帮你快速写综述,25分钟生成高质量综述,智能提取关键信息,辅助科研写作。

立即免费体验

使用美国国立癌症研究所基因组数据共享平台应用程序编程接口开发癌症信息学应用程序和工具。

Developing Cancer Informatics Applications and Tools Using the NCI Genomic Data Commons API.

作者信息

Wilson Shane, Fitzsimons Michael, Ferguson Martin, Heath Allison, Jensen Mark, Miller Josh, Murphy Mark W, Porter James, Sahni Himanso, Staudt Louis, Tang Yajing, Wang Zhining, Yu Christine, Zhang Junjun, Ferretti Vincent, Grossman Robert L

机构信息

Ontario Institute for Cancer Research, Toronto, Ontario, Canada.

Center for Data Intensive Science (CDIS), University of Chicago, Chicago, Illinois.

出版信息

Cancer Res. 2017 Nov 1;77(21):e15-e18. doi: 10.1158/0008-5472.CAN-17-0598.

DOI:10.1158/0008-5472.CAN-17-0598
PMID:29092930
原文链接:https://pmc.ncbi.nlm.nih.gov/articles/PMC5683428/
Abstract

The NCI Genomic Data Commons (GDC) was launched in 2016 and makes available over 4 petabytes (PB) of cancer genomic and associated clinical data to the research community. This dataset continues to grow and currently includes over 14,500 patients. The GDC is an example of a biomedical data commons, which collocates biomedical data with storage and computing infrastructure and commonly used web services, software applications, and tools to create a secure, interoperable, and extensible resource for researchers. The GDC is (i) a data repository for downloading data that have been submitted to it, and also a system that (ii) applies a common set of bioinformatics pipelines to submitted data; (iii) reanalyzes existing data when new pipelines are developed; and (iv) allows users to build their own applications and systems that interoperate with the GDC using the GDC Application Programming Interface (API). We describe the GDC API and how it has been used both by the GDC itself and by third parties. .

摘要

美国国立癌症研究所基因组数据共享库(GDC)于2016年启动,为研究界提供了超过4拍字节(PB)的癌症基因组及相关临床数据。该数据集持续增长,目前包含超过14500名患者的数据。GDC是生物医学数据共享库的一个范例,它将生物医学数据与存储和计算基础设施以及常用的网络服务、软件应用程序和工具配置在一起,为研究人员创建了一个安全、可互操作且可扩展的资源。GDC既是(i)一个用于下载已提交数据的数据存储库,也是一个(ii)对提交数据应用一套通用生物信息学管道的系统;(iii)在开发新管道时重新分析现有数据;以及(iv)允许用户使用GDC应用程序编程接口(API)构建与GDC互操作的自己的应用程序和系统。我们描述了GDC API及其在GDC自身和第三方中的使用方式。

相似文献

1
Developing Cancer Informatics Applications and Tools Using the NCI Genomic Data Commons API.使用美国国立癌症研究所基因组数据共享平台应用程序编程接口开发癌症信息学应用程序和工具。
Cancer Res. 2017 Nov 1;77(21):e15-e18. doi: 10.1158/0008-5472.CAN-17-0598.
2
Harmonizing and integrating the NCI Genomic Data Commons through accessible, interactive, and cloud-enabled workflows.通过可访问、交互式且支持云的工作流程,协调和整合美国国立癌症研究所基因组数据共享库。
PLoS One. 2025 Mar 4;20(3):e0318676. doi: 10.1371/journal.pone.0318676. eCollection 2025.
3
Uniform genomic data analysis in the NCI Genomic Data Commons.在 NCI 基因组数据共享中心进行统一的基因组数据分析。
Nat Commun. 2021 Feb 22;12(1):1226. doi: 10.1038/s41467-021-21254-9.
4
Data Lakes, Clouds, and Commons: A Review of Platforms for Analyzing and Sharing Genomic Data.数据湖、云与公共数据池:基因组数据分析与共享平台综述
Trends Genet. 2019 Mar;35(3):223-234. doi: 10.1016/j.tig.2018.12.006. Epub 2019 Jan 25.
5
TCGA Expedition: A Data Acquisition and Management System for TCGA Data.TCGA探索计划:一个用于TCGA数据的数据采集与管理系统。
PLoS One. 2016 Oct 27;11(10):e0165395. doi: 10.1371/journal.pone.0165395. eCollection 2016.
6
caTissue Suite to OpenSpecimen: Developing an extensible, open source, web-based biobanking management system.从caTissue套件到OpenSpecimen:开发一个可扩展的、基于网络的开源生物样本库管理系统。
J Biomed Inform. 2015 Oct;57:456-64. doi: 10.1016/j.jbi.2015.08.020. Epub 2015 Aug 29.
7
The Cancer Genomics Cloud: Collaborative, Reproducible, and Democratized-A New Paradigm in Large-Scale Computational Research.癌症基因组学云:协作、可重复且民主化——大规模计算研究的新范式
Cancer Res. 2017 Nov 1;77(21):e3-e6. doi: 10.1158/0008-5472.CAN-17-0387.
8
The ISB Cancer Genomics Cloud: A Flexible Cloud-Based Platform for Cancer Genomics Research.国际生物信息学研究所癌症基因组云平台:一个用于癌症基因组学研究的灵活的基于云的平台。
Cancer Res. 2017 Nov 1;77(21):e7-e10. doi: 10.1158/0008-5472.CAN-17-0617.
9
Bionimbus: a cloud for managing, analyzing and sharing large genomics datasets.Bionimbus:用于管理、分析和共享大型基因组数据集的云平台。
J Am Med Inform Assoc. 2014 Nov-Dec;21(6):969-75. doi: 10.1136/amiajnl-2013-002155. Epub 2014 Jan 24.
10
The caCORE Software Development Kit: streamlining construction of interoperable biomedical information services.caCORE软件开发工具包:简化可互操作生物医学信息服务的构建
BMC Med Inform Decis Mak. 2006 Jan 6;6:2. doi: 10.1186/1472-6947-6-2.

引用本文的文献

1
: a Bioconductor package for rapid, cross-cohort variant and allelic bias analysis.用于快速跨队列变异和等位基因偏差分析的一个生物导体包。
Bioinform Adv. 2025 Apr 28;5(1):vbaf098. doi: 10.1093/bioadv/vbaf098. eCollection 2025.
2
Comprehensive Analysis of Multi-Omics Data on RNA Polymerase as an Adverse Factor in Head and Neck Squamous Cell Carcinoma.将RNA聚合酶作为头颈鳞状细胞癌不良因素的多组学数据综合分析
J Inflamm Res. 2025 Mar 1;18:3067-3091. doi: 10.2147/JIR.S496748. eCollection 2025.
3
Harmonizing and integrating the NCI Genomic Data Commons through accessible, interactive, and cloud-enabled workflows.通过可访问、交互式且支持云的工作流程,协调和整合美国国立癌症研究所基因组数据共享库。
PLoS One. 2025 Mar 4;20(3):e0318676. doi: 10.1371/journal.pone.0318676. eCollection 2025.
4
A prognostic signature established based on genes related to tumor microenvironment for patients with hepatocellular carcinoma.基于与肿瘤微环境相关基因建立的肝细胞癌患者预后特征。
Aging (Albany NY). 2024 Apr 4;16(7):6537-6549. doi: 10.18632/aging.205722.
5
Creation of a data commons for substance misuse related health research through privacy-preserving patient record linkage between hospitals and state agencies.通过医院与州机构之间的隐私保护患者记录关联,创建一个用于药物滥用相关健康研究的数据共享库。
JAMIA Open. 2023 Nov 2;6(4):ooad092. doi: 10.1093/jamiaopen/ooad092. eCollection 2023 Dec.
6
Whole Genome Variant Dataset for Enriching Studies across 18 Different Cancers.用于丰富18种不同癌症研究的全基因组变异数据集。
Onco (Basel). 2022 Jun;2(2):129-144. doi: 10.3390/onco2020009. Epub 2022 Jun 17.
7
: a Bioconductor package for rapid, cross-cohort variant and allelic bias analysis.一个用于快速进行跨队列变异和等位基因偏差分析的Bioconductor软件包。
bioRxiv. 2024 Nov 27:2023.09.15.558026. doi: 10.1101/2023.09.15.558026.
8
Cloud-based biomedical data storage and analysis for genomic research: Landscape analysis of data governance in emerging NIH-supported platforms.基于云的生物医学数据存储和分析在基因组研究中的应用:新兴 NIH 支持平台中数据治理的景观分析。
HGG Adv. 2023 Apr 12;4(3):100196. doi: 10.1016/j.xhgg.2023.100196. eCollection 2023 Jul 13.
9
Ten lessons for data sharing with a data commons.数据共享十课:创建数据 Commons
Sci Data. 2023 Mar 6;10(1):120. doi: 10.1038/s41597-023-02029-x.
10
Moving Toward Findable, Accessible, Interoperable, Reusable Practices in Epidemiologic Research.迈向流行病学研究中可发现、可访问、可互操作和可重复使用的实践。
Am J Epidemiol. 2023 Jun 2;192(6):995-1005. doi: 10.1093/aje/kwad040.

本文引用的文献

1
A Case for Data Commons: Toward Data Science as a Service.数据共享的实例:迈向数据科学即服务
Comput Sci Eng. 2016 Sep-Oct;18(5):10-20. doi: 10.1109/MCSE.2016.92. Epub 2016 Aug 24.
2
Toward a Shared Vision for Cancer Genomic Data.迈向癌症基因组数据的共同愿景。
N Engl J Med. 2016 Sep 22;375(12):1109-12. doi: 10.1056/NEJMp1607591.
3
TCGAbiolinks: an R/Bioconductor package for integrative analysis of TCGA data.TCGAbiolinks:一个用于对TCGA数据进行综合分析的R/Bioconductor软件包。
Nucleic Acids Res. 2016 May 5;44(8):e71. doi: 10.1093/nar/gkv1507. Epub 2015 Dec 23.
4
TCGA-assembler: open-source software for retrieving and processing TCGA data.TCGA汇编程序:用于检索和处理TCGA数据的开源软件。
Nat Methods. 2014 Jun;11(6):599-600. doi: 10.1038/nmeth.2956.