Please use this identifier to cite or link to this item:
https://www.arca.fiocruz.br/handle/icict/62821
SPLICEPROT 2.0: A SEQUENCE REPOSITORY OF HUMAN, MOUSE, AND RAT PROTEOFORMS
Author
Affilliation
Fundação Oswaldo Cruz. Instituto Carlos Chagas. Curitiba, PR, Brasil.
Fundação Oswaldo Cruz. Instituto Carlos Chagas. Curitiba, PR, Brasil.
Fundação Oswaldo Cruz. Instituto Carlos Chagas. Curitiba, PR, Brasil. / Fundação Oswaldo Cruz. Instituto Oswaldo Cruz. Laboratório de Toxinologia. Rio de Janeiro, RJ, Brasil.
Fundação Oswaldo Cruz. Instituto Carlos Chagas. Curitiba, PR, Brasil.
Fundação Oswaldo Cruz. Instituto Carlos Chagas. Curitiba, PR, Brasil.
Fundação Oswaldo Cruz. Instituto Oswaldo Cruz. Laboratório de Toxinologia. Rio de Janeiro, RJ, Brasil.
Fundação Oswaldo Cruz. Instituto Carlos Chagas. Curitiba, PR, Brasil.
Fundação Oswaldo Cruz. Instituto Carlos Chagas. Curitiba, PR, Brasil. / Universidade Federal de São Carlos. Departamento de Genética e Evolução. São Carlos, SP, Brasil.
Fundação Oswaldo Cruz. Instituto Carlos Chagas. Curitiba, PR, Brasil.
Fundação Oswaldo Cruz. Instituto Carlos Chagas. Curitiba, PR, Brasil.
Fundação Oswaldo Cruz. Instituto Carlos Chagas. Curitiba, PR, Brasil. / Fundação Oswaldo Cruz. Instituto Oswaldo Cruz. Laboratório de Toxinologia. Rio de Janeiro, RJ, Brasil.
Fundação Oswaldo Cruz. Instituto Carlos Chagas. Curitiba, PR, Brasil.
Fundação Oswaldo Cruz. Instituto Carlos Chagas. Curitiba, PR, Brasil.
Fundação Oswaldo Cruz. Instituto Oswaldo Cruz. Laboratório de Toxinologia. Rio de Janeiro, RJ, Brasil.
Fundação Oswaldo Cruz. Instituto Carlos Chagas. Curitiba, PR, Brasil.
Fundação Oswaldo Cruz. Instituto Carlos Chagas. Curitiba, PR, Brasil. / Universidade Federal de São Carlos. Departamento de Genética e Evolução. São Carlos, SP, Brasil.
Fundação Oswaldo Cruz. Instituto Carlos Chagas. Curitiba, PR, Brasil.
Abstract
SpliceProt 2.0 is a public proteogenomics database that aims to list the sequence of known proteins and potential new proteoforms in human, mouse, and rat proteomes. This updated repository provides an even broader range of computationally translated proteins and serves, for example, to aid with proteomic validation of splice variants absent from the reference UniProtKB/SwissProt database. We demonstrate the value of SpliceProt 2.0 to predict orthologous proteins between humans and murines based on transcript reconstruction, sequence annotation and detection at the transcriptome and proteome levels. In this release, the annotation data used in the reconstruction of transcripts based on the methodology of ternary matrices were acquired from new databases such as Ensembl, UniProt, and APPRIS. Another innovation implemented in the pipeline is the exclusion of transcripts predicted to be susceptible to degradation through the NMD pathway. Taken together, our repository and its applications represent a valuable resource for the proteogenomics community.
Share