PICR
PICR maps protein identifiers across multiple biological databases to provide consistent cross-references for integrating protein datasets and resolving identifier inconsistencies.
Key Features:
- Cross-Reference Mapping: Maps protein identifiers across diverse source databases to unify equivalent protein entries.
- Central Repository (UniParc): Uses the UniProt Archive (UniParc) as its central data repository.
- Source Coverage: Includes over 70 distinct source databases.
- Mapping Criterion: Relies on 100% sequence identity as the core criterion for mapping.
- Species-Transcending Mapping: Provides mappings that transcend species-specific and technique-limited identifier systems.
- Input Formats: Accepts protein identifiers and protein sequences in FASTA format.
- Filtering Criteria: Supports selection by source database, taxonomic ID, and activity status within source databases.
- Output Formats: Supports output in HTML, comma-separated values (CSV), and Microsoft Excel (XLS) formats.
- Dataset Unification: Enables unifying protein datasets from multiple sources to produce consistent identifier mappings.
Scientific Applications:
- Data integration: Integrating datasets annotated with proteins from multiple database sources.
- Identifier reconciliation: Reconciling unstable or inconsistent protein identifier assignments across resources.
- Cross-database querying: Enabling queries across data providers that use different identifier systems.
- Data interoperability: Improving interoperability of protein data for downstream bioinformatics analyses.
Methodology:
Uses the UniProt Archive (UniParc) as the central repository and maps identifiers by requiring 100% sequence identity across over 70 source databases.
Topics
Collections
Details
- Tool Type:
- web application
- Operating Systems:
- Linux, Windows, Mac
- Added:
- 1/29/2015
- Last Updated:
- 11/25/2024
Operations
Publications
Côté RG, Jones P, Martens L, Kerrien S, Reisinger F, Lin Q, Leinonen R, Apweiler R, Hermjakob H. The Protein Identifier Cross-Referencing (PICR) service: reconciling protein identifiers across multiple source databases. BMC Bioinformatics. 2007;8(1). doi:10.1186/1471-2105-8-401. PMID:17945017. PMCID:PMC2151082.
Documentation
Terms of use
http://www.ebi.ac.uk/about/terms-of-useAPI documentation
http://www.ebi.ac.uk/Tools/picr/RESTDocumentation.doMap accession numbers between databases. It will also retrieve the UPI(UniProt Archive (UniParc) identifier of the given accession number.