nanoporetech/dorado
Oxford Nanopore's Basecaller
What it solves
Dorado는 Oxford Nanopore reads를 처리하도록 설계된 고성능 분석 엔진입니다. GPU 및 Apple Silicon에서의 하드웨어 가속을 극대화하면서, basecalling, alignment, error correction을 통해 원시 시퀀싱 데이터를 사용 가능한 유전 정보로 변환하는 과정을 간소화합니다.
How it works
Dorado는 libtorch(PyTorch의 C++ API)를 기반으로 구축되었으며, 딥러닝 모델을 사용하여 basecalling을 수행합니다. 즉, nanopore sequencing에서 발생하는 원시 신호 데이터를 뉴클레오타이드 서열로 변환합니다. Nvidia GPU 및 Apple M-series 칩에서 고속 추론을 보장하기 위해 맞춤형 CUDA 및 Metal 최적화를 사용합니다. 이 엔진은 simplex 및 duplex basecalling을 포함한 다양한 모드를 지원하며, 변형된 염기(epigenetic markers) 및 poly(A) tail 추정 기능도 지원합니다.
Who it’s for
Oxford Nanopore sequencing data를 다루는 생물정보학자 및 연구자 중 basecalling, read alignment, assembly polishing을 위한 빠르고 확장 가능한 분석 파이프라인이 필요한 분들을 대상으로 합니다.
Highlights
- Hardware Acceleration: Nvidia A100/H100 GPU 및 Apple Silicon에 최적화되어 있으며, multi-GPU linear scaling을 지원합니다.
- Advanced Basecalling: 변형된 염기 basecalling(예: 5mC, 6mA) 및 더 높은 정확도를 위한 duplex basecalling을 지원합니다.
- Integrated Tooling: minimap2를 통한 read alignment, barcode classification, 그리고 HERRO를 통한 single-read error correction 기능을 내장하고 있습니다.
- Assembly Polishing: Flye 또는 Hifiasm과 같은 다른 도구로부터 얻은 draft assemblies를 정교하게 다듬는 고정확도 polishing tool을 제공합니다.
관련
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트
- Dispatch