Las traducciones son generadas a través de traducción automática. En caso de conflicto entre la traducción y la version original de inglés, prevalecerá la version en inglés.
Prediga las estructuras de las proteínas con ESMfold en Deadline Cloud
El paquete de trabajos facebook/esmfold_v1 El paquete toma un archivo FASTA como entrada y produce un .pdb archivo por secuencia como salida, junto con métricas de confianza y un informe de validación opcional comparándolo con estructuras de referencia experimentales.
El trabajo consta de cuatro pasos:
-
Analice el FASTA de entrada, valide las secuencias (hasta 1024 aminoácidos, residuos estándar más X) y divida los registros entre las tareas de los trabajadores.
-
Ejecute la inferencia de EsmFold en cada lote de secuencias de la GPU.
-
Genere una imagen esquemática de cada estructura predicha, coloreada según el nivel de confianza de pLDDT por residuo.
-
Opcional: al proporcionar un directorio de PDB de referencia experimentales, calcule TM-score, utilice el RMSD y una gráfica de calibración por residuo. pLDDT/error
El paquete requiere una granja con una flota gestionada por servicios de GPU de NVIDIA (A10G, L4 o A100; al menos 16 GB de VRAM y 16 GB de RAM del sistema) y una cola con un entorno de cola conda que consuma los parámetros y del trabajo. CondaPackages CondaChannels La configuración más rápida es la plantilla cuda_farm () del sitio web. https://github.com/aws-deadline/deadline-cloud-samples/tree/mainline/cloudformation/farm_templates/cuda_farm
Envía la demostración, que incluye tres proteínas breves de referencia (las Trp-cage variantes 1L2Y y 2JOF, y la villina Headpiece 1VII):
deadline bundle submit ./job_bundles/esmfold_predict/ \ -p InputFasta=./job_bundles/esmfold_predict/sample_inputs/demo.fasta
La primera vez que un trabajador nuevo descarga los facebook/esmfold_v1 pesos de 5,2 GB (unos tres minutos en <OutputDir>/.hf_cache/ cada unidad). g5.2xlarge Las tareas de plegado subsiguientes de la misma tarea reutilizan la caché.
Para validar las predicciones comparándolas con las referencias experimentales, coloque <seq_id>.pdb los archivos en un directorio y páselos comoReferencePdbDir. El Validate paso escribe validation.csv y uno por secuenciacalibration.png.