mfsig.com
rosetta · gratis

Piedra Rosetta — conversión universal de archivos

Arquitectura de concentrador y radios. Cada lector se normaliza al esquema Pydantic FullOutput de MolForge; cada escritor emite a partir de él. Añadir un nuevo proveedor es un lector nuevo + un escritor nuevo.

Cada proveedor de QM tiene su propio dialecto .cosmo. Unidades distintas, órdenes de columnas distintos, convenciones distintas para la indexación de átomos. La solución histórica eran scripts de regex por proveedor; cada laboratorio mantenía el suyo; ninguno hacía la ida y vuelta a fp64.

El módulo de la Piedra Rosetta colapsa todos los formatos de proveedor en un único concentrador: el FullOutput de MolForge. Soporte de producción para Turbomole / COSMOtherm / xtb / CSV de MolForge; parcial para Gaussian / NwChem / ORCA. La detección automática los distingue mediante análisis de contenido.

Matriz de soporte de formatos

Turbomole + COSMOtherm: producción, ida y vuelta a fp64. Volcado nativo de xtb: producción (diferenciado de Turbomole por la cabecera $gfn / # generated by xtb). CSV de MolForge: intercambio nativo para tuberías de ML. ORCA cpcm.dat, Gaussian SCRF, NwChem cosmo: parcial (mejor esfuerzo en las distribuciones de versiones más comunes).

Añadir un nuevo proveedor

Escribe _parse_X_blocks(path) → _ParsedLegacy con las unidades normalizadas a Bohr / Ų / índices de átomos basados en 0. Añade una rama de detección automática a read_legacy_cosmo. Opcionalmente, añade un escritor write_X_cosmo. Tiempo total por proveedor nuevo: ~1 día.