mfsig.com
rosetta · kostenlos

Rosetta Stone – universelle Dateikonvertierung

Hub-and-Spoke-Architektur. Jeder Reader normalisiert in das MolForge-FullOutput-Pydantic-Schema; jeder Writer emittiert daraus. Einen neuen Vendor hinzuzufügen, ist ein neuer Reader + ein neuer Writer.

Jeder QM-Vendor hat seinen eigenen .cosmo-Dialekt. Andere Einheiten, andere Spaltenreihenfolgen, andere Konventionen für die Atomindizierung. Der historische Behelf waren Vendor-spezifische Regex-Skripte; jedes Labor pflegte sein eigenes; keines davon machte einen Round-Trip auf fp64.

Das Rosetta-Stone-Modul führt jedes Vendor-Format in einem Hub zusammen: das MolForge-FullOutput. Produktive Unterstützung für Turbomole / COSMOtherm / xtb / MolForge CSV; teilweise für Gaussian / NwChem / ORCA. Die Auto-Erkennung unterscheidet sie per Inhaltsanalyse.

Format-Unterstützungsmatrix

Turbomole + COSMOtherm: produktiv, fp64-Round-Trip. xtb-Native-Dump: produktiv (von Turbomole über den Header $gfn / # generated by xtb unterschieden). MolForge CSV: nativer Austausch für ML-Pipelines. ORCA cpcm.dat, Gaussian SCRF, NwChem cosmo: teilweise (Best-Effort bei den gängigsten Versionslayouts).

Einen neuen Vendor hinzufügen

Schreiben Sie _parse_X_blocks(path) → _ParsedLegacy mit auf Bohr / Ų / 0-basierte Atomindizes normalisierten Einheiten. Fügen Sie read_legacy_cosmo einen Auto-Erkennungs-Zweig hinzu. Optional einen write_X_cosmo-Writer ergänzen. Gesamtaufwand pro neuem Vendor: ~1 Tag.