Jeder QM-Vendor hat seinen eigenen .cosmo-Dialekt. Andere Einheiten, andere Spaltenreihenfolgen, andere Konventionen für die Atomindizierung. Der historische Behelf waren Vendor-spezifische Regex-Skripte; jedes Labor pflegte sein eigenes; keines davon machte einen Round-Trip auf fp64.
Das Rosetta-Stone-Modul führt jedes Vendor-Format in einem Hub zusammen: das MolForge-FullOutput. Produktive Unterstützung für Turbomole / COSMOtherm / xtb / MolForge CSV; teilweise für Gaussian / NwChem / ORCA. Die Auto-Erkennung unterscheidet sie per Inhaltsanalyse.
Format-Unterstützungsmatrix
Turbomole + COSMOtherm: produktiv, fp64-Round-Trip. xtb-Native-Dump: produktiv (von Turbomole über den Header $gfn / # generated by xtb unterschieden). MolForge CSV: nativer Austausch für ML-Pipelines. ORCA cpcm.dat, Gaussian SCRF, NwChem cosmo: teilweise (Best-Effort bei den gängigsten Versionslayouts).
Einen neuen Vendor hinzufügen
Schreiben Sie _parse_X_blocks(path) → _ParsedLegacy mit auf Bohr / Ų / 0-basierte Atomindizes normalisierten Einheiten. Fügen Sie read_legacy_cosmo einen Auto-Erkennungs-Zweig hinzu. Optional einen write_X_cosmo-Writer ergänzen. Gesamtaufwand pro neuem Vendor: ~1 Tag.