Warc-metadata-sidecar
A lap korábbi változatát látod, amilyen Admin (vitalap | szerkesztései) 2024. május 12., 18:34-kor történt szerkesztése után volt.
A University of North Texas Libraries munkatársai által írt Python könyvtár, amivel WARC vagy ARC konténerekből kigyűjthetők bizonyos típusú metaadatok egy [eredeti-fájlnév].warc.meta.gz nevű, WARC Metadata Sidecar formátumú kísérőfájlba. Ez azután akár CDXJ formátumra is konvertálható és összefésülhető az eredeti WARC-hoz tartozó CDXJ indexszel.