{"id":"common-crawl-2","name":"Common Crawl","library":"PR, reputation and narrative","library_file":"06","category":"News, media and web mentions","status":"free corpus; downloader MIT/Apache-2.0","sources":[{"label":"Project","url":"https://commoncrawl.org/"}],"links":[{"label":"Project","url":"https://commoncrawl.org/"}],"attributes":{"status":"free corpus; downloader MIT/Apache-2.0","interface_and_best_use":"WARC/WAT/WET/index → historic pages/metadata/text","limits_cautions":"incomplete/not live; inclusion does not erase copyright/privacy/deletion duties","official_source":"Project"},"defined_in":{"file":"06","file_slug":"pr-reputation-tool-library","section":"2-news-media-and-web-mentions","table":"06.2-news-media-and-web-mentions.t1","line":22}}