프로젝트 소개

recipe-scrapers는 요리 웹사이트에서 레시피 데이터를 추출하기 위해 설계된 Python 패키지입니다. 표준 HTML 구조, Schema.org 마크업(JSON-LD, Microdata, RDFa 형식 포함) 또는 OpenGraph 메타데이터에서 레시피 정보를 파싱합니다. 이 패키지는 재료, 조리법, 조리 시간 등과 같은 데이터를 검색하기 위한 간단하고 일관된 API를 제공합니다. HTML 파싱에만 전념하며 웹사이트에서 구현한 봇 보호 조치를 우회하거나 회피하지 않습니다. ## 설치 ```shell pip install recipe-scrapers ``` ## 기본 사용법 ```python from recipe_scrapers import scrape_me scraper = scrape_me("https://www.allrecipes.com/recipe/158968/spinach-and-feta-turkey-burgers/") scraper.title() scraper.instructions() scraper.to_json() # 전체 메서드 목록: # help(scraper) ``` 고급 구현의 경우 레시피 HTML을 가져오고 네트워크 요청을 관리하기 위한 자체 솔루션을 구현해야 합니다. 이 라이브러리는 HTML 콘텐츠와 해당 소스 도메인을 모두 제공할 때 가장 잘 작동합니다. `scrape_html` 메서드를 사용하는 것이 권장됩니다: ```python from recipe_scrapers import scrape_html ``` 페이지에 여러 옵션이 있을 때 더 높은 품질의 이미지 감지가 기본적으로 활성화됩니다. 사이트에서 반환된 첫 번째 이미지를 유지하려면 호출별로 또는 전역 설정을 통해 이 동작을 비활성화하세요: ```python scraper = scrape_html(html, url, best_image=False) image_url = scraper.image() from recipe_scrapers.settings import settings settings.BEST_IMAGE_SELECTION = False ``` ## 지원 사이트 다양한 레시피 웹사이트가 기본적으로 지원됩니다. 전체 목록은 [지원 사이트 목록](https://docs.recipe-scrapers.com/getting-started/supported-sites/)을 확인하세요. 다음을 통해 프로그래밍 방식으로 전체 목록을 얻을 수도 있습니다: ```python from recipe_scrapers import SCRAPERS SCRAPERS.keys() ``` ## 기여 기여를 환영합니다. 시작하려면 [기여 가이드](https://docs.recipe-scrapers.com/contributing/home/)를 읽어보세요. ## 특별 감사 이 프로젝트를 더 나은 방향으로 만드는 데 도움을 주는 모든 [기여자](https://github.com/hhursev/recipe-scrapers/graphs/contributors)에게 감사드립니다. ## 프로젝트 공유 recipe-scrapers를 사용할 아이디어가 있으신가요? 영감을 얻거나 자신의 프로젝트를 공유하려면 [프로젝트 아이디어 월](https://github.com/hhursev/recipe-scrapers/issues/9)을 확인하세요.