AuDoLab.subclasses.abstractscraper_arxiv¶
- class AuDoLab.subclasses.abstractscraper_arxiv.AbstractScraper_Arxiv[source]¶
Bases:
object- scrape_arxiv(url, pages=8, author=True)[source]¶
- Scrapes arxiv.org and returns a pd.DataFrame containing abstracts,
titles and author names.
Returns these informations based on the users given url (search query), e.g. url=”https://arxiv.org/search/?query=deep+learning&searchtype=all&source=header&order=&size=100&abstracts=show&date-date_type=submitted_date&start=0”
- Args:
url (str): link of searchquery from arxiv.org
- pages (int, optional): number of pages the algorithm iterates
through and searches for abstracts. Defaults to 8.
author (bool, optional): if true all author names are scraped as well. Defaults to True.
- Returns:
pd.DataFrame: DataFrame that contains Abstracts, Titles and Authors