AuDoLab.subclasses.abstractscraper_arxiv

class AuDoLab.subclasses.abstractscraper_arxiv.AbstractScraper_Arxiv[source]

Bases: object

scrape_arxiv(url, pages=8, author=True)[source]
Scrapes arxiv.org and returns a pd.DataFrame containing abstracts,

titles and author names.

Returns these informations based on the users given url (search query), e.g. url=”https://arxiv.org/search/?query=deep+learning&searchtype=all&source=header&order=&size=100&abstracts=show&date-date_type=submitted_date&start=0

Args:

url (str): link of searchquery from arxiv.org

pages (int, optional): number of pages the algorithm iterates

through and searches for abstracts. Defaults to 8.

author (bool, optional): if true all author names are scraped as well. Defaults to True.

Returns:

pd.DataFrame: DataFrame that contains Abstracts, Titles and Authors

AuDoLab.subclasses.abstractscraper_arxiv.warn(*args, **kwargs)[source]