# Main Content Extraction from Web Pages

**Type:** Papers  
**Canonical URL:** https://scholariq.org/papers/main-content-extraction-from-web-pages/

## Facts

| Field | Value |
| --- | --- |
| Author Names | Stanislas Morbieu,Guillaume Bruneval,Mohamed Lacarne,Mohamed Meyer Kana Kone,Francois-Xavier Bois |
| Citations | 3 |
| DOI | 10.1109/icmla51294.2020.00162 |
| Fields | Computer Science |
| Open Access | false |
| OA Status | closed |
| OpenAlex ID | https://openalex.org/W3130845557 |
| Type | conference-paper |
| Year | 2020 |

## Paper authors

- [Mohamed Meyer Kana Kone](https://scholariq.org/researchers/mohamed-meyer-kana-kone/)

## Paper primary topic

- [Web Data Mining and Analysis](https://scholariq.org/topics/web-data-mining-and-analysis/)

## Paper topics

- [Web Data Mining and Analysis](https://scholariq.org/topics/web-data-mining-and-analysis/)
- [Text and Document Classification Technologies](https://scholariq.org/topics/text-and-document-classification-technologies/)
- [Web visibility and informetrics](https://scholariq.org/topics/web-visibility-and-informetrics/)

---
Source: ScholarIQ — public research metadata, principally OpenAlex. See https://scholariq.org/sources/ for provenance and https://scholariq.org/methodology/ for what these figures mean.
