Web-Crawler-basiertes Archivsystem
Gemeinsam mit dem DenktMit-Team habe ich ein web-crawler-basiertes Archivsystem für die Intranet-Migration eines Schweizer Softwareherstellers entwickelt:
- Entwicklung eines Web-Crawlers in Kotlin und Selenium zur Extraktion von Seiten mit gerendertem JavaScript
- Implementierung einer React-Webapp als Such- und Einstiegsportal
- Aufbau und Tuning eines Suchindex mit Apache Solr
Technologien
- Kotlin
- Apache Solr
- Selenium
- React
- Docker
- Maven
- Git