Hello !
Si tu as de la chance (du genre pour ton site Rational), tu as juste à trouver la bonne url vers le json avec toute la donnée : https://www.rational-online.com/fr_fr/system/servicepartnerjson.json.
En 2mn tu as tout ! Donc pour chacun de tes sites, regarde si un json existe, et si oui télécharge le.
Pour GIF, c’est un peu le même sujet que pour le use case de Scrap du tableau de l'ordre des architectes - #2 par Scalon : tu dois envoyer une requête POST et parser le résultat.
Malheureusement, pour le 2è, il n’y a pas trop de moyen d’automatiser à 100% ce parsing : les pages html varient beaucoup d’un site à l’autre. Il y a des projets intéressant incluant de l’IA qui sont en cours de dev; mais rien de super concluant et abordable aujourd’hui à ma connaissance.
Mais si tu as quelqu’un avec les bonnes connaissances, ce sera très rapide à faire pour lui !
Tu pourrais aussi regarder le language Regex, que j’utilise dans tous mes projets : ca te permet de détecter des patterns de texte dans les pages html, sans prendre en compte la structure de ces pages html. C’est super utile pour extraire les numéros de tel ou les adresses emails, qui suivent des patterns reconnaissables dans un html, mais plus compliqué pour les nom, prénom, adresse, etc.