Description du poste
Au sein de notre équipe Data/Tech, vous contribuerez activement à la collecte automatisée de données provenant de sources web variées. Vous interviendrez dans le développement de nouveaux scrapers, la maintenance des pipelines existants et l’optimisation de nos processus de collecte.
Votre mission principale consistera à concevoir des solutions robustes et évolutives pour alimenter nos bases de données, tout en garantissant la qualité, la fiabilité et la traçabilité des données collectées. Vous serez un acteur clé de l’amélioration continue de notre infrastructure data, en collaboration avec une équipe technique passionnée et exigeante.
Vos missions seront les suivantes :
- Développement de scrapers web : concevoir, coder et déployer des outils de scraping — APIs, sites statiques et dynamiques — afin de collecter des données stratégiques, dans le respect des bonnes pratiques et des contraintes techniques.
- Maintenance et optimisation : assurer la pérennité des scrapers existants, notamment en corrigeant les pannes, en adaptant les outils aux évolutions des sites sources et en optimisant leurs performances. Mettre également en place un monitoring fiable — alertes, suivi des volumes et détection des anomalies.
- Traitement et stockage des données : structurer, nettoyer et stocker les données collectées dans nos bases, tout en garantissant leur intégrité et leur accessibilité pour les équipes métiers.
- Documentation et partage : rédiger une documentation claire et exhaustive des scrapers et des processus associés, et contribuer à la montée en compétence de l’équipe.
Ce que nous proposons
- Un environnement technique exigeant et formateur, porté par un fort ADN R&D.
- Une grande autonomie et une relation de confiance dès votre arrivée.
- Un accès aux outils d’IA les plus avancés, intégrés à vos pratiques.
- Une politique de télétravail hybride, à raison de deux jours par semaine.
- Un environnement qui encourage et favorise l’apprentissage continu : hackathons, formations aux usages de l’IA par métier, formations continues, etc.
- Des événements réguliers et fédérateurs pour célébrer nos réussites individuelles et collectives.
- Une culture d’entreprise forte, où l’excellence, la sobriété, la curiosité et la confiance sont les maîtres-mots.
- Un accompagnement par un tuteur expérimenté.
Compétences requises
- Maîtrise technique : bonne pratique de Python et connaissance d’au moins une bibliothèque de scraping, comme Scrapy, BeautifulSoup, Selenium ou Playwright.
- Compréhension du web : notions de HTML/CSS et des requêtes HTTP, ainsi que capacité à lire et exploiter une documentation d’API REST.
- Outils et méthodes : familiarité avec Git, rigueur dans le versionnage et le suivi des évolutions.
- Résolution de problèmes : autonomie, esprit analytique et goût pour le débogage et l’optimisation.
- Collaboration : capacité à travailler en équipe, à documenter son travail et à partager ses connaissances.
Atouts supplémentaires :
- Expérience avec des bases de données, comme PostgreSQL ou MongoDB.
- Notions de Docker et de déploiement, notamment en CI/CD.
- Connaissance des techniques anti-bot, comme les proxies, la rotation des en-têtes ou les captchas.
Profil recherché
- Vous êtes étudiant·e en Bac+3 à Bac+5, en école d’ingénieur ou à l’université, avec une spécialisation en informatique, data engineering ou développement web.
- Passionné·e par la data et les défis techniques, vous souhaitez mettre vos compétences en pratique au sein d’une équipe dynamique et innovante.
- Rigoureux·se, autonome et orienté·e solutions, vous aimez relever des défis techniques et contribuer à des projets concrets.
- Votre curiosité, votre esprit d’initiative et votre capacité à travailler en équipe seront des atouts majeurs pour réussir dans ce poste.
Processus de recrutement
Notre processus de recrutement se déroule en quatre étapes afin de vous permettre de rencontrer l’équipe et de découvrir votre futur environnement de travail :
- Entretien RH — 30 min : première rencontre en visioconférence pour échanger sur votre parcours et vos motivations.
- Entretien avec le manager — 45 min : échange destiné à mieux comprendre vos compétences et la manière dont vous pouvez contribuer au succès de notre équipe.
- Mise en situation — 1 h 30 : rencontre sur site comprenant un cas pratique technique.
- Rencontre finale — 30 min : échange avec l’un de nos dirigeants pour découvrir notre vision et notre culture d’entreprise.
Nous garantissons un processus rapide, d’une durée maximale de trois semaines, ainsi que des retours constructifs à chaque étape.
Nos engagements
- Égalité des chances : nous veillons à proposer un processus de recrutement favorisant l’égalité des chances. Nous nous engageons à promouvoir un environnement de travail inclusif et respectueux pour tous, où chaque collaborateur peut s’épanouir pleinement.
- Convention de réserve : nous soutenons l’engagement de nos collaborateurs en leur permettant de signer une convention de réserve.
- Comité RSE : notre comité a pour objectif de maîtriser notre empreinte environnementale à travers des actions concrètes :
- Bilan carbone annuel et feuille de route de réduction.
- Infrastructure et modèles d’IA conçus pour limiter la consommation de ressources.
- Engagement en faveur de la mobilité durable et des achats responsables.
- Fondation Sahar : nous avons créé une fondation d’entreprise qui incarne l’engagement de notre organisation en faveur d’une IA éthique, écologique et responsable. Cet engagement se traduit par de nombreuses initiatives portées par nos collaborateurs : sensibilisation du grand public à travers des publications open source, animation de tables rondes, challenges internationaux, publication de manifestes, etc.
Pour en savoir plus : https://fondation-sahar.fr