Project Image 1
Project Image 2
  • Category:Web Application / SaaS
  • Software:Angular, Node.js, TypeSense, Copyleaks
  • Service:Architecture logicielle, Développement, Sécurité, Intégration
  • Client:Datark
  • Site : datark.fr
  • Date:Septembre, 2023

Description (intro)

Datark est une plateforme web dédiée à la diffusion, la valorisation et la mise en relation autour de documents scientifiques, avec une attention particulière pour les domaines des sciences humaines et de l’archéologie.

Développée en Angular côté front et Node.js côté backend, la solution intègre un moteur de recherche TypeSense ultra-performant, une modération automatisée par Copyleaks pour la détection de plagiat, ainsi qu’un back-office complet de validation des publications. Chaque utilisateur peut créer un profil, publier, discuter, explorer des événements ou opportunités professionnelles dans son domaine.

Challenge & Solution

L’enjeu principal était de construire un écosystème robuste capable de gérer des volumes importants de documents, tout en maintenant un haut niveau de qualité éditoriale. Nous avons mis en place un système de dépôt contrôlé, avec validation manuelle via un panneau d’administration, et vérification automatique via l’API de Copyleaks.

Côté utilisateur, l’accent a été mis sur l’interaction : profils enrichis, messagerie interne, système de suivi pour rester informé des publications de ses scientifiques favoris, et une veille des événements et offres d’emploi issus de grandes institutions.

Le moteur de recherche repose sur TypeSense pour une indexation rapide avec facettes dynamiques et recherche temps réel sur des milliers de documents.

Final Result

Datark fournit aujourd’hui une plateforme complète, fluide et sécurisée, où chercheurs, archéologues et institutions peuvent publier, échanger et valoriser leur production scientifique. Les documents sont contrôlés, référencés et interrogeables avec précision, tout en bénéficiant d’un réseau social intégré pour stimuler la collaboration.

La plateforme s’impose progressivement comme un hub scientifique de référence, alliant rigueur académique et expérience utilisateur moderne.

Étude de cas — Datark

Contexte client

Datark est une startup spécialisée dans la valorisation du patrimoine archéologique. Face à des milliers de documents hétérogènes (rapports de fouilles, photos, relevés géospatiaux), l'équipe avait besoin d'une plateforme centralisée permettant une recherche instantanée et une gestion documentaire avancée.

Une version 2 est en cours de développement. Elle fait passer la plateforme sur Next.js et NestJS, avec PostgreSQL comme base unique et sa recherche plein texte native, et lui ajoute la gestion de licences pour les établissements, un espace par organisation à sous-domaine dédié et une billetterie. L'étude de cas ci-dessous décrit la version actuellement en service ; nous la mettrons à jour une fois la refonte livrée.

Problématique

Aucun outil existant ne répondait aux contraintes spécifiques du secteur : indexation de documents scannés non-structurés, recherche plein texte sur des fonds anciens, et une interface accessible à des équipes travaillant dans plusieurs langues.

Solution AzurIT

  • ✓ Pipeline OCR automatique pour numériser et indexer les documents scannés
  • ✓ Moteur de recherche plein texte via Typesense, en connexion directe depuis le navigateur, sur les champs titre, description et texte extrait
  • ✓ Interface traduite en cinq langues — français, anglais, allemand, espagnol, italien
  • ✓ Interface d'administration et API REST documentée pour intégrations tierces

En bref

3,4 M
notices indexées et interrogeables en plein texte
Typesense
moteur de recherche auto-hébergé, sans abonnement à un service tiers
OCR
texte des documents scannés extrait et rendu recherchable

Technologies utilisées

Angular 17
Typesense