
Assistant de recherche documentaire
Retrouver une information dans un corpus sans masquer l'incertitude ni les limites des sources
Contexte:
Des documents utiles existent, mais leur contenu est difficile à parcourir rapidement
Problème:
La recherche par mots-clés ne suffit pas toujours et les réponses doivent être traçables
Contraintes:
Confidentialité, qualité des documents, citations er risque de réponse trop assurée
Réflexion:
Considérer la recherche comme système d'aide, pas comme une source véritable autonome.
Solution construite:
Indexation, recherche sémantique, sélection de passages et génération d'une réponse sourcée
Résultats observés:
Indexation longue, LLM utilisé ne garantie pas la sécurité de la donnée mais réponse rapide et documents trouvés cohérents
Limites:
Difficulté à prompter correctement le LLM pour lui faire rechercher les bonnes infos, maintenir le serveur du projet sans avoir à refaire indexation, complexité pour un résultat mitigé
Technologies:
Indexation par IA, embeddings, LLM, serveur local
Ce qui a fonctionné
Ce que je ferais différement
Pourquoi ce n'est pas universel
Power in Numbers
30
Programs
50
Locations
200
Volunteers