La construction de requêtes avancées est un levier puissant pour explorer efficacement les millions de documents disponibles dans Istex Search. Cependant, la maîtrise de la syntaxe Lucene peut représenter un obstacle pour certains utilisateurs, notamment lorsqu’il s’agit de traduire une intention de recherche en une requête structurée. Pour faciliter cette étape, nous introduisons une nouvelle fonctionnalité expérimentale : la génération de requêtes Lucene à partir d’une description en langage naturel.
Décrivez votre besoin, nous construisons la requête
Désormais, un bouton dédié permet d’ouvrir une interface de recherche en langage naturel.

Il suffit ensuite de décrire son besoin.

Cette fonctionnalité fait appel à un nouveau web service de TDM. Un modèle d’intelligence artificielle (actuellement le LLM gemma-4-31b) décompose cette description et génère automatiquement une requête Lucene compatible avec Istex Search. La requête générée peut être en français mais également dans d’autres langues comme l’anglais, l’italien, l’allemand.

L’objectif n’est pas de remplacer la recherche experte, mais d’aider les utilisateurs à construire plus rapidement des requêtes complexes et à découvrir les possibilités offertes par le moteur de recherche. Les utilisateurs conservent ensuite la possibilité de consulter, modifier ou enrichir la requête générée pour relancer la recherche.
Une première version centrée sur les principales informations bibliographiques
Dans cette version initiale, la génération automatique de requêtes prend en compte les champs suivants :
- Titre (title)
- Résumé (abstract)
- Mots-clés d’auteurs (subject.value)
- Auteur (author.name)
- Date de publication (publicationDate)
- Langue (language.raw)
- Type de document : article de recherche (genre.raw: »research-article »)
Ces éléments permettent déjà de couvrir de nombreux scénarios de recherche documentaire.
Une fonctionnalité expérimentale
La génération de requêtes par IA est proposée comme une aide à la recherche. Les requêtes produites peuvent varier légèrement d’une génération à l’autre.
Nous invitons les utilisateurs à tester cette nouvelle fonctionnalité et à nous faire part de leurs retours afin d’enrichir progressivement ses capacités.
Pascal Cuxac, pour l’équipe Text & Data Mining et Mathilde Huguin, pour l’équipe Textes & Corpus – Istex
Besoin d'aide ?
Consultez notre Faq, la documentation Istex ou nos tutoriels
N’hésitez pas à nous contacter si besoin, nous reviendrons rapidement vers vous !