Performance

Optimisations de performance

Optimisations

  • Formatage optimisé — réponses adaptées à la lecture par un modèle de langage
  • Transport HTTP streamable — pour les réponses volumineuses
  • Pagination — pour parcourir les grands volumes sans tout charger

Conseils d'utilisation

  1. Limitez le nombre de résultats — ne demandez que ce dont vous avez besoin. Une recherche qui renvoie 100 décisions intégrales sature la fenêtre de contexte de votre assistant et dégrade la qualité de sa réponse.
  2. Utilisez le mode panorama pour balayer un grand nombre de résultats : il ne renvoie que les métadonnées et les résumés. Vous demandez ensuite le texte complet des seuls résultats retenus.
  3. Utilisez les filtres — juridiction, ministère, type de texte, plage de dates. Filtrer à la source coûte moins cher que trier après coup.
  4. Préférez les recherches spécifiques aux termes trop généraux. Par défaut, tous les mots doivent être présents : trois mots précis valent mieux qu'une phrase entière.

Temps de réponse typiques

Opération Temps moyen
Liste des outils < 100 ms
Recherche simple 200 à 500 ms
Recherche complexe 500 ms à 2 s

Ces ordres de grandeur concernent la passerelle. Le temps perçu inclut en plus celui que votre assistant met à formuler sa réponse, qui est généralement le plus long.

Gestion des erreurs

En cas de dépassement de délai ou d'erreur, le serveur renvoie un message explicite. Attendez quelques secondes avant de réessayer.

Pour vérifier que le service est disponible sans consommer votre quota, utilisez le point d'accès public https://mcp.openlegi.fr/health — voir la page « Health Check ».