Retour à toutes les fonctionnalités

Mise en cache sémantique des réponses

Arrêtez de payer deux fois pour la même réponse

Mettez en cache les réponses et servez-les à nouveau lorsqu'une requête entrante est suffisamment proche d'une requête déjà traitée — pas seulement une correspondance exacte. Vous réduisez les coûts et la latence sur le trafic répétitif, avec un contrôle total sur ce qui est mis en cache et pendant combien de temps.

Inclus

Pourquoi c'est important

  • Réduction des dépenses fournisseur sur les requêtes répétitives

  • Réponses plus rapides pour les questions courantes

  • Administrez précisément ce qui est mis en cache et à quel moment

Ce qui est inclus

Correspondance par similarité

Servez une réponse mise en cache lorsqu'une nouvelle requête est sémantiquement proche d'une requête antérieure, pas uniquement en cas de correspondance exacte.

Administration du cache

Inspectez, délimitez et videz le cache, avec un contrôle sur les durées de vie par cas d'usage.

Gains sur les coûts et la latence

Réduisez à la fois les dépenses et le temps de réponse sur le trafic le plus répétitif.

Soumis aux mêmes règles

Le trafic mis en cache respecte toujours les clés, les budgets et les garde-fous.

Prêt à le voir en action ?

Parlez à notre équipe et nous vous montrerons comment Xcellerate AIG s'intègre à votre stack.

Commencer gratuitement