Modèles et plateformes d’IA
Qu’est-ce que la multitenance dans les bases de données vectorielles ?
Lorsque vous téléchargez et gérez vos données sur GitHub de sorte que personne d’autre ne puisse les voir à moins que vous ne les rendiez publiques, vous partagez les infrastructures physiques avec d’autres utilisateurs. C’est parce que GitHub utilise la multitenance comme une alternative rentable et plus facile à gérer que l’attribution d’une base de données distincte à chaque utilisateur.
Cependant, le partage de la même infrastructure devient un risque pour la sécurité lorsque tous les utilisateurs peuvent voir les données des autres. La multitenance répond à ce problème en partitionnant logiquement les données des utilisateurs tout en leur permettant de fonctionner sur les mêmes ressources.
Cet article explore la multitenance dans les bases de données vectorielles, ses avantages, ses limites et ses cas d’utilisation réels.
Comment fonctionne la multitenance dans les bases de données vectorielles ?
La multitenance est une approche où plusieurs locataires, c’est-à-dire les utilisateurs, partagent la même base de données mais stockent leurs données dans un environnement isolé.
Un environnement isolé est créé à l’aide de références uniques pour chaque locataire afin de sécuriser leurs données. En conséquence, chaque locataire peut stocker, gérer et modifier ses données dans son environnement isolé. Cependant, l’entreprise a accès à la gestion et au contrôle des ressources et des limites des locataires.

Illustration d’exemple d’une collection à deux locataires avec un accès isolé à la même base de données. Source d’image: Qdrant
Les bases de données vectorielles utilisent l’indexation comme technique de recherche qui organise les vecteurs en fonction de leur similarité. La stratégie d’indexation a un impact sur la partition des données des locataires. Actuellement, deux stratégies d’indexation sont utilisées dans les bases de données vectorielles multilocataires.
Discutons des deux stratégies d’indexation dans les bases de données vectorielles multilocataires:
- Indexation partagée: Tous les locataires partagent le même index avec des références uniques qui partitionnent les données. Cette méthode est efficace en termes de mémoire. Cependant, elle nécessite des mécanismes de sécurité et de contrôle d’accès robustes pour protéger les données des locataires.
- Indexation par locataire: Chaque locataire a un index distinct dans l’indexation par locataire. Cela permet un contrôle d’accès complet et améliore les performances de recherche. Cependant, cette méthode est gourmande en ressources.
Certaines bases de données vectorielles comme Qdrant et Milvus offrent une architecture multilocataire pour permettre une personnalisation et une évolutivité accrues pour les utilisateurs avec les deux stratégies d’indexation.
Avantages de la multitenance dans les bases de données vectorielles
La multitenance dans les bases de données vectorielles offre de nombreux avantages pour les entreprises qui nécessitent des instances de base de données isolées pour plusieurs utilisateurs. Certains des avantages incluent:
1. Réduction des coûts
L’utilisation de moins de ressources pour plus d’utilisateurs se traduit par une réduction des coûts d’infrastructure.
2. Évolutivité
La multitenance permet un partage de ressources basé sur les besoins. Cela signifie que les locataires ayant des exigences de stockage plus élevées obtiennent plus de ressources et vice versa.
3. Personnalisation
Un environnement distinct permet aux locataires de configurer leur environnement en fonction de leurs besoins, y compris le schéma de base de données, les plug-ins, les métriques et les tableaux de bord. Les configurations sont privées aux locataires, et les locataires peuvent les modifier à mesure que leurs besoins changent.
4. Gestion
Une base de données unique pour tous les locataires permet une gestion centralisée des ressources, de la configuration et de la surveillance au lieu de surveiller tous les locataires séparément. Alors qu’une entreprise peut gérer tous les locataires en un seul endroit, les locataires ont le contrôle pour gérer leurs données dans leurs environnements isolés.
Limitations de la multitenance dans les bases de données vectorielles
Comme toute autre approche architecturale, la multitenance a certaines limitations. Il est important de considérer ces limitations pour prendre des décisions éclairées. Les limitations les plus courantes incluent:
1. Complexités supplémentaires
La gestion de plusieurs locataires sur une seule ressource nécessite une configuration supplémentaire. Cela inclut l’intégration des locataires, le contrôle d’accès, l’authentification des utilisateurs et l’autorisation. Le manque de connaissances et de support pourrait entraîner des résultats indésirables tels que le partage accidentel de données ou la surcharge des ressources.
Pour répondre à cela, une planification soigneuse et un support de base de données garantissent un environnement utilisateur sécurisé.
2. Problèmes de sécurité
L’accès malveillant, les erreurs de configuration accidentelles ou les vulnérabilités de l’infrastructure sous-jacente peuvent entraîner un partage de données entre les locataires. En tant que garde-fous, la mise en œuvre d’une conception soigneuse, la réalisation d’audits réguliers et l’intégration de mesures de sécurité multicolores peuvent renforcer la sécurité globale.
3. Goulots d’étranglement des performances
Une utilisation plus élevée des ressources par un locataire peut ralentir les performances des autres. L’indexation partagée affecte spécifiquement les performances de recherche en raison des vérifications d’autorisation à l’exécution pour correspondre à la liste d’accès. La gestion des ressources et le contrôle, les mises à jour régulières et l’éducation des locataires sont importants pour atténuer les problèmes de performances.
4. Panne du système
La maintenance planifiée, les défaillances matérielles et les bogues logiciels affectent tous les locataires lorsqu’ils partagent une infrastructure similaire. Cela entraîne des pertes de données, de réputation et financières. Une évaluation régulière des risques, une assurance de la qualité de l’infrastructure et des sauvegardes à temps peuvent minimiser l’impact négatif des pannes du système.
Cas d’utilisation de la multitenance
La multitenance est utile dans diverses applications, des systèmes de recommandation de commerce électronique à la formation de grands modèles d’apprentissage automatique (ML) dans les entreprises. Certains des cas d’utilisation les plus courants incluent:
1. Systèmes de recommandation
Imaginez une plateforme de commerce électronique où les utilisateurs peuvent s’inscrire et enregistrer leurs préférences d’achat. Une configuration multilocataire permettrait des recommandations de produits personnalisées à chaque utilisateur.
Sur la plateforme de commerce électronique, tous les locataires peuvent définir leurs critères, de sorte que le système de recommandation envoie des recommandations de produits personnalisées aux utilisateurs finals.
2. Applications d’entreprise
Les grandes applications logicielles servant de multiples employés et clients utilisent la même base de données pour tous les utilisateurs. Tous les utilisateurs peuvent télécharger et gérer leurs données tout en les protégeant des autres. Par exemple, Dropbox et HubSpot (HUBS ) permettent à tous les utilisateurs de partager les mêmes ressources tout en gardant leurs données protégées les unes des autres.
3. Détection d’anomalies et de fraude
La multitenance permet le développement de solides systèmes de détection de fraude tout en gardant les données individuelles sécurisées. Les entreprises forment des modèles de détection de fraude sur leurs données anonymisées et n’envoient que le modèle formé sur la base de données centralisée. Cela leur permet de garder leurs données sécurisées tout en contribuant au développement de systèmes de détection de fraude.
Par exemple, les systèmes de détection de fraude de carte de crédit utilisent l’apprentissage automatique pour une meilleure efficacité et confidentialité.
Quand utiliser et quand ne pas utiliser la multitenance
De multiples facteurs contribuent à la décision de passer à la multitenance, notamment les performances des locataires, les exigences d’isolation et les problèmes de sécurité. Discutons de quand et de quand ne pas utiliser la multitenance en détail ci-dessous.
Quand utiliser la multitenance
Les indicateurs suivants font de la multitenance une bonne option:
- Plusieurs locataires ont besoin d’environnements distincts.
- Les locataires peuvent accepter des compromis sur les performances.
- La réduction des coûts est votre priorité.
- La gestion centralisée des locataires améliore vos opérations.
Quand ne pas utiliser la multitenance
Les limitations de la multitenance l’empêchent de convenir à toutes les situations. Une base de données vectorielle multilocataire n’est pas une bonne option pour vous si vous avez les exigences suivantes:
- Les locataires possèdent des données très sensibles avec des exigences de sécurité strictes.
- Un nombre limité de locataires avec une croissance lente.
- Les locataires nécessitent des environnements dédiés et ne peuvent pas tolérer une dégradation des performances.
- Expertise et capacité limitées en matière de multitenance pour gérer une complexité croissante.
La multitenance introduit une évolutivité et une gestion supplémentaires dans les bases de données vectorielles. Si elle est configurée correctement, la multitenance permet d’économiser des coûts et des ressources significatifs pour une organisation.
Intéressé par plus de contenu lié à l’IA ? Restez en contact avec unite.ai.












