Réponse en bref
Depuis l’annonce du 30 septembre, ENHANCED filtre les métadonnées avant la recherche de similarité. Un index créé aujourd’hui peut conserver l’ancien mode si son compartiment est antérieur.
L’ordre des opérations change
AWS a présenté le préfiltrage des métadonnées pour Amazon S3 Vectors le 30 septembre. Le nouveau mode ENHANCED identifie d’abord les vecteurs correspondant au filtre, puis recherche les similarités dans cet ensemble. Pour un assistant consultant les dossiers d’un client, cela change les documents susceptibles de figurer dans les résultats, avant même que le modèle de langage ne reçoive les informations.
La nouveauté vise un problème concret : une recherche peut produire des résultats plausibles tout en manquant des documents pertinents dans une petite collection. Notre lecture est qu’il s’agit aussi d’une évolution de la qualité applicative. Elle compte lorsque la réponse dépend de preuves bien retrouvées, mais elle ne corrige pas les informations erronées qui figurent déjà dans les documents disponibles.
Un ancien compartiment garde son ancien réglage
Les index existants restent en mode CLASSIC jusqu’à leur mise à jour. AWS distingue aussi la date du compartiment de vecteurs de celle de chaque index. Les compartiments créés à partir du 30 septembre utilisent ENHANCED par défaut. Un compartiment antérieur garde son réglage, même pour des index créés plus tard, tant que l’administrateur ne le modifie pas explicitement.
Ce détail peut compliquer le déploiement. Deux équipes créant des index le même jour peuvent obtenir des comportements différents à cause de l’historique des compartiments. Le tableau présente les états documentés de configuration, sans mesure de performance. Inventorier les modes des index et les réglages par défaut donne une meilleure vision que la seule date de publication d’une application.
| Situation | Mode documenté | Action pour ENHANCED |
|---|---|---|
| Index existant | CLASSIC jusqu’au changement | Modifier le mode de l’index |
| Nouvel index dans un ancien compartiment | Réglage du compartiment | Modifier le mode par défaut |
| Compartiment créé depuis le 30 septembre | ENHANCED par défaut | Vérifier la configuration |
| Vecteurs déjà présents | Conservés sur place | Aucune nouvelle ingestion |
Le rappel concerne la collection autorisée
AWS affirme que des filtres très sélectifs peuvent retourner jusqu’à cinq fois plus de vecteurs correspondants que la même requête en CLASSIC. C’est une affirmation du fournisseur portant sur une condition particulière de recherche. Elle ne signifie pas que chaque réponse devient cinq fois plus exacte et ne démontre pas une baisse générale de latence. Nous n’avons pas reproduit ce test.
Une évaluation locale devrait définir les documents pertinents à l’intérieur de chaque périmètre, puis comparer leur récupération avec des entrées identiques. Elle devrait inclure de petites collections et des filtres plus larges, car la difficulté dépend de la sélectivité. La réponse finale nécessite une autre vérification : un document supplémentaire n’aide que si l’assistant l’interprète correctement et rattache sa conclusion à la bonne source.
Le filtrage est un problème commun aux moteurs
La documentation officielle de pgvector apporte un contexte technique indépendant. Elle explique qu’un filtrage après le parcours d’un index approximatif peut laisser trop peu de résultats et décrit des parcours itératifs qui continuent jusqu’à obtenir suffisamment de correspondances ou atteindre des limites configurées. Il s’agit d’une autre réalisation, pas d’une preuve d’équivalence algorithmique ou de performance avec S3 Vectors.
Cette comparaison précise les questions à poser à tout service vectoriel : quand le périmètre autorisé intervient-il et que se passe-t-il si trop peu de candidats subsistent ? Le nom du produit ne suffit pas. Un test utile exige les mêmes représentations vectorielles, collection, filtre et nombre de résultats recherchés, ainsi que le coût et la latence de la requête entière.
Les métadonnées deviennent un contrat applicatif
La version ajoute la recherche par préfixe avec $startsWith. AWS indique jusqu’à 2 Ko de métadonnées filtrables par vecteur et jusqu’à 100 contraintes par requête, comptées selon les valeurs évaluées. Le choix des champs a donc des conséquences pratiques. Un identifiant de collection concis peut être plus simple à utiliser qu’une longue liste d’identifiants de documents envoyée à chaque recherche.
Imaginons un assistant chargé des documents d’un projet. L’application doit disposer d’un champ cohérent, actualiser les valeurs et traiter les documents supprimés ou réaffectés. Le filtre exprime ce périmètre ; il ne prouve pas que l’appelant a le droit de choisir n’importe quel projet. Les vérifications d’accès restent une responsabilité du système autour du moteur de recherche, indépendamment de cette nouvelle option.
Une évaluation possible sans changer de modèle
AWS indique que la mise à jour s’applique sans nouvelle ingestion, sans changement de requêtes et sans supplément pour cette fonction. Les tarifs habituels restent en vigueur. La disponibilité annoncée couvre les régions commerciales proposant le service et les régions AWS en Chine. Il faut rapprocher cette annonce de la région utilisée, puis vérifier le mode de l’index concerné.
Une entreprise déjà cliente peut conserver son modèle et examiner uniquement la récupération. Relever les preuves manquantes, les résultats inutiles et le temps de réponse avant et après permet d’attribuer le changement à la bonne couche. La version de septembre modifie la recherche dans un périmètre défini ; la qualité des documents et l’interprétation de l’assistant demeurent des responsabilités distinctes à évaluer.
Questions et réponses
Faut-il importer à nouveau les vecteurs ?
AWS annonce un changement sur place, sans nouvelle ingestion ni modification des requêtes. Il faut néanmoins disposer des autorisations nécessaires et vérifier le mode et le comportement obtenus après l’opération.
Un nouvel index utilise-t-il toujours ENHANCED ?
Le réglage par défaut du compartiment décide. Ceux créés depuis le 30 septembre utilisent ENHANCED ; les anciens conservent CLASSIC jusqu’à modification, y compris pour leurs nouveaux index.
La recherche devient-elle gratuite ?
Non. Le préfiltrage n’entraîne pas de supplément propre à cette fonction, mais les tarifs habituels de stockage, de chargement et de requête restent applicables, comme les coûts des autres services utilisés.
