VJOURNAL

IA • Mesa global • 01 de octubre de 2026

S3 Vectors cambia la búsqueda filtrada, pero los depósitos existentes necesitan una actualización

La novedad del 30 de septiembre selecciona primero los metadatos y después busca similitudes. Un índice creado hoy aún puede usar el modo anterior si pertenece a un depósito más antiguo.

Portada de VJOURNAL para «S3 Vectors cambia la búsqueda filtrada, pero los depósitos existentes necesitan una actualización»

Respuesta breve

La novedad del 30 de septiembre selecciona primero los metadatos y después busca similitudes. Un índice creado hoy aún puede usar el modo anterior si pertenece a un depósito más antiguo.

Corte de verificación: 2 fuentes
ENHANCED aplica el filtro antes de buscar similitudes; los índices existentes siguen en CLASSIC hasta su actualización.
Los depósitos creados desde el 30 de septiembre tienen el nuevo valor por defecto; los anteriores requieren cambiarlo.
El aumento de hasta cinco veces en vectores coincidentes es una afirmación de AWS para filtros muy selectivos.

Cambia el orden de las operaciones

AWS presentó el filtrado previo de metadatos para Amazon S3 Vectors el 30 de septiembre. El nuevo modo ENHANCED identifica primero los vectores que cumplen un filtro y después busca similitudes dentro de ese conjunto. Para un asistente que consulta los registros de un cliente, cambia qué información puede competir por aparecer entre los resultados antes de que la vea el modelo de lenguaje.

La novedad aborda un problema concreto: una búsqueda puede devolver material plausible y pasar por alto documentos pertinentes dentro de una colección pequeña. Nuestra interpretación es que afecta a la calidad de la aplicación, además del almacenamiento. Importa cuando una respuesta depende de encontrar las pruebas adecuadas, aunque no puede corregir información equivocada que ya figure en esos documentos.

Un depósito antiguo transmite el comportamiento anterior

Los índices existentes permanecen en CLASSIC hasta que se actualizan. AWS también distingue la fecha del depósito de vectores de la fecha del índice individual. Los depósitos creados el 30 de septiembre o después utilizan ENHANCED por defecto. Un depósito anterior mantiene su configuración, incluso para índices creados posteriormente, salvo que el administrador modifique ese valor de manera explícita.

Ese detalle puede complicar el despliegue. Dos equipos que creen índices el mismo día podrían obtener comportamientos distintos por la historia de sus depósitos. La tabla recoge estados documentados de configuración, no mediciones de rendimiento. Inventariar los modos de los índices y los valores por defecto ofrece una imagen operativa más clara que fijarse únicamente en la fecha de lanzamiento de una aplicación.

Configuración según el anuncio de AWS del 30 de septiembre de 2026, comprobada el 1 de octubre; sin mediciones comparativas.
SituaciónModo documentadoAcción para ENHANCED
Índice existenteCLASSIC hasta modificarloActualizar el modo del índice
Índice nuevo en depósito antiguoValor del depósitoCambiar el modo por defecto
Depósito creado desde el 30 de septiembreENHANCED por defectoVerificar la configuración
Vectores ya almacenadosSe conservanNo hace falta otra carga

La cobertura se evalúa dentro del conjunto permitido

AWS afirma que los filtros muy selectivos pueden devolver hasta cinco veces más vectores coincidentes que la misma consulta sobre CLASSIC. Es una afirmación del proveedor sobre una condición particular de recuperación. No significa que todas las respuestas sean cinco veces más correctas ni establece una mejora universal de latencia. No hemos reproducido esa comparación ni realizado una prueba independiente.

Una evaluación propia debería identificar los documentos pertinentes dentro de cada ámbito previsto y comparar cuántos aparecen con entradas idénticas. Conviene incluir colecciones pequeñas de clientes y filtros más amplios, porque la dificultad cambia con la selectividad. La respuesta final exige otra comprobación: recuperar un documento adicional solo ayuda si el asistente lo interpreta correctamente y atribuye su conclusión al material adecuado.

El filtrado plantea una cuestión general de búsqueda

La documentación oficial de pgvector aporta contexto técnico independiente. Explica que filtrar después de recorrer un índice aproximado puede dejar pocos resultados y describe recorridos iterativos que continúan hasta encontrar suficientes coincidencias o alcanzar los límites configurados. Es información sobre otra implementación, no una prueba de que pgvector y S3 Vectors compartan algoritmos o rindan igual en condiciones comparables.

La comparación aclara qué preguntar a cualquier servicio vectorial: en qué etapa se aplica la colección permitida y qué ocurre cuando sobreviven pocos candidatos. El nombre del producto no resuelve esas dudas. Una prueba relevante necesita las mismas representaciones vectoriales, colección, filtro y cantidad deseada de resultados, además del coste y la latencia de la consulta completa.

Los metadatos forman parte del contrato de la aplicación

El lanzamiento añade coincidencias por prefijo mediante $startsWith. AWS documenta hasta 2 KB de metadatos filtrables por vector y hasta 100 restricciones por consulta, contadas según los valores evaluados. Por eso importa la estructura de los metadatos. Un campo breve que identifique una colección puede resultar más práctico que enviar una lista larga de identificadores individuales en cada petición.

Como ejemplo de diseño, pensemos en un asistente que busca documentos de un proyecto. La aplicación necesita un campo de proyecto uniforme, valores actualizados y reglas para los documentos eliminados o reasignados. El filtro expresa ese ámbito, pero su existencia no demuestra que el usuario tenga permiso para elegir cualquier proyecto. Las comprobaciones de acceso siguen formando parte del diseño del sistema que lo rodea.

Se puede evaluar el cambio sin sustituir el modelo

AWS afirma que la actualización no requiere ingerir otra vez los vectores ni cambiar consultas, y no tiene un cargo adicional por la función. Se mantienen las tarifas normales. El anuncio indica disponibilidad en las regiones comerciales donde existe el servicio y en las regiones de AWS en China. Hay que comprobar el modo del índice concreto, además de la región donde opera.

Una empresa que ya utiliza este almacenamiento puede conservar el modelo y comparar solo la recuperación. Registrar pruebas omitidas, resultados irrelevantes y tiempo de respuesta antes y después permite entender el efecto. La novedad de septiembre cambia cómo se encuentra información dentro de un ámbito definido; la calidad de los registros y la interpretación del asistente continúan siendo responsabilidades distintas que también deben evaluarse.

Preguntas frecuentes

¿Hay que cargar otra vez los vectores?

AWS indica que el cambio se aplica sin volver a ingerir los vectores ni modificar consultas. Aun así, hacen falta permisos adecuados y una comprobación del modo y del comportamiento resultante.

¿Un índice nuevo siempre utiliza ENHANCED?

Depende del valor por defecto del depósito. Los creados desde el 30 de septiembre usan ENHANCED; los más antiguos conservan CLASSIC hasta que se cambie la configuración, incluso para índices nuevos.

¿La búsqueda pasa a ser gratuita?

No. AWS no añade un cargo específico por el filtrado previo, pero mantiene las tarifas normales de almacenamiento, cargas y consultas. La aplicación completa puede consumir otros servicios con coste propio.