Amazon apporte la recherche vectorielle native en temps réel à DynamoDB pour prendre en charge les applications d'IA à grande échelle

Amazon Web Services Inc. a annoncé aujourd'hui la disponibilité générale de la recherche vectorielle sur DynamoDB, la base de données de valeurs-clés et de documents NoSQL haute disponibilité de la société, conçue pour une vitesse et une évolutivité élevées.

Lancé en 2021, le service de base de données a connu de nombreuses itérations et se positionne aujourd'hui comme la base de données incontournable pour les développeurs qui ont besoin de performances prévisibles sans surcharge opérationnelle. Il s'agit d'un service puissant pour les applications Web et mobiles sans serveur, les jeux, la technologie publicitaire, l'Internet des objets, la vente au détail et les applications nécessitant un accès à faible latence et à haut débit.

L'annonce d'aujourd'hui apporte une recherche vectorielle avec une latence à un chiffre en millisecondes et une capacité de rappel de 99 %. Il est conçu pour prendre en charge n’importe quelle échelle, y compris des milliards de vecteurs. Les développeurs n'ont pas besoin de provisionner, de corriger ou de gérer des serveurs.

Cette mise à jour permettra à la base de données de prendre en charge des applications à grande échelle nécessitant une récupération sémantique, notamment des applications d'intelligence artificielle et de mémoire agentique, une génération augmentée par récupération, des moteurs de recommandation, une personnalisation et une détection d'anomalies.

Les capacités des bases de données vectorielles sont essentielles au développement de l'IA, car elles stockent des données de grande dimension appelées intégrations, qui permettent des recherches rapides de similarité basées sur la signification plutôt que sur la correspondance de mots clés. De nombreux systèmes d’IA utilisent des bases de données vectorielles comme mémoire à long terme et pour gérer de grandes quantités de données non structurées. Ces systèmes aident à créer un contexte pour les grands modèles de langage et les agents afin d'augmenter la précision des réponses et d'éviter les fausses sorties, telles que les hallucinations.

L'avantage de l'ajout de cette fonctionnalité à DynamoDB est que de nombreux développeurs utilisent déjà le service pour récupérer d'autres données. Cela signifie que les développeurs peuvent désormais déplacer leurs capacités de recherche vectorielle vers un service qui sert également leurs données opérationnelles, partageant la même infrastructure sans serveur gérée et la même tarification à la demande.

Avant cette mise à jour, les développeurs auraient dû exécuter séparément leur stockage à grande échelle de données principal et leur recherche vectorielle.

La société héberge actuellement de nombreuses fonctionnalités natives de recherche de vecteurs dans de nombreuses bases de données spécialisées ; les services vectoriels principaux incluent S3 Vectors, un moteur de requête de stockage natif, d'indexation et de similarité inférieure à la seconde pour le stockage d'objets dans le cloud et OpenSearch Service, qui offre une recherche vectorielle entièrement gérée avec un moteur vectoriel sans serveur pour des ensembles de données à l'échelle d'un milliard.

Newsletter

Rejoignez notre newsletter pour des astuces chaque semaine