Amazon führt Echtzeit-ACL-Enforcement für RAG-Knowledge-Bases ein
Neue Funktion prüft Berechtigungen direkt an der Quelle und erhöht so die Sicherheit von RAG-Anwendungen.
Mit KI erstellt◆ Fakten auf einen Blick
- Amazon Quick und Amazon Bedrock Knowledge Bases setzen Zugriffskontrolllisten (ACLs) in Echtzeit durch, indem sie Berechtigungen direkt bei den autoritativen Quellen zum Abfragezeitpunkt überprüfen.
- Enterprise-Organisationen nutzen RAG, um Erkenntnisse aus Quellen wie Microsoft SharePoint, Google Drive und Atlassian Confluence zu gewinnen, aber diese enthalten sensible Informationen mit komplexen Berechtigungsstrukturen.
- Bestehende Ansätze zur RAG-Zugriffskontrolle verwenden oft einen 'replicate-and-filter'-Ansatz, der als unzureichend dargestellt wird.
- Amazon Bedrock Managed Knowledge Base ist in General Availability verfügbar und bietet eine vollständig verwaltete agentische Retrieval-Lösung, die Skalierung, hochgenaue Retrieval und Dokument-Zugriffskontrolle übernimmt.
- Managed Knowledge Base ermöglicht es, Unternehmensdatenquellen zu verbinden oder das Web zu crawlen, und bietet Standardeinstellungen, um in Minuten erste Retrievals zu erreichen.
- Managed Knowledge Base bietet Kontrolle über Embedding-Modelle, Reranker, Chunking-Strategien und mehr.
Echtzeit-ACL-Enforcement für RAG in Amazon Quick und Bedrock Knowledge Bases
Amazon hat angekündigt, dass die Knowledge Bases in Amazon Quick und Amazon Bedrock Zugriffskontrolllisten (ACLs) künftig in Echtzeit durchsetzen. Wie das Unternehmen mitteilt (Herstellerangabe), werden Berechtigungen dabei direkt bei den autoritativen Quellen zum Zeitpunkt der Abfrage überprüft – nicht etwa anhand einer zwischengespeicherten Kopie. Der Hintergrund: Enterprise-Organisationen setzen Retrieval Augmented Generation (RAG) zunehmend ein, um Erkenntnisse aus Quellen wie Microsoft SharePoint, Google Drive oder Atlassian Confluence zu gewinnen. Diese Systeme enthalten jedoch sensible Informationen mit komplexen Berechtigungsstrukturen. Stellen Sie sich vor, ein SharePoint-Websitebesitzer erstellt eine Wissensdatenbank für sein Unternehmen. Teammitglieder aus verschiedenen Abteilungen nutzen einen KI-Assistenten, um Antworten aus dieser Wissensdatenbank zu erhalten. Die entscheidende Anforderung: Jedes Teammitglied darf nur KI-generierte Erkenntnisse aus Dokumenten erhalten, für die es autorisiert ist. Bisherige Ansätze zur Zugriffskontrolle bei RAG basieren laut Amazon häufig auf einem „replicate-and-filter“-Verfahren, bei dem Daten zunächst kopiert und anschließend gefiltert werden. Dieser Ansatz ist unzureichend, weil er zu Verzögerungen führt: Änderungen an den ursprünglichen ACLs werden erst nach einer Synchronisierung der Kopie wirksam. Zudem können veraltete Berechtigungen in der Kopie dazu führen, dass Nutzer auf Dokumente zugreifen, für die sie inzwischen keine Freigabe mehr besitzen – ein erhebliches Sicherheitsrisiko. Die neue Echtzeit-Prüfung soll sicherstellen, dass jeder Nutzer nur Antworten aus Dokumenten erhält, für die er tatsächlich eine Zugriffsberechtigung besitzt. Technisch funktioniert dies, indem bei jeder Abfrage die ACLs direkt bei der autoritativen Quelle – etwa SharePoint oder Google Drive – abgefragt werden, ohne dass eine zwischengespeicherte Kopie der Berechtigungen verwendet wird.
Warum Unternehmen diese Funktion brauchen und was Managed Knowledge Base bietet
Für Unternehmen mit sensiblen Daten ist die korrekte Durchsetzung von Zugriffsrechten in RAG-Systemen eine zentrale Anforderung. Die nun vorgestellte Echtzeit-ACL-Prüfung adressiert dieses Risiko, indem sie die Berechtigungslogik direkt an der Quelle verankert. Konkret bedeutet das: Bei jeder Abfrage werden die aktuell gültigen Zugriffsrechte bei den autoritativen Systemen wie SharePoint oder Google Drive abgefragt. Dadurch wird sichergestellt, dass keine veralteten oder zwischengespeicherten Berechtigungslisten verwendet werden, sondern stets die aktuellsten Freigaben. Dies erhöht die Zuverlässigkeit der Zugriffskontrolle erheblich, da stets die aktuell gültigen Berechtigungen verwendet werden und Inkonsistenzen zwischen einer zwischengespeicherten Kopie und der Quelle entfallen.
Ergänzend verweist Amazon (Herstellerangabe) auf die Amazon Bedrock Managed Knowledge Base, die nach Angaben des Unternehmens in General Availability verfügbar ist. Dabei handelt es sich um eine vollständig verwaltete agentische Retrieval-Lösung, die Skalierung, hochgenaue Retrieval und Dokument-Zugriffskontrolle übernimmt. Laut Herstellerangabe können Entwickler durch die Abstraktion der Komplexität von RAG-Pipelines in Minuten statt Tagen oder Wochen erste Retrieval-Ergebnisse erzielen. Entwickler können Unternehmensdatenquellen anbinden oder das Web crawlen; Standardeinstellungen sollen den Weg von null zur ersten Retrieval-Abfrage in Minuten ermöglichen. Wer individuelle Anpassungen benötigt, erhält Kontrolle über Embedding-Modelle, Reranker und Chunking-Strategien. Die Lösung adressiert laut Amazon drei zentrale Herausforderungen: die Anbindung an unterschiedliche Unternehmensdatenquellen mit verschiedenen Zugriffskontrolllisten und Dokumentformaten, die Optimierung der RAG-Genauigkeit durch Experimente mit Parsing-Strategien, Chunking-Ansätzen und Embedding-Modellen sowie das Infrastrukturmanagement im großen Maßstab – sei es für Knowledge Bases mit Millionen von Dokumenten oder für Tausende kleinerer Knowledge Bases über Teams hinweg. Die Ankündigung der Managed Knowledge Base zielt darauf ab, die Komplexität von RAG-Pipelines zu abstrahieren und den Aufbau enterprise-grade generativer KI-Anwendungen mit proprietären Daten zu beschleunigen.



