Live LEGO-Anything: KI-Agent generiert editierbaren 3D-Code aus einem Foto
↘

UC Berkeley veröffentlicht KI-gestützte Datenbank lokaler US-Gesetze

Fast sieben Millionen Seiten aus rund 9.000 Gerichtsbarkeiten frei zugänglich

· Veröffentlicht: 03.10.2026 ·1 Min Lesezeit
UC Berkeley veröffentlicht KI-gestützte Datenbank lokaler US-GesetzeMit KI erstellt
◆ Fakten auf einen Blick
  • Das Projekt wird an der University of California, Berkeley durchgeführt; beteiligt ist Diag Davenport, Assistant Professor für Technologiepolitik, Governance und Gesellschaft.
  • Die Datenbank umfasst nach Angaben der Berichte fast sieben Millionen Seiten lokaler Gesetze aus rund 9.000 Gerichtsbarkeiten.
  • Die Datenbank ist frei zugänglich und maschinenlesbar.
  • Die Sammlung umfasst lokale Verordnungen, Bauvorschriften, Lärmschutzverordnungen etc.; Beispiele reichen von Alameda, California bis Zephyrhills, Florida.
  • Zur Verarbeitung wurde eine mehrstufige KI-Pipeline eingesetzt: Harvesting von kommunalen Portalen und Drittarchiven, OCR mit LightOnOCR, danach Tagging/Kategorisierung durch Large Language Models von OpenAI.
  • Das Dataset auf Hugging Face (v2026.09.1) enthält 5.081.709 sections, 308 Dateien, drei neue Spalten (official_status, currency_note, adopting_citations), Vorschriften für 40 Jurisdiktionen, den aktuellen Code of Federal Regulations und 104.540 state attorney general opinions aus 42 Jurisdiktionen.

Forschende der University of California, Berkeley haben eine frei zugängliche, maschinenlesbare Datenbank lokaler US-Gesetze veröffentlicht. Sie umfasst nach Angaben der Forschenden fast sieben Millionen Seiten aus rund 9.000 Gerichtsbarkeiten – von Verordnungen über Bauvorschriften bis zu Lärmschutzverordnungen. Während Online-Repositorien seit Jahren Bundes- und Staatsrecht katalogisieren, ist das neue Projekt die erste solche Datenbank speziell für lokale Gesetze. Für Forschung, Lehre, Rechtshilfe, Journalismus und andere nicht-kommerzielle Zwecke ist die Nutzung kostenlos, kommerzielle Nutzung erfordert eine Lizenz. Zum Aufbau setzte das Team eine mehrstufige KI-Pipeline ein: systematisches Einsammeln von Dokumenten, Texterkennung per Vision-Language-OCR (LightOnOCR) und automatische Kategorisierung durch große Sprachmodelle von OpenAI.

J
Jasmin Freitag
Redaktion · KI-Anwendungen & Tools

Jasmin Freitag beobachtet für KI Spotlight die praktische Seite der künstlichen Intelligenz: neue Anwendungen, generative Werkzeuge, kreative KI und den Einsatz von Tools im Alltag und in Unternehmen. Sie erklärt praxisnah, was ein Werkzeug wirklich taugt.

Quellen

  1. hyper.ai ↗

Ähnliche Artikel