BlueBox

Funktionsübersicht Feature overview

Alle Funktionen der Plattform auf einen Blick. Diese Seite ist ohne Login zugänglich.

All features at a glance. This page is accessible without login.

Wissensgraph & Korpus Knowledge graph & corpus

  • Neo4j-Wissensgraph

    Alle Quellen, Personen, Begriffe und Aussagen leben im Graphen. Eine geschlossene Ontologie verhindert, dass das LLM neue Knotentypen erfindet.

    Neo4j knowledge graph

    Sources, people, concepts and claims live in a graph. A closed ontology prevents the LLM from inventing new node types.

  • Mehrere Wikis (Tenants)

    Jedes Arbeitsgebiet bekommt einen eigenen Korpus mit eigener Sichtbarkeit, Lizenz-Logik und Datenpflege — auf einer einzigen Plattform.

    Multiple wikis (tenants)

    Every working area gets its own corpus with its own visibility, licensing and curation rules — on a single platform.

  • Sammelbände & Beiträge

    Aufsatz-Sammelbände werden automatisch in einzelne Beiträge zerlegt; jede Citation greift auf den richtigen Beitrag, nicht auf das Buch.

    Edited volumes & pieces

    Edited volumes are split automatically into individual chapters; every citation hits the right contribution, not the book.

Aufnahme neuer Werke Ingestion pipeline

  • Sechs-stufige Bearbeitung

    Hochladen, Texterkennung, Metadaten, Sammelband-Erkennung, Textaufteilung und Rechte-Prüfung — jeder Schritt ist nachvollziehbar und wiederholbar.

    Six-stage processing

    Upload, OCR, metadata, container detection, chunking and rights review — every step is traceable and repeatable.

  • Einzelne Phase neu starten

    Eine einzelne Bearbeitungsstufe lässt sich erneut auslösen, ohne die ganze Datei neu zu verarbeiten.

    Phase replay

    Re-run a single pipeline stage without reprocessing the whole document.

  • Mehrere Quellen neu verarbeiten

    Quellen lassen sich gemeinsam erneut durchlaufen, etwa nachdem ein OCR-Profil verbessert wurde.

    Bulk re-processing

    Re-process several sources at once, for instance after an OCR profile has been improved.

  • Inhaltsverzeichnis-Erkennung

    PDF-Bookmarks, OCR-Heuristiken und Vision-Modelle liefern parallele Hypothesen über das Inhaltsverzeichnis und werden zusammengeführt.

    Table-of-contents detection

    PDF bookmarks, OCR heuristics and vision models produce parallel TOC hypotheses that are merged into one.

  • Journal- & Buch-Erkennung

    Crossref- und K10plus-Metadaten fließen in die Typ-Bestimmung; Zeitschriftenartikel, Buchkapitel und Monografien werden korrekt unterschieden.

    Journal vs book detection

    Crossref and K10plus metadata feed type detection; journal articles, book chapters and monographs are distinguished correctly.

Belege & Citations Evidence & citations

  • Seitengenaue Belege

    Jede Aussage ist an einen Textabschnitt mit Seitenzahl verankert. Ohne Beleg keine Aussage — das System weigert sich, das zu umgehen.

    Page-precise evidence

    Every statement is anchored to a text chunk with a page number. No anchor, no statement — the pipeline refuses workarounds.

  • Citation-Style nach DGfE

    Zitationen folgen dem Standard der Deutschen Gesellschaft für Erziehungswissenschaft, inklusive Seitenbereichen und ‚o. A.‘/‚o. J.‘-Konventionen.

    DGfE citation style

    Citations follow the German Educational Research Association style, including page ranges and the ‚o. A.‘ / ‚o. J.‘ conventions for missing data.

  • Keine erfundenen Quellen

    Findet das System keinen Beleg, antwortet es ‚keine Quelle gefunden‘ — niemals halluziniert.

    No fabricated sources

    If no source is found, the system answers ‚no source found‘ — never a hallucinated reference.

Rechte & Compliance Rights & compliance

  • Rechte-Stufen pro Textstelle

    Jeder Textabschnitt trägt einen Rechte-Status (Open Access, Uni-intern, § 60a, § 60c, TDM). Nichts wird öffentlich, dessen Rechte das nicht hergeben.

    Per-chunk rights tier

    Every text chunk carries a rights tier (Open Access, university-internal, § 60a, § 60c, TDM). Nothing is published whose rights don’t allow it.

  • Uni-Bremen-Login

    Authentifizierung über das Uni-Bremen-Single-Sign-On; sieben Zugriffsstufen werden direkt aus der Affiliation abgeleitet.

    Single sign-on

    Authentication via the University of Bremen single sign-on; seven access levels are derived from the affiliation field.

  • Audit-Trail

    Jede rechte-relevante Entscheidung wird in einem manipulationssicher verketteten Protokoll festgehalten — forensisch nachvollziehbar.

    Audit trail

    Every rights-relevant decision is recorded in a hash-chained log — forensically traceable.

Datenpflege Curation

  • Eingangs-Liste

    Eine zentrale Eingangsliste zeigt neue, noch nicht freigegebene Quellen. Datenpfleger:innen können prüfen, korrigieren und freigeben.

    Inbox workflow

    A central inbox shows new, unreleased sources. Curators can review, correct and release them.

  • Begriffe pflegen

    Konzepte lassen sich umbenennen, zusammenführen oder löschen — die Änderung greift auf alle abhängigen Aussagen.

    Concept curation

    Concepts can be renamed, merged or deleted — the change cascades to all dependent statements.

  • Inhaltsverzeichnis korrigieren

    Stimmt das automatisch erkannte Inhaltsverzeichnis nicht, kann es im Browser editiert werden, ohne erneutes Hochladen der PDF.

    TOC overrides

    If the auto-detected table of contents is wrong, it can be edited in the browser without re-uploading the PDF.

  • Endgültiges Löschen mit Bestätigung

    Fehlerhafte Quellen können vollständig entfernt werden — inklusive Seiten, Textstellen und ausschließlich von dieser Quelle zitierter Werke.

    Hard delete with confirmation

    Faulty sources can be removed completely — including pages, chunks and works cited only by this source.

Visuelle Werk-Identität Visual work identity

  • Titelbild-Auswahl

    Aus den ersten Seiten der PDF wird ein passendes Titelbild gewählt — bevorzugt Frontispiz oder Titelseite.

    Cover selection

    A cover image is chosen from the first pages of the PDF — preferably frontispiece or title page.

  • Werk-Karten

    Jede Quelle hat eine eigene Karte mit Titelbild, Metadaten, Beitragsliste (bei Sammelbänden) und Rechte-Hinweis.

    Work cards

    Every source has its own card with cover, metadata, list of contributions (for edited volumes) and a rights notice.

Dialog & Retrieval Chat & retrieval

  • Frage-Antwort mit Belegen

    Eine Frage in natürlicher Sprache wird beantwortet — jede Aussage mit Quellenangabe und Seitenzahl.

    Q&A with citations

    A natural-language question is answered — every statement with a source reference and page number.

  • Inhalts- und Beziehungs-Suche

    Eine Heuristik wählt automatisch zwischen Volltext-Suche und einer Abfrage des Wissensgraphen — je nachdem, ob die Frage nach Inhalten oder nach strukturellen Beziehungen verlangt.

    Hybrid + text-to-Cypher retrieval

    A heuristic picks between vector/full-text hybrid retrieval and LLM-generated Cypher — depending on whether the question asks for content or for structural relations.

  • Lokales Modell als Default

    Fragen, die rechte-geschützte Quellen treffen, laufen über ein lokales Sprachmodell — keine Daten verlassen die Universität.

    Local model by default

    Questions touching rights-protected sources run through a local language model — no data leaves the university.

Visualisierungen Visualisations

  • Begriffs-Karte

    Eine interaktive Karte zeigt zentrale Begriffe und ihre Verbindungen — als Einstieg für Studierende und Lehrende.

    Concept map

    An interactive map shows central concepts and their connections — as an entry point for students and teachers.

  • Datenpflege-Heatmap

    Eine Wochenübersicht zeigt, welche Tage Datenpflege gebraucht haben — mit Trend-Diagramm und Auslastungs-Anzeige der Aufnahme.

    Curation heatmap

    A weekly view shows which days needed curation — with trend chart and pipeline load.

  • Durchsatz-Übersicht

    Live-Zahlen über Verarbeitungstempo, Wartezeiten und Bearbeitungsdauer pro Phase.

    Worker throughput dashboard

    Live numbers on processing throughput, waiting times and stage latency.

Lehre & Veranstaltungen Teaching & events

  • Veranstaltungs-Korpus

    Pro Seminar lässt sich ein Auszug des Korpus zusammenstellen, der nur den Teilnehmenden zugänglich ist.

    Course corpus

    For each seminar, a corpus subset can be assembled that is accessible only to the course participants.

  • Schlüsselbegriff-Listen

    Themen-Lehrkräfte können kuratierte Begriffs-Listen anlegen — als Lehrgrundlage oder Prüfungsvorbereitung.

    Key-term lists

    Subject teachers can create curated term lists — as a teaching base or for exam preparation.

  • Kollaborative Annotation

    Studierende markieren Stellen direkt in Quellen, kommentieren und diskutieren in der Kursgruppe. Lehrende sehen alle Anmerkungen ihres Seminars an einem Ort. Annotationen liegen in Hypothes.is, getrennt vom Wissensgraphen — Seminar-privat per Default.

    Collaborative annotation

    Students mark passages directly in sources, comment, and discuss within their course group. Teachers see all annotations from their seminar in one place. Annotations live in Hypothes.is, separate from the knowledge graph — course-private by default.

Qualitätsmessung & Betrieb Eval & operations

  • Regelmäßige Qualitätsmessung

    Mit einem fest definierten Frage-Antwort-Set wird regelmäßig gemessen, wie zuverlässig das System die richtigen Quellen findet — Trefferquote, Belegtreue, Antwortzeit.

    RAG evaluation

    A gold-set pipeline regularly measures how well answers find the correct sources — recall, faithfulness, latency.

  • Nächtlicher Wiki-Neuaufbau

    Wenn neue Inhalte fertig verarbeitet sind und die Aufnahme ruht, baut das System das öffentliche Wiki neu auf.

    Nightly wiki builds

    When new content has finished processing and the pipeline is idle, the public wiki is rebuilt.

  • Backup mit Prüfsumme

    Datenbanken, Speicher und Audit-Log werden täglich gesichert; jede Sicherung wird mit einer Prüfsumme abgeschlossen, damit Manipulation auffällt.

    Hash-verified backups

    Postgres, Neo4j, storage and audit log are backed up daily; every backup ends with hash verification.

  • E-Mail-Benachrichtigungen

    Über den Uni-Bremen-Mailserver gehen Status-Mails an die zuständigen Personen — z. B. wenn neue Quellen freigeschaltet sind.

    Email notifications

    Status mails go through the University of Bremen mail server to the responsible people — e.g. when new sources are released.