BlueBox
Funktionsübersicht Feature overview
Alle Funktionen der Plattform auf einen Blick. Diese Seite ist ohne Login zugänglich.
All features at a glance. This page is accessible without login.
Wissensgraph & Korpus Knowledge graph & corpus
-
Neo4j-Wissensgraph
Alle Quellen, Personen, Begriffe und Aussagen leben im Graphen. Eine geschlossene Ontologie verhindert, dass das LLM neue Knotentypen erfindet.
Neo4j knowledge graph
Sources, people, concepts and claims live in a graph. A closed ontology prevents the LLM from inventing new node types.
-
Mehrere Wikis (Tenants)
Jedes Arbeitsgebiet bekommt einen eigenen Korpus mit eigener Sichtbarkeit, Lizenz-Logik und Datenpflege — auf einer einzigen Plattform.
Multiple wikis (tenants)
Every working area gets its own corpus with its own visibility, licensing and curation rules — on a single platform.
-
Sammelbände & Beiträge
Aufsatz-Sammelbände werden automatisch in einzelne Beiträge zerlegt; jede Citation greift auf den richtigen Beitrag, nicht auf das Buch.
Edited volumes & pieces
Edited volumes are split automatically into individual chapters; every citation hits the right contribution, not the book.
Aufnahme neuer Werke Ingestion pipeline
-
Sechs-stufige Bearbeitung
Hochladen, Texterkennung, Metadaten, Sammelband-Erkennung, Textaufteilung und Rechte-Prüfung — jeder Schritt ist nachvollziehbar und wiederholbar.
Six-stage processing
Upload, OCR, metadata, container detection, chunking and rights review — every step is traceable and repeatable.
-
Einzelne Phase neu starten
Eine einzelne Bearbeitungsstufe lässt sich erneut auslösen, ohne die ganze Datei neu zu verarbeiten.
Phase replay
Re-run a single pipeline stage without reprocessing the whole document.
-
Mehrere Quellen neu verarbeiten
Quellen lassen sich gemeinsam erneut durchlaufen, etwa nachdem ein OCR-Profil verbessert wurde.
Bulk re-processing
Re-process several sources at once, for instance after an OCR profile has been improved.
-
Inhaltsverzeichnis-Erkennung
PDF-Bookmarks, OCR-Heuristiken und Vision-Modelle liefern parallele Hypothesen über das Inhaltsverzeichnis und werden zusammengeführt.
Table-of-contents detection
PDF bookmarks, OCR heuristics and vision models produce parallel TOC hypotheses that are merged into one.
-
Journal- & Buch-Erkennung
Crossref- und K10plus-Metadaten fließen in die Typ-Bestimmung; Zeitschriftenartikel, Buchkapitel und Monografien werden korrekt unterschieden.
Journal vs book detection
Crossref and K10plus metadata feed type detection; journal articles, book chapters and monographs are distinguished correctly.
Belege & Citations Evidence & citations
-
Seitengenaue Belege
Jede Aussage ist an einen Textabschnitt mit Seitenzahl verankert. Ohne Beleg keine Aussage — das System weigert sich, das zu umgehen.
Page-precise evidence
Every statement is anchored to a text chunk with a page number. No anchor, no statement — the pipeline refuses workarounds.
-
Citation-Style nach DGfE
Zitationen folgen dem Standard der Deutschen Gesellschaft für Erziehungswissenschaft, inklusive Seitenbereichen und ‚o. A.‘/‚o. J.‘-Konventionen.
DGfE citation style
Citations follow the German Educational Research Association style, including page ranges and the ‚o. A.‘ / ‚o. J.‘ conventions for missing data.
-
Keine erfundenen Quellen
Findet das System keinen Beleg, antwortet es ‚keine Quelle gefunden‘ — niemals halluziniert.
No fabricated sources
If no source is found, the system answers ‚no source found‘ — never a hallucinated reference.
Rechte & Compliance Rights & compliance
-
Rechte-Stufen pro Textstelle
Jeder Textabschnitt trägt einen Rechte-Status (Open Access, Uni-intern, § 60a, § 60c, TDM). Nichts wird öffentlich, dessen Rechte das nicht hergeben.
Per-chunk rights tier
Every text chunk carries a rights tier (Open Access, university-internal, § 60a, § 60c, TDM). Nothing is published whose rights don’t allow it.
-
Uni-Bremen-Login
Authentifizierung über das Uni-Bremen-Single-Sign-On; sieben Zugriffsstufen werden direkt aus der Affiliation abgeleitet.
Single sign-on
Authentication via the University of Bremen single sign-on; seven access levels are derived from the affiliation field.
-
Audit-Trail
Jede rechte-relevante Entscheidung wird in einem manipulationssicher verketteten Protokoll festgehalten — forensisch nachvollziehbar.
Audit trail
Every rights-relevant decision is recorded in a hash-chained log — forensically traceable.
Datenpflege Curation
-
Eingangs-Liste
Eine zentrale Eingangsliste zeigt neue, noch nicht freigegebene Quellen. Datenpfleger:innen können prüfen, korrigieren und freigeben.
Inbox workflow
A central inbox shows new, unreleased sources. Curators can review, correct and release them.
-
Begriffe pflegen
Konzepte lassen sich umbenennen, zusammenführen oder löschen — die Änderung greift auf alle abhängigen Aussagen.
Concept curation
Concepts can be renamed, merged or deleted — the change cascades to all dependent statements.
-
Inhaltsverzeichnis korrigieren
Stimmt das automatisch erkannte Inhaltsverzeichnis nicht, kann es im Browser editiert werden, ohne erneutes Hochladen der PDF.
TOC overrides
If the auto-detected table of contents is wrong, it can be edited in the browser without re-uploading the PDF.
-
Endgültiges Löschen mit Bestätigung
Fehlerhafte Quellen können vollständig entfernt werden — inklusive Seiten, Textstellen und ausschließlich von dieser Quelle zitierter Werke.
Hard delete with confirmation
Faulty sources can be removed completely — including pages, chunks and works cited only by this source.
Visuelle Werk-Identität Visual work identity
-
Titelbild-Auswahl
Aus den ersten Seiten der PDF wird ein passendes Titelbild gewählt — bevorzugt Frontispiz oder Titelseite.
Cover selection
A cover image is chosen from the first pages of the PDF — preferably frontispiece or title page.
-
Werk-Karten
Jede Quelle hat eine eigene Karte mit Titelbild, Metadaten, Beitragsliste (bei Sammelbänden) und Rechte-Hinweis.
Work cards
Every source has its own card with cover, metadata, list of contributions (for edited volumes) and a rights notice.
Dialog & Retrieval Chat & retrieval
-
Frage-Antwort mit Belegen
Eine Frage in natürlicher Sprache wird beantwortet — jede Aussage mit Quellenangabe und Seitenzahl.
Q&A with citations
A natural-language question is answered — every statement with a source reference and page number.
-
Inhalts- und Beziehungs-Suche
Eine Heuristik wählt automatisch zwischen Volltext-Suche und einer Abfrage des Wissensgraphen — je nachdem, ob die Frage nach Inhalten oder nach strukturellen Beziehungen verlangt.
Hybrid + text-to-Cypher retrieval
A heuristic picks between vector/full-text hybrid retrieval and LLM-generated Cypher — depending on whether the question asks for content or for structural relations.
-
Lokales Modell als Default
Fragen, die rechte-geschützte Quellen treffen, laufen über ein lokales Sprachmodell — keine Daten verlassen die Universität.
Local model by default
Questions touching rights-protected sources run through a local language model — no data leaves the university.
Visualisierungen Visualisations
-
Begriffs-Karte
Eine interaktive Karte zeigt zentrale Begriffe und ihre Verbindungen — als Einstieg für Studierende und Lehrende.
Concept map
An interactive map shows central concepts and their connections — as an entry point for students and teachers.
-
Datenpflege-Heatmap
Eine Wochenübersicht zeigt, welche Tage Datenpflege gebraucht haben — mit Trend-Diagramm und Auslastungs-Anzeige der Aufnahme.
Curation heatmap
A weekly view shows which days needed curation — with trend chart and pipeline load.
-
Durchsatz-Übersicht
Live-Zahlen über Verarbeitungstempo, Wartezeiten und Bearbeitungsdauer pro Phase.
Worker throughput dashboard
Live numbers on processing throughput, waiting times and stage latency.
Lehre & Veranstaltungen Teaching & events
-
Veranstaltungs-Korpus
Pro Seminar lässt sich ein Auszug des Korpus zusammenstellen, der nur den Teilnehmenden zugänglich ist.
Course corpus
For each seminar, a corpus subset can be assembled that is accessible only to the course participants.
-
Schlüsselbegriff-Listen
Themen-Lehrkräfte können kuratierte Begriffs-Listen anlegen — als Lehrgrundlage oder Prüfungsvorbereitung.
Key-term lists
Subject teachers can create curated term lists — as a teaching base or for exam preparation.
-
Kollaborative Annotation
Studierende markieren Stellen direkt in Quellen, kommentieren und diskutieren in der Kursgruppe. Lehrende sehen alle Anmerkungen ihres Seminars an einem Ort. Annotationen liegen in Hypothes.is, getrennt vom Wissensgraphen — Seminar-privat per Default.
Collaborative annotation
Students mark passages directly in sources, comment, and discuss within their course group. Teachers see all annotations from their seminar in one place. Annotations live in Hypothes.is, separate from the knowledge graph — course-private by default.
Qualitätsmessung & Betrieb Eval & operations
-
Regelmäßige Qualitätsmessung
Mit einem fest definierten Frage-Antwort-Set wird regelmäßig gemessen, wie zuverlässig das System die richtigen Quellen findet — Trefferquote, Belegtreue, Antwortzeit.
RAG evaluation
A gold-set pipeline regularly measures how well answers find the correct sources — recall, faithfulness, latency.
-
Nächtlicher Wiki-Neuaufbau
Wenn neue Inhalte fertig verarbeitet sind und die Aufnahme ruht, baut das System das öffentliche Wiki neu auf.
Nightly wiki builds
When new content has finished processing and the pipeline is idle, the public wiki is rebuilt.
-
Backup mit Prüfsumme
Datenbanken, Speicher und Audit-Log werden täglich gesichert; jede Sicherung wird mit einer Prüfsumme abgeschlossen, damit Manipulation auffällt.
Hash-verified backups
Postgres, Neo4j, storage and audit log are backed up daily; every backup ends with hash verification.
-
E-Mail-Benachrichtigungen
Über den Uni-Bremen-Mailserver gehen Status-Mails an die zuständigen Personen — z. B. wenn neue Quellen freigeschaltet sind.
Email notifications
Status mails go through the University of Bremen mail server to the responsible people — e.g. when new sources are released.