Datenquellen konfigurieren
Unter Einstellungen → Daten & Struktur → Org Intelligence (/signals) verwaltest du die Datenquellen, aus denen Interaktionssignale gesammelt werden.
Verfügbare Collector-Typen
Abschnitt betitelt „Verfügbare Collector-Typen“| Typ | Datenquelle | Benötigte Zugangsdaten |
|---|---|---|
msgraph | Microsoft Graph / Teams / Exchange | Azure Tenant ID, Client ID, Client Secret |
confluence | Atlassian Confluence | Confluence-URL, E-Mail, API-Token |
sharepoint | SharePoint Online | Azure Tenant ID, Client ID, Client Secret + Site-IDs |
jira | Jira / Jira Service Management | Jira-URL, E-Mail, API-Token |
csv_import | Beliebige CSV-Exporte | CSV-Inhalt (direkt einfügen oder Dateipfad) |
filesystem | Netzlaufwerk / lokaler Sync | Verzeichnispfad |
ical | iCalendar-Dateien (.ics) | Datei-URL oder Dateipfad |
ldap | LDAP / Active Directory | LDAP-URL, Bind-DN, Passwort |
chrome_crawler | Intranet-Webseiten (headless Chrome) | Optionaler Login (Benutzer/Passwort) |
Das System ist offen erweiterbar — neue Connector-Typen können ohne UI-Änderungen hinzugefügt werden.
Microsoft Graph / Teams / Exchange (msgraph)
Abschnitt betitelt „Microsoft Graph / Teams / Exchange (msgraph)“Sammelt Interaktionssignale aus Microsoft 365 — Teams-Kanälen, Anrufen und Exchange-Kalender.
Was wird gesammelt?
Abschnitt betitelt „Was wird gesammelt?“| Signal | Bedeutung |
|---|---|
teams_channel_coactivity | Personen, die gemeinsam in einem Teams-Kanal aktiv sind |
teams_call_coparticipation | Teilnehmer desselben Anrufs |
exchange_recurring_meeting | Organisator und Teilnehmer wiederkehrender Besprechungen |
exchange_meeting_response_latency | Reaktionsverhalten auf Meeting-Einladungen |
Zugangsdaten einrichten
Abschnitt betitelt „Zugangsdaten einrichten“Du benötigst eine App Registration in Azure Entra ID mit folgenden API-Berechtigungen (Application-Berechtigung, kein delegierter Zugriff):
Team.ReadBasic.AllCallRecords.Read.AllCalendars.ReadUser.Read.All
Schritte:
- Azure Portal → Entra ID → App Registrations → Neue Registrierung
- Zertifikate & Geheimnisse → Neues Client Secret erstellen
- API-Berechtigungen → Oben genannte hinzufügen → Admin-Zustimmung erteilen
- Azure Tenant ID, Client ID und Client Secret in roleALPHA eintragen
Konfiguration
Abschnitt betitelt „Konfiguration“| Parameter | Bedeutung | Standard |
|---|---|---|
| Max. Alter (Tage) | Wie weit zurück Daten abgerufen werden | 90 |
| Min. Interaktionen | Mindestanzahl für eine Kante | siehe Auswertungsrahmen |
| Personen automatisch mappen | E-Mail-Adressen direkt mit rA-Personen verknüpfen | nein |
Hinweise
Abschnitt betitelt „Hinweise“- Es werden ausschließlich Metadaten gesammelt (keine Inhalte, keine Audio/Video-Daten)
- Throttling der Graph-API wird automatisch mit Exponential-Backoff behandelt
Atlassian Confluence (confluence)
Abschnitt betitelt „Atlassian Confluence (confluence)“Analysiert die Zusammenarbeitsstruktur in Confluence-Wikis anhand von Seitenbearbeitungen und Kommentaren.
Was wird gesammelt?
Abschnitt betitelt „Was wird gesammelt?“| Signal | Bedeutung |
|---|---|
confluence_coauthorship | Mehrere Autoren bearbeiten dieselbe Seite |
confluence_mention | Kommentar-Autoren und Seiten-Autoren in Verbindung |
confluence_cross_space_link | Verknüpfungen zwischen verschiedenen Spaces |
Zugangsdaten einrichten
Abschnitt betitelt „Zugangsdaten einrichten“- Atlassian → Mein Konto → Sicherheit → API-Token erstellen
- Confluence-URL (z.B.
https://firma.atlassian.net), E-Mail-Adresse und Token in roleALPHA eintragen
Der Benutzer benötigt Leserechte auf alle auszuwertenden Spaces.
Konfiguration
Abschnitt betitelt „Konfiguration“| Parameter | Bedeutung | Standard |
|---|---|---|
| Max. Alter (Tage) | Wie weit zurück Versionshistorie ausgewertet wird | 90 |
| Min. Interaktionen | Mindestanzahl gemeinsamer Bearbeitungen | siehe Auswertungsrahmen |
SharePoint Online (sharepoint)
Abschnitt betitelt „SharePoint Online (sharepoint)“Wertet Dateiänderungen auf SharePoint-Sites aus und erkennt gemeinsame Dokumentenarbeit.
Was wird gesammelt?
Abschnitt betitelt „Was wird gesammelt?“| Signal | Bedeutung |
|---|---|
sharepoint_coauthorship | Ersteller und letzter Bearbeiter einer Datei |
sharepoint_site_coactivity | Benutzer, die auf derselben Site aktiv sind |
Zugangsdaten einrichten
Abschnitt betitelt „Zugangsdaten einrichten“Gleiche Azure App Registration wie bei MS Graph (Client Credentials Flow), zusätzliche Berechtigung:
Sites.Read.All
Die Site IDs findest du über: https://firma.sharepoint.com/sites/SITENAME/_api/site/id
Konfiguration
Abschnitt betitelt „Konfiguration“| Parameter | Bedeutung | Standard |
|---|---|---|
| Site IDs | Kommagetrennte Liste der auszuwertenden Sites | — |
| Max. Alter (Tage) | Dateiänderungen ab diesem Zeitraum | 90 |
| Min. Interaktionen | Mindestanzahl gemeinsamer Bearbeitungen | siehe Auswertungsrahmen |
Hinweise
Abschnitt betitelt „Hinweise“sharepoint_site_coactivityerfordert SharePoint-Analytics, das nicht in allen Lizenzen enthalten ist- Ohne Site Analytics werden nur
sharepoint_coauthorship-Signale erzeugt
Jira / Jira Service Management (jira)
Abschnitt betitelt „Jira / Jira Service Management (jira)“Erkennt Zusammenarbeit aus Issue-Bearbeitungen, Zuweisungen und Kommentaren.
Was wird gesammelt?
Abschnitt betitelt „Was wird gesammelt?“| Signal | Bedeutung |
|---|---|
jira_co_assignee | Reporter und Assignee desselben Tickets |
jira_cocomment | Alle Paare von Personen, die dasselbe Ticket kommentiert haben |
Zugangsdaten einrichten
Abschnitt betitelt „Zugangsdaten einrichten“- Atlassian → Mein Konto → Sicherheit → API-Token erstellen
- Jira-URL (z.B.
https://firma.atlassian.net), E-Mail-Adresse und Token in roleALPHA eintragen
Konfiguration
Abschnitt betitelt „Konfiguration“| Parameter | Bedeutung | Standard |
|---|---|---|
| Projekt-Keys | Einschränkung auf bestimmte Projekte (leer = alle) | alle |
| Max. Alter (Tage) | Tickets ab diesem Zeitraum (nach letzter Änderung) | 90 |
| Min. Interaktionen | Mindestanzahl gemeinsamer Aktivitäten | siehe Auswertungsrahmen |
CSV-Import (csv_import)
Abschnitt betitelt „CSV-Import (csv_import)“Der schnellste Einstieg ohne API-Zugang — beliebige Interaktionsdaten aus einer CSV-Datei.
Was wird gesammelt?
Abschnitt betitelt „Was wird gesammelt?“Beliebige Interaktionen: der Signal-Typ ist frei konfigurierbar (Standard: csv_interaction).
vonPerson,zuPerson,anzahlalice@firma.de,bob@firma.de,12carol@firma.de,alice@firma.de,7vonPerson/zuPerson: Externe IDs (E-Mail, Name, beliebige Kennung)anzahl: Optional — Interaktionszahl (Standard: 1 pro Zeile)- Spaltenbezeichnungen sind frei konfigurierbar
Konfiguration
Abschnitt betitelt „Konfiguration“| Parameter | Bedeutung | Standard |
|---|---|---|
| Von-Spalte | Spaltenname für den Ausgangs-Akteur | vonPerson |
| Zu-Spalte | Spaltenname für den Ziel-Akteur | zuPerson |
| Anzahl-Spalte | Spaltenname für die Interaktionszahl (optional) | — |
| Signal-Typ | Bezeichnung für diese Signalquelle | csv_interaction |
Hinweise
Abschnitt betitelt „Hinweise“- CSV-Inhalt kann direkt in das Textfeld eingefügt oder als Dateipfad auf dem Server angegeben werden
- Gleiche Paare in mehreren Zeilen werden automatisch aufsummiert
- Ideal für den initialen Daten-Import oder einmalige Analysen
Dateisystem / Netzlaufwerk (filesystem)
Abschnitt betitelt „Dateisystem / Netzlaufwerk (filesystem)“Liest Office-Dokumente von einem lokalen oder Netzwerk-Dateipfad und extrahiert Co-Autoren aus den Metadaten.
Was wird gesammelt?
Abschnitt betitelt „Was wird gesammelt?“| Signal | Bedeutung |
|---|---|
filesystem_coauthorship | Ersteller und letzter Bearbeiter eines Dokuments |
Unterstützte Formate
Abschnitt betitelt „Unterstützte Formate“.docx, .xlsx, .pptx (OOXML-Format — Metadaten aus core.xml)
Konfiguration
Abschnitt betitelt „Konfiguration“| Parameter | Bedeutung | Standard |
|---|---|---|
| Pfad | Verzeichnis, das rekursiv durchsucht wird | — |
| Datei-Endungen | Gefilterte Formate | .docx, .xlsx, .pptx |
| Max. Alter (Tage) | Dateien ab diesem Änderungsdatum | 90 |
| Min. Interaktionen | Mindestanzahl Co-Autorschaften | siehe Auswertungsrahmen |
Hinweise
Abschnitt betitelt „Hinweise“- Der Server muss Lesezugriff auf den angegebenen Pfad haben
- Es werden ausschließlich Metadaten ausgewertet (kein Dokumentinhalt)
- Ersteller und letzter Bearbeiter müssen unterschiedliche Personen sein — reine Selbst-Bearbeitungen werden ignoriert
- Netzlaufwerke funktionieren nur wenn der ra-signals-Service entsprechend eingebunden ist
iCalendar (.ics) (ical)
Abschnitt betitelt „iCalendar (.ics) (ical)“Wertet Kalender-Dateien im iCalendar-Format aus und erkennt gemeinsame Meeting-Teilnehmer.
Was wird gesammelt?
Abschnitt betitelt „Was wird gesammelt?“| Signal | Bedeutung |
|---|---|
ical_coapplicant | Alle Teilnehmer und Organisatoren desselben Termins |
Konfiguration
Abschnitt betitelt „Konfiguration“| Parameter | Bedeutung | Standard |
|---|---|---|
| Kalender-URL | HTTP(S)-URL zur .ics-Datei | — |
| Kalender-Pfad | Alternativer Server-Dateipfad | — |
| Max. Alter (Tage) | Termine ab diesem Zeitraum | 90 |
| Min. Interaktionen | Mindestanzahl gemeinsamer Termine | siehe Auswertungsrahmen |
Hinweise
Abschnitt betitelt „Hinweise“- Entweder URL oder Pfad muss angegeben werden
- Unterstützt öffentliche Kalender-URLs (z.B. freigegebene Outlook-Kalender) sowie lokale .ics-Exporte
- Erstellt Verbindungen zwischen allen Teilnehmern aller erfassten Termine
LDAP / Active Directory (ldap)
Abschnitt betitelt „LDAP / Active Directory (ldap)“Leitet Zusammenarbeits-Signale aus Gruppen-Mitgliedschaften ab: Wer ist in welchen Gruppen?
Was wird gesammelt?
Abschnitt betitelt „Was wird gesammelt?“| Signal | Bedeutung |
|---|---|
ldap_group_coactivity | Alle Mitglieder derselben LDAP-Gruppe |
Zugangsdaten einrichten
Abschnitt betitelt „Zugangsdaten einrichten“Ein Read-Only-Bind-Benutzer reicht aus. Benötigt werden:
ldap://oderldaps://URL (z.B.ldap://dc.firma.de:389)- Bind-DN (z.B.
cn=readonly,dc=firma,dc=de) - Bind-Passwort
Konfiguration
Abschnitt betitelt „Konfiguration“| Parameter | Bedeutung | Standard |
|---|---|---|
| Such-Basis | Basis-DN für die Gruppensuche | — |
| Gruppen-Filter | LDAP-Filter für Gruppen | (objectClass=group) |
| Max. Alter (Tage) | (wird für Schwellenwert genutzt) | 90 |
| Min. Interaktionen | Mindestanzahl gemeinsamer Gruppen | siehe Auswertungsrahmen |
Hinweise
Abschnitt betitelt „Hinweise“- Unterstützt
member,uniqueMemberundmemberUidAttribute - Verbindung wird nach dem Abruf sofort geschlossen
- Für sehr große Verzeichnisse (>10.000 Gruppen) empfiehlt sich eine engere Suchbasis
Chrome Web Crawler (chrome_crawler)
Abschnitt betitelt „Chrome Web Crawler (chrome_crawler)“Crawlt interne Webseiten (Intranet, Wikis, Web-Apps) über headless Chrome und extrahiert Erwähnungs- und Co-Authorship-Signale.
Besonderheit: Der Crawler läuft als CLI-Tool auf dem Client-Rechner — nicht als Server-Prozess. Daten werden nach dem Crawl per API an roleALPHA gesendet. In dieser Quelle werden Start-URLs und Konfiguration als Referenz dokumentiert.
Was wird gesammelt?
Abschnitt betitelt „Was wird gesammelt?“| Signal | Bedeutung |
|---|---|
web_cocitation | Zwei Personen werden auf derselben Seite erwähnt |
web_person_entity | Person und Entity (Rolle, Wertstrom, OKR …) auf derselben Seite |
web_entity_cooccurrence | Zwei Entities werden gemeinsam erwähnt |
web_coauthorship | Erkannte Co-Autoren einer Seite |
web_cocomment | Kommentare von mehreren Personen auf einer Seite |
Voraussetzungen
Abschnitt betitelt „Voraussetzungen“- Google Chrome auf dem ausführenden Rechner (wird automatisch erkannt)
- Node.js + tsx zum Starten des CLI
- Netzwerkzugang zu den Start-URLs
- Keine Root-Rechte erforderlich
CLI-Aufruf
Abschnitt betitelt „CLI-Aufruf“tsx services/ra-signals/chrome-crawler/index.ts \ --url https://wiki.intern/home \ --pattern "https://wiki\\.intern/.*" \ --depth 3 \ --max-pages 100 \ --endpoint https://ra.example.com \ --token <jwt-token> \ --tenant <tenant-uuid>Alle Parameter
Abschnitt betitelt „Alle Parameter“| Parameter | Bedeutung | Standard |
|---|---|---|
--url | Start-URL(s) — mehrfach angebbar | — |
--pattern | Regex zum Einschränken des Crawl-Bereichs | Prefix der ersten URL |
--depth | Max. Crawl-Tiefe | 3 |
--max-pages | Sicherheitsgrenze Seitenanzahl | 100 |
--endpoint | roleALPHA-URL | — |
--token | JWT-Token (aus Einstellungen → Persönlich → Profil) | — |
--tenant | Tenant-UUID | — |
--login-url | URL des Login-Formulars (optional) | — |
--login-user | Benutzername für Login | — |
--login-pass | Passwort für Login | — |
--author-selector | CSS-Selektor für Autoren-Elemente | — |
--chrome-path | Pfad zum Chrome-Binary | automatisch |
Live-Progress
Abschnitt betitelt „Live-Progress“[ 1/100] https://wiki.intern/home — 3 Entities gefunden (Alice Müller, Wertstrom X, OKR Y)[ 2/100] https://wiki.intern/team-a — 5 Entities gefunden...✔ Ingest erfolgreich: 234 Kanten, 18 AkteureQuellennachweis
Abschnitt betitelt „Quellennachweis“Jede gefundene Verbindung trägt die konkreten Quell-URLs. Diese erscheinen in der Org-Intelligence-Reports Lückenanalyse als klickbare Links — jede Erkenntnis ist direkt nachvollziehbar.
Eine Quelle hinzufügen
Abschnitt betitelt „Eine Quelle hinzufügen“- Klicke auf Neue Quelle.
- Wähle den Collector-Typ aus der Dropdown-Liste.
- Fülle die Zugangsdaten und Konfiguration aus (das Formular passt sich dynamisch an den Typ an).
- Aktiviere Automatisch sammeln, damit die Quelle stündlich abgerufen wird.
- Speichern.
Fehlerbehebung: Collector-Typ-Liste ist leer
Abschnitt betitelt „Fehlerbehebung: Collector-Typ-Liste ist leer“Bleibt die Collector-Typ-Dropdown-Liste leer (und werden auch keine vorhandenen Quellen angezeigt), ist der Org-Intelligence-Dienst (ra-signals) für diesen Tenant nicht eingeschaltet, nicht erreichbar oder noch nicht ausgerollt.
Der Dialog zeigt in diesem Fall einen entsprechenden Hinweis statt einer leeren Auswahl. Abhilfe:
- Der Data Node Org Intelligence (
ra-signals) muss unter Einstellungen › Data Nodes eingeschaltet sein (Data Nodes) — das schaltet der Tenant-Admin selbst. - Durch den Platform-Admin: Der
ra-signals-Dienst muss auf dem Deployment-Target des Tenants laufen. Wurde der Dienst erst nachträglich hinzugefügt, hilft im Platform-Admin der Knopf Re-Sync am Deployment-Target — er stößt einen erneuten Rollout an (der Dienst startet, die Routen werden eingerichtet und im Service-Verzeichnis registriert).
Fehlerbehebung: Quelle meldet einen Fehler, „Zuletzt gesammelt” bleibt leer
Abschnitt betitelt „Fehlerbehebung: Quelle meldet einen Fehler, „Zuletzt gesammelt” bleibt leer“Zeigt eine aktivierte Quelle einen Fehler und bleibt der Zeitstempel „Zuletzt gesammelt” leer, ist der Collect-Lauf gestartet, aber beim Schreiben gescheitert. Der Fehler steht an der Quelle; die Auswertungen (Org-Lücken, Signal-Berichte) bleiben in diesem Fall leer, weil keine Kanten ankommen.
Wichtig zum Verständnis: eine leere Auswertung heißt hier nicht „keine Signale”, sondern „nichts aufgenommen”. Prüfe daher immer zuerst den Fehler an der Quelle, bevor du aus einem leeren Bericht schließt, dass es keine Zusammenarbeit gibt.
Der Dienst behebt die häufigste Ursache selbst: fehlt der Eindeutigkeits-Index, den die Aufnahme braucht, legt ra-signals ihn beim nächsten Lauf an (und entfernt zuvor doppelte Kanten aus dem Bestand). Bleibt der Fehler danach bestehen, fehlen der Datenbankrolle vermutlich die Rechte, einen Index anzulegen — dann hilft der Platform-Admin.
Zugangsdaten
Abschnitt betitelt „Zugangsdaten“Alle sensitiven Felder (Passwörter, API-Tokens, Client-Secrets) werden AES-256-GCM verschlüsselt gespeichert und niemals in der API zurückgegeben.
Manuell triggern & Verbindung testen
Abschnitt betitelt „Manuell triggern & Verbindung testen“- Herz-Icon: Testet die Verbindung zur externen API ohne Daten zu sammeln.
- Play-Icon: Startet sofort einen Collect-Lauf (läuft im Hintergrund).
Konfigurationsparameter (global)
Abschnitt betitelt „Konfigurationsparameter (global)“| Parameter | Bedeutung | Standard |
|---|---|---|
| Max. Alter (Tage) | Wie weit zurück Interaktionen gesammelt werden | 90 |
| Min. Interaktionen | Schwelle: Kanten mit weniger Interaktionen werden verworfen | siehe Auswertungsrahmen |
Automatischer Collect-Rhythmus
Abschnitt betitelt „Automatischer Collect-Rhythmus“Aktivierte Quellen werden stündlich automatisch gesammelt. Der Zeitstempel „Zuletzt gesammelt” zeigt den letzten erfolgreichen Lauf.
Verwandt
Abschnitt betitelt „Verwandt“- Org Intelligence — Überblick über das Feature
- Personen-Mapping — Gesammelte Akteure mit Personen verknüpfen
- Org-Intelligence-Reports — Lückenanalyse und Reports