2.2 KiB
Meeting Lab
Experimentierumgebung zur Entwicklung eines lokalen Diskussionsanalyzers für Meetingtranskripte.
Ziel
Das Meeting Lab dient dazu, Verfahren zur Analyse realer Meetingtranskripte zu entwickeln und zu evaluieren.
Im Mittelpunkt steht nicht die Softwarearchitektur, sondern die Frage:
Wie lässt sich aus einem realen Meeting möglichst zuverlässig strukturiertes Wissen extrahieren?
Neue Ideen werden zunächst hier experimentell umgesetzt. Erst wenn sich ein Ansatz bewährt hat, wird er in den eigentlichen Meeting Assistant übernommen.
Grundidee
Klassische Meeting-Zusammenfassungen versuchen, das gesamte Transkript in einem einzigen Schritt zu verstehen und zusammenzufassen.
Das funktioniert bei realen Diskussionen nur eingeschränkt, da Themen häufig
- begonnen,
- unterbrochen,
- später wieder aufgenommen,
- ergänzt oder
- relativiert
werden.
Deshalb verfolgt das Meeting Lab einen mehrstufigen Analyseansatz.
Meeting
↓
Normalisierung
↓
Diskussionsblöcke
↓
Themensegmentierung
↓
Extraktion
↓
Konsolidierung
↓
Protokoll
Jeder Verarbeitungsschritt löst genau eine klar definierte Aufgabe.
Entwicklungsprinzipien
- Kleine, klar abgegrenzte Verarbeitungsschritte
- Ein Modul = eine Aufgabe
- Deterministische Vorverarbeitung
- Nachvollziehbare Ergebnisse
- Reproduzierbare Experimente
- Lokale Ausführung ohne Cloud-Abhängigkeit
Repository-Struktur
meeting-lab/
├── src/ # Quellcode
├── prompts/ # LLM-Prompts
├── experiments/ # Reproduzierbare Experimente
├── samples/ # Beispieltranskripte
├── tests/ # Tests
├── docs/ # Dokumentation
└── pyproject.toml
Aktuelle Pipeline
Whisper
↓
normalize_transcript.py
↓
chunk_transcript.py
↓
(segment_topics.py)
↓
Extraktoren
↓
Protokoll
Die Themensegmentierung bildet den nächsten großen Entwicklungsschritt.
Projektstatus
Aktuell liegt der Schwerpunkt auf der Entwicklung eines modularen Diskussionsanalyzers.
Die eigentliche Protokollerstellung ist bewusst der letzte Verarbeitungsschritt.
Lizenz
Noch nicht festgelegt.