# Meeting Lab Experimentierumgebung zur Entwicklung eines lokalen Diskussionsanalyzers für Meetingtranskripte. ## Ziel Das Meeting Lab dient dazu, Verfahren zur Analyse realer Meetingtranskripte zu entwickeln und zu evaluieren. Im Mittelpunkt steht nicht die Softwarearchitektur, sondern die Frage: > **Wie lässt sich aus einem realen Meeting möglichst zuverlässig strukturiertes Wissen extrahieren?** Neue Ideen werden zunächst hier experimentell umgesetzt. Erst wenn sich ein Ansatz bewährt hat, wird er in den eigentlichen *Meeting Assistant* übernommen. --- ## Grundidee Klassische Meeting-Zusammenfassungen versuchen, das gesamte Transkript in einem einzigen Schritt zu verstehen und zusammenzufassen. Das funktioniert bei realen Diskussionen nur eingeschränkt, da Themen häufig - begonnen, - unterbrochen, - später wieder aufgenommen, - ergänzt oder - relativiert werden. Deshalb verfolgt das Meeting Lab einen mehrstufigen Analyseansatz. ```text Meeting ↓ Normalisierung ↓ Diskussionsblöcke ↓ Themensegmentierung ↓ Extraktion ↓ Konsolidierung ↓ Canonical Meeting Knowledge ↓ Arbeitsprotokoll / Verteilerprotokoll / Knowledge Objects ``` Jeder Verarbeitungsschritt löst genau eine klar definierte Aufgabe. --- ## Entwicklungsprinzipien - Kleine, klar abgegrenzte Verarbeitungsschritte - Ein Modul = eine Aufgabe - Deterministische Vorverarbeitung - Nachvollziehbare Ergebnisse - Reproduzierbare Experimente - Lokale Ausführung ohne Cloud-Abhängigkeit --- ## Repository-Struktur ```text meeting-lab/ ├── src/ # Quellcode ├── prompts/ # LLM-Prompts ├── experiments/ # Reproduzierbare Experimente ├── samples/ # Beispieltranskripte ├── tests/ # Tests ├── docs/ # Dokumentation └── pyproject.toml ``` --- ## Aktuelle Pipeline ```text Whisper ↓ normalize_transcript.py ↓ chunk_transcript.py ↓ (segment_topics.py) ↓ Extraktoren ↓ Canonical Meeting Knowledge ↓ Output-Ansichten ``` Die Themensegmentierung bildet den nächsten großen Entwicklungsschritt. Das Meeting Lab behandelt "das Protokoll" nicht mehr als ein einzelnes Endprodukt. Das konsolidierte Meeting-Wissen ist die **Canonical Meeting Knowledge**, also die kanonische semantische Repräsentation eines Meetings und die Single Source of Truth für alle nachgelagerten Ausgaben. Aus dieser Canonical Meeting Knowledge entstehen drei unabhängige Output-Ansichten: - Working Protocol (`working_protocol.md`, Arbeitsprotokoll): relativ vollständig, mit Kontext, Begründungen, Entscheidungen, Aufgaben und offenen Fragen. - Distribution Protocol (`distribution_protocol.md`, Verteilerprotokoll): deutlich kürzer, ergebnisorientiert und für Kolleginnen, Management oder Stakeholder geeignet. - Knowledge Objects, dargestellt zum Beispiel als Knowledge-base Entry (`knowledge_entry.md`) oder später strukturiert gespeichert, zum Beispiel als `knowledge_entry.json` (Wissensdatenbankeintrag). Diese Ausgaben sind parallele Renderings desselben semantischen Modells. Das Arbeitsprotokoll ist nicht die Quelle des Verteilerprotokolls, und das Verteilerprotokoll ist nicht die Quelle der Knowledge Objects. --- ## Projektstatus Aktuell liegt der Schwerpunkt auf der Entwicklung eines modularen Diskussionsanalyzers. Die eigentliche Ausgabeerzeugung ist bewusst der letzte Verarbeitungsschritt. --- ## Lizenz Noch nicht festgelegt.