Le Confidant
Artikel

Welche KI-Modelle analysieren deinen WhatsApp-Chat? Eine klare Antwort

Kurze Antwort: deinen Bericht erstellt ein Zusammenspiel mehrerer Systeme, nicht eine einzelne KI. Die Statistiken berechnet gewöhnlicher Code, ohne jedes Modell. Die geschriebene Analyse und der Assistent laufen auf einem großen Sprachmodell von OpenAI. Ein aus Embeddings gebauter Suchindex lässt den Assistenten die richtigen Nachrichten finden. Und eine vierte Schicht, in diesem Monat hinzugekommen, ist eine neue Klasse von Modell namens Jev, die misst, was das Sprachmodell früher geschätzt hat.

Die meisten Produkte beantworten diese Frage mit "angetrieben von fortschrittlicher KI". Diese Formulierung existiert, um die Antwort zu vermeiden. Hier ist die echte, Schicht für Schicht — einschließlich der Teile deines Berichts, die überhaupt nicht von KI erzeugt werden.

Warum ein Zusammenspiel statt eines großen Modells

Der Reflex ist, das ganze Gespräch an das größte verfügbare Modell zu schicken und alles davon zu verlangen. Es ist eine einzige Integration und macht sich gut in einer Demo.

Es ist auch die falsche Form für dieses Problem, denn die Fragen in deinem Bericht sind nicht dieselbe Art von Frage.

"Wie viele Nachrichten hat jeder von euch geschickt, und wie hat sich die durchschnittliche Antwortzeit seit März verändert?" ist Arithmetik. Es gibt eine richtige Antwort, sie steht in der Datei, und ein Sprachmodell, das sie erzeugen soll, tut etwas, das strikt schlechter ist als Zählen: es schätzt eine Zahl, die man einfach berechnen könnte.

"Was hat sich daran verändert, wie ihr zwei miteinander redet?" ist Deutung. Kein Maß an Zählen erzeugt diesen Absatz. Das braucht ein Modell, das Sprache versteht.

Diese Aufgaben gehen hier an verschiedene Maschinen. Genau das bedeutet das Wort Zusammenspiel in diesem Zusammenhang: nicht mehrere Marken derselben Sache gemittelt, sondern verschiedene Arten von System, jede mit dem Teil, in dem sie wirklich gut ist.

Bereit, deine Konversation zu analysieren?

Lade deine Exportdatei zu Le Confidant hoch und erhalte sofortige Einblicke in Kommunikationsmuster, Antwortzeiten, emotionalen Tonfall und mehr — ohne Konto.

Meinen Chat analysieren →

Schicht eins: die Statistiken sind überhaupt keine KI

Nachrichtenzahlen, wer mehr schreibt, wer Gespräche beginnt, Verteilungen der Antwortzeiten, Aktivität über Monate und Stunden, die soziolinguistischen Maße — all das wird aus deinem pseudonymisierten Text mit konventionellem Code und etablierten Bibliotheken zur Sprachverarbeitung berechnet. Kein großes Modell ist auf diesem Weg beteiligt.

Deshalb sind diese Zahlen jedes Mal identisch, wenn du dieselbe Datei analysierst. Sie können zwischen Durchläufen nicht abweichen und sie können nicht erfunden werden, weil nichts sie erzeugt. Sie werden gezählt.

Es ist die unglamouröseste Schicht und die, die wir am härtesten verteidigen würden. Eine durch Arithmetik erzeugte Statistik ist eine Tatsache über dein Gespräch. Eine von einem Sprachmodell erzeugte Statistik ist der Eindruck dieses Modells von deinem Gespräch, mit einer Dezimalstelle versehen.

Schicht zwei: das Sprachmodell

Die semantische Analyse — Stimmung, Beteiligung, Konflikt, Klarheit, Beziehungsgesundheit — und jeder Austausch, den du mit dem Assistenten hast, laufen auf einem großen Sprachmodell von OpenAI.

Ganz direkt, wie auf unserer Datenschutzseite: das heißt, der pseudonymisierte Text deines Gesprächs wird an die API dieses Anbieters gesendet. Er kommt dort ohne Konto, ohne E-Mail, ohne Telefonnummer und ohne echte Namen an, weil die in deinem Browser ersetzt wurden, bevor irgendetwas hochgeladen wurde. Nach den API-Bedingungen, unter denen dieser Anbieter arbeitet, wird der Inhalt nicht zum Training seiner Modelle verwendet.

Wir veröffentlichen bewusst keine genauen Modellversionen. Sie ändern sich, sobald bessere erscheinen, und eine Versionsnummer auf einer Marketingseite ist binnen Monaten veraltet. Was zählt, ist die Kategorie und der Anbieter, und beide stehen oben.

Schicht drei: der Suchindex

Damit der Assistent "haben wir jemals über Geld gestritten?" beantworten kann, ohne dass du genau diese Worte getippt hast, wird dein Gespräch in Abschnitte geteilt und in Embeddings umgewandelt — numerische Darstellungen von Bedeutung. Dieser Index gehört allein zu deiner Analyse und wird mit ihr gelöscht.

Schicht vier: Jev, und was sich damit ändert

Diese Schicht ist neu — sie ging mit diesem Artikel live — und sie verdient eine ordentliche Erklärung, denn sie ist eine wirklich neue Art von Bauteil und nicht eine größere Version des vorigen.

Jev kommt von TypeSafe AI, einem Labor in San Francisco, gegründet von Diogo Almeida, Mitautor der InstructGPT-Arbeit hinter ChatGPT. Es kam im September 2026 aus dem Verborgenen und Entwickler wurden sofort aufmerksam, aus einem ungewöhnlichen Grund: Jev schreibt nicht.

Es ist, was seine Macher ein System-Eins-Modell nennen, nach Daniel Kahnemans schnellem, intuitivem Denkmodus. Du gibst ihm einen Zustand und eine typisierte Frage, und es gibt eine typisierte Antwort mit einer kalibrierten Wahrscheinlichkeit zurück. Keinen Absatz. Einen Wert und eine Zahl, die ausdrückt, wie sicher es ist. Weil die möglichen Antworten vorab festgelegt sind, gibt es in der Ausgabe keinen Raum, eine zu erfinden — der Fehlermodus, der Menschen an KI-Analysen zweifeln lässt, ist strukturell abwesend. Es wurde vollständig mit synthetischen Daten trainiert und ist schnell und günstig genug, um ein ganzes Gespräch zu durchlaufen statt einer Handvoll abgerufener Auszüge.

Und hier ist, warum das für einen Bericht über deine Beziehung zählt.

Bisher wurden die semantischen Werte hier auf die übliche Weise erzeugt: die relevanten Passagen abrufen, einem Sprachmodell geben, einen Konfliktwert zwischen 0 und 1 verlangen. Das funktioniert, und es hat drei Schwächen, mit denen wir nie zufrieden waren. Die Zahl ist ein Eindruck und keine Messung. Sie ist nicht reproduzierbar, weil in verschiedenen Durchläufen verschiedene Passagen auftauchen. Und sie kann ihren Rechenweg nicht zeigen — gefragt "welche Nachrichten?", wird ein Modell, das sich einen Eindruck gebildet hat, bereitwillig im Nachhinein plausibel klingende Zitate konstruieren.

Mit Jev kehrt sich die Reihenfolge um. Jeder Wortwechsel im Gespräch wird gelesen, und zu jedem werden enge, sachliche Fragen gestellt — wird hier abgetan, was gerade gesagt wurde? ist das ein Versuch, nach einer Reibung zu reparieren? geht diese Antwort auf die Sache ein oder weicht sie aus? Jede Antwort ist eine Wahrscheinlichkeit, die an einen bestimmten Wortwechsel geknüpft ist, und alle werden gespeichert.

Die Werte werden dann im Code aus diesen gespeicherten Labels berechnet, genau wie die Nachrichtenzahlen in Schicht eins. Das Sprachmodell schreibt weiterhin den Text, der den Abschnitt erklärt, denn dafür sind Sprachmodelle da — aber es bekommt fertige Zahlen, und jede Ziffer wird vor dem Weg zu dir mit dem berechneten Wert überschrieben. Das Modell darf nicht runden, anpassen oder eine Statistik improvisieren.

Was dir das bringt: reproduzierbare Werte, Abdeckung des ganzen Gesprächs statt der Passagen, die der Abruf zufällig nach oben gebracht hat, und Befunde, die sich auf bestimmte Nachrichten mit Zeitstempel zurückführen lassen. "Woher kommt das?" hat jetzt eine Antwort aus Belegen statt aus Rekonstruktion.

Wenn du hier schon einmal ein Gespräch analysiert hast: das ist die Schicht, die sich geändert hat. Die Statistiken, die du gesehen hast, sind unverändert — sie wurden schon damals gezählt. Die semantischen Abschnitte sind die, die jetzt auf Messung beruhen, und was deine Statistiken bedeuten lohnt mit diesem Wissen eine zweite Lektüre.

Bereit, deine Konversation zu analysieren?

Lade deine Exportdatei zu Le Confidant hoch und erhalte sofortige Einblicke in Kommunikationsmuster, Antwortzeiten, emotionalen Tonfall und mehr — ohne Konto.

Meinen Chat analysieren →

Was wir geklärt haben, bevor wir es eingeschaltet haben

Die Engine war lange fertig, bevor sie eingeschaltet wurde. Sie lag hinter einem Schalter, während sie von Anfang bis Ende durchlief, in allen sechs Sprachen ausgewertet wurde, die wir unterstützen, und gegen einen Referenzsatz kalibriert wurde — und während wir den Teil klärten, der nichts mit Genauigkeit zu tun hatte.

Diese Schicht hinzuzufügen heißt, dass dein pseudonymisiertes Gespräch an ein Unternehmen mehr gesendet wird als bisher. Das wollten wir nicht stillschweigend tun. Der Anbieter ist auf unserer Datenschutzseite genannt, zusammen mit den Bedingungen, unter denen seine Daten behandelt werden, und diese Seite stand online, bevor das erste Gespräch dort ankam — nicht danach. Keiner der beiden Anbieter trainiert mit dem, was wir senden, und wie bei jeder anderen Schicht trägt das, was wir senden, kein Konto, keine E-Mail und keine echten Namen.

Die andere Hälfte davon ist, was auf unserer Seite passiert, und das ist der Teil, auf den wir zuerst zeigen würden. Hier wird nichts behalten. Wenn deine Analyse abläuft, werden die hochgeladene Datei, die Statistiken, die geschriebenen Abschnitte, die Messungen pro Wortwechsel hinter den semantischen Werten und der Suchindex mit seinen Embeddings alle vernichtet — von einem geplanten Prozess in getrennter Infrastruktur, der nicht darauf angewiesen ist, dass diese Website funktioniert. Übrig bleibt eine Kennung und ein paar Daten, die festhalten, dass es eine Analyse gab. Es gibt hier keinen Bestand an Gesprächen zum Trainieren, Verkaufen oder Verlieren, weil wir keinen führen.

Das war langsamer, als es einfach auszuliefern. Es ist dieselbe Überlegung, die den Schritt der Namensersetzung in deinen Browser gelegt hat und nicht auf unsere Server: Datenschutzversprechen, die den Kontakt mit der Realität überleben, sind strukturell, und Struktur wird vor dem Start entschieden, nicht nach dem Ausliefern einer Funktion angeschraubt.

Fragen, die gestellt werden

Nutzt irgendein KI-Unternehmen mein Gespräch zum Training? Nein. Beide Anbieter auf diesem Weg arbeiten unter API-Bedingungen, die übermittelte Inhalte vom Modelltraining ausschließen, und TypeSafe gibt an, dass Jev nicht mit Kundendaten feinabgestimmt oder angepasst wird — dieselben Gewichte bedienen jedes Konto. Wir trainieren auch kein eigenes Modell mit deinen Gesprächen, und wir könnten es nicht: deine Daten werden vernichtet, wenn die Analyse abläuft, es gibt also keinen Bestand zum Trainieren.

Kann die KI herausfinden, wer ich bin? Nicht aus dem, was wir senden. Die Namen der Teilnehmer werden vor dem Hochladen in deinem Browser ersetzt, es gibt keine Konten, und auf unserer Seite existiert keine E-Mail und keine Telefonnummer, an die man etwas hängen könnte. Ein Modell kann beobachten, dass Person A am Wochenende langsamer antwortet. Von dort gibt es keinen Weg zu deiner Identität.

Warum nicht einfach das beste Modell für alles nehmen? Weil "das beste" von der Aufgabe abhängt. Nachrichten zu zählen braucht keine Intelligenz, es braucht Arithmetik, und ein Sprachmodell, das rechnet, ist ein schlechterer Taschenrechner mit selbstsicherem Ton. Deutung braucht ein Sprachmodell. Tausende Wortwechsel gleichmäßig und günstig zu labeln braucht etwas wie Jev. Ein einziges Modell, das alle drei Dinge tut, tut jedes davon schlechter.

Ist ein Konfliktwert von 0,62 eine Tatsache? Er ist jetzt eine berechnete Größe und kein Eindruck — Arithmetik über tausende einzeln gelabelte Wortwechsel, reproduzierbar über Durchläufe hinweg und auf die Nachrichten dahinter zurückführbar. Das ist eine echte Verbesserung gegenüber einer Schätzung, und es beschreibt weiterhin ein Gespräch, statt einen Streit zu entscheiden. Nimm es als gut begründeten Ausgangspunkt für dein eigenes Nachdenken, nicht als Urteil.

Hat meine frühere Analyse das benutzt? Nein. Analysen von vor diesem Monat haben die semantischen Werte direkt vom Sprachmodell erzeugen lassen. Die Statistiken wurden damals gezählt und werden jetzt gezählt, die sind also unverändert — verbessert haben sich die semantischen Abschnitte.

Was, wenn ich meinen Chat noch nicht exportiert habe? Unsere Schritt-für-Schritt-Anleitung zum Export deckt iPhone und Android ab. Es wird nichts hochgeladen, bevor du die Namen der Teilnehmer in deinem Browser ersetzt hast.

Verwandte Artikel

Welche KI-Modelle analysieren deinen WhatsApp-Chat? Eine klare Antwort | Le Confidant