WhatsApp testet eine neue optionale Funktion namens 'Scam Alert', die Betrugsnachrichten erkennt, ohne die Ende-zu-Ende-Verschlüsselung anzutasten. Das Besondere: Das Modell läuft vollständig auf dem Gerät – kein Nachrichteninhalt verlässt das Telefon.
Das lokale maschinelle Lernmodell wird auf das Gerät heruntergeladen und klassifiziert Text direkt auf dem Smartphone, ohne Server von Meta. 'Kein Nachrichteninhalt verlässt das Gerät zur Klassifizierung und wird nicht automatisch an WhatsApp, Meta oder sonst jemanden gemeldet', heißt es in der Ankündigung. Die Funktion soll Betrugsmuster wie Identitätstäuschung und KI-generierte Köder erkennen.
Erkennt das Modell einen wahrscheinlichen Betrugsversuch, erscheint im Chat eine Warnung, die für den anderen Teilnehmer unsichtbar ist. Nutzer können dann blockieren, melden oder das Gespräch fortsetzen – oder den Chat als vertrauenswürdig markieren, woraufhin weitere Warnungen ausbleiben. Wer einem Chat vertraut, kann optional die letzten fünf empfangenen Nachrichten zur Verbesserung des Modells an WhatsApp übermitteln.
Zunächst will WhatsApp die Funktion nur in einer begrenzten Beta in einigen Regionen testen. Das Unternehmen veröffentlicht außerdem ein technisches Papier und lädt die Sicherheits-Community zur Prüfung ein. Selbst die Telemetrie-Daten – etwa wie oft Warnungen angezeigt und wie oft darauf reagiert wurde – werden anonymisiert an spezielle verschlüsselte Trusted Execution Environments von AMD und Nvidia übermittelt.
Der Schritt folgt auf jahrelange Debatten über Scam-Erkennung in verschlüsselten Messengern. Apples Versuch 2021, missbräuchliche Bilder auf dem Gerät zu erkennen, stieß auf erheblichen Widerstand. WhatsApp betont, dass die Funktion jederzeit ein- und ausgeschaltet werden kann und klassische Meldewege für Regelverstöße unverändert bleiben.




