Modulate, ein auf Audio spezialisiertes KI-Unternehmen aus Boston, hat 25 Millionen US-Dollar eingesammelt. Angeführt wurde die Runde von Future Ventures, beteiligt waren Hyperplane und Lakestar.

Die 2026 vorgestellte Plattform Velma arbeitet nicht mit einem einzigen großen Modell, sondern mit mehr als 100 kleinen Modellen, die Sprache auswerten: Transkription, Analyse von Tonfall, Emotion und Absicht sowie die Erkennung synthetischer Audiodaten – etwa Deepfakes und KI-generierter Musik. Verkauft wird die Analyse-Software an Unternehmen, unter anderem zur Betrugsprävention, Deepfake-Erkennung und Überwachung von KI-Agenten.

Mit dem frischen Kapital will Modulate die audio-nativen Modelle weiterentwickeln und sein Entwickler- und Partnernetzwerk ausbauen. Die Runde bringt das Gesamtvolumen nach Angaben mehrerer Medien auf rund 60 Millionen Dollar; zuvor hatte das Unternehmen 41 Millionen Dollar bei einer Bewertung von 170 Millionen Dollar eingesammelt.

Der Schritt fällt in eine Phase, in der Plattformen und Regulierer unter Druck stehen, KI-generierte Stimminhalte zu erkennen – ein Problem, das Identitätsbetrug und Streit über Einwilligung in synthetischen Medien befeuert. Modulates Wette lautet, dass Audioanalyse nicht nur versteht, was gesagt wurde, sondern ob die sprechende Person echt ist – und damit zur Unternehmensanforderung statt zum Spezialwerkzeug wird.