Artikel:Brian Johnson und Eloi Du Bois
Sparrow-2: Ganzheitliches Szenenverständnis für Konversations-KI
Tavus stellt mit Sparrow-2 ein audiogebundenes Sprachmodell vor, das das Turn-Taking grundlegend überarbeitet. Statt Audiosignale durch Rauschunterdrückung künstlich zu bereinigen und das Gesprächsende über Pausen zu ermitteln, analysiert das Modell die gesamte akustische Szene samt Nebengeräuschen, Sprecheridentität und Prosodie.
Aus Video: Weekly AI Updates: Local Models, GPT-6 Astra, and Agent Architectures