Üzerinde çalıştıklarımız
İnsan-YZ etkileşimi tek bir modelden daha fazlasıdır. Algı, akıl yürütme, gecikme ve konuşma sezgisinin karşılıklı etkileşimidir. Multimodal asistanların bir yazılımdan ziyade bir varlık gibi hissettirmesi için tüm bu boyutlarda çalışıyoruz.
Kesintisiz Çok Modluluk
Oturum kesintisi veya algılanabilir mod değiştirme gecikmesi olmadan sadece ses ve tam çok modlu etkileşim (görüntü, metin ve ses) arasında akıcı bir şekilde geçiş yapan birleşik bir çalışma zamanı tasarlıyoruz.
Gecikme ve Yanıt Verilebilirlik
Transkripsiyon, akıl yürütme ve sentez genelinde uçtan uca boru hattı gecikmesini azaltıyoruz. Konuşmaların gerçekten eşzamanlı hissedilmesini sağlayan algı altı yanıt süreleri inşa ediyoruz.
Konuşma Dinamikleri
Daha iyi kesinti yönetimi, konuşma bitiş noktası tespiti ve insan konuşma ritmini anlayan sıra alma modelleri aracılığıyla çift yönlü konuşma kalitesini iyileştiriyoruz.
Amaca Yönelik Modeller
Belirli etkileşim modaliteleri için sınır modellerine ince ayar yaparken aynı zamanda sıfırdan şirket içi modeller geliştiriyoruz - her biri konuşma boru hattının farklı bir parçası için optimize edilmiş.
Çalışmalarımızla veya işbirliği olanaklarıyla ilgileniyor musunuz?
[email protected]