Σε μια εσωτερική δοκιμή διάρκειας ενός λεπτού σε ζωντανή βιντεοκλήση, 26 από τους 54 συμμετέχοντες (το 48%) πίστεψαν ότι μιλούσαν με έναν πραγματικό άνθρωπο. Το επίτευγμα αυτό θεωρείται σημαντικό ορόσημο, καθώς τα προηγούμενα παρόμοια συστήματα της εταιρείας είχαν ποσοστό επιτυχίας μικρότερο από 3%.
Αντίθετα με τα παραδοσιακά chatbot που περιμένουν να τελειώσει ο χρήστης για να απαντήσουν, το μοντέλο της Tavus ακούει, βλέπει και επεξεργάζεται τον ήχο και το βίντεο ταυτόχρονα.
Το σύστημα έχει τη δυνατότητα να διακόπτει, να χειρονομεί, να αλλάζει το βλέμμα του και να αντιδρά σε πραγματικό χρόνο (σε χρόνο μικρότερο του ενός δευτερολέπτου), προσαρμόζοντας τις εκφράσεις του προσώπου του στη ροή της συζήτησης.
Το μοντέλο κατέλαβε την πρώτη θέση στο σχετικό benchmark της NVIDIA για full-duplex AI βίντεο, πλησιάζοντας μόλις 0.1 βαθμούς κάτω από την απόδοση ενός πραγματικού ανθρώπου.
Προς το παρόν, η έκδοση Griffin-Lite είναι διαθέσιμη μόνο ως ερευνητική προεπισκόπηση για επιλεγμένους δοκιμαστές. Η εταιρεία καθυστερεί την ευρύτερη κυκλοφορία του στην αγορά προκειμένου να αναπτύξει δικλείδες ασφαλείας, όπως ενδείξεις που θα ξεκαθαρίζουν στον χρήστη ότι συνομιλεί με AI.
ΒΙΝΤΕΟ ΕΔΩ
photo AI: pixabay









