News Το VALL-E της Microsoft χρειάζεται 3″ για να μιμηθεί την φωνή του καθενός By i.tsompas 13 Ιανουαρίου, 2023577 views ShareTweet 0 Μια νέα ψηφιακή υπηρεσία που βασίζεται στην τεχνητή νοημοσύνη εμφάνισε η Microsoft και ισχυρίζεται πως μπορεί να μιμηθεί οποιαδήποτε ανθρώπινη φωνή. Η νέα δημιουργία της εταιρείας φέρνει την ονομασία VALL-E, όπως και ο προηγούμενος αλγόριθμος DALL-E. Αν δεν γνωρίζετε, το τελευταίο δημιουργεί μια εικόνα με βάση ένα κείμενο. Το VALL-E μπορεί να μιμηθεί τη χροιά και τον τρόπο ομιλίας ακούγοντας τη φωνή ενός πραγματικού προσώπου σε μόλις τρία δευτερόλεπτα. Αν και ο ήχος μοιάζει λίγο με τη φωνή ενός ρομπότ, το αποτέλεσμα εξακολουθεί να είναι εντυπωσιακό. Η Microsoft το αποκάλεσε “μοντέλο γλώσσας νευρωνικού κωδικοποιητή”. Το VALL-E κατασκευάστηκε με βάση το EnCodec (έναν κωδικοποιητή ήχου που χρησιμοποιεί τεχνικές μηχανικής μάθησης), που αναπτύχθηκε από τη Meta πριν από ένα χρόνο, το 2022. Άλλες μέθοδοι μετατροπής κειμένου σε ομιλία λαμβάνουν υπόψη τις κυματομορφές, αλλά το VALL-E δημιουργεί ξεχωριστούς κωδικοποιητές ήχου από κείμενο και ήχο. Στην πραγματικότητα, αναλύει πώς ακούγεται ένα άτομο. Στη συνέχεια, αναλύει αυτές τις πληροφορίες σε ξεχωριστά μέρη (που ονομάζονται “tokens”) μέσω του EnCodec. Και στο τέλος, χρησιμοποιεί δεδομένα προπόνησης για να ταιριάξει με αυτό που “γνωρίζει” για το πώς θα ακουγόταν αυτή η φωνή αν έλεγε άλλες φράσεις εκτός του δείγματος των τριών δευτερολέπτων. Το VALL-E διδάχθηκε χρησιμοποιώντας ειδική βιβλιοθήκη. Το τελευταίο περιέχει 60.000 ώρες αγγλικής ομιλίας από περισσότερα από 7.000 άτομα. Οι προγραμματιστές προτείνουν ότι η μέθοδος θα μπορούσε να χρησιμοποιηθεί για εφαρμογές μετατροπής κειμένου σε ομιλία υψηλής ποιότητας. Για παράδειγμα, μπορείτε να το χρησιμοποιήσετε για την επεξεργασία εγγραφών ομιλίας όπου επιτρέπεται η αλλαγή ανθρώπινων λέξεων. Ως αποτέλεσμα, μπορείτε να δημιουργήσετε ηχητικό περιεχόμενο (όπως φωνητικά για ηχητικά βιβλία) και πολλά άλλα. Φυσικά, μια τέτοια τεχνολογία μπορεί επίσης να εγκυμονεί έναν συγκεκριμένο κίνδυνο. Αργά ή γρήγορα, κάποιοι χρήστες θα το κάνουν εργαλείο εκβιασμού. Ας πούμε, μπορούν να χρησιμοποιήσουν την τεχνητή νοημοσύνη για να αποδείξουν ότι διάσημοι άνθρωποι είπαν κάτι που δεν είπαν. [via] Δημιουργήστε ένα λογαριασμό ή συνδεθείτε για να σχολιάσετε Συνδεθείτε για να σχολιάσετε Καλώς ήλθατε {{inv_username}} comments Συνδεθείτε για να απαντήσετε Aπαντήστε {{inv_error}} New Comment Post Comment Logout Σύνδεση Email Κωδικός Σύνδεση Κλείσιμο
Gadgets Η Huawei προγραμματίζει την ανακοίνωση του smartwatch για τις 19 Σεπτεμβρίου By i.tsompas10 ώρες ago0
Mobiles Φήμες της τελευταίας στιγμής λένε ότι τα μοντέλα iPhone 16 Pro υποστηρίζουν εγγραφή βίντεο 4K/120 FPS By i.tsompas11 ώρες ago0
Mobiles Πηγή λέει πως η Apple έχει μειώσει το μέγεθος των πλαισίων του iPhone 16 Pro κατά 33% By i.tsompas12 ώρες ago0
Gadgets Περισσότερες ίντσες οθόνης για το νέο Honor Watch 5, καλύτερη φωτεινότητα και διάρκεια μπαταρίας 15 ημερών By i.tsompas13 ώρες ago0
Computers [IFA 2024]: Αυτό δεν το έχετε ξαναδεί… η Lenovo παρουσιάζει laptop με οθόνη που αναστρέφεται με φωνητικές εντολές By i.tsompas19 ώρες ago0
Computers [IFA 2024]: Σαν νέα επιλογή υπάρχει από την Honor το MagicBook Art 14 με Snapdragon X Elite και πολλά εργαλεία AI By i.tsompas19 ώρες ago0
Mobiles [IFA 2024]: Για πολύωρη χρήση η TCL προτείνει τα 50 NxtPaper και 50 Pro NxtPaper By i.tsompas19 ώρες ago0
Gadgets [IFA 2024]: Έγινε πλέον επίσημο το TCL NxtPaper 14, ενώ παράλληλα κυκλοφορεί το Tab 11 Gen 2 By i.tsompas19 ώρες ago0
Events Τι δεν πρόκειται να δείτε στις 9 Σεπτεμβρίου, στο event “It’s Glowtime” της Apple By i.tsompas1 ημέρα ago0