Η OpenAI παρουσιάζει το μοντέλο Sora ένα νέο εργαλείο που δημιουργεί βίντεο από κείμενα

Η OpenAI, δημιουργός του ChatGPT και του δημιουργού εικόνων DALL-E, παρουσίασε ένα νέο εργαλείο με την ονομασία «Sora»,  που θα επιτρέπει στους χρήστες να δημιουργούν “ρεαλιστικές” και “ευφάνταστες” σκηνές από οδηγίες κειμένου.

Βασισμένη στις προηγούμενες έρευνες για τα προγράμματα DALL-E και GPT, αυτή η νέα πλατφόρμα είναι ακόμη υπό δοκιμή, διευκρίνισε η καλιφορνέζικη νεοφυής σύμμαχος της Microsoft, η οποία παρουσίασε πάντως μερικά βίντεο και τον τρόπο που δημιουργήθηκαν.

Το πρόγραμμα μπορεί να δημιουργήσει βίντεο μέγιστης διάρκειας ενός λεπτού «διατηρώντας οπτική ποιότητα και σεβόμενο το αίτημα του χρήστη», ανέφερε στον ιστότοπό της η OpenAI.

Το Sora επιτρέπει επίσης να δημιουργηθεί βίντεο από μια σταθερή εικόνα, διαβεβαιώνει ο γίγαντας της τεχνητής νοημοσύνης ή και να επιμηκυνθούν υφιστάμενα βίντεο.

Ο Σαμ Άλτμαν, ο επικεφαλής της OpenAI, δήλωσε στο μέσο κοινωνικής δικτύωσης X πως η εταιρεία του «θα προσφέρει σε περιορισμένο αριθμό δημιουργών την πρόσβαση» σ’ αυτό το νέο εργαλείο, στο πλαίσιο μιας πειραματικής φάσης.

Η εταιρεία σημείωσε ότι το Sora βρίσκεται ακόμη σε ερευνητικό στάδιο. “Το Sora είναι σε θέση να δημιουργεί σύνθετες σκηνές με πολλαπλούς χαρακτήρες, συγκεκριμένους τύπους κίνησης και ακριβείς λεπτομέρειες του θέματος και του φόντου. Το μοντέλο καταλαβαίνει όχι μόνο τι έχει ζητήσει ο χρήστης στην προτροπή, αλλά και πώς αυτά τα πράγματα υπάρχουν στον φυσικό κόσμο”, δήλωσε η OpenAI.

Το Sora χρησιμεύει ως βάση για «προγράμματα ικανά να καταλάβουν και να προσομοιώσουν τον πραγματικό κόσμο», εξηγεί η νεοφυής, η οποία ελπίζει ότι «θα αποτελέσει ένα σημαντικό σταθμό στην πραγματοποίηση της AGI», της Γενικής Τεχνητής Νοημοσύνης, ενός πολύ αυτόνομου συστήματος που φέρεται ότι θα ξεπεράσει τους ανθρώπους στις περισσότερες από τις οικονομικά αποδοτικές δουλειές.

Η OpenAI προειδοποίησε ότι το «σημερινό μοντέλο» της πλατφόρμας παρουσιάζει «ελαττώματα», καθώς συγχέει το αριστερά με το δεξιά και εμφανίζει αδυναμία να διατηρήσει μια οπτική συνέχεια σε ολόκληρο το βίντεο.

«Για παράδειγμα, ένα πρόσωπο μπορεί να δαγκώσει ένα μπισκότο, όμως μετά το μπισκότο μπορεί να μην έχει ίχνη από το δάγκωμα», εξηγεί η εταιρεία.

Παρουσιάζοντας αυτό το νέο εργαλείο, η OpenAI ανέφερε πως το ζήτημα της ασφάλειας αποτελεί ουσιώδες διακύβευμα και ότι προσομοιώσεις θα οργανωθούν με χρήστες από τους οποίους θα ζητηθεί να παραγάγουν δυσλειτουργίες ή να δημιουργήσουν ανάρμοστα περιεχόμενα, ώστε να καθορισθούν καλύτερα τα όρια της πλατφόρμας.

«Θα καλέσουμε πρόσωπα που λαμβάνουν πολιτικές αποφάσεις, εκπαιδευτικούς και καλλιτέχνες απ’ όλο τον κόσμο για να κατανοήσουμε τις ανησυχίες τους και να εντοπίσουμε τις θετικές περιπτώσεις χρήσης αυτής της νέας τεχνολογίας», ανέφερε η OpenAI. Οι Meta, Google και Runway AI, οι οποίες εργάζονται σε παρόμοιες εφαρμογές μετατροπής κειμένου σε βίντεο, τις λεγόμενες «text-to-video» («από κείμενο σε βίντεο»), έχουν ήδη παρουσιάσει δείγματα.

Το Sora θα τεθεί στη διάθεση εικαστικών καλλιτεχνών, σχεδιαστών και κινηματογραφιστών “για να αποκτήσει ανατροφοδότηση σχετικά με το πώς θα προχωρήσει το μοντέλο ώστε να είναι πιο χρήσιμο για τους δημιουργικούς επαγγελματίες”.

 

 

 

 

Τελευταία Νέα

Ακολουθήστε το στο Google News και μάθετε πρώτοι όλες τις ειδήσεις.