«Το μέλλον είναι εδώ»: Η OpenAI παρουσίασε το επαναστατικό εργαλείο Sora
Η OpenAI, δημιουργός του ChatGPT και του δημιουργού εικόνων
DALL
-E, παρουσίασε ένα νέο εργαλείο με την ονομασία «Sora», το οποίο είναι ικανό να δημιουργεί, με την απλή εντολή κειμένου, ρεαλιστικά
βίντεο
που μπορούν να διαρκέσουν μέχρι ένα λεπτό. Πρόκειται για μια μείζων καινοτομία στον τομέα της τεχνητής νοημοσύνης.
Βασισμένη στις προηγούμενες έρευνες για τα προγράμματα DALL-E και GPT, αυτή η νέα πλατφόρμα είναι ακόμη υπό δοκιμή, διευκρίνισε η νεοφυής σύμμαχος της Microsoft, η οποία παρουσίασε πάντως μερικά βίντεο και τον τρόπο που δημιουργήθηκαν.
Το πρόγραμμα μπορεί να δημιουργήσει βίντεο μέγιστης διάρκειας ενός λεπτού «διατηρώντας οπτική ποιότητα και σεβόμενο το αίτημα του χρήστη», ανέφερε στον ιστότοπό της η OpenAI.
Introducing Sora, our text-to-video model.
Sora can create videos of up to 60 seconds featuring highly detailed scenes, complex camera motion, and multiple
characters
with vibrant emotions.
https://t.co/7j2JN27M3W
Prompt: “Beautiful, snowy…
pic.twitter.com/ruTEWn87vf
— OpenAI (@OpenAI)
February 15, 2024
Το Sora μπορεί «να δημιουργεί πολύπλοκες σκηνές με πολλά πρόσωπα, συγκεκριμένους τύπους κινήσεων και ακριβείς λεπτομέρειες», αναφέρει στον ιστότοπό της η start-up. Το Sora επιτρέπει επίσης να δημιουργηθεί βίντεο από μια σταθερή εικόνα, διαβεβαιώνει ο γίγαντας της τεχνητής νοημοσύνης ή και να επιμηκυνθούν υφιστάμενα βίντεο.
Ο επικεφαλής της OpenAI, Sam Altman, δήλωσε στο X, πρώην Twitter, πως η εταιρεία του «θα προσφέρει σε περιορισμένο αριθμό δημιουργών την πρόσβαση» σ’ αυτό το νέο εργαλείο, στο πλαίσιο μιας πειραματικής φάσης. Ο ίδιος κάλεσε επίσης τους χρήστες να κάνουν προτάσεις για τη δημιουργία βίντεο και μερικά λεπτά αργότερα ανέβασε στην πλατφόρμα τα πιο επιτυχημένα απ’ αυτά.
here is sora, our video generation model:
https://t.co/CDr4DdCrh1
today
we are starting red-teaming and offering access to a limited number of creators.
@_tim_brooks
@billpeeb
@model_mechanic
are really incredible; amazing work by them and the team.remarkable moment.
— Sam Altman (@sama)
February 15, 2024
Ανάμεσα σ’ αυτά τα βίντεο βλέπει κανείς δύο σκύλους να παίζουν στο χιόνι σε βουνό. Ένα άλλο βίντεο δείχνει την πτήση ενός φανταστικού ζώου, μισό πάπια μισό δράκος, μπροστά σε ένα υπέροχο ηλιοβασίλεμα, έχοντας στην πλάτη του ένα χάμστερ με εκδρομική περιβολή.
Το Sora χρησιμεύει ως βάση για «προγράμματα ικανά να καταλάβουν και να προσομοιώσουν τον πραγματικό κόσμο», εξηγεί η νεοφυής, η οποία ελπίζει ότι «θα αποτελέσει ένα σημαντικό σταθμό στην πραγματοποίηση της AGI», της Γενικής Τεχνητής Νοημοσύνης, ενός πολύ αυτόνομου συστήματος που φέρεται ότι θα ξεπεράσει τους ανθρωπους στις περισσότερες από τις οικονομικά αποδοτικές δουλειές.
Η OpenAI προειδοποίησε ότι το «σημερινό
μοντέλο
» της πλατφόρμας παρουσιάζει «ελαττώματα», καθώς συγχέει το αριστερά με το δεξιά και εμφανίζει αδυναμία να διατηρήσει μια οπτική συνέχεια σε ολόκληρο το βίντεο.
«Για παράδειγμα, ένα πρόσωπο μπορεί να δαγκώσει ένα μπισκότο, όμως μετά το μπισκότο μπορεί να μην έχει ίχνη από το δάγκωμα», εξηγεί η εταιρεία.
Παρουσιάζοντας αυτό το νέο εργαλείο, η OpenAI ανέφερε πως το ζήτημα της ασφάλειας αποτελεί ουσιώδες διακύβευμα και ότι προσομοιώσεις θα οργανωθούν με χρήστες από τους οποίους θα ζητηθεί να παραγάγουν δυσλειτουργίες ή να δημιουργήσουν ανάρμοστα περιεχόμενα, ώστε να καθορισθούν καλύτερα τα όρια της πλατφόρμας.
«Θα καλέσουμε πρόσωπα που λαμβάνουν πολιτικές αποφάσεις, εκπαιδευτικούς και καλλιτέχνες απ’ όλο τον κόσμο για να κατανοήσουμε τις ανησυχίες τους και να εντοπίσουμε τις θετικές περιπτώσεις χρήσης αυτής της νέας τεχνολογίας», ανέφερε η OpenAI. Οι Meta, Google και Runway AI, οι οποίες εργάζονται σε παρόμοιες εφαρμογές μετατροπής κειμένου σε βίντεο, τις λεγόμενες «text-to-video» («από κείμενο σε βίντεο»), έχουν ήδη παρουσιάσει δείγματα.
Δείτε μερικά από τα βίντεο που δημιούργησε το Sora της OpenAI:
Prompt: “A stylish woman walks down a Tokyo street filled with warm glowing neon and animated city signage. she wears a black leather jacket, a long red dress, and black boots, and carries a black purse. she wears sunglasses and red lipstick. she walks confidently and casually.…
pic.twitter.com/cjIdgYFaWq
— OpenAI (@OpenAI)
February 15, 2024
Prompt: “Animated scene features a close-up of a short fluffy monster kneeling beside a melting red candle. the art style is 3d and realistic, with a focus on lighting and texture. the mood of the painting is one of wonder and curiosity, as the monster gazes at the flame with…
pic.twitter.com/aLMgJPI0y6
— OpenAI (@OpenAI)
February 15, 2024
Prompt: “A gorgeously rendered papercraft world of a coral reef, rife with colorful fish and sea creatures.”
pic.twitter.com/gzEE8SwP81
— OpenAI (@OpenAI)
February 15, 2024
Prompt: “A movie trailer featuring the adventures of the 30 year old space man wearing a red wool knitted motorcycle helmet, blue sky, salt desert, cinematic style, shot on 35mm film, vivid colors.”
pic.twitter.com/0JzpwPUGPB
— OpenAI (@OpenAI)
February 15, 2024
Prompt: “Several giant wooly mammoths approach treading through a snowy meadow, their long wooly fur lightly blows in the wind as they walk, snow covered trees and dramatic snow capped mountains in the distance, mid afternoon light with wispy clouds and a sun high in the distance…
pic.twitter.com/Um5CWI18nS
— OpenAI (@OpenAI)
February 15, 2024
VIA:
FoxReport.gr

