Το νέο μοντέλο AI της Google για «οτιδήποτε σε οτιδήποτε» εντυπωσιάζει

Από Trantorian 24 Μαΐου 2026 1 λεπτό ανάγνωσης
Το νέο μοντέλο AI της Google για «οτιδήποτε σε οτιδήποτε» εντυπωσιάζει

Posts from this topic will be added to your daily email digest and your homepage feed.

Το Omni έστειλε το λούτρινο του παιδιού μου για ράφτινγκ και με deepfake-αρε μπροστά στον Πύργο του Άιφελ. Αλλά δεν είναι ακόμη η μοναδικότητα.

Posts from this author will be added to your daily email digest and your homepage feed.

See All by Allison Johnson

Πέρυσι έκανα deepfake το λούτρινο ζώο του παιδιού μου, για να φαίνεται πως το πλασματάκι του είχε φύγει διακοπές.

Ήταν ένα πείραμα για να δω αν μπορούσα να αναπαράγω τα γεγονότα που έδειχνε μια διαφήμιση του Gemini που πρόβαλλε η Google, και ποτέ δεν έδειξα στον τετράχρονο τα βίντεο με τον Buddy, το ελάφι, στις περιπέτειές του. Ήταν όμως μια αποκαλυπτική δοκιμή, που με έκανε να σκέφτομαι πολύ τη διαφορά ανάμεσα στο αθώο παιχνίδι με τη γενετική AI και στην πλήρη κακοποίηση του περιεχομένου. Ίσως αυτό το διάγραμμα Venn να είναι ένας τέλειος κύκλος. Ίσως όχι. Αυτό που ξέρω σίγουρα είναι ότι τα εργαλεία για τη δημιουργία ρεαλιστικών βίντεο είναι εντυπωσιακά καλά και απαιτούν εντυπωσιακά λίγη προσπάθεια και τεχνογνωσία. Και αυτή η τάση συνεχίζεται δυναμικά στην εποχή του Omni του Gemini.

Το Omni είναι μια νέα οικογένεια μοντέλων γενετικής AI που, όπως υποστηρίζεται, κάποια μέρα θα μπορεί να μετατρέπει κάθε είδους είσοδο —φωτογραφία, βίντεο, κείμενο— σε οτιδήποτε άλλο. Προς το παρόν, όμως, δημιουργεί μόνο βίντεο. Το Omni Flash είναι το πρώτο από αυτά τα μοντέλα που κυκλοφόρησε η Google και είναι πλέον διαθέσιμο στην πλατφόρμα δημιουργίας και επεξεργασίας βίντεο της εταιρείας, το Flow. Μπορείτε ακόμη να χρησιμοποιήσετε το προηγούμενο μοντέλο, το Veo, αν θέλετε, αλλά το Omni βελτιώνει το Veo σε αρκετά σημεία.

Με το Omni, μπορείτε να ανεβάσετε ένα βίντεο και να το χρησιμοποιήσετε μαζί με ένα κείμενο-προτροπή ως αφετηρία για το AI-generated αποτέλεσμα. Η Google υποστηρίζει επίσης ότι το Omni ενσωματώνει περισσότερη γνώση του πραγματικού κόσμου όταν παράγει βίντεο και ότι μπορεί να διατηρεί καλύτερα τη συνοχή των χαρακτήρων μέσα στο ίδιο βίντεο. Υπήρχε μόνο ένας τρόπος να διαπιστώσω αν ισχύουν αυτά: έφερα ξανά τον AI Buddy για να ετοιμάσει τα μικρά του, AI-generated πράγματα για άλλη μια περιπέτεια.

Το αποτέλεσμα είναι τόσο ανάμεικτο, που σε αφήνει άναυδο. Κάποια κλιπ ήταν πολύ καλά — πολύ πιο συνεπή και πιο κοντά στην προτροπή μου από ό,τι όταν δοκίμαζα το Veo πριν από πέντε μήνες. Αλλά ακόμη και τα καλύτερα πλάνα που μου έδωσε το Omni είχαν ορισμένα από εκείνα τα ξαφνικά AI «τι έγινε τώρα;» στιγμιότυπα, όπως όταν ο Buddy αλλάζει ξαφνικά προσανατολισμό ενώ κάνει αλεξίπτωτο.

Για ένα άλλο βίντεο, έδωσα στο Omni λίγη καλλιτεχνική ελευθερία. «Δημιούργησε ένα μοντάζ με τον Buddy να ετοιμάζεται για διακοπές και να επιβιβάζεται σε κρουαζιερόπλοιο για τροπικές διακοπές. Η διάθεση είναι χαριτωμένη και παιχνιδιάρικη. Ο Buddy βάζει κάτι αστείο στη βαλίτσα του που θα χρησιμοποιηθεί αργότερα στο κλιπ». Τον έβαλε να πακετάρει ένα βάζο με μέλι. Αργότερα, στο βίντεο, το πιάνει σαν να είναι μπουκάλι αντηλιακού. «Ωχ όχι», λέει ο χαρακτήρας καθώς απλώνει μέλι στην οπλή του.

Ειλικρινά, δεν είναι κακό εύρημα. Μόνο που το βάζο με το μέλι αλλάζει συνεχώς μέσα στο βίντεο: από βάζο, σε διαφανές μπουκάλι με σπρέι γεμάτο νερό, και μετά ξανά σε μπουκάλι που πιέζεται και είναι γεμάτο μέλι. Και δεν μπορώ καν να περιγράψω πώς κατέληξε το μοντέλο στο τελευταίο καρέ του βίντεο — λες και απλώς ξέρασε όλα τα στοιχεία της αλληλουχίας που μόλις δημιούργησε.

Μπορείτε να χρησιμοποιήσετε προτροπές με κείμενο για να προτείνετε διορθώσεις στα βίντεό σας, και εδώ θα δώσω εύσημα στη Google: αυτό λειτουργεί καλύτερα με το Omni απ’ ό,τι όταν δοκίμασα το Veo 3. Όμως τα αποτελέσματα με το Veo ήταν κακά — τόσο κακά, που μου ήταν πολύ πιο εύκολο απλώς να ξεκινώ κάθε φορά ένα νέο βίντεο από την αρχή, όταν ήθελα να αλλάξω κάτι. Το Omni όντως λαμβάνει υπόψη τις διορθώσεις σας, αλλά τα αποτελέσματα δεν πετυχαίνουν πάντα.

Του ζήτησα να δώσει έμφαση στις εκφράσεις του προσώπου του Buddy στα βίντεο των διακοπών του, και το αποτέλεσμα κατέληξε απλώς να φαίνεται περίεργο. Επίσης, του έβαζε κατά καιρούς κέρατα, τα οποία δεν έχει. Ο Buddy είναι μωρό, ευχαριστώ πολύ. Όταν του ζήτησα να αφαιρέσει τα κέρατα που εμφανίστηκαν σε μια σκηνή, το έκανε — και μετά έβαλε κέρατα σε όλες τις άλλες.

Το θέμα είναι ότι τίποτα από όλα αυτά δεν είναι δωρεάν. Η δημιουργία βίντεο κοστίζει credits, από 15 έως 40 ανάλογα με τη διάρκεια της σκηνής και τα «υλικά» με τα οποία ξεκινάτε. Ένας γύρος διορθώσεων κοστίζει 40 credits. Έχω το πρόγραμμα AI Pro των 20 δολαρίων τον μήνα, που δίνει 1.000 credits κάθε μήνα. Μετά από περίπου 20 κλιπ, με μερικές διορθώσεις σε κάποια από αυτά, έχω πέσει στα 145. Αν έχετε συγκεκριμένη ιδέα για το βίντεο που θέλετε να δημιουργήσει το Omni, μάλλον σας περιμένει αρκετό, ακριβό πήγαιν’ έλα με το μοντέλο, μέχρι να φτάσετε σε κάτι που να πλησιάζει το όραμά σας.

Ειλικρινά, δεν ήμουν προετοιμασμένη γι’ αυτό που είδα.

Ένα από τα υποτιθέμενα πλεονεκτήματα του Omni είναι ότι μπορεί να προσθέτει AI-generated στοιχεία σε πραγματικά βίντεο, οπότε έδωσα στον Buddy ένα διάλειμμα και έκανα deepfake τον εαυτό μου. Ξεκινώντας από ένα selfie βίντεο με ουδέτερη έκφραση, ζήτησα από το Omni να δημιουργήσει βίντεο όπου τρώω ένα πιάτο σπαγγέτι, κάθομαι σε κάθισμα αεροπλάνου και στέκομαι μπροστά στον Πύργο του Άιφελ δαγκώνοντας μια μπαγκέτα. Και ειλικρινά, δεν ήμουν προετοιμασμένη γι’ αυτό που είδα.

Υπάρχουν AI σημάδια στα deepfake βίντεό μου. Ο ήχος από το πιρούνι που χτυπά το μπολ με τα ζυμαρικά είναι λίγο υπερβολικά «στημένος». Στο βίντεο με το αεροπλάνο υπάρχει μια γυναίκα στο φόντο που εμφανίζεται δύο φορές. Αλλά πέρα από αυτές τις μικρές αστοχίες και μια αόριστα ανησυχητική αίσθηση που αφήνουν, είναι πειστικά όσο δεν πάει.

Έδειξα το κλιπ με τα μακαρόνια στον σύζυγό μου. Ήξερε ότι δοκίμαζα ένα εργαλείο AI για βίντεο, αλλά δεν του είπα τι ακριβώς στη σκηνή είχε δημιουργηθεί από AI. Χωρίς να ξέρει τι ήταν αυτό που είχε παραχθεί τεχνητά, πίστεψε ότι καθόμουν μπροστά στην κάμερα και έτρωγα μακαρόνια, και είπε ότι το μόνο στοιχείο που τον έκανε να υποψιαστεί κάτι ήταν πως το μπολ τού φάνηκε άγνωστο. Το ίδιο το φαγητό φαινόταν αρκετά αληθινό ώστε να πείσει τον σύζυγό μου. Έναν άνθρωπο που με βλέπει στην πραγματική ζωή σχεδόν κάθε μέρα τα τελευταία δέκα χρόνια.

Τα υπόλοιπα deepfakes μου κυμαίνονται σε διαφορετικά επίπεδα του «αρκετά καλό για να ξεγελάσει κόσμο στα social media». Κάποια από τα κλιπ με τον Πύργο του Άιφελ δείχνουν ελαφρώς καρτουνίστικα, αλλά ένα από αυτά είναι αρκετά πειστικό ώστε να χρειαστεί να το δείτε μερικές φορές για να καταλάβετε ότι είναι AI. Ξέρω ότι δεν είμαι εγώ όταν το AI εγώ γυρίζει το κεφάλι και αποκαλύπτει τα μαλλιά της πιασμένα σε αλογοουρά. Αλλά δεν είμαι σίγουρη ότι θα το καταλάβαινε κάποιος άλλος, και αυτό με κάνει να νιώθω περίεργα.

Έχουμε μπει για τα καλά στην αμφίβολη ζώνη του ανοίκειου.

Για να είμαι ειλικρινής, έχω κουραστεί λίγο με όλο αυτό. Έμεινα άφωνη όταν δοκίμασα το Veo 3, από τον ρεαλισμό που μπορούσε να πετύχει. Έχω μείνει άφωνη ξανά και ξανά τα τελευταία χρόνια, βλέποντας πόσο εύκολο είναι να φτιάχνεις ψεύτικους ανθρώπους σε ψεύτικες φωτογραφίες. Πιθανότατα θα έπρεπε να με εκπλήσσει και το Omni, και φαντάζομαι ότι με εκπλήσσει. Αλλά η αιχμή έχει πλέον αμβλυνθεί.

Παραμένει όμως ακόμα δύσκολο να φτιάξεις ένα AI-generated κινηματογραφικό αριστούργημα τόσο εύκολα όσο θα ήθελε να πιστέψετε η Google. Το Omni όμως βελτιώνει το Veo σε μερικούς αναγνωρίσιμους τομείς. Αν έχετε λογαριασμό Google και πιστωτική κάρτα, μπορείτε να πάρετε ένα βίντεο του εαυτού σας να κάθεται στο σπίτι και να το κάνετε να μοιάζει σαν να βρίσκεστε σε πτήση για το Μάουι με ελάχιστη προσπάθεια. Δεν νομίζω ότι βρισκόμαστε ακριβώς στους «πρόποδες της μοναδικότητας», αλλά σίγουρα έχουμε βυθιστεί βαθιά στην αμφίβολη ζώνη του ανοίκειου.

Όλες οι εικόνες και τα βίντεο σε αυτό το κείμενο δημιουργήθηκαν από το Google Gemini.

See All Google I/O 2026

More in: Google I/O 2026: All the news and announcements

This is the title for the native ad

Το παρόν κείμενο δημιουργήθηκε με τη χρήση τεχνητής νοημοσύνης.