Süni intellekt video: necə hazırlanır və TryVeo ilə ilk addım

Süni intellekt videonun iş prinsipini, prompt yazmağı, format və model seçimini, kreditləri və TryVeo-da ilk videonu yaratma mərhələlərini öyrənin.

Dərc olunub

Yenilənib

Mövzu: AI Video Yaratma

Noutbuk qarşısında süni intellekt video layihəsi üzərində işləyən yaradıcı və ekranda təbii mənzərə kadrı

“süni intellekt video” dedikdə, təbii dildə yazılmış təsvirin video materialına çevrilməsi nəzərdə tutulur. İstifadəçi səhnəni, hərəkəti, işığı və üslubu mətnlə izah edir; model isə həmin göstərişi kadrlar ardıcıllığına çevirir. Bu proses yalnız mətnlə məhdudlaşmır: başlanğıc şəkli hərəkətləndirmək, mövcud videonu davam etdirmək və ya kadrlar arasında keçid yaratmaq da AI video iş axınının hissəsidir. Bu bələdçi anlayışın əsasından başlayaraq TryVeo-da ilk nəticəni yaratmağa qədər praktik ardıcıllıq təqdim edir.

Text-to-video sistemləri təbii dil emalı ilə kompüter görməsini birləşdirərək mətn təsvirindən video yaradır. Lakin yaxşı nəticə yalnız gözəl cümlədən asılı deyil. Elmi icmallarda temporal consistency, yəni hərəkətin kadrlar arasında ardıcıl qalması, semantic alignment, yəni nəticənin təsvirə uyğunluğu və scalability, yəni sistemin müxtəlif uzunluq və mürəkkəblikdə işi səmərəli görməsi əsas çətinliklər kimi göstərilir. Bu səbəbdən ilk layihədə bir neçə dəqiqəlik bütöv video əvəzinə qısa, ayrıca yoxlanılan kadrlarla işləmək daha nəzarətli yanaşmadır. Mövzu barədə elmi icmalda daha geniş texniki izah verilmişdir.

Süni intellekt video hansı üsullarla hazırlanır?

Ən sadə üsul text-to-video-dur: ideyanı mətn promptu kimi yazırsınız və model səhnəni sıfırdan qurur. Məsələn, “səhər işığında Bakı küçəsində velosiped sürən insan, kamera yavaşca onu izləyir” kimi təsvir səhnənin məkanını, vaxtını, obyektini və kamera hərəkətini bildirir. Bu üsul ideyanı tez sınaqdan keçirmək, sosial şəbəkə üçün qısa vizual hazırlamaq və mövcud şəkiliniz olmadıqda başlamaq üçün münasibdir.

TryVeo platforma məlumatları: modellər üzrə ölçülmüş render vaxtları

TryVeo-nun öz istehsalat render loglarında son 90 gün ərzində ölçülüb (356 tam vaxt ölçüsü olan tamamlanmış render, 2026-09-25 tarixinə). İşin başlamasından hazır fayla qədər real vaxt, yəni provayder növbəsi də daxildir. Bunlar bizim öz ölçmələrimizdir, istehsalçı iddiaları deyil.

ModelMedian render90-cı persentilÖlçülmüş render sayı
veo-3.1-fast-generate-preview89 san137 san251
seedance-2.0-fast199 san358 san72
kling-2.5-turbo135 san159 san17
seedance-2.0307 san436 san16

Image-to-video isə hazır şəkli hərəkətli səhnəyə çevirir. Burada promptun əsas işi şəkli yenidən təsvir etmək deyil, hərəkəti və kameranın davranışını izah etməkdir: saçın küləklə tərpənməsi, fincandan buxarın qalxması, kameranın obyektə yaxınlaşması və ya fon işığının dəyişməsi kimi. Məhsul fotoşəkli, illüstrasiya və ya öz hazırladığınız başlanğıc kadrınız varsa, bu yanaşma vizual üslubu daha sabit saxlamağa kömək edə bilər. TryVeo-nun Image to Video səhifəsində bu iş axını üçün ayrıca giriş mövcuddur.

Digər üsullar mövcud videonu davam etdirmək, iki kadr arasındakı hərəkəti hesablamaq, referans şəkillərlə səhnəni istiqamətləndirmək, videonu redaktə etmək və keyfiyyəti yüksəltməkdir. TryVeo-da aktiv video yaratma növlərinə Text to Video, Image to Video, Video Continuation, Frame Interpolation, Reference-Guided Video, Video Extension, Video Edit və Video Upscale daxildir. Hansı üsulun uyğun olması məqsəddən asılıdır: yeni ideya üçün mətn, sabit vizual başlanğıc üçün şəkil, yarımçıq səhnə üçün davam və texniki təmizləmə üçün yüksəltmə seçilə bilər.

Formatı, müddəti və keyfiyyəti əvvəlcədən seçin

Video yaratmazdan əvvəl onun harada yayımlanacağını müəyyənləşdirin. Şaquli 9:16 format telefon ekranında və qısa sosial video lentlərində daha təbii görünür. Üfüqi 16:9 isə təqdimat, veb-səhifə, geniş kadr və ənənəvi video pleyerlər üçün əlverişlidir. Mövzunu sonradan kəsmək mümkün olsa da, əsas obyekti əvvəlcədən uyğun nisbətdə yerləşdirmək kadrın vacib hissələrinin itmə riskini azaldır.

Veo 3.1 üçün rəsmi sənədləşdirilmiş seçimlər

Bu cədvəl Google Gemini API-də sənədləşdirilən Veo 3.1 seçimlərini göstərir; bunları TryVeo-da bütün modellər üçün avtomatik vəd kimi qəbul etməyin.

ParametrSənədləşdirilmiş seçimlərPraktik istifadəMəhdudiyyət və qeyd
Video nisbəti16:9 və 9:16Üfüqi və şaquli yayımSeçim konkret model və məhsul interfeysindən asılı ola bilər
Müddət4, 6 və 8 saniyəQısa, yoxlanılan kadrlar1080p və 4K üçün 8 saniyə tələb olunur
Çıxış keyfiyyəti720p, 1080p və 4KKeyfiyyətlə xərc arasında seçim4K bütün variantlarda dəstəklənmir
Giriş və idarəetməMətn, şəkil, video uzatması, ilk və son kadrSəhnə istiqamətini nəzarətdə saxlamaqBəzi ssenarilərdə referans şəkillərindən istifadə mümkündür

Sources: Google AI for Developers

Google-un Veo 3.1 sənədlərində text-to-video və image-to-video ilə yanaşı video extension, ilk və son kadrlarla idarəetmə, 16:9 və 9:16 nisbətləri, 4, 6 və 8 saniyəlik müddətlər, həmçinin 720p, 1080p və 4K seçimləri göstərilir. Eyni sənəddə 1080p və 4K çıxışın 8 saniyəlik müddət tələb etdiyi qeyd olunur. Bu məlumat rəsmi Veo sənədində təsdiqlənir. Ancaq Google API-dəki parametr ilə TryVeo interfeysində görünən seçim eyni şey deyil; konkret modelin həmin anda təqdim etdiyi imkanları TryVeo daxilində yoxlamaq lazımdır.

Yaxşı prompt necə yazılır?

Promptu ədəbi və uzun mətn kimi deyil, çəkiliş tapşırığı kimi düşünün. Səhnənin əsas obyektini, hərəkəti, məkanı, işığı, kamera davranışını və vizual üslubu ardıcıl yazın. Məsələn: “taxta masanın üzərində əl işi keramika fincanı, fincandan yavaşca buxar qalxır, kamera soldan sağa yumşaq panoram edir, səhər pəncərəsi işığı, realistik məhsul çəkilişi”. Burada nə göründüyü, nə baş verdiyi və necə çəkildiyi ayrıdır.

Runway-in Gen-4 üzrə təlimatı da promptu sadə saxlamağı, image-to-video zamanı diqqəti hərəkətə yönəltməyi və nəticəni iterativ şəkildə yaxşılaşdırmağı tövsiyə edir. Bu prinsip TryVeo-da da praktikdir: ilk nəticə uğursuz olduqda bütün promptu yenidən yazmaq əvəzinə yalnız problemli hissəni dəyişin. Məsələn, obyekt düzgündür, amma kamera həddən artıq sürətlidirsə, yalnız “slow, steady camera movement” hissəsini daha aydın ifadə edin.

TryVeo-da ilk videonu yaratmaq: praktik ardıcıllıq

TryVeo-nun interfeysi Azərbaycan, ingilis və rus dillərini dəstəkləyir. Yeni başlayan istifadəçi əvvəlcə TryVeo-nun video yaratma səhifəsinə keçib interfeys dilini rahat oxuduğu seçimə gətirə bilər. Sonra aşağıdakı ardıcıllıqla işləmək daha məqsədəuyğundur: əvvəlcə ideyanı daraldın, sonra giriş növünü seçin və yalnız bundan sonra promptu yazın.

  1. Məqsədi bir cümlə ilə yazın: məsələn, məhsulun diqqətçəkən qısa təqdimatı və ya atmosferik giriş kadrı.
  2. Text to Video və Image to Video arasında seçim edin. Hazır şəkiliniz varsa, şəkli yükləyərək hərəkətə fokuslanan prompt yazın.
  3. Çıxış nisbətini yayım kanalına uyğunlaşdırın: mobil lent üçün şaquli, geniş təqdimat üçün üfüqi kadr düşünün.
  4. Prompta obyekt, hərəkət, məkan, işıq, kamera və üslub elementlərini əlavə edin.
  5. Mövcud modellər arasından tapşırığa uyğun olanı seçin və ilk generasiyanı test kimi qiymətləndirin.
  6. Nəticəni beş meyarla yoxlayın: obyektin görünüşü, hərəkətin ardıcıllığı, prompta uyğunluq, kadrın kompozisiyası və texniki keyfiyyət.
  7. Yalnız bir və ya iki dəyişiklik edərək yenidən generasiya edin; hər cəhddə çox şeyi dəyişmək hansı düzəlişin işlədiyini anlamağı çətinləşdirir.
  8. Uğurlu variantı saxlayın, uğursuz variantın səbəbini qeyd edin və növbəti kadrda həmin problemi nəzərə alın.

TryVeo-da video modellərinin sayı, digər modallıqlarla birlikdə ümumi model kataloqu və mövcud seçimlər zamanla dəyişə bilər. Təsdiqlənmiş tətbiq məlumatına görə platformada 65 video modeli və bütün modallıqlar üzrə 138 aktiv model mövcuddur. Buna görə konkret model adını əzbər seçim kimi qəbul etməkdənsə, həmin gün layihənizin məqsədinə uyğun görünən modeli və onun parametrlərini interfeysdə yoxlamaq daha düzgündür. Model seçimini ayrıca izah edən TryVeo-da model və büdcə seçimi məqaləsi də bu mərhələdə faydalı ola bilər.

Kreditləri və xərci necə düşünmək lazımdır?

TryVeo-da ödəniş mexanizmi vahid kredit balansına əsaslanır: hər plan billing dövrü üçün kredit verir və hər generasiya seçilmiş modelin konfiqurasiya edilmiş kredit dəyərini həmin ümumi balansdan çıxır. Deməli, bir videonun “xərci” yalnız müddətdən yox, seçilmiş modeldən və həmin model üçün təyin edilmiş kredit dəyərindən asılıdır. Konkret generasiyadan əvvəl hesabdakı balansı və interfeysdə göstərilən çıxımı yoxlamaq daha təhlükəsizdir.

Hazırda üç günlük sınaq müddətində 240 kredit verilir; 24 saat ərzində sınaqda 80 kreditdən və bir generasiyadan çox istifadə etmək mümkün deyil. Ödənişli planlar kredit həcmi və gündəlik limitlərlə fərqlənir: Starter 500 kredit və 150 gündəlik limit, Pro 1500 kredit və 250 gündəlik limit, Business 4500 kredit və 600 gündəlik limit, Corporate isə 10000 kredit və 1200 gündəlik limit təqdim edir. İllik variantlarda bu dövr kreditləri müvafiq olaraq 6000, 18000, 54000 və 120000-dir; gündəlik limitlər eyni plan səviyyəsində göstərilən limitlər olaraq qalır.

Bu rəqəmlər TryVeo planlarının təsdiqlənmiş xüsusiyyətləridir, lakin model başına neçə kredit çıxılması burada hesablanmır, çünki həmin dəyər seçilmiş modelə görə dəyişir. Marketinq səhifələrində qiymətlər həftəlik ekvivalent kimi görünə bilər; faktiki ödəniş məbləği yoxlama mərhələsində, şərtlərdə və qəbzlərdə göstərilir. Buna görə TryVeo qiymət səhifəsində yalnız planın kredit və limitlərini deyil, ödəniş ekranındakı yekun məbləği də yoxlayın.

Bazar qiymətlərini TryVeo qiyməti ilə qarışdırmaq olmaz. Məsələn, Google Gemini API-nin qiymət səhifəsində Veo 3.1 Standard, Fast və Lite üçün saniyəlik ayrıca tariflər verilir. Bunlar Google API istifadəsinə aid rəsmi nümunələrdir, TryVeo-nun plan və ya generasiya qiyməti deyil. Bu fərqi saxlamaq vacibdir: API-də saniyə ilə hesablanan tariflə platformada model kreditindən çıxan məbləğ eyni ölçü vahidi olmaya bilər.

İlk nəticəni necə qiymətləndirib yaxşılaşdırmalı?

İlk video ideyanın son forması yox, diaqnostika mərhələsidir. Əvvəlcə kadrda əsas obyektin deformasiya olub-olmadığına baxın. Sonra hərəkətin başlanğıc və sonunun məntiqli olub-olmadığını, kameranın obyektə mane olub-olmadığını, işığın səhnə boyunca sabit qalıb-qalmadığını yoxlayın. Nəticə texniki cəhətdən yaxşı olsa belə, promptdakı əsas məqsədi göstərmirsə, onu uğurlu saymaq olmaz.

Problem görsəniz, bir dəyişən seçin. Obyektin forması səhvdirsə, onu daha sadə və konkret təsvir edin. Hərəkət qarışıqdırsa, eyni anda bir neçə hərəkət əvəzinə tək hərəkət yazın. Kadr həddən artıq statikdirsə, kamera və ya obyekt hərəkətini ayrıca göstərin. Vizual üslub dəyişirsə, eyni əsas təsviri saxlayıb yalnız işıq və kamera ifadəsini yeniləyin. Belə iterasiya prosesi həm daha az kredit itkisinə, həm də hansı prompt quruluşunun işlədiyini anlamağa kömək edir.

Yadda saxlayın ki, süni intellekt video istehsalında texniki imkan qədər düzgün məhdudlaşdırılmış tapşırıq da əhəmiyyətlidir. Birinci addımda ideyanı tək kadr səviyyəsinə endirin, uyğun formatı seçin, hərəkəti aydın yazın və nəticəni ölçülə bilən meyarlarla qiymətləndirin. TryVeo-nun text-to-video və digər video alətləri bu iş axınını sürətləndirə bilər, amma son qərar həmişə sizin məqsədinizə, yayım kanalınıza və mövcud kredit balansınıza uyğun verilməlidir.

Mənbələr

  1. Generate videos with Veo 3.1 in Gemini API, Google AI for Developers — Veo 3.1 is a model for generating 8-second videos (720p, 1080p, or 4k) with natively generated audio. It supports portrait videos in 16:9 and 9:16, video extension, frame-specific generation, and image-based direction using up to three reference images. The API parameters list 4-, 6-, and 8-second durations; 1080p and 4k require 8 seconds.
  2. Gemini Developer API pricing, Google AI for Developers — Veo 3.1 Standard video with audio is priced at $0.40 per second for 720p and 1080p, and $0.60 per second for 4K. Veo 3.1 Fast is priced at $0.10 per second for 720p, $0.12 per second for 1080p, and $0.30 per second for 4K. Veo 3.1 Lite is priced at $0.05 per second for 720p and $0.08 per second for 1080p; 4K output is not supported.
  3. Text-to-video generators: a comprehensive survey, Journal of Big Data — Text-to-video (T2V) generation merges natural language processing with computer vision to produce video material from textual narratives. The review highlights significant issues including temporal consistency, semantic alignment, and scalability, and discusses applications in content creation, education, virtual reality, and e-commerce.