Przejdź do treści
ZWIDSTUDIO AIZapisz się do bety

PIERWSZE KROKI / PORADNIK

Wan 3.0 po polsku, bez API. Jak ZWID zamienia Twój opis w prompt

Wan 3.0 to model wideo, na którym działa ZWID. Nie musisz zakładać konta u dostawcy, pisać kodu ani promptów po angielsku. Opisujesz scenę po polsku, a ZWID zamienia ją w prompt dla modelu i pokazuje go przed generowaniem. Poniżej, co dokładnie dzieje się z Twoim opisem i czego się po modelu spodziewać.

Zespół ZWID · 6 min czytania · Aktualizacja:

Filmy wygenerowane w ZWID na modelu Wan 3.0, bez poprawek po generowaniu. Kliknij film, aby włączyć dźwięk.

Po przeczytaniu

Będziesz wiedzieć, co Wan 3.0 robi w ZWID, jak opis po polsku zamienia się w prompt i ile kosztuje film w każdej jakości.

Co Wan 3.0 robi w ZWID

  • Jeden film od 5 do 30 sekund. Dłuższy materiał składasz z kilku części.
  • Trzy jakości: HD 720p, Full HD i 4K. HD i Full HD powstają od razu w tej rozdzielczości, 4K przez powiększenie obrazu Full HD.
  • Trzy kadry: pion 9:16, kwadrat 1:1 i poziom 16:9.
  • Kilka ujęć w jednym filmie - z cięciami, w jednym zleceniu.
  • Dźwięk otoczenia powstaje razem z obrazem. Kliknij film, żeby go usłyszeć.
  • Referencje: do 10 zdjęć, 5 filmów i 5 ścieżek dźwiękowych w jednym zleceniu. Filmy i dźwięk mogą mieć razem do 15 sekund na typ.
Pies na plaży: trzy ujęcia w normalnym tempie, z dźwiękiem otoczenia. 10 s w 720p.

Opis po polsku, prompt po angielsku

Model najlepiej rozumie angielski, więc ZWID robi tłumaczenie za Ciebie. To nie jest tłumaczenie słowo w słowo:

  1. Uzupełnia szczegóły kadru, których nie podałeś: wygląd miejsca, faktury, porę dnia. Nie dodaje ludzi, marek, logo ani napisów, o które nie prosiłeś.
  2. Dokłada styl rodzaju filmu. Rodzaj filmu wybrany w Studiu dopisuje kamerę, światło i charakter obrazu. W rodzaju Bez szablonu ZWID dopisuje tylko to, czego w opisie brakuje - jeśli sam podasz kamerę i światło, zostają takie, jak napisałeś.
  3. Pokazuje wynik przed generowaniem. Rozwiń Co dokładnie pójdzie do modelu i przeczytaj prompt, zanim zapłacisz.

Tak wyglądał opis i prompt filmu z kawiarnią:

OPIS PO POLSKU

Ujęcie 1: dłonie mielą kawę w ręcznym młynku, zmielona kawa sypie się na blat. Ujęcie 2: młoda baristka z kręconymi włosami śmieje się, podając kubek klientce przez ladę. Ujęcie 3: widok przez okno kawiarni na ulicę, rowerzyści i przechodnie w porannym słońcu.

PROMPT, KTÓRY TRAFIŁ DO MODELU

Three-shot sequence with hard cuts. Shot 1: extreme close-up of hands grinding coffee beans, grounds falling. Shot 2: a young barista with curly hair laughs while handing a cup to a customer across the counter. Shot 3: wide view through the cafe window, cyclists and pedestrians passing in morning sun. Shot on 35mm film with natural grain, real-world imperfect lighting, realistic skin and material textures, handheld documentary camera, real-time speed, no slow motion, no glossy CGI look, no oversaturated colors, no text, no subtitles, no logos.

Wynik: trzy ujęcia z jednego opisu po polsku. 10 s w 720p.

Kilka ujęć: Shot 1, Shot 2, Shot 3

Wan 3.0 tnie scenę na ujęcia, gdy prompt ma wyraźny podział. Jeśli w Studiu wybierzesz Kilka ujęć w jednej rolce i napiszesz „Ujęcie 1, Ujęcie 2...”, ZWID zachowa ten podział jako Shot 1, Shot 2. Jeśli napiszesz jedno zdanie, podzieli je na detal, akcję i plan szeroki.

Cały schemat z przykładami znajdziesz w poradniku Kilka ujęć w jednej rolce, a 20 gotowych promptów z wynikami w Promptach do wideo AI.

Zdjęcia, filmy i dźwięk jako wskazówki

  • Zdjęcia - do 10. Model trzyma kształt i kolor produktu, drobne detale mogą się różnić.
  • Filmy - do 5, razem do 15 sekund. Pokazują ruch albo styl.
  • Dźwięk - do 5 ścieżek, razem do 15 sekund.
  • Asystent analizuje do 4 zdjęć, gdy układasz z nim scenę w rozmowie.

Jak przygotować zdjęcie produktu: Film ze zdjęcia produktu.

Deser ze zdjęcia: jedno zdjęcie referencyjne, trzy ujęcia, 10 s w 720p.

Czego nie obiecujemy

  • Napisy w kadrze. Model nie pisze poprawnie po polsku. Tekst dodaj w montażu.
  • Logo i drobny tekst na opakowaniu mogą się zmienić.
  • Polskie dialogi. ZWID opisuje modelowi obraz, nie kwestie mówione. Na wypowiedzi po polsku nie licz - lektora dodasz osobno.
  • Dłonie i twarze sprawdzaj w każdym ujęciu.
  • Identyczna powtórka. Ten sam opis wygenerowany drugi raz da podobny, ale nie ten sam film.

Jak pisać, żeby film nie wyglądał sztucznie: Realistyczny film AI bez efektu plastiku.

Kropla tuszu: statyw, białe tło, jedno zdarzenie w prawdziwym tempie. Kwadrat 1:1.

Cena w złotych

DługośćHD 720pFull HD4K
5 s5 zł8 zł10 zł
10 s10 zł15 zł20 zł
15 s15 zł23 zł30 zł
20 s20 zł30 zł40 zł
30 s30 zł45 zł60 zł
1 minuta (2 x 30 s)60 zł90 zł120 zł

Każdy z 20 przykładów w Promptach do wideo AI to 10 s w 720p, czyli 10 zł. 1 kredyt to 1 zł brutto, bez abonamentu, a do zakupu wystawiamy fakturę VAT. Szczegóły: Ile kosztuje film AI.

Bez API i bez konta u dostawcy

Do zwykłej pracy nie potrzebujesz klucza API ani konta u dostawcy modelu. Logujesz się do ZWID, opisujesz scenę i płacisz kredytami. Dostęp przez API jest w pakiecie Studio - dla tych, którzy chcą podpiąć generowanie do własnego systemu.

Szczegółowy test samego modelu znajdziesz na promptowy.com.

TWÓJ NASTĘPNY KROK

Przełóż to na własną scenę.

Przygotuj opis w kreatorze briefu albo sprawdź gotowy w sprawdzaczu opisu. Studio otwieramy dla osób zapisanych do bety - samo przygotowanie nie uruchamia generowania.