Napisałeś prompt, poczekałeś na render, a klip wyszedł prawie dobrze. Postać ma sześć palców. Filiżanka kawy zamienia się w miskę. Kamera, która miała przelecieć nad miastem, stoi w miejscu jak przyklejona.
Większość takich wpadek ma trzy źródła: prompt wymaga zbyt wiele, zostawia zbyt dużo swobody albo prosi o coś, z czym modele wideo radzą sobie słabo. Gdy znasz przyczynę, poprawka zwykle sprowadza się do jednego lub dwóch zdań.
Poniżej znajdziesz dziewięć typowych problemów, wyjaśnienie, skąd się biorą, oraz prompty „przed” i „po”, które możesz skopiować.
Jedna zasada na początek
Zmieniaj jedną rzecz naraz. Zachowaj prompt, który prawie zadziałał, zmień jedno zdanie i wygeneruj klip ponownie. Jeśli zmienisz trzy rzeczy i klip się poprawi, nie będziesz wiedzieć, która zmiana pomogła.
Testuj poprawki przy najkrótszym czasie trwania, jaki oferuje model: 4 sekundy w Veo 4, 5 sekund w Kling. W obu przypadkach najkrótszy klip kosztuje najmniej kredytów. Na pełną długość przejdź dopiero wtedy, gdy prompt działa.
1. Zniekształcone dłonie i twarze
Skąd się to bierze
Dłonie i twarze są małe, pełne szczegółów i szybko się poruszają. Skomplikowany ruch palców w szerokim ujęciu daje modelowi niewiele pikseli i dużo ruchu do odwzorowania.
Jak to naprawić
Uczyń dłonie lub twarz wyraźnym tematem ujęcia albo pozostaw je nieruchome. Uprość akcję, przybliż kamerę i opisz pozę.
Before:
A woman in a busy office types quickly on a laptop while talking on the phone and drinking coffee.
After:
Medium close-up of a woman at a desk, both hands resting on a laptop keyboard, typing slowly. Her face is calm and in focus, soft window light from the left. Steady camera.
Na stronie Kling model Kling v2.5 Turbo Pro przyjmuje też prompt negatywny. Lista powinna być krótka i konkretna:
Negative prompt: extra fingers, distorted hands, deformed face, blurry face
2. Obiekty, które się zmieniają lub tracą kształt
Skąd się to bierze
Jeśli obiekt jest opisany ogólnikowo („napój”, „urządzenie”), jego tożsamość może dryfować z klatki na klatkę. Szybki ruch i dłoń przesuwająca się przed obiektem tylko to pogarszają.
Jak to naprawić
Nazwij obiekt precyzyjnie i nadaj mu dwie lub trzy stałe cechy: materiał, kolor, kształt. Jeśli to ważne, powtórz kluczowy rzeczownik.
Before:
A man picks up his drink and walks to the window.
After:
A man picks up a tall clear glass of orange juice and walks slowly to the window. The glass stays in his right hand the whole time.
Przy ujęciach produktowych zacznij od obrazu. Veo 4, Kling, Hailuo 2 i Seedance przyjmują obraz startowy, a prawdziwe zdjęcie produktu utrzymuje kształt lepiej niż sam opis słowny.
3. Niechciany tekst, logotypy i bełkotliwe szyldy
Skąd się to bierze
Ulice, sklepy i biura na prawdziwych nagraniach są pełne napisów. Model kopiuje fakturę tekstu, ale bez prawdziwych słów.
Jak to naprawić
Wybieraj otoczenie z mniejszą ilością tekstu albo wprost napisz, że powierzchnie są puste. Nie proś w prompcie o napisy na ekranie. Dodaj je później w edytorze, gdzie masz kontrolę nad fontem i pisownią.
Before:
A neon-lit street at night in Tokyo with shop signs, a title that says "Midnight Run".
After:
A quiet street at night, wet pavement reflecting soft purple and blue light. Shop fronts have plain, unlit signs with no readable text. No captions, no titles on screen.
W Kling v2.5 Turbo Pro dodaj to samo do promptu negatywnego:
Negative prompt: text, letters, watermark, logo, subtitles, captions
4. Migotanie i drgające detale
Skąd się to bierze
Drobne, powtarzalne wzory, takie jak paski, płoty czy cegły, trudno utrzymać stabilnie między klatkami. Słowa w rodzaju „flashing” czy „strobing” również zachęcają do skoków jasności.
Jak to naprawić
Uprość faktury i opisz światło jako stałe.
Before:
A man in a striped shirt walks past a brick wall under flickering city lights.
After:
A man in a plain navy shirt walks past a smooth concrete wall. Even, constant evening light, soft shadows, no flashing lights.
Wyższa rozdzielczość lepiej zachowuje drobne detale. Veo 4, Hailuo 2 i Seedance oferują 1080p. W Hailuo 2 i Seedance niższe rozdzielczości kosztują mniej kredytów, więc przetestuj prompt właśnie na nich, a wersję końcową wyrenderuj w 1080p. Hailuo 2 renderuje 1080p wyłącznie dla klipów 6-sekundowych.
5. Ruch zbyt szybki lub zbyt wolny
Skąd się to bierze
Model dopasowuje akcję do długości klipu. Pięć czynności w 4 sekundy wygląda jak w przyspieszonym tempie, a jedna drobna czynność w 10 sekund się dłuży albo zostaje wypełniona przypadkowym ruchem.
Jak to naprawić
Dopasuj ilość akcji do czasu trwania i używaj słów określających tempo: slowly, gently, briskly, in slow motion, in real time. Na początek daj klipowi 4–6-sekundowemu jedną główną czynność, a klipowi 8–10-sekundowemu dwie powiązane czynności.
Before (8 seconds):
A dancer spins, jumps, lands, bows, waves to the crowd, and walks off the stage.
After (8 seconds):
A dancer completes one slow, controlled spin, then lands softly and bows to the audience. Real-time speed, smooth movement.
6. Model ignoruje część promptu
Skąd się to bierze
Modele przykładają największą wagę do tego, co pojawia się na początku, i do tego, co konkretne. Polecenia ukryte na końcu albo zapisane jako abstrakcyjne cele („niech to wygląda premium”) często przepadają.
Jak to naprawić
Umieść najważniejszy element na początku, a abstrakcyjne życzenia zamień na widoczne szczegóły.
Before:
A cozy cabin scene with snow outside and a fireplace, and there should be a black cat sleeping on the rug, make it feel warm.
After:
A black cat sleeps curled up on a red wool rug in front of a glowing fireplace. Snow falls past the cabin window behind it. Warm orange firelight, soft shadows.
Na stronie Hailuo 2 funkcja Prompt Optimizer jest domyślnie włączona i przepisuje Twój prompt przed generowaniem. Jeśli precyzyjne polecenie wciąż ginie, wyłącz ją, aby model przeczytał dokładnie Twoje słowa.
7. Przeładowane prompty
Skąd się to bierze
Cztery postacie, trzy lokacje i zwrot akcji to materiał na krótki film, a nie na klip. Model próbuje pokazać wszystko naraz.
Jak to naprawić
Jeden klip, jedno ujęcie: jeden bohater, jedna czynność, jedno miejsce, jeden ruch kamery, jeden nastrój. Dłuższy pomysł podziel na kilka klipów i połącz je w edytorze.
Before:
A detective enters a bar, talks to the bartender, a fight breaks out, police arrive, and the detective escapes through the back door into the rain.
After (clip 1 of 3):
A detective in a grey trench coat pushes open the door of a dim bar and steps inside, scanning the room. Slow push-in, moody amber light, light rain behind him.
8. Słaba synchronizacja dźwięku lub niechciane odgłosy
Skąd się to bierze
Veo 4 generuje dźwięk razem z obrazem, podobnie jak Kling 3.0 i Seedance 2.0 po włączeniu opcji natywnego dźwięku. Jeśli nie opiszesz dźwięku, model zgaduje: wymyślone dialogi, niechciana muzyka, efekty niepasujące do akcji.
Jak to naprawić
Opisz każdy dźwięk i powiąż go z widoczną czynnością. Dialogi niech będą krótkie, w cudzysłowie, z określonym mówcą. Pisz „no music” lub „no dialogue”, gdy właśnie o to Ci chodzi.
Before:
A chef talks about her new dish in the kitchen with background music.
After:
A chef in a white apron looks at the camera and says, "Fresh basil, last thing in." She drops the leaves into the pan, and they sizzle loudly at that moment. Quiet kitchen ambience, no music.
W 8-sekundowym klipie ogranicz dialog do jednego lub dwóch krótkich zdań. Dłuższa kwestia sprawia, że postać się spieszy, a ruch ust rozjeżdża się z dźwiękiem.
9. Nieruchoma kamera, choć chciałeś ruchu
Skąd się to bierze
Bez nazwanego ruchu kamery wiele modeli domyślnie tworzy statyczne ujęcie. Słowa takie jak „dynamic” czy „cinematic” nie wskazują kierunku.
Jak to naprawić
Nazwij ruch, kierunek i tempo. Używaj terminów filmowych: dolly in, tracking shot, crane up, orbit, handheld.
Before:
A cinematic shot of a lighthouse on a cliff at sunset.
After:
Slow aerial drone shot circling a white lighthouse on a cliff at sunset, the camera rising gently as waves break on the rocks below. Golden light, long shadows.
Na stronie Seedance sprawdź, czy opcja „Fix Camera Position” jest wyłączona. Gdy jest włączona, kamera stoi w miejscu bez względu na treść promptu. Pełną listę ruchów kamery z przykładami znajdziesz w naszym przewodniku po promptach z ruchem kamery.
Ściąga: rozwiązywanie problemów
| Problem | Najbardziej prawdopodobna przyczyna | Pierwsza poprawka do wypróbowania |
|---|---|---|
| Zniekształcone dłonie lub twarze | Drobne detale, szybka akcja | Bliższe ujęcie, prostsza akcja |
| Zmieniające się obiekty | Ogólnikowy opis obiektu | Podaj materiał, kolor, kształt |
| Bełkotliwy tekst | Otoczenie pełne napisów | Gładkie powierzchnie, napisy dodane później |
| Migotanie | Drobne wzory, niestabilne światło | Proste faktury, stałe światło |
| Złe tempo | Akcja niedopasowana do długości | Jedna czynność na krótki klip |
| Ignorowane polecenia | Kluczowy szczegół ukryty na końcu | Główny temat na początku |
| Chaotyczny wynik | Za dużo pomysłów w jednym klipie | Jedno ujęcie na klip |
| Zły dźwięk | Dźwięk nieopisany | Powiąż każdy dźwięk z czynnością |
| Zamrożona kamera | Brak nazwanego ruchu lub włączona stała kamera | Nazwij ruch, kierunek, tempo |
Jeśli ta sama postać wygląda inaczej w kolejnych klipach, to osobny problem z własnymi rozwiązaniami. Zajrzyj do naszego przewodnika o zachowaniu spójności postaci w klipach wideo AI.
Najczęściej zadawane pytania
Gdzie wpisać to, czego nie chcę w filmie?
Na stronie Kling model Kling v2.5 Turbo Pro przyjmuje prompt negatywny. Niezależnie od modelu najważniejsze wykluczenia zapisz też jako zwykłe zdania w głównym prompcie, na przykład „no text on screen” lub „no music”. Główny prompt to jedyne pole, które czyta każdy model.
Czy dłuższy prompt daje większą kontrolę?
Nie zawsze. Jasny prompt z trzech do pięciu zdań zwykle wygrywa z długim. Dodawaj szczegóły tam, gdzie coś poszło nie tak, i usuwaj te, które nie zmieniają tego, co widać na ekranie.
Dlaczego ten sam prompt za każdym razem daje inny wynik?
Każdy render to nowa, losowa próba, więc szczegóły, których prompt nie określa, za każdym razem wychodzą inaczej. Jeśli prompt działa mniej więcej co drugi raz, jesteś blisko: znajdź, co różni udane wyniki od nieudanych, i opisz tę część dokładniej.
Czy obraz startowy rozwiązuje większość problemów?
Rozwiązuje wiele problemów z tożsamością i kształtem, bo model zaczyna od Twojego konkretnego obrazu. Sam w sobie nie naprawia jednak problemów z ruchem, więc nadal musisz opisać akcję i pracę kamery.
Wypróbuj poprawki samodzielnie
Weź klip, który się nie udał, znajdź jego problem w ściądze i zmień jedno zdanie. Następnie wygeneruj go ponownie w generatorze wideo AI albo otwórz bezpośrednio stronę modelu: Veo 4 dla natywnego dźwięku, Kling dla promptu negatywnego lub Seedance dla przełącznika stałej kamery. Tworzysz klipy do mediów społecznościowych? Nasze przewodniki o pionowym wideo na TikTok, Reels i Shorts oraz o reklamach produktowych wideo AI pokazują te poprawki w praktyce.