Co potrafi HiDream-O1-Video: 7 przykładów i poleceń do wypróbowania
Producent nie opublikował klipów z poleceniami. Zebrałem to, co jest: klip z X, dema fizyki z premiery i własne polecenia pod obraz na wideo.

👁 117 przeczytań
- HiDream-O1-Video-1.0 nie opublikował ani jednego oficjalnego klipu z poleceniem - brak materiałów na stronach firmy, Hugging Face i YouTube według stanu na 11 października 2026.
- Model zajmuje 6. miejsce w rankingu Artificial Analysis z wynikiem 1175 Elo i obsługuje wyłącznie tryb obraz na wideo, mimo że zapowiedź z września obiecywała też tekst na wideo.
- Wypróbowanie wszystkich 7 scen po 10 sekund kosztuje ok. 6,80 USD przy stawce 5,80 USD za minutę według danych Artificial Analysis.
HiDream-O1-Video-1.0 jest 6. w rankingu obrazu na wideo Artificial Analysis (1175 Elo), ale producent nie opublikował ani jednego klipu z podanym poleceniem. Zebrałem 7 przykładów: jeden klip z posta na X, trzy oficjalne dema opisane przez chińską prasę i trzy moje polecenia do wypróbowania pod jedyny dostępny tryb, czyli obraz na wideo. Parametry, ceny i dostęp opisałem w przewodniku HiDream-O1-Video.
Werdykt w skrócie (11 października 2026)
- Oficjalnych klipów z poleceniami brak - nie ma ich na stronach HiDream, na Hugging Face ani na YouTube (stan na 11.10).
- Jedyny klip do obejrzenia to porównanie trzech modeli w poście @Chinazhidx z 15 września.
- Dema o fizyce (sznurek, jabłko, piłeczka) znam tylko z opisu QbitAI. Obrazów stamtąd nie wstawiam, bo nie znam ich licencji.
- Własnych klipów nie mam - modelu nie ma u pośredników, z których korzystam. Moje polecenia oznaczam jako „do wypróbowania”.
Jak czytać te przykłady
Publiczne API HiHarness przyjmuje jeden obraz (wymagany), opcjonalne polecenie i pole force_10s. Nie ma trybu tekst na wideo, mimo że zapowiedź z 15 i 17 września go obiecywała. Dlatego każde polecenie niżej zakłada, że masz już klatkę startową. Model sam dobiera długość klipu (zapowiedź: 5-20 s), chyba że wymusisz 10 s.
Klipy z rankingów też nie są publiczne z poleceniami. Arena.ai pokazała wynik, nie przykłady: 30 września HiDream wszedł do jej rankingu obrazu na wideo na 7. miejscu z 1456 punktami.
Hidream-O1-Video-1.0 by @HiDream_AI just landed in the Image-to-Video Arena at #7 with 1456 pts!
- Arena.ai (@arena) 30 września 2026
| Nr | Przykład | Co sprawdza | Źródło | Materiał |
|---|---|---|---|---|
| 1 | Ten sam prompt w trzech modelach | ogólna jakość | post @Chinazhidx (15.09) | klip w poście |
| 2 | Czerwony sznurek w dwóch rękach | napięcie, materiał | demo HiDream wg QbitAI | tylko opis |
| 3 | Rzut jabłkiem | długość dobierana przez model | demo HiDream wg QbitAI | tylko opis |
| 4 | Piłeczka pingpongowa | grawitacja + dźwięk | demo HiDream wg QbitAI | tylko opis |
| 5 | Kawa wlewana do szklanki | ciecz, przelanie | moje polecenie | brak |
| 6 | Domino na stole | zderzenia w łańcuchu | moje polecenie | brak |
| 7 | Flaga na wietrze, 10 s | tkanina, force_10s | moje polecenie | brak |
Przykłady z materiałów o premierze
1. Ten sam prompt w trzech modelach
Zastosowanie: szybkie porównanie jakości z rywalami, zanim zapłacisz za generacje.
Polecenie: autor posta go nie podał. Wiadomo tylko, że trzy modele dostały to samo polecenie, a ostatni klip w zestawieniu to HiDream (wtedy pod chińską nazwą HD-V1).
Materiał: pionowe wideo 720 x 1280 w poście chińskiego serwisu o AI. To nie jest materiał z oficjalnego konta HiDream ani mój klip.
Text, image, or video in. 5-20s 1080p video out.
- 智东西China AI News (@Chinazhidx) 15 września 2026
Komentarz: post powtarza hasło z zapowiedzi („tekst, obraz albo wideo na wejściu”). W API na 11 października działa tylko obraz. Nie wiadomo też, z jakiego wejścia powstał ten klip, więc traktuj go jako pokaz producenta, a nie dowód na tryb tekst na wideo.
2. Czerwony sznurek w dwóch rękach
Zastosowanie: sceny z napięciem materiału - liny, kable, gumy, tkaniny w rękach.
Polecenie: oficjalnego HiDream nie podał. QbitAI (15.09.2026) opisuje demo porównawcze: dwie ręce ciągną czerwony sznurek, a model ma pokazać, jak się napina. Moja propozycja polecenia w tym duchu (do wypróbowania, nie mój wynik):
Two hands slowly pull a red string in opposite directions. The string straightens and becomes taut, fibers stretch slightly, a small vibration runs along it before it holds still. Close-up, soft daylight, static camera.
Po polsku: dwie ręce powoli ciągną czerwony sznurek w przeciwne strony, aż się napina i lekko drży.
Materiał: brak. Kadrów z QbitAI nie wstawiam (licencja nieznana).
Komentarz: obraz startowy powinien pokazywać sznurek luźny, żeby model miał co napinać. To typowy test, na którym starsze modele „rozciągają” ręce zamiast sznurka.
3. Rzut jabłkiem
Zastosowanie: krótkie akcje, w których długość klipu powinna wynikać z ruchu, a nie z ustawienia.
Polecenie: oficjalnego brak. W demie opisanym przez QbitAI model sam wybierał długość ujęcia do rzutu jabłkiem. Moja wersja do wypróbowania:
A person tosses a red apple to a friend standing a few meters away. The apple flies in a natural arc, the friend catches it with one hand and takes a bite. Medium shot, park in late afternoon light.
Po polsku: ktoś rzuca jabłko koledze, ten łapie je jedną ręką i odgryza kęs.
Materiał: brak, tylko opis słowny w QbitAI.
Komentarz: tu nie ustawiaj force_10s - chodzi właśnie o to, ile czasu model uzna za potrzebne. Zapisz długość wyniku; przy 5,80 USD za minutę (stawka AA) każda sekunda to ok. 0,097 USD.
4. Piłeczka pingpongowa
Zastosowanie: grawitacja, utrata energii i dźwięk dopasowany do obrazu.
Polecenie: oficjalnego brak. QbitAI opisuje demo, w którym piłeczka odbija się coraz niżej, a dźwięk uderzeń pasuje do każdego odbicia. Moja wersja:
A white ping-pong ball drops onto a wooden table and bounces, each bounce lower than the last, until it rolls to a stop. Each impact makes a crisp click. Low angle, shallow depth of field.
Po polsku: piłeczka spada na drewniany stół i odbija się coraz niżej, a każde uderzenie słychać jako krótkie stuknięcie.
Materiał: brak.
Komentarz: zapowiedź obiecuje natywny dźwięk, ale dokumentacja API nie ma ani przełącznika audio, ani słowa o ścieżce dźwiękowej. Jeśli wynik z API przyjdzie bez dźwięku, to nie twój błąd w poleceniu.
Moje polecenia do wypróbowania
Nie przepłacaj za te subskrypcje
Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.
Trzy sceny, które dobrałem pod to, co producent deklaruje: fizyka, materiały i długość dobierana przez model. Żadnej z nich nie generowałem - to polecenia do wypróbowania, nie moje wyniki. Klatkę startową możesz zrobić w otwartym HiDream-O1-Image, który opisałem w hubie.
5. Kawa wlewana do szklanki
Zastosowanie: reklama produktu, kawiarnia, sklep z napojami.
Hot coffee is poured from a glass carafe into a clear glass on a marble counter. The liquid swirls, foam rises, the glass fills to the brim and a few drops spill over the edge. Steam drifts up. Static close-up, warm morning light.
Po polsku: kawa z karafki wypełnia szklankę po brzegi i kilka kropel spływa po ściance.
Materiał: brak - polecenie do wypróbowania, nie mój wynik.
Komentarz: nalewanie aż do przelania to scena, którą dałem wszystkim modelom w Arenie wideo. Tam był to test tekstu na wideo, tu startujesz od zdjęcia pustej szklanki.
6. Domino na stole
Zastosowanie: efekt łańcucha zdarzeń, intro do filmu, materiał edukacyjny.
A long curved line of wooden dominoes stands on a table. A finger pushes the first one and they fall one after another in sequence, the last domino knocks over a small toy figure. Camera slowly tracks along the line.
Po polsku: palec popycha pierwszą kostkę, a domino przewraca się po kolei aż do figurki na końcu.
Materiał: brak - polecenie do wypróbowania, nie mój wynik.
Komentarz: sprawdzisz tu dwie rzeczy naraz: czy kostki padają w kolejności i czy żadna nie znika. Długość zostaw modelowi - przy długim rzędzie zobaczysz, czy rzeczywiście wydłuży ujęcie.
7. Flaga na wietrze, równo 10 sekund
Zastosowanie: tło do montażu, pętla na stronę, ujęcie przerywnikowe o stałej długości.
A white and red flag waves on a flagpole against a cloudy sky. The wind changes strength, the fabric ripples and snaps, light passes through the thin cloth. Static wide shot.
Po polsku: biało-czerwona flaga łopocze na maszcie, a wiatr co chwilę zmienia siłę.
Materiał: brak - polecenie do wypróbowania, nie mój wynik.
Komentarz: to scena pod "force_10s": true. Koszt jest wtedy przewidywalny: ok. 0,97 USD za klip przy stawce z AA.
Skala: 100% = 20 s, najdłuższy klip z zapowiedzi. Koszty to moje przeliczenie stawki z tabeli Artificial Analysis (odczyt 11.10.2026); HiDream nie publikuje własnego cennika.
Wskazówki do poleceń
- Pisz po angielsku. Producent nie podaje obsługiwanych języków.
- Opisz zmianę, nie obraz. Obraz już masz; polecenie ma powiedzieć, co się ruszy i jak.
- Nazywaj fizykę wprost: „bounces lower each time”, „becomes taut”, „spills over the edge”.
- Dodaj dźwięk w poleceniu, nawet jeśli API go nie opisuje - w zapowiedzi dźwięk wynika z akcji.
- Ostry obraz startowy: API przyjmuje pliki od 40 KB do 20 MB, a proporcje wyniku będą takie jak obrazu.
Jak HiDream wypada na tle rywali w rankingu i cenie, opisałem w porównaniu HiDream-O1-Video vs MiniMax H3 vs Vidu Q4. Dla kontrastu: przykłady z modeli, które mają tryb tekst na wideo, znajdziesz przy Wan 3.0 i MiniMax H3 Max.
Najczęstsze pytania
Czy HiDream opublikował przykładowe klipy z poleceniami?
Nie znalazłem żadnych (11.10.2026): ani na stronach firmy, ani na Hugging Face, ani na YouTube. Są tylko dema opisane w chińskiej prasie i klipy w postach na X.
Czy mogę użyć tych poleceń bez obrazu?
Nie przez API - pole image jest wymagane. Musisz najpierw przygotować klatkę startową.
Ile kosztuje wypróbowanie wszystkich siedmiu scen?
Przy stawce z AA i założeniu 10 s na scenę ok. 6,80 USD. Gdy model wybierze dłuższe klipy, odpowiednio więcej.
Czy dopiszesz własne wyniki?
Tak, gdy model pojawi się u pośrednika, z którego korzystam, albo gdy założę konto HiHarness. Wtedy dodam klipy z opisem kosztu i ustawień.
Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →Źródła i data sprawdzenia
- Post @Chinazhidx z klipem (15.09.2026)
- QbitAI o premierze HD-V1 i demach (15.09.2026)
- Dokumentacja API HiHarness (odczyt 11.10.2026)
- Artificial Analysis, obraz na wideo (odczyt 11.10.2026)
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →