Claude for Startups i 100+ programów z darmowymi kredytami AI dla startupów i JDG Darmowe kredyty AI dla Twojej firmy Sprawdź, co dostaniesz
✨ Świeża dostawa•nowe kody na kinetyka.pl: Gemini Pro 18 mies. 170 zł•Cursor, ElevenLabs, Lovable i więcej, roczne plany AI w ułamku ceny Zobacz →
Przejdź do treści
Artykuły

Co potrafi HiDream-O1-Video: 7 przykładów i poleceń do wypróbowania

Producent nie opublikował klipów z poleceniami. Zebrałem to, co jest: klip z X, dema fizyki z premiery i własne polecenia pod obraz na wideo.

8 min czytania
Logo HiDream i napis 7 przykładów - co potrafi HiDream-O1-Video

👁 117 przeczytań

// w skrócie
  • HiDream-O1-Video-1.0 nie opublikował ani jednego oficjalnego klipu z poleceniem - brak materiałów na stronach firmy, Hugging Face i YouTube według stanu na 11 października 2026.
  • Model zajmuje 6. miejsce w rankingu Artificial Analysis z wynikiem 1175 Elo i obsługuje wyłącznie tryb obraz na wideo, mimo że zapowiedź z września obiecywała też tekst na wideo.
  • Wypróbowanie wszystkich 7 scen po 10 sekund kosztuje ok. 6,80 USD przy stawce 5,80 USD za minutę według danych Artificial Analysis.

HiDream-O1-Video-1.0 jest 6. w rankingu obrazu na wideo Artificial Analysis (1175 Elo), ale producent nie opublikował ani jednego klipu z podanym poleceniem. Zebrałem 7 przykładów: jeden klip z posta na X, trzy oficjalne dema opisane przez chińską prasę i trzy moje polecenia do wypróbowania pod jedyny dostępny tryb, czyli obraz na wideo. Parametry, ceny i dostęp opisałem w przewodniku HiDream-O1-Video.

Werdykt w skrócie (11 października 2026)

  • Oficjalnych klipów z poleceniami brak - nie ma ich na stronach HiDream, na Hugging Face ani na YouTube (stan na 11.10).
  • Jedyny klip do obejrzenia to porównanie trzech modeli w poście @Chinazhidx z 15 września.
  • Dema o fizyce (sznurek, jabłko, piłeczka) znam tylko z opisu QbitAI. Obrazów stamtąd nie wstawiam, bo nie znam ich licencji.
  • Własnych klipów nie mam - modelu nie ma u pośredników, z których korzystam. Moje polecenia oznaczam jako „do wypróbowania”.

Jak czytać te przykłady

Publiczne API HiHarness przyjmuje jeden obraz (wymagany), opcjonalne polecenie i pole force_10s. Nie ma trybu tekst na wideo, mimo że zapowiedź z 15 i 17 września go obiecywała. Dlatego każde polecenie niżej zakłada, że masz już klatkę startową. Model sam dobiera długość klipu (zapowiedź: 5-20 s), chyba że wymusisz 10 s.

Klipy z rankingów też nie są publiczne z poleceniami. Arena.ai pokazała wynik, nie przykłady: 30 września HiDream wszedł do jej rankingu obrazu na wideo na 7. miejscu z 1456 punktami.

NrPrzykładCo sprawdzaŹródłoMateriał
1Ten sam prompt w trzech modelachogólna jakośćpost @Chinazhidx (15.09)klip w poście
2Czerwony sznurek w dwóch rękachnapięcie, materiałdemo HiDream wg QbitAItylko opis
3Rzut jabłkiemdługość dobierana przez modeldemo HiDream wg QbitAItylko opis
4Piłeczka pingpongowagrawitacja + dźwiękdemo HiDream wg QbitAItylko opis
5Kawa wlewana do szklankiciecz, przelaniemoje poleceniebrak
6Domino na stolezderzenia w łańcuchumoje poleceniebrak
7Flaga na wietrze, 10 stkanina, force_10smoje poleceniebrak

Przykłady z materiałów o premierze

1. Ten sam prompt w trzech modelach

Zastosowanie: szybkie porównanie jakości z rywalami, zanim zapłacisz za generacje.

Polecenie: autor posta go nie podał. Wiadomo tylko, że trzy modele dostały to samo polecenie, a ostatni klip w zestawieniu to HiDream (wtedy pod chińską nazwą HD-V1).

Materiał: pionowe wideo 720 x 1280 w poście chińskiego serwisu o AI. To nie jest materiał z oficjalnego konta HiDream ani mój klip.

Komentarz: post powtarza hasło z zapowiedzi („tekst, obraz albo wideo na wejściu”). W API na 11 października działa tylko obraz. Nie wiadomo też, z jakiego wejścia powstał ten klip, więc traktuj go jako pokaz producenta, a nie dowód na tryb tekst na wideo.

2. Czerwony sznurek w dwóch rękach

Zastosowanie: sceny z napięciem materiału - liny, kable, gumy, tkaniny w rękach.

Polecenie: oficjalnego HiDream nie podał. QbitAI (15.09.2026) opisuje demo porównawcze: dwie ręce ciągną czerwony sznurek, a model ma pokazać, jak się napina. Moja propozycja polecenia w tym duchu (do wypróbowania, nie mój wynik):

Two hands slowly pull a red string in opposite directions. The string straightens and becomes taut, fibers stretch slightly, a small vibration runs along it before it holds still. Close-up, soft daylight, static camera.

Po polsku: dwie ręce powoli ciągną czerwony sznurek w przeciwne strony, aż się napina i lekko drży.

Materiał: brak. Kadrów z QbitAI nie wstawiam (licencja nieznana).

Komentarz: obraz startowy powinien pokazywać sznurek luźny, żeby model miał co napinać. To typowy test, na którym starsze modele „rozciągają” ręce zamiast sznurka.

3. Rzut jabłkiem

Zastosowanie: krótkie akcje, w których długość klipu powinna wynikać z ruchu, a nie z ustawienia.

Polecenie: oficjalnego brak. W demie opisanym przez QbitAI model sam wybierał długość ujęcia do rzutu jabłkiem. Moja wersja do wypróbowania:

A person tosses a red apple to a friend standing a few meters away. The apple flies in a natural arc, the friend catches it with one hand and takes a bite. Medium shot, park in late afternoon light.

Po polsku: ktoś rzuca jabłko koledze, ten łapie je jedną ręką i odgryza kęs.

Materiał: brak, tylko opis słowny w QbitAI.

Komentarz: tu nie ustawiaj force_10s - chodzi właśnie o to, ile czasu model uzna za potrzebne. Zapisz długość wyniku; przy 5,80 USD za minutę (stawka AA) każda sekunda to ok. 0,097 USD.

4. Piłeczka pingpongowa

Zastosowanie: grawitacja, utrata energii i dźwięk dopasowany do obrazu.

Polecenie: oficjalnego brak. QbitAI opisuje demo, w którym piłeczka odbija się coraz niżej, a dźwięk uderzeń pasuje do każdego odbicia. Moja wersja:

A white ping-pong ball drops onto a wooden table and bounces, each bounce lower than the last, until it rolls to a stop. Each impact makes a crisp click. Low angle, shallow depth of field.

Po polsku: piłeczka spada na drewniany stół i odbija się coraz niżej, a każde uderzenie słychać jako krótkie stuknięcie.

Materiał: brak.

Komentarz: zapowiedź obiecuje natywny dźwięk, ale dokumentacja API nie ma ani przełącznika audio, ani słowa o ścieżce dźwiękowej. Jeśli wynik z API przyjdzie bez dźwięku, to nie twój błąd w poleceniu.

Moje polecenia do wypróbowania

Nie przepłacaj za te subskrypcje

Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.

Zobacz, co jest dostępne

Trzy sceny, które dobrałem pod to, co producent deklaruje: fizyka, materiały i długość dobierana przez model. Żadnej z nich nie generowałem - to polecenia do wypróbowania, nie moje wyniki. Klatkę startową możesz zrobić w otwartym HiDream-O1-Image, który opisałem w hubie.

5. Kawa wlewana do szklanki

Zastosowanie: reklama produktu, kawiarnia, sklep z napojami.

Hot coffee is poured from a glass carafe into a clear glass on a marble counter. The liquid swirls, foam rises, the glass fills to the brim and a few drops spill over the edge. Steam drifts up. Static close-up, warm morning light.

Po polsku: kawa z karafki wypełnia szklankę po brzegi i kilka kropel spływa po ściance.

Materiał: brak - polecenie do wypróbowania, nie mój wynik.

Komentarz: nalewanie aż do przelania to scena, którą dałem wszystkim modelom w Arenie wideo. Tam był to test tekstu na wideo, tu startujesz od zdjęcia pustej szklanki.

6. Domino na stole

Zastosowanie: efekt łańcucha zdarzeń, intro do filmu, materiał edukacyjny.

A long curved line of wooden dominoes stands on a table. A finger pushes the first one and they fall one after another in sequence, the last domino knocks over a small toy figure. Camera slowly tracks along the line.

Po polsku: palec popycha pierwszą kostkę, a domino przewraca się po kolei aż do figurki na końcu.

Materiał: brak - polecenie do wypróbowania, nie mój wynik.

Komentarz: sprawdzisz tu dwie rzeczy naraz: czy kostki padają w kolejności i czy żadna nie znika. Długość zostaw modelowi - przy długim rzędzie zobaczysz, czy rzeczywiście wydłuży ujęcie.

7. Flaga na wietrze, równo 10 sekund

Zastosowanie: tło do montażu, pętla na stronę, ujęcie przerywnikowe o stałej długości.

A white and red flag waves on a flagpole against a cloudy sky. The wind changes strength, the fabric ripples and snaps, light passes through the thin cloth. Static wide shot.

Po polsku: biało-czerwona flaga łopocze na maszcie, a wiatr co chwilę zmienia siłę.

Materiał: brak - polecenie do wypróbowania, nie mój wynik.

Komentarz: to scena pod "force_10s": true. Koszt jest wtedy przewidywalny: ok. 0,97 USD za klip przy stawce z AA.

Orientacyjny koszt klipu przy 5,80 USD/min (wg AA)
5 s0,48 USD
10 s (force_10s)0,97 USD
15 s1,45 USD
20 s1,93 USD

Skala: 100% = 20 s, najdłuższy klip z zapowiedzi. Koszty to moje przeliczenie stawki z tabeli Artificial Analysis (odczyt 11.10.2026); HiDream nie publikuje własnego cennika.

Wskazówki do poleceń

  • Pisz po angielsku. Producent nie podaje obsługiwanych języków.
  • Opisz zmianę, nie obraz. Obraz już masz; polecenie ma powiedzieć, co się ruszy i jak.
  • Nazywaj fizykę wprost: „bounces lower each time”, „becomes taut”, „spills over the edge”.
  • Dodaj dźwięk w poleceniu, nawet jeśli API go nie opisuje - w zapowiedzi dźwięk wynika z akcji.
  • Ostry obraz startowy: API przyjmuje pliki od 40 KB do 20 MB, a proporcje wyniku będą takie jak obrazu.

Jak HiDream wypada na tle rywali w rankingu i cenie, opisałem w porównaniu HiDream-O1-Video vs MiniMax H3 vs Vidu Q4. Dla kontrastu: przykłady z modeli, które mają tryb tekst na wideo, znajdziesz przy Wan 3.0 i MiniMax H3 Max.

Najczęstsze pytania

Czy HiDream opublikował przykładowe klipy z poleceniami?

Nie znalazłem żadnych (11.10.2026): ani na stronach firmy, ani na Hugging Face, ani na YouTube. Są tylko dema opisane w chińskiej prasie i klipy w postach na X.

Czy mogę użyć tych poleceń bez obrazu?

Nie przez API - pole image jest wymagane. Musisz najpierw przygotować klatkę startową.

Ile kosztuje wypróbowanie wszystkich siedmiu scen?

Przy stawce z AA i założeniu 10 s na scenę ok. 6,80 USD. Gdy model wybierze dłuższe klipy, odpowiednio więcej.

Czy dopiszesz własne wyniki?

Tak, gdy model pojawi się u pośrednika, z którego korzystam, albo gdy założę konto HiHarness. Wtedy dodam klipy z opisem kosztu i ustawień.

Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →

Źródła i data sprawdzenia

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.
Piotr Olszewski

Piotr Olszewski

AUTOR I WYDAWCA

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony

🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok Lovable Pro 450 zł/rok Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× ‹ powiększenie ›