Claude for Startups i 100+ programów z darmowymi kredytami AI dla startupów i JDG Darmowe kredyty AI dla Twojej firmy Sprawdź, co dostaniesz
✨ Świeża dostawa•nowe kody na kinetyka.pl: Gemini Pro 18 mies. 170 zł•Cursor, ElevenLabs, Lovable i więcej, roczne plany AI w ułamku ceny Zobacz →
Przejdź do treści
Artykuły

HiDream-O1-Video w API robi tylko wideo z obrazu, wbrew zapowiedzi

Zapowiedź z września obiecywała tekst, obraz i wideo na wejściu. Publiczne API przyjmuje jeden obraz, a vivago podaje sprzeczne informacje o dostępności.

4 min czytania
Logo HiDream i napis Tylko z obrazu - API HiDream-O1-Video węższe niż zapowiedź

👁 118 przeczytań

HiDream.ai zapowiadał we wrześniu model wideo, który przyjmuje tekst, obraz i wideo. Publiczne API HiDream-O1-Video-1.0 przyjmuje tylko jeden obraz, a model zajmuje 11 października 6. miejsce w rankingu obrazu na wideo Artificial Analysis (1175 Elo). Szczegóły modelu opisałem w przewodniku HiDream-O1-Video.

W skrócie (11 października 2026)

  • Zapowiedź: tekst, obraz i wideo na wejściu, 5-20 s, 1080p, natywny dźwięk.
  • API HiHarness: tylko obraz + opcjonalne polecenie + przełącznik 10 s.
  • Ranking AA: 6. miejsce w obrazie na wideo, brak w tekście na wideo.
  • vivago: dwa sprzeczne komunikaty o dostępności (30.09 i 9.10).

Co zapowiedziano we wrześniu

15 września 2026 HiDream.ai, pekiński jednorożec założony przez dr. Mei Tao, pokazał w Chinach model HD-V1. Dwa dni później, 17 września, wyszedł angielski komunikat o HiDream-O1-Video-1.0. Opis był szeroki: „natywnie wszechmodalny” model, który przyjmuje tekst, obraz i wideo, robi klipy 1080p od 5 do 20 sekund, sam dobiera długość do akcji i generuje dźwięk zsynchronizowany z obrazem, łącznie z ruchem ust. Producent mocno akcentował fizykę: grawitację, zderzenia, odkształcenia materiałów.

Ten sam komunikat z 17 września mówił też, że model jest „in internal testing”, a dostępność będzie „in the near future”.

Co trafiło do API

Dokumentacja platformy HiHarness (odczytałem ją 11 października) opisuje HiDream-O1-Video-1.0 jako „single-image-to-video model”. Zestaw parametrów jest krótki:

  • image - wymagany obraz, URL albo Base64, od 40 KB do 20 MB;
  • prompt - opcjonalne polecenie;
  • force_10s - jedyna kontrola długości: wybór modelu albo równo 10 s;
  • request_id - własny identyfikator zadania.

Nie ma trybu tekst na wideo, wejścia wideo, wielu referencji, wyboru rozdzielczości ani przełącznika dźwięku. Ten sam rozjazd opisały AlphaSignal (9.10) i OrcaRouter (10.10).

FunkcjaZapowiedź (15-17.09)API (11.10)
Tekst na wideotaknie
Obraz na wideotaktak
Wideo na wejściutaknie
Długość5-20 swybór modelu albo 10 s
Rozdzielczość1080pbez parametru
Dźwięknatywnynieopisany

Ranking: wysoko, ale niżej niż przy premierze

Przy premierze HiDream chwalił się 4. miejscem w wariancie Artificial Analysis „I2V With Audio” i 8. w Arena.ai. 30 września Arena.ai wpisała go na 7. miejsce w swoim rankingu obrazu na wideo (1456 pkt). W głównej tabeli AA z 11 października jest 6., z wynikiem 1175 i przedziałem 1165-1185.

Elo w rankingu obrazu na wideo (AA, 11.10.2026)
MiniMax H3 Max1195
MiniMax H31181
Vidu Q4 Preview1179
Gemini Omni Flash1178
Seedance 2.0 720p1176
HiDream-O1-Video1175

Skala od 1000 punktów. Miejsca 2-6 dzieli 6 punktów i nachodzące na siebie przedziały ufności, więc spadek z 4. na 6. pozycję nie znaczy, że model jest wyraźnie gorszy od Vidu Q4 czy Seedance 2.0. Wyraźnie wyżej jest tylko MiniMax H3 Max. W rankingu tekstu na wideo HiDreama nie ma, co zgadza się z tym, co jest w API.

vivago: „już jest” i „będzie”

Nie przepłacaj za te subskrypcje

Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.

Zobacz, co jest dostępne

Z aplikacją jest jeszcze mniej jasno. 30 września konto @vivago_ai napisało, że HiDream-O1 Video jest „now available in vivago R1 Studio”. 9 października HiDream ogłosił globalną dostępność vivago R1, agenta do produkcji filmów do 5 minut, a w tym komunikacie O1-Video ma dojść do R1 „in an upcoming update”. Jedno z tych zdań jest nieaktualne; HiDream tego nie wyjaśnił.

Co to znaczy dla twórców w Polsce

  • Zawsze startujesz od obrazu. Klatkę startową trzeba zrobić osobno, np. w otwartym HiDream-O1-Image (MIT) albo w innym generatorze.
  • Osobne konto. Modelu nie ma na fal.ai, Replicate ani OpenRouterze (sprawdzone 11.10), więc zostaje API HiHarness albo vivago.
  • Cena bez cennika. Jedyna liczba to 5,80 USD za minutę z tabeli AA, czyli ok. 0,97 USD za 10 s. HiDream nie publikuje stawek.
  • Po polsku - niewiadoma. Producent nie podaje obsługiwanych języków. Polecenia pisz po angielsku.
  • Jeśli potrzebujesz tekstu na wideo, lepiej sięgnąć po Wan 3.0 lub H3 Max, które mają ten tryb i są u pośredników.

Na start możesz wypróbować polecenia z tekstu co potrafi HiDream-O1-Video. Zapowiadane tryby dopiszę, gdy pojawią się w dokumentacji API.

Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →

Źródła i data sprawdzenia

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.
Piotr Olszewski

Piotr Olszewski

AUTOR I WYDAWCA

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony

🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok Lovable Pro 450 zł/rok Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× ‹ powiększenie ›