HiDream-O1-Video w API robi tylko wideo z obrazu, wbrew zapowiedzi
Zapowiedź z września obiecywała tekst, obraz i wideo na wejściu. Publiczne API przyjmuje jeden obraz, a vivago podaje sprzeczne informacje o dostępności.

👁 118 przeczytań
HiDream.ai zapowiadał we wrześniu model wideo, który przyjmuje tekst, obraz i wideo. Publiczne API HiDream-O1-Video-1.0 przyjmuje tylko jeden obraz, a model zajmuje 11 października 6. miejsce w rankingu obrazu na wideo Artificial Analysis (1175 Elo). Szczegóły modelu opisałem w przewodniku HiDream-O1-Video.
W skrócie (11 października 2026)
- Zapowiedź: tekst, obraz i wideo na wejściu, 5-20 s, 1080p, natywny dźwięk.
- API HiHarness: tylko obraz + opcjonalne polecenie + przełącznik 10 s.
- Ranking AA: 6. miejsce w obrazie na wideo, brak w tekście na wideo.
- vivago: dwa sprzeczne komunikaty o dostępności (30.09 i 9.10).
Co zapowiedziano we wrześniu
15 września 2026 HiDream.ai, pekiński jednorożec założony przez dr. Mei Tao, pokazał w Chinach model HD-V1. Dwa dni później, 17 września, wyszedł angielski komunikat o HiDream-O1-Video-1.0. Opis był szeroki: „natywnie wszechmodalny” model, który przyjmuje tekst, obraz i wideo, robi klipy 1080p od 5 do 20 sekund, sam dobiera długość do akcji i generuje dźwięk zsynchronizowany z obrazem, łącznie z ruchem ust. Producent mocno akcentował fizykę: grawitację, zderzenia, odkształcenia materiałów.
Ten sam komunikat z 17 września mówił też, że model jest „in internal testing”, a dostępność będzie „in the near future”.
Co trafiło do API
Dokumentacja platformy HiHarness (odczytałem ją 11 października) opisuje HiDream-O1-Video-1.0 jako „single-image-to-video model”. Zestaw parametrów jest krótki:
image- wymagany obraz, URL albo Base64, od 40 KB do 20 MB;prompt- opcjonalne polecenie;force_10s- jedyna kontrola długości: wybór modelu albo równo 10 s;request_id- własny identyfikator zadania.
Nie ma trybu tekst na wideo, wejścia wideo, wielu referencji, wyboru rozdzielczości ani przełącznika dźwięku. Ten sam rozjazd opisały AlphaSignal (9.10) i OrcaRouter (10.10).
| Funkcja | Zapowiedź (15-17.09) | API (11.10) |
|---|---|---|
| Tekst na wideo | tak | nie |
| Obraz na wideo | tak | tak |
| Wideo na wejściu | tak | nie |
| Długość | 5-20 s | wybór modelu albo 10 s |
| Rozdzielczość | 1080p | bez parametru |
| Dźwięk | natywny | nieopisany |
Ranking: wysoko, ale niżej niż przy premierze
Przy premierze HiDream chwalił się 4. miejscem w wariancie Artificial Analysis „I2V With Audio” i 8. w Arena.ai. 30 września Arena.ai wpisała go na 7. miejsce w swoim rankingu obrazu na wideo (1456 pkt). W głównej tabeli AA z 11 października jest 6., z wynikiem 1175 i przedziałem 1165-1185.
Skala od 1000 punktów. Miejsca 2-6 dzieli 6 punktów i nachodzące na siebie przedziały ufności, więc spadek z 4. na 6. pozycję nie znaczy, że model jest wyraźnie gorszy od Vidu Q4 czy Seedance 2.0. Wyraźnie wyżej jest tylko MiniMax H3 Max. W rankingu tekstu na wideo HiDreama nie ma, co zgadza się z tym, co jest w API.
vivago: „już jest” i „będzie”
Nie przepłacaj za te subskrypcje
Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.
Z aplikacją jest jeszcze mniej jasno. 30 września konto @vivago_ai napisało, że HiDream-O1 Video jest „now available in vivago R1 Studio”. 9 października HiDream ogłosił globalną dostępność vivago R1, agenta do produkcji filmów do 5 minut, a w tym komunikacie O1-Video ma dojść do R1 „in an upcoming update”. Jedno z tych zdań jest nieaktualne; HiDream tego nie wyjaśnił.
All three models are now available in vivago R1 Studio
- vivago.ai (@vivago_ai) 30 września 2026
Co to znaczy dla twórców w Polsce
- Zawsze startujesz od obrazu. Klatkę startową trzeba zrobić osobno, np. w otwartym HiDream-O1-Image (MIT) albo w innym generatorze.
- Osobne konto. Modelu nie ma na fal.ai, Replicate ani OpenRouterze (sprawdzone 11.10), więc zostaje API HiHarness albo vivago.
- Cena bez cennika. Jedyna liczba to 5,80 USD za minutę z tabeli AA, czyli ok. 0,97 USD za 10 s. HiDream nie publikuje stawek.
- Po polsku - niewiadoma. Producent nie podaje obsługiwanych języków. Polecenia pisz po angielsku.
- Jeśli potrzebujesz tekstu na wideo, lepiej sięgnąć po Wan 3.0 lub H3 Max, które mają ten tryb i są u pośredników.
Na start możesz wypróbować polecenia z tekstu co potrafi HiDream-O1-Video. Zapowiadane tryby dopiszę, gdy pojawią się w dokumentacji API.
Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →Źródła i data sprawdzenia
- Komunikat HiDream (17.09.2026), QbitAI (15.09.2026)
- Dokumentacja HiHarness (11.10.2026)
- Artificial Analysis (11.10.2026)
- Komunikat o vivago R1 (9.10.2026)
- OrcaRouter (10.10.2026), AlphaSignal (9.10.2026)
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →