HiDream-O1-Video: 6. miejsce w rankingu obrazu na wideo, cena i start
Model wideo HiDream.ai na 6. miejscu rankingu Artificial Analysis. Co obiecywała zapowiedź, co naprawdę jest w API, ile kosztuje i jak zacząć z Polski.

👁 120 przeczytań
- HiDream-O1-Video-1.0 zajmuje 6. miejsce w rankingu obrazu na wideo Artificial Analysis z wynikiem 1175 punktów Elo (przedział 1165-1185), odczyt z 11 października 2026.
- Według danych Artificial Analysis model kosztuje 5,80 USD za minutę, co daje ok. 0,97 USD za 10-sekundowy klip generowany przez API HiHarness.
- Zapowiedź z 15-17 września 2026 obiecywała wejście tekstowe, obrazowe i wideo, ale publiczne API HiHarness przyjmuje wyłącznie jeden obraz i opcjonalny prompt.
Strona aktualizowana na bieżąco. Stan na 11 października 2026.
HiDream-O1-Video-1.0 to model wideo pekińskiej firmy HiDream.ai, który 11 października 2026 zajmuje 6. miejsce w rankingu obrazu na wideo Artificial Analysis (1175 punktów Elo, przedział 1165-1185). Według AA kosztuje 5,80 USD za minutę, taniej niż większość czołówki. Haczyk: zapowiedź mówiła o tekście, obrazie i wideo na wejściu, a publiczne API przyjmuje tylko jeden obraz i opcjonalne polecenie.
Stan na 11 października 2026
- Premiera: 15 września 2026 w Chinach (nazwa HD-V1), 17 września komunikat po angielsku. AA podaje datę wydania 28 sierpnia 2026.
- Ranking: 6. miejsce w AA-Video-I2V v1.0, 1175 Elo, 3231 porównań. W rankingu tekstu na wideo go nie ma.
- Publiczne API: tylko obraz na wideo (HiHarness). Tekst na wideo, wejście wideo i referencje są na razie tylko w materiałach marketingowych.
- Cena: 5,80 USD za minutę wg AA. Oficjalnego cennika HiDream nie znalazłem.
- Gdzie: vivago.ai (aplikacja HiDream) i API HiHarness. Nie ma go na fal.ai, Replicate ani OpenRouterze.
- Otwarte wagi: model wideo nie. Otwarty (MIT) jest siostrzany model obrazów HiDream-O1-Image.
- Mój test: klipów wideo nie mam, bo O1-Video nie jest dostępny u pośredników ani w otwartych wagach. Sprawdziłem za to otwarty model obrazów HiDream-O1-Image (fal.ai, 11.10) - wyniki w sekcji o otwartych wagach.
Co to jest HiDream-O1-Video i kto go robi
HiDream.ai (po chińsku 智象未来) to firma z pekińskiej dzielnicy Haidian, zarejestrowana w marcu 2023. Założył ją i prowadzi dr Mei Tao, który przez 12 lat pracował w Microsoft Research Asia, a potem był wiceprezesem ds. widzenia komputerowego w JD.com. Dyrektorem technicznym jest Yao Ting. Firma jest znana z modeli obrazów (HiDream-I1, E1, O1-Image) i aplikacji vivago.ai.
Pieniądze nie są tu problemem. Według TechNode (18.09.2026) w lipcu 2026 HiDream zamknął rundę C na 1,5 mld juanów (ok. 221,6 mln USD) i uzyskał status jednorożca. Od kwietnia 2026 zebrał łącznie ponad 2,1 mld juanów. Firma deklaruje ponad 30 mln użytkowników, ponad 40 000 klientów firmowych i ponad 400 mln juanów zakontraktowanego przychodu w I kwartale 2026.
O1-Video-1.0 to pierwszy model wideo z rodziny O1. Producent opisuje go jako „natywnie wszechmodalny” (native omnimodal) i stawia na trzy rzeczy:
- Fizykę - grawitacja, bezwładność, zderzenia, odkształcenia, materiały, światło i ciągłość przestrzeni.
- Planowanie przed generowaniem - model najpierw ustala długość ujęcia, scenografię, ruch postaci, mimikę, kompozycję, ruch kamery, dialog i dźwięk.
- Długość dobieraną przez model - od 5 do 20 s, zależnie od akcji i tempa sceny, zamiast sztywnych 5 czy 10 s.
Model trenowano metodą Diffusion RL z multimodalnym modelem nagrody, na architekturze UiT (Unified Transformer) HiDream. Pracy naukowej o modelu wideo firma nie opublikowała - praca na arXiv (2605.11061) dotyczy O1-Image.
Miejsce w rankingu Artificial Analysis
Ranking Artificial Analysis powstaje ze ślepych porównań: oceniający widzą dwa klipy z tego samego materiału i wybierają lepszy. HiDream-O1-Video występuje tylko w tabeli obrazu na wideo (AA-Video-I2V v1.0). Ma 1175 punktów, a 95-procentowy przedział ufności to 1165-1185. Odczytałem ranking 11 października 2026.
| Miejsce | Model | Firma | Elo | Przedział 95% | USD za minutę (AA) |
|---|---|---|---|---|---|
| 1 | MiniMax H3 Max | MiniMax (wg AA: Fal) | 1195 | 1186-1204 | 4,80 |
| 2 | MiniMax H3 | MiniMax | 1181 | 1173-1189 | 7,80 |
| 3 | Vidu Q4 Preview | Vidu (ShengShu) | 1179 | 1169-1189 | 5,04 |
| 4 | Gemini Omni Flash | 1178 | 1171-1185 | 6,00 | |
| 5 | Seedance 2.0 720p | ByteDance | 1176 | 1169-1183 | 9,07 |
| 6 | HiDream-O1-Video-1.0 | HiDream | 1175 | 1165-1185 | 5,80 |
| 7 | Wan 3.0 | Alibaba | 1164 | 1156-1172 | 12,00 |
| 8 | HappyHorse-1.1 | Alibaba-ATH | 1104 | 1097-1111 | 9,90 |
Dane: Artificial Analysis, obraz na wideo, odczyt 11.10.2026. Przedziały zaokrągliłem do pełnych punktów.
Skala zaczyna się od 1000 punktów (pasek = (Elo - 1000) / 2 procent), żeby było widać różnice. Co z tego wynika:
- Miejsca 2-6 to remis statystyczny. HiDream traci do MiniMax H3 6 punktów, a przedziały ufności wszystkich pięciu modeli nachodzą na siebie.
- Wyraźnie wyżej jest tylko H3 Max (1195). Górna granica HiDreama (1185) nie sięga dolnej granicy H3 Max (1186).
- HiDream ma najmniej porównań w czołówce - 3231, przy 15 721 u Seedance 2.0. Dlatego jego przedział jest szeroki.
- Przy premierze było wyżej. HiDream ogłaszał 4. miejsce w wariancie AA „I2V With Audio”, a Arena.ai 30 września dała mu 7. miejsce (1456 pkt) w swoim rankingu obrazu na wideo.
Hidream-O1-Video-1.0 by @HiDream_AI just landed in the Image-to-Video Arena at #7 with 1456 pts!
- Arena.ai (@arena) 30 września 2026
Parametry: zapowiedź a publiczne API
To najważniejsza tabela w tym tekście. Materiały prasowe z 15 i 17 września opisują model, który przyjmuje tekst, obraz i wideo. Dokumentacja API na HiHarness opisuje coś węższego: „single-image-to-video model”. Zestawiłem obie wersje punkt po punkcie.
| Cecha | Zapowiedź (15-17.09.2026) | Publiczne API HiHarness (odczyt 11.10.2026) |
|---|---|---|
| Wejście | tekst, obraz, wideo | jeden obraz (wymagany) + opcjonalny prompt i negative_prompt |
| Tekst na wideo | tak | nie |
| Wejście wideo, edycja, referencje | tak | nie |
| Długość | 5-20 s, dobierana przez model | dobierana przez model albo dokładnie 10 s (force_10s) |
| Rozdzielczość | 1080p | brak parametru; proporcje jak obraz wejściowy |
| Dźwięk | natywny, zsynchronizowany, ruch ust do mowy | brak przełącznika i brak opisu w dokumentacji |
| Obraz wejściowy | - | URL albo Base64, od 40 KB do 20 MB |
| fps, limit promptu, języki | nie podano | nie podano |
Źródła: komunikat HiDream (17.09.2026), QbitAI (15.09.2026), dokumentacja żądania HiHarness. Ten sam rozjazd opisały OrcaRouter (10.10) i AlphaSignal (9.10). Więcej o tym w tekście HiDream-O1-Video w API robi tylko wideo z obrazu.

Ile kosztuje HiDream-O1-Video
HiDream nie publikuje cennika API dla tego modelu - tak twierdzi też OrcaRouter, a ja oficjalnej stawki nie znalazłem. Jedyna liczba to 5,80 USD za minutę z tabeli Artificial Analysis (powtarza ją AlphaSignal). Z niej policzyłem orientacyjne koszty klipów:
| Długość klipu | Koszt przy 5,80 USD/min | Uwagi |
|---|---|---|
| 1 s | ok. 0,097 USD | stawka sekundowa |
| 5 s | ok. 0,48 USD | minimalna długość z zapowiedzi |
| 10 s | ok. 0,97 USD | tyle daje force_10s |
| 20 s | ok. 1,93 USD | maksimum z zapowiedzi |
Uwaga: gdy model sam dobiera długość, nie wiesz z góry, ile zapłacisz. Jeśli budżet ma być przewidywalny, ustaw force_10s. Jak to się ma do innych modeli, zebrałem w tekście ile kosztuje sekunda wideo AI.
Plany vivago.ai
W aplikacji vivago płacisz abonamentem w dolarach. Ceny ze strony vivago.ai (stan z 11.10.2026):
| Plan | Przy płatności rocznej | Przy płatności miesięcznej |
|---|---|---|
| Free | 0 USD | 0 USD |
| Basic | 7,90 USD / mies. | 12,90 USD |
| Plus | 19,90 USD / mies. | 39,90 USD |
| Pro | 59,90 USD / mies. | 99,90 USD |
Ile kredytów kosztuje jedna generacja O1-Video w vivago, nie potwierdziłem - strona tego nie podaje przed zalogowaniem.
Gdzie jest dostępny z Polski
- vivago.ai - aplikacja internetowa HiDream. 30 września konto @vivago_ai napisało, że O1-Video jest „now available in vivago R1 Studio”. Ale komunikat o globalnym starcie vivago R1 z 9 października mówi, że O1-Video dojdzie do R1 „in an upcoming update”. Te dwie informacje się wykluczają; zanim kupisz plan, sprawdź na koncie Free, czy model jest na liście.
- HiHarness (hiharness.ai) - platforma API HiDream. Model ma tam ID
HiDream-O1-Video-1.0. Czy rejestracja i płatność działają z Polski, nie potwierdziłem; komunikat R1 mówi o dostępności „globalnej”, ale dotyczy aplikacji, nie API. - Pośrednicy - brak. Sprawdzone 11.10: nie ma go na fal.ai, Replicate, WaveSpeed, OpenRouterze (lista 30 modeli wideo w
/api/v1/videos/models), Segmind, reAPI, kie, Pollo ani Higgsfield.
All three models are now available in vivago R1 Studio
- vivago.ai (@vivago_ai) 30 września 2026
Otwarte wagi i co uruchomisz lokalnie
Nie przepłacaj za te subskrypcje
Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.
Modelu wideo nie pobierzesz. 11 października nie było go ani na Hugging Face HiDream-ai, ani na GitHubie firmy. To model zamknięty, dostępny tylko przez usługi HiDream.
Otwarty jest za to model obrazów z tej samej rodziny, HiDream-O1-Image, na licencji MIT:
- Warianty Full i Dev z 8 maja 2026 oraz Dev-2604 z 14 maja 2026 (karta modelu, kod).
- Hugging Face podaje 9 mld parametrów; obrazy do 2048 x 2048.
- Wymagania: oficjalnie tylko „CUDA GPU”. Konwersja społeczności (drbaph) podaje ok. 10 GB VRAM w FP8 i 17-20 GB w BF16/FP16. Tych liczb sam nie mierzyłem; wynika z nich, że karta 24 GB powinna wystarczyć.
- Wariant Pro (ponad 200 mld parametrów) jest zamknięty.
Mój test HiDream-O1-Image (obraz, nie wideo)
Uprzedzam: to test modelu obrazowego O1-Image, nie O1-Video. Modelu wideo nie ma u pośredników ani w otwartych wagach, więc własnych klipów nie mam. O1-Image (pełną wersję) uruchomiłem 11 października 2026 na fal.ai (endpoint fal-ai/hidream-o1-image): 50 kroków, guidance 5, seed 20261011. fal liczy 0,01 USD za megapiksel, więc dwa obrazy kosztowały mnie ok. 0,02 USD. Sprawdzałem dwie rzeczy: polskie znaki w napisach i trzymanie się polecenia.


Wniosek: polskie znaki są prawie dobre, ale nie w 100% - z ośmiu liter z polskimi znakami dwie wyszły źle. Szyld z napisem trzeba sprawdzić litera po literze, zanim zrobisz z niego klatkę startową do wideo. Polecenie model trzyma dobrze, choć tło potrafi „dopowiedzieć” sobie sam.
Sensowny układ dla oszczędnych: klatkę startową robisz lokalnie w O1-Image, a animujesz ją w O1-Video przez API. Jak przygotować komputer do lokalnych modeli, opisałem w przewodniku lokalne AI, a O1-Image na tle innych otwartych modeli jest w rankingu otwartych modeli do obrazów. Jeśli koniecznie chcesz otwartego modelu wideo z czołówki, AA podaje link do wag tylko przy MiniMax H3 (o tym w porównaniu niżej) i przy MAGI-2.
Jak zacząć krok po kroku
W przeglądarce (vivago)
- Wejdź na vivago.ai/studio i załóż konto Free.
- Sprawdź, czy na liście modeli wideo jest HiDream-O1 Video (patrz sprzeczne komunikaty wyżej).
- Wgraj obraz startowy - najlepiej ostry kadr z wyraźnym obiektem, który ma się ruszyć.
- Opisz akcję po angielsku: co się dzieje, jaka fizyka, jaki dźwięk. Długość możesz zostawić modelowi.
- Wygeneruj i popraw polecenie. Płatny plan rozważ dopiero po udanej próbie.
Przez API HiHarness
- Załóż konto na hiharness.ai i wygeneruj klucz API.
- Wyślij żądanie POST z obrazem (URL albo Base64 bez prefiksu Data URL, 40 KB-20 MB).
- Zapisz
task_idz odpowiedzi. - Odpytuj endpoint wyników.
result.status = 1znaczy tylko, że zadanie się skończyło - o sukcesie mówitask_statuswsub_task_results: 0 kolejka, 1 sukces, 2 w toku, 3 błąd generowania, 4 odrzucone przez kontrolę bezpieczeństwa. - Pobierz plik z pola
url.
Przykładowe żądanie z dokumentacji HiHarness (klucz zastąp swoim, nie wklejaj go do publicznych repozytoriów):
curl --request POST 'https://hiharness.hidreamai.com/api/maas/gw/v1/videos/generations' \
--header 'Authorization: Bearer <YOUR_API_KEY>' \
--header 'Content-Type: application/json' \
--data-raw '{
"model_id": "HiDream-O1-Video-1.0",
"image": "https://example.com/input.png",
"prompt": "The subject turns toward the camera, with gentle cinematic motion",
"negative_prompt": "blur, distortion",
"request_id": "my-video-task-001"
}'Odpowiedź zawiera result.task_id. Wynik odbierasz tak:
curl --get 'https://hiharness.hidreamai.com/api/maas/gw/v1/videos/generations/results' \ --header 'Authorization: Bearer <YOUR_API_KEY>' \ --data-urlencode 'task_id=7aa15e3d-dcd6-4c27-9378-87ec97b2fbce'
Ciekawostka z dokumentacji: przykład zawiera negative_prompt, choć tabela parametrów go nie wymienia. Dokumentację odczytałem 11.10.2026. Gotowe polecenia pod ten tryb zebrałem w tekście co potrafi HiDream-O1-Video: przykłady.
Porównanie z rywalami
| Model | Elo I2V | Przedział 95% | USD/min (AA) | Tekst na wideo w AA | Na OpenRouterze (11.10) |
|---|---|---|---|---|---|
| MiniMax H3 Max | 1195 | 1186-1204 | 4,80 | tak (1130) | tak |
| MiniMax H3 | 1181 | 1173-1189 | 7,80 | tak, 768p (1137) | tak |
| Vidu Q4 Preview | 1179 | 1169-1189 | 5,04 | nie | nie |
| Gemini Omni Flash | 1178 | 1171-1185 | 6,00 | tak, wersja 1.1 (1113) | nie |
| Seedance 2.0 720p | 1176 | 1169-1183 | 9,07 | tak (1116) | tak |
| HiDream-O1-Video-1.0 | 1175 | 1165-1185 | 5,80 | nie | nie |
| Wan 3.0 | 1164 | 1156-1172 | 12,00 | tak, 1. miejsce (1156) | tak |
Ranking i ceny: Artificial Analysis, 11.10.2026. Obecność na OpenRouterze: lista modeli wideo z 11.10.2026. W jakości HiDream jest w tej samej grupie co H3, Vidu Q4, Gemini i Seedance. W cenie wypada trzeci po H3 Max i Vidu Q4. Przegrywa elastycznością: nie ma tekstu na wideo ani pośredników. Szczegóły: HiDream-O1-Video vs MiniMax H3 vs Vidu Q4. Własne porównanie kilku modeli na tych samych scenach robiłem w Arenie wideo (HiDreama tam nie było).
Dla kogo jest HiDream-O1-Video
- Dla tych, którzy animują gotowe kadry - zdjęcie produktu, ilustrację, klatkę z innego modelu. To jedyny tryb, ale robiony na poziomie czołówki.
- Dla scen z fizyką - odbicia, rzuty, napięcie, materiały. Na tym producent oparł całą prezentację.
- Dla użytkowników otwartego O1-Image - spójny zestaw: obraz lokalnie, ruch w chmurze.
Nie dla ciebie, jeśli:
- chcesz pisać tylko tekst - wybierz Wan 3.0 albo MiniMax H3 Max;
- potrzebujesz kontroli rozdzielczości, dźwięku i dokładnej długości - API tego nie daje;
- chcesz najtaniej przy najwyższym miejscu - H3 Max jest wyżej i tańszy.
Szerszy przegląd: generatory wideo AI - który wybrać.
Teksty w tej serii
Najczęstsze pytania
Czy HiDream-O1-Video robi wideo z tekstu?
Według zapowiedzi tak, ale publiczne API (HiHarness, odczyt 11.10.2026) przyjmuje tylko obraz z opcjonalnym poleceniem. Dlatego model nie występuje w rankingu tekstu na wideo Artificial Analysis.
Ile kosztuje HiDream-O1-Video?
Artificial Analysis podaje 5,80 USD za minutę, czyli ok. 0,48 USD za 5 s i ok. 0,97 USD za 10 s. Oficjalnego cennika HiDream nie znalazłem.
Czy HiDream-O1-Video jest za darmo?
vivago.ai ma plan Free, ale ile generacji O1-Video na nim zrobisz i czy model jest tam w ogóle dostępny, nie potwierdziłem. Komunikaty vivago z 30.09 i 9.10 są sprzeczne.
Czy można pobrać HiDream-O1-Video i uruchomić lokalnie?
Nie. Wag modelu wideo nie ma na Hugging Face ani GitHubie. Lokalnie uruchomisz HiDream-O1-Image (MIT), model obrazów z tej samej rodziny.
Czy HiDream-O1-Video ma dźwięk?
Zapowiedź opisuje natywny, zsynchronizowany dźwięk z ruchem ust. Dokumentacja API nie ma ani przełącznika audio, ani opisu ścieżki dźwiękowej, więc tego nie potwierdzam.
Jak długie klipy robi HiDream-O1-Video?
Zapowiedź: 5-20 s, długość dobiera model. W API masz dwie opcje: zostawić wybór modelowi albo wymusić dokładnie 10 s polem force_10s.
Czy HiDream-O1-Video działa po polsku?
Producent nie podaje listy języków ani dla poleceń, ani dla mowy. Polecenia najbezpieczniej pisać po angielsku. Polskiej mowy w tym modelu nie sprawdzałem.
Źródła i data sprawdzenia
- Artificial Analysis, ranking obrazu na wideo i tekstu na wideo (odczyt 11.10.2026)
- Komunikat HiDream, Media Outreach (17.09.2026)
- QbitAI i Jiemian (15.09.2026)
- TechNode o HiDream i finansowaniu (18.09.2026)
- Dokumentacja HiHarness: żądanie, wynik (odczyt 11.10.2026)
- vivago.ai, plany (11.10.2026)
- Komunikat o globalnym starcie vivago R1 (9.10.2026)
- OrcaRouter o rozjeździe API (10.10.2026), AlphaSignal (9.10.2026)
- HiDream-O1-Image na Hugging Face, konwersja FP8 (drbaph) (11.10.2026)
- Posty na X: Arena.ai, vivago.ai (30.09.2026)
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →