Claude for Startups i 100+ programów z darmowymi kredytami AI dla startupów i JDG Darmowe kredyty AI dla Twojej firmy Sprawdź, co dostaniesz
✨ Świeża dostawa•nowe kody na kinetyka.pl: Gemini Pro 18 mies. 170 zł•Cursor, ElevenLabs, Lovable i więcej, roczne plany AI w ułamku ceny Zobacz →
Przejdź do treści
Artykuły

HiDream-O1-Video: 6. miejsce w rankingu obrazu na wideo, cena i start

Model wideo HiDream.ai na 6. miejscu rankingu Artificial Analysis. Co obiecywała zapowiedź, co naprawdę jest w API, ile kosztuje i jak zacząć z Polski.

12 min czytania
Logo HiDream i napis HiDream O1-Video - przewodnik: 6. miejsce w rankingu obrazu na wideo

👁 117 przeczytań

// w skrócie
  • HiDream-O1-Video-1.0 zajmuje 6. miejsce w rankingu obrazu na wideo Artificial Analysis z wynikiem 1175 punktów Elo (przedział 1165-1185), odczyt z 11 października 2026.
  • Według danych Artificial Analysis model kosztuje 5,80 USD za minutę, co daje ok. 0,97 USD za 10-sekundowy klip generowany przez API HiHarness.
  • Zapowiedź z 15-17 września 2026 obiecywała wejście tekstowe, obrazowe i wideo, ale publiczne API HiHarness przyjmuje wyłącznie jeden obraz i opcjonalny prompt.

Strona aktualizowana na bieżąco. Stan na 11 października 2026.

HiDream-O1-Video-1.0 to model wideo pekińskiej firmy HiDream.ai, który 11 października 2026 zajmuje 6. miejsce w rankingu obrazu na wideo Artificial Analysis (1175 punktów Elo, przedział 1165-1185). Według AA kosztuje 5,80 USD za minutę, taniej niż większość czołówki. Haczyk: zapowiedź mówiła o tekście, obrazie i wideo na wejściu, a publiczne API przyjmuje tylko jeden obraz i opcjonalne polecenie.

Stan na 11 października 2026

  • Premiera: 15 września 2026 w Chinach (nazwa HD-V1), 17 września komunikat po angielsku. AA podaje datę wydania 28 sierpnia 2026.
  • Ranking: 6. miejsce w AA-Video-I2V v1.0, 1175 Elo, 3231 porównań. W rankingu tekstu na wideo go nie ma.
  • Publiczne API: tylko obraz na wideo (HiHarness). Tekst na wideo, wejście wideo i referencje są na razie tylko w materiałach marketingowych.
  • Cena: 5,80 USD za minutę wg AA. Oficjalnego cennika HiDream nie znalazłem.
  • Gdzie: vivago.ai (aplikacja HiDream) i API HiHarness. Nie ma go na fal.ai, Replicate ani OpenRouterze.
  • Otwarte wagi: model wideo nie. Otwarty (MIT) jest siostrzany model obrazów HiDream-O1-Image.
  • Mój test: klipów wideo nie mam, bo O1-Video nie jest dostępny u pośredników ani w otwartych wagach. Sprawdziłem za to otwarty model obrazów HiDream-O1-Image (fal.ai, 11.10) - wyniki w sekcji o otwartych wagach.
6.miejsce w rankingu obrazu na wideo AA
1175punktów Elo (przedział 1165-1185)
5,80USD za minutę wg AA
5-20 sdługość klipu wg zapowiedzi

Co to jest HiDream-O1-Video i kto go robi

HiDream.ai (po chińsku 智象未来) to firma z pekińskiej dzielnicy Haidian, zarejestrowana w marcu 2023. Założył ją i prowadzi dr Mei Tao, który przez 12 lat pracował w Microsoft Research Asia, a potem był wiceprezesem ds. widzenia komputerowego w JD.com. Dyrektorem technicznym jest Yao Ting. Firma jest znana z modeli obrazów (HiDream-I1, E1, O1-Image) i aplikacji vivago.ai.

Pieniądze nie są tu problemem. Według TechNode (18.09.2026) w lipcu 2026 HiDream zamknął rundę C na 1,5 mld juanów (ok. 221,6 mln USD) i uzyskał status jednorożca. Od kwietnia 2026 zebrał łącznie ponad 2,1 mld juanów. Firma deklaruje ponad 30 mln użytkowników, ponad 40 000 klientów firmowych i ponad 400 mln juanów zakontraktowanego przychodu w I kwartale 2026.

O1-Video-1.0 to pierwszy model wideo z rodziny O1. Producent opisuje go jako „natywnie wszechmodalny” (native omnimodal) i stawia na trzy rzeczy:

  • Fizykę - grawitacja, bezwładność, zderzenia, odkształcenia, materiały, światło i ciągłość przestrzeni.
  • Planowanie przed generowaniem - model najpierw ustala długość ujęcia, scenografię, ruch postaci, mimikę, kompozycję, ruch kamery, dialog i dźwięk.
  • Długość dobieraną przez model - od 5 do 20 s, zależnie od akcji i tempa sceny, zamiast sztywnych 5 czy 10 s.

Model trenowano metodą Diffusion RL z multimodalnym modelem nagrody, na architekturze UiT (Unified Transformer) HiDream. Pracy naukowej o modelu wideo firma nie opublikowała - praca na arXiv (2605.11061) dotyczy O1-Image.

Miejsce w rankingu Artificial Analysis

Ranking Artificial Analysis powstaje ze ślepych porównań: oceniający widzą dwa klipy z tego samego materiału i wybierają lepszy. HiDream-O1-Video występuje tylko w tabeli obrazu na wideo (AA-Video-I2V v1.0). Ma 1175 punktów, a 95-procentowy przedział ufności to 1165-1185. Odczytałem ranking 11 października 2026.

MiejsceModelFirmaEloPrzedział 95%USD za minutę (AA)
1MiniMax H3 MaxMiniMax (wg AA: Fal)11951186-12044,80
2MiniMax H3MiniMax11811173-11897,80
3Vidu Q4 PreviewVidu (ShengShu)11791169-11895,04
4Gemini Omni FlashGoogle11781171-11856,00
5Seedance 2.0 720pByteDance11761169-11839,07
6HiDream-O1-Video-1.0HiDream11751165-11855,80
7Wan 3.0Alibaba11641156-117212,00
8HappyHorse-1.1Alibaba-ATH11041097-11119,90

Dane: Artificial Analysis, obraz na wideo, odczyt 11.10.2026. Przedziały zaokrągliłem do pełnych punktów.

Elo w rankingu obrazu na wideo (AA, 11.10.2026)
MiniMax H3 Max1195
MiniMax H31181
Vidu Q4 Preview1179
Gemini Omni Flash1178
Seedance 2.0 720p1176
HiDream-O1-Video1175
Wan 3.01164
HappyHorse-1.11104

Skala zaczyna się od 1000 punktów (pasek = (Elo - 1000) / 2 procent), żeby było widać różnice. Co z tego wynika:

  • Miejsca 2-6 to remis statystyczny. HiDream traci do MiniMax H3 6 punktów, a przedziały ufności wszystkich pięciu modeli nachodzą na siebie.
  • Wyraźnie wyżej jest tylko H3 Max (1195). Górna granica HiDreama (1185) nie sięga dolnej granicy H3 Max (1186).
  • HiDream ma najmniej porównań w czołówce - 3231, przy 15 721 u Seedance 2.0. Dlatego jego przedział jest szeroki.
  • Przy premierze było wyżej. HiDream ogłaszał 4. miejsce w wariancie AA „I2V With Audio”, a Arena.ai 30 września dała mu 7. miejsce (1456 pkt) w swoim rankingu obrazu na wideo.

Parametry: zapowiedź a publiczne API

To najważniejsza tabela w tym tekście. Materiały prasowe z 15 i 17 września opisują model, który przyjmuje tekst, obraz i wideo. Dokumentacja API na HiHarness opisuje coś węższego: „single-image-to-video model”. Zestawiłem obie wersje punkt po punkcie.

CechaZapowiedź (15-17.09.2026)Publiczne API HiHarness (odczyt 11.10.2026)
Wejścietekst, obraz, wideojeden obraz (wymagany) + opcjonalny prompt i negative_prompt
Tekst na wideotaknie
Wejście wideo, edycja, referencjetaknie
Długość5-20 s, dobierana przez modeldobierana przez model albo dokładnie 10 s (force_10s)
Rozdzielczość1080pbrak parametru; proporcje jak obraz wejściowy
Dźwięknatywny, zsynchronizowany, ruch ust do mowybrak przełącznika i brak opisu w dokumentacji
Obraz wejściowy-URL albo Base64, od 40 KB do 20 MB
fps, limit promptu, językinie podanonie podano

Źródła: komunikat HiDream (17.09.2026), QbitAI (15.09.2026), dokumentacja żądania HiHarness. Ten sam rozjazd opisały OrcaRouter (10.10) i AlphaSignal (9.10). Więcej o tym w tekście HiDream-O1-Video w API robi tylko wideo z obrazu.

Dokumentacja HiHarness: HiDream-O1-Video-1.0 opisany jako model single-image-to-video
Dokumentacja HiHarness, zrzut z 11 października 2026: „single-image-to-video model”, jeden obraz wejściowy, długość dynamiczna albo stałe 10 s.

Ile kosztuje HiDream-O1-Video

HiDream nie publikuje cennika API dla tego modelu - tak twierdzi też OrcaRouter, a ja oficjalnej stawki nie znalazłem. Jedyna liczba to 5,80 USD za minutę z tabeli Artificial Analysis (powtarza ją AlphaSignal). Z niej policzyłem orientacyjne koszty klipów:

Długość klipuKoszt przy 5,80 USD/minUwagi
1 sok. 0,097 USDstawka sekundowa
5 sok. 0,48 USDminimalna długość z zapowiedzi
10 sok. 0,97 USDtyle daje force_10s
20 sok. 1,93 USDmaksimum z zapowiedzi

Uwaga: gdy model sam dobiera długość, nie wiesz z góry, ile zapłacisz. Jeśli budżet ma być przewidywalny, ustaw force_10s. Jak to się ma do innych modeli, zebrałem w tekście ile kosztuje sekunda wideo AI.

Plany vivago.ai

W aplikacji vivago płacisz abonamentem w dolarach. Ceny ze strony vivago.ai (stan z 11.10.2026):

PlanPrzy płatności rocznejPrzy płatności miesięcznej
Free0 USD0 USD
Basic7,90 USD / mies.12,90 USD
Plus19,90 USD / mies.39,90 USD
Pro59,90 USD / mies.99,90 USD

Ile kredytów kosztuje jedna generacja O1-Video w vivago, nie potwierdziłem - strona tego nie podaje przed zalogowaniem.

Gdzie jest dostępny z Polski

  • vivago.ai - aplikacja internetowa HiDream. 30 września konto @vivago_ai napisało, że O1-Video jest „now available in vivago R1 Studio”. Ale komunikat o globalnym starcie vivago R1 z 9 października mówi, że O1-Video dojdzie do R1 „in an upcoming update”. Te dwie informacje się wykluczają; zanim kupisz plan, sprawdź na koncie Free, czy model jest na liście.
  • HiHarness (hiharness.ai) - platforma API HiDream. Model ma tam ID HiDream-O1-Video-1.0. Czy rejestracja i płatność działają z Polski, nie potwierdziłem; komunikat R1 mówi o dostępności „globalnej”, ale dotyczy aplikacji, nie API.
  • Pośrednicy - brak. Sprawdzone 11.10: nie ma go na fal.ai, Replicate, WaveSpeed, OpenRouterze (lista 30 modeli wideo w /api/v1/videos/models), Segmind, reAPI, kie, Pollo ani Higgsfield.

Otwarte wagi i co uruchomisz lokalnie

Nie przepłacaj za te subskrypcje

Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.

Zobacz, co jest dostępne

Modelu wideo nie pobierzesz. 11 października nie było go ani na Hugging Face HiDream-ai, ani na GitHubie firmy. To model zamknięty, dostępny tylko przez usługi HiDream.

Otwarty jest za to model obrazów z tej samej rodziny, HiDream-O1-Image, na licencji MIT:

  • Warianty Full i Dev z 8 maja 2026 oraz Dev-2604 z 14 maja 2026 (karta modelu, kod).
  • Hugging Face podaje 9 mld parametrów; obrazy do 2048 x 2048.
  • Wymagania: oficjalnie tylko „CUDA GPU”. Konwersja społeczności (drbaph) podaje ok. 10 GB VRAM w FP8 i 17-20 GB w BF16/FP16. Tych liczb sam nie mierzyłem; wynika z nich, że karta 24 GB powinna wystarczyć.
  • Wariant Pro (ponad 200 mld parametrów) jest zamknięty.

Mój test HiDream-O1-Image (obraz, nie wideo)

Uprzedzam: to test modelu obrazowego O1-Image, nie O1-Video. Modelu wideo nie ma u pośredników ani w otwartych wagach, więc własnych klipów nie mam. O1-Image (pełną wersję) uruchomiłem 11 października 2026 na fal.ai (endpoint fal-ai/hidream-o1-image): 50 kroków, guidance 5, seed 20261011. fal liczy 0,01 USD za megapiksel, więc dwa obrazy kosztowały mnie ok. 0,02 USD. Sprawdzałem dwie rzeczy: polskie znaki w napisach i trzymanie się polecenia.

HiDream-O1-Image: witryna kawiarni z szyldem KAWIARNIA POD LIPÁ i tablicą z ceną 12 zł
Mój test HiDream-O1-Image (fal.ai, 11.10.2026). Prosiłem o szyld „KAWIARNIA POD LIPĄ” i tablicę „ŻÓŁTA ŁÓDŹ 12 ZŁ”. Wyszło „KAWIARNIA POD LIPÁ” (Á zamiast Ą) i „ŻÓŁTA ŁÓDŻ 12 ZŁ” (Ż zamiast Ź). Reszta liter poprawna, zdjęcie realistyczne.
HiDream-O1-Image: portret baristki z krótkimi ciemnymi kręconymi włosami w oliwkowym fartuchu, w tle kawiarnia
Mój test HiDream-O1-Image (fal.ai, 11.10.2026). Portret baristki z krótkimi ciemnymi kręconymi włosami w oliwkowym fartuchu. Prosiłem o gładkie tło („plain background”), a model dał pełne wnętrze kawiarni. Poza tym zgodnie z opisem.

Wniosek: polskie znaki są prawie dobre, ale nie w 100% - z ośmiu liter z polskimi znakami dwie wyszły źle. Szyld z napisem trzeba sprawdzić litera po literze, zanim zrobisz z niego klatkę startową do wideo. Polecenie model trzyma dobrze, choć tło potrafi „dopowiedzieć” sobie sam.

Sensowny układ dla oszczędnych: klatkę startową robisz lokalnie w O1-Image, a animujesz ją w O1-Video przez API. Jak przygotować komputer do lokalnych modeli, opisałem w przewodniku lokalne AI, a O1-Image na tle innych otwartych modeli jest w rankingu otwartych modeli do obrazów. Jeśli koniecznie chcesz otwartego modelu wideo z czołówki, AA podaje link do wag tylko przy MiniMax H3 (o tym w porównaniu niżej) i przy MAGI-2.

Jak zacząć krok po kroku

W przeglądarce (vivago)

  1. Wejdź na vivago.ai/studio i załóż konto Free.
  2. Sprawdź, czy na liście modeli wideo jest HiDream-O1 Video (patrz sprzeczne komunikaty wyżej).
  3. Wgraj obraz startowy - najlepiej ostry kadr z wyraźnym obiektem, który ma się ruszyć.
  4. Opisz akcję po angielsku: co się dzieje, jaka fizyka, jaki dźwięk. Długość możesz zostawić modelowi.
  5. Wygeneruj i popraw polecenie. Płatny plan rozważ dopiero po udanej próbie.

Przez API HiHarness

  1. Załóż konto na hiharness.ai i wygeneruj klucz API.
  2. Wyślij żądanie POST z obrazem (URL albo Base64 bez prefiksu Data URL, 40 KB-20 MB).
  3. Zapisz task_id z odpowiedzi.
  4. Odpytuj endpoint wyników. result.status = 1 znaczy tylko, że zadanie się skończyło - o sukcesie mówi task_status w sub_task_results: 0 kolejka, 1 sukces, 2 w toku, 3 błąd generowania, 4 odrzucone przez kontrolę bezpieczeństwa.
  5. Pobierz plik z pola url.

Przykładowe żądanie z dokumentacji HiHarness (klucz zastąp swoim, nie wklejaj go do publicznych repozytoriów):

curl --request POST 'https://hiharness.hidreamai.com/api/maas/gw/v1/videos/generations' \
  --header 'Authorization: Bearer <YOUR_API_KEY>' \
  --header 'Content-Type: application/json' \
  --data-raw '{
    "model_id": "HiDream-O1-Video-1.0",
    "image": "https://example.com/input.png",
    "prompt": "The subject turns toward the camera, with gentle cinematic motion",
    "negative_prompt": "blur, distortion",
    "request_id": "my-video-task-001"
  }'

Odpowiedź zawiera result.task_id. Wynik odbierasz tak:

curl --get 'https://hiharness.hidreamai.com/api/maas/gw/v1/videos/generations/results' \
  --header 'Authorization: Bearer <YOUR_API_KEY>' \
  --data-urlencode 'task_id=7aa15e3d-dcd6-4c27-9378-87ec97b2fbce'

Ciekawostka z dokumentacji: przykład zawiera negative_prompt, choć tabela parametrów go nie wymienia. Dokumentację odczytałem 11.10.2026. Gotowe polecenia pod ten tryb zebrałem w tekście co potrafi HiDream-O1-Video: przykłady.

Porównanie z rywalami

ModelElo I2VPrzedział 95%USD/min (AA)Tekst na wideo w AANa OpenRouterze (11.10)
MiniMax H3 Max11951186-12044,80tak (1130)tak
MiniMax H311811173-11897,80tak, 768p (1137)tak
Vidu Q4 Preview11791169-11895,04nienie
Gemini Omni Flash11781171-11856,00tak, wersja 1.1 (1113)nie
Seedance 2.0 720p11761169-11839,07tak (1116)tak
HiDream-O1-Video-1.011751165-11855,80nienie
Wan 3.011641156-117212,00tak, 1. miejsce (1156)tak

Ranking i ceny: Artificial Analysis, 11.10.2026. Obecność na OpenRouterze: lista modeli wideo z 11.10.2026. W jakości HiDream jest w tej samej grupie co H3, Vidu Q4, Gemini i Seedance. W cenie wypada trzeci po H3 Max i Vidu Q4. Przegrywa elastycznością: nie ma tekstu na wideo ani pośredników. Szczegóły: HiDream-O1-Video vs MiniMax H3 vs Vidu Q4. Własne porównanie kilku modeli na tych samych scenach robiłem w Arenie wideo (HiDreama tam nie było).

Dla kogo jest HiDream-O1-Video

  • Dla tych, którzy animują gotowe kadry - zdjęcie produktu, ilustrację, klatkę z innego modelu. To jedyny tryb, ale robiony na poziomie czołówki.
  • Dla scen z fizyką - odbicia, rzuty, napięcie, materiały. Na tym producent oparł całą prezentację.
  • Dla użytkowników otwartego O1-Image - spójny zestaw: obraz lokalnie, ruch w chmurze.

Nie dla ciebie, jeśli:

  • chcesz pisać tylko tekst - wybierz Wan 3.0 albo MiniMax H3 Max;
  • potrzebujesz kontroli rozdzielczości, dźwięku i dokładnej długości - API tego nie daje;
  • chcesz najtaniej przy najwyższym miejscu - H3 Max jest wyżej i tańszy.

Szerszy przegląd: generatory wideo AI - który wybrać.

Najczęstsze pytania

Czy HiDream-O1-Video robi wideo z tekstu?

Według zapowiedzi tak, ale publiczne API (HiHarness, odczyt 11.10.2026) przyjmuje tylko obraz z opcjonalnym poleceniem. Dlatego model nie występuje w rankingu tekstu na wideo Artificial Analysis.

Ile kosztuje HiDream-O1-Video?

Artificial Analysis podaje 5,80 USD za minutę, czyli ok. 0,48 USD za 5 s i ok. 0,97 USD za 10 s. Oficjalnego cennika HiDream nie znalazłem.

Czy HiDream-O1-Video jest za darmo?

vivago.ai ma plan Free, ale ile generacji O1-Video na nim zrobisz i czy model jest tam w ogóle dostępny, nie potwierdziłem. Komunikaty vivago z 30.09 i 9.10 są sprzeczne.

Czy można pobrać HiDream-O1-Video i uruchomić lokalnie?

Nie. Wag modelu wideo nie ma na Hugging Face ani GitHubie. Lokalnie uruchomisz HiDream-O1-Image (MIT), model obrazów z tej samej rodziny.

Czy HiDream-O1-Video ma dźwięk?

Zapowiedź opisuje natywny, zsynchronizowany dźwięk z ruchem ust. Dokumentacja API nie ma ani przełącznika audio, ani opisu ścieżki dźwiękowej, więc tego nie potwierdzam.

Jak długie klipy robi HiDream-O1-Video?

Zapowiedź: 5-20 s, długość dobiera model. W API masz dwie opcje: zostawić wybór modelowi albo wymusić dokładnie 10 s polem force_10s.

Czy HiDream-O1-Video działa po polsku?

Producent nie podaje listy języków ani dla poleceń, ani dla mowy. Polecenia najbezpieczniej pisać po angielsku. Polskiej mowy w tym modelu nie sprawdzałem.

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.
Piotr Olszewski

Piotr Olszewski

AUTOR I WYDAWCA

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony

🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok Lovable Pro 450 zł/rok Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× ‹ powiększenie ›