✨ Świeża dostawa•nowe kody na kinetyka.pl: Gemini Pro 18 mies. 170 zł•Cursor, ElevenLabs, Lovable i więcej, roczne plany AI w ułamku ceny Zobacz →
Przejdź do treści
Artykuły

Muse Spark 1.3 od Mety: benchmarki, cena i dostęp w Polsce

Najszybszy model w czołówce Artificial Analysis. W moim teście po polsku 75,5 pkt za 0,10 USD - świetny przekład, fatalny opis produktu.

8 min czytania
Muse Spark 1.3 od Mety: benchmarki, cena i dostęp w Polsce

👁 115 przeczytań

// w skrócie
  • Muse Spark 1.3 osiągnął 48 pkt w indeksie Artificial Analysis i 214-252 tokeny na sekundę, co czyni go najszybszym modelem w czołówce rankingu.
  • Model kosztuje 1,25 USD za milion tokenów wejścia, a tańsza wersja Contributor (0,10 USD) wymaga zgody na trenowanie modeli Mety na zapytaniach użytkownika.
  • W teście po polsku Muse Spark 1.3 zdobył 75,5 pkt na 100, wypadając słabiej od GPT-6 Luna (81,8) i Qwen3.8 Max (77,5), z najniższą naturalnością w stawce (5,63 na 10).

Muse Spark 1.3 to najnowszy model językowy Mety i najszybszy model w czołówce rankingu Artificial Analysis: 214-252 tokenów na sekundę przy 45-48 punktach w indeksie inteligencji. Wyszedł 2 września 2026, kosztuje 1,25 USD za milion tokenów wejścia i ma tańszą wersję, za którą płacisz swoimi danymi. Przepuściłem go przez moje Laboratorium: w 13 zadaniach po polsku zdobył 75,5 pkt na 100 za 0,10 USD. Poniżej wyniki z fragmentami odpowiedzi, benchmarki, ceny w złotówkach, poziomy rozumowania i to, jak dostać się do modelu z Polski.

W skrócie

Muse Spark 1.3 w wariancie max ma 48 pkt w indeksie Artificial Analysis - najwięcej spośród modeli spoza Anthropic i OpenAI (27 września 2026) - i generuje tekst ponad dwa razy szybciej niż Claude Opus 5.5. Kosztuje 1,25 / 4,25 USD za milion tokenów, a wersja Contributor 0,10 / 0,20 USD, w zamian za zgodę na trenowanie modeli Mety na twoich zapytaniach. W moim teście po polsku dostał 75,5 pkt: mniej niż Qwen3.8 Max (77,5) i GPT-6 Luna (81,8), więcej niż MiMo-V2.6-Pro i GLM-5.3. Wynik podnoszą reguły i czysta typografia, a sędziowie ocenili jego teksty niżej niż teksty MiMo (6,78 wobec 7,12 na 10), z najniższą naturalnością w stawce (5,63). Minusy: długo czeka się na pierwszy token (25-35 s w pomiarach AA), a dostęp do API z Polski nie jest oficjalnie potwierdzony.

48pkt w indeksie AA (max), 45 w xhigh
75,5pkt w moim teście pisania po polsku
0,10 USDkoszt 13 zadań po polsku
1,25 / 4,25 USDza milion tokenów wejścia / wyjścia

Czym jest Muse Spark

Muse Spark to rodzina modeli z Meta Superintelligence Labs. Pierwsza wersja z kwietnia 2026 zasiliła asystenta w aplikacji Meta AI i na meta.ai. W lipcu Meta otworzyła API dla Muse Spark 1.1, a 2 września wydała wersję 1.3. Model jest zamknięty i multimodalny, a według Mety służy głównie do długich zadań agentowych, programowania i pracy wielu agentów naraz.

Meta wymienia cztery zmiany względem 1.2: lepszą pracę agentową (dopytywanie, wielozadaniowość), programowanie z „~20% mniej wywołań narzędzi i ~25% mniej tokenów”, lepsze trzymanie się poleceń przy długich zadaniach i większą odporność na ataki. W tekście wpisu nie podaje liczb z benchmarków, tylko wykres porównawczy z GPT i Claude’em. O polszczyźnie ani innych językach w ogłoszeniu nie ma ani słowa.

Benchmarki: gdzie stoi Muse Spark 1.3

Niezależne liczby daje Artificial Analysis. Jego indeks (wersja 4.3.2) składa się z 10 testów: zadań agentowych (30%), programowania (20%), rozumowania naukowego (20%) i wiedzy ogólnej (30%).

ModelIndeks AATokeny/sKoszt zadania AA
Claude Opus 5.5 (max)58-5,98 USD
GPT-6 Astra (max)53633,26 USD
Muse Spark 1.3 (max)482141,60 USD
GPT-6 Sol (max)48861,06 USD
MiMo-V2.6-Pro46440,13 USD
Muse Spark 1.3 (xhigh)452521,37 USD
Qwen3.8 Max (0902)45395,41 USD
GLM-5.3 (max)45842,01 USD

Dane z 27 września 2026. Trzy rzeczy z tej tabeli:

  • Prędkość. 214-252 tokeny na sekundę to najwięcej w pierwszej dwudziestce piątce indeksu. Claude Opus 5.5 w wariancie xhigh robi 89.
  • Gadatliwość. Przy indeksie Muse Spark wygenerował 170 mln tokenów wyjścia, przy medianie 88 mln. Część przewagi w szybkości zjada więc długość odpowiedzi.
  • Opóźnienie startu. Na pierwszy token czeka się według AA od 25 do 35 sekund, zależnie od pomiaru. Przy czacie na żywo to dużo, przy zadaniach w tle nie ma znaczenia.

Według AA najmocniej wypada w zadaniach agentowych (AA-Briefcase, GDPval-AA, AutomationBench). Porównanie mniej znanych modeli z czołówki, z wynikami mojego testu po polsku dla wszystkich czterech, jest w tekście Mniej znane modele AI: MiMo, Qwen3.8 Max, GLM-5.3 i Muse Spark.

Ceny: standard i Contributor

WersjaWejście USDZ pamięci podręcznej USDWyjście USDWejście złWyjście zł
Muse Spark 1.31,250,154,254,8216,39
Muse Spark 1.3 Contributor0,100,0020,200,390,77
Claude Opus 5.5, dla porównania4,00-20,0015,4377,14

Ceny Mety za milion tokenów, bez VAT, przeliczone po kursie NBP 3,857 zł za dolara. Contributor to ten sam model za ułamek ceny, ale Meta pisze wprost (tłumaczenie moje), że rabat jest „w zamian za zgodę na użycie twoich zapytań i odpowiedzi do trenowania przyszłych modeli Mety”. Nie ma w nim poziomu rozumowania max. Do danych klientów, umów czy czegokolwiek poufnego nie użyłbym tej wersji. To moja opinia.

Poziomy rozumowania

API przyjmuje parametr reasoning_effort z wartościami minimal, low, medium, high, xhigh i max. Wartość „none” zwraca błąd 400, więc rozumowania nie da się wyłączyć. Artificial Analysis mierzy dwa najwyższe poziomy: xhigh daje 45 pkt i 1,37 USD za zadanie, max - 48 pkt i 1,60 USD. W moim Laboratorium wszystkie modele dostają effort=low, żeby porównanie było równe.

Mój test po polsku: 75,5 pkt

Muse Spark 1.3 przeszedł te same 13 zadań co Qwen3.8 Max, GLM-5.3 i MiMo-V2.6-Pro: 9 zadań pisarskich, dwie korekty i dwa quizy o Polsce. Ustawienia jak u wszystkich w moim rankingu AI do pisania po polsku: OpenRouter, effort=low, te same limity tokenów. Odpowiedzi ocenili w ciemno trzej sędziowie (Claude Opus 5.5, GPT-6 Sol, Gemini 3.1 Pro), a obok Muse Sparka w puli były cztery kotwice z pierwszej rundy. Ich wyniki różniły się od tamtych o 1,0-1,7 pkt, a kolejność się nie zmieniła. Po kalibracji do skali pierwszej rundy Muse ma 75,3 pkt.

ModelWynikSędziowie (1-10)NaturalnośćRegułyKorekta trudnaQuiz trudnyKoszt 13 zadań
Claude Opus 5.591,89,228,5025/2630/3048/480,3716 USD (1,43 zł)
GPT-6 Luna81,88,067,2824/2629/3048/480,0041 USD (0,02 zł)
Qwen3.8 Max77,57,907,2626/2630/3048/480,2357 USD (0,91 zł)
Muse Spark 1.375,56,785,6325/2629/3048/480,1012 USD (0,39 zł)
GLM-5.362,76,225,8123/2626/3046/480,0304 USD (0,12 zł)

Wszystkie wyniki z tej samej puli oceniania, 27 września 2026. Wynik łączny to w 70% średnia sędziów, w 20% reguły z poleceń i w 10% higiena tekstu. W rankingu 16 modeli Muse Spark z wynikiem 75,3 zająłby 11. miejsce, tuż za Qwen3.8 Max (75,9) i przed DeepSeek V4 Pro (74,1). Wynik Qwena zawiera jedną odpowiedź z drugiej próby z wyższym limitem; przy równych limitach Qwen miałby w tej puli 68,7 pkt, czyli mniej niż Muse.

Ważne zastrzeżenie: Muse zawdzięcza sporą część wyniku higienie tekstu. Zdanie urwane - brak zakończenia konstrukcji.dnego zwrotu z listy waty, więc w tej części dostał 88 na 100. Same oceny sędziów (6,78) ma niższe niż MiMo (7,12) i Qwen (7,90). Licząc tylko sędziów i reguły, byłby za MiMo.

Muse Spark 1.3: średnia sędziów w zadaniach (1-10)
Tłumaczenie8,67
Post na LinkedIn8,56
Inflacja dla dziecka8,44
Opowiadanie7,67
Tytuły SEO7,00
Mail6,78
Streszczenie6,56
Artykuł3,89
Opis produktu3,44

Fragmenty odpowiedzi

Nie przepłacaj za te subskrypcje

Prowadzę sklep z rocznymi dostępami do narzędzi AI - te same konta, o których piszę wyżej, tylko taniej niż w cenniku producenta.

Zobacz, co jest dostępne

Najlepiej wyszedł przekład newslettera pełnego angielskich idiomów (8,67, przy 9,50 u Opusa):

„Bądźmy szczerzy: wdrożenie nowego klienta to nie fizyka kwantowa, ale ostatnio za bardzo szliśmy na skróty. (…) To był dla nas zimny prysznic.”

Sędziowie wytknęli tu tylko „straciliśmy z radaru trzy duże konta”, co zaciera, że klienci odeszli. Dobrze wypadł też post na LinkedIn, z trafnym „powtarzalność w niepowtarzalnym rzemiośle”.

Najgorszy był opis czajnika z karty produktu (3,44). Muse dopchnął akapit do wymaganej długości, powtarzając całą specyfikację drugi raz w jednym zdaniu:

„Pojemność wynosi 1,7 l, moc wynosi 2200 W, regulacja temperatury jest od 40 do 100 °C co 10 °C, funkcja podtrzymania temperatury wynosi 30 minut…”

W artykule o rachunkach za prąd (3,89) dopisał „(to przykład)” 20 razy i wstawił tureckie słowo w polską odmianę: „za, na przykład, 20 zł (to przykład ceny, nie gerçekowa cena rynkowa)”. Artykuł był też za długi - to jedyna złamana reguła w całym teście (25 z 26).

Poza pisaniem Muse zrobił resztę niemal bezbłędnie: łatwa korekta 22 z 22, trudna 29 z 30, oba quizy o Polsce w całości (46 z 46 i 48 z 48). Nie oddał ani jednej pustej odpowiedzi.

Szybki model, który długo myśli

Mimo effort=low Muse Spark sporo myślał: 17,2 tys. tokenów rozumowania na 22,7 tys. wszystkich tokenów wyjścia, czyli 76%. Dlatego 9 zadań pisarskich zajęło mu 135 sekund, prawie tyle co Claude’owi Opus 5.5 (133 s), mimo prędkości z tabeli AA. Cały test 13 zadań kosztował 0,1012 USD (0,39 zł), 3,7 razy mniej niż w Opusie i 25 razy więcej niż w GPT-6 Lunie. Wersji Contributor nie testowałem.

Do czego bym go użył: korekta, przekłady i zadania z twardymi regułami, bo tam był prawie bezbłędny. Do tekstów, które mają brzmieć naturalnie po polsku, wybrałbym GPT-6 Lunę - wyższy wynik za 1/25 ceny. To moja opinia. Asystent Meta AI działa w Polsce od 2025 roku, ale Meta nie podaje, na którym modelu; jak z niego korzystać, opisałem w tekście Meta AI: co to jest i gdzie działa.

Jak dostać się do Muse Spark z Polski

  • OpenRouter - meta/muse-spark-1.3, jedynym dostawcą jest Meta, cena jak u producenta. Wymaga potwierdzenia wieku 18+ w ustawieniach konta.
  • Meta Model API (dev.meta.ai) - Meta pisze o publicznym podglądzie z „rozszerzonym dostępem globalnym”, ale nie publikuje listy krajów. Użytkownicy z Europy zgłaszali we wrześniu komunikat o niedostępności w regionie. Z Polski tego nie potwierdziłem.
  • Muse Code - agent do programowania na macOS i Linuksa, w którym Meta udostępniła wersję 1.3 w dniu premiery. Opisywałem go w sierpniu.
  • Aplikacja Muse (agent osobisty, 8 września) - plany Free, Power za 20 USD i Maximum za 100 USD miesięcznie, według relacji prasowych tylko w USA i dla pełnoletnich. O prywatności tej aplikacji pisałem w recenzji asystenta Muse.

Najczęstsze pytania

Ile kosztuje Muse Spark 1.3?

1,25 USD (4,82 zł) za milion tokenów wejścia i 4,25 USD (16,39 zł) za milion wyjścia, bez VAT. Wersja Contributor kosztuje 0,10 / 0,20 USD, ale Meta może na niej trenować swoje modele.

Czy Muse Spark 1.3 jest dostępny w Polsce?

Przez OpenRouter tak, po potwierdzeniu wieku 18+ w ustawieniach konta (wynika to z komunikatu błędu, który dostałem). Meta nie podaje listy krajów dla swojego API, a aplikacja Muse działa tylko w USA.

Czy Muse Spark 1.3 dobrze pisze po polsku?

Poprawnie, ale sztywno: 75,5 pkt na 100 w moim teście, 7,56 na 10 za poprawność i 5,63 za naturalność. Najlepiej wyszedł mu przekład z idiomami (8,67), najgorzej opis produktu (3,44).

Czy Muse Spark 1.3 jest open source?

Nie, wagi są zamknięte. Otwarte wagi Meta wydała dla mniejszego Muse Glimmer 30B.

Czy Muse Spark jest lepszy od GPT-6 Sol?

W indeksie Artificial Analysis remisują: po 48 pkt w wariancie max. Muse Spark jest ponad dwa razy szybszy (214 wobec 86 tokenów/s), GPT-6 Sol tańszy w przeliczeniu na zadanie (1,06 wobec 1,60 USD).

Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →

Źródła i data sprawdzenia

Premiera i zmiany: wpis Meta o Muse Spark 1.3. Ceny i Contributor: cennik Meta Model API. Kontekst i rozumowanie: lista modeli i dokumentacja rozumowania. Dostępność API: strona Meta Model API. Aplikacja Muse: TechCrunch. Indeks, prędkość, koszt zadania i liczba tokenów: Artificial Analysis i ranking modeli. Wyniki, fragmenty i koszty testu po polsku to moje pomiary przez OpenRouter (metoda: Laboratorium Promptowego), wymóg potwierdzenia wieku - komunikat OpenRoutera przy pierwszej próbie. Sprawdzone 27 września 2026.

// Newsletter

Cały tydzień w AI, w jednym mailu

Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.

Zapisz się za darmo →
Za darmo. Wypisujesz się jednym kliknięciem.

Najczęstsze pytania

Ile kosztuje Muse Spark 1.3 w złotówkach?

Standardowa wersja kosztuje 4,82 zł za milion tokenów wejścia i 16,39 zł za milion tokenów wyjścia. Tańsza wersja Contributor to 0,39 zł za wejście i 0,77 zł za wyjście, ale Meta używa tych danych do trenowania swoich modeli.

Czy Muse Spark 1.3 jest dostępny w Polsce?

Dostęp przez OpenRouter (meta/muse-spark-1.3) jest możliwy, a cena jest taka sama jak u producenta. Meta Model API deklaruje rozszerzony dostęp globalny, ale użytkownicy z Europy zgłaszali we wrześniu 2026 komunikat o niedostępności w regionie.

Jak szybko działa Muse Spark 1.3 w porównaniu do Claude Opus 5.5?

Muse Spark 1.3 generuje 214-252 tokeny na sekundę, podczas gdy Claude Opus 5.5 w wariancie xhigh osiąga 89 tokenów na sekundę. Jednak na pierwszy token czeka się od 25 do 35 sekund, co przy czacie na żywo jest odczuwalnym opóźnieniem.

Czy Muse Spark 1.3 dobrze pisze po polsku?

W 13 zadaniach po polsku model uzyskał 75,5 pkt na 100 i ocenę sędziów 6,78 na 10, z najniższą naturalnością w stawce (5,63). Dobrze radził sobie z korektą i przekładami, ale w opisie produktu powtórzył całą specyfikację, a w artykule wstawił tureckie słowo w polską odmianę.

Piotr Olszewski

Piotr Olszewski

ADMINISTRATOR

Piotr Olszewski - twórca i autor Promptowego, polskiego serwisu o sztucznej inteligencji. Codziennie śledzi premiery modeli, narzędzia i regulacje AI, i tłumaczy je prostym, konkretnym językiem.

// mapa strony

🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok Cursor Pro 500 zł/rok Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× ‹ powiększenie ›