🎬 Higgsfield Plus na rok 649 zł 1 990 zł -67% zostało 7 szt. albo Pro na rok 464 zł Kup teraz →
Przejdź do treści
Słownik AI / Latency (opóźnienie)
⚙️ Technika

Latency (opóźnienie)

Czas od wysłania zapytania do pierwszego słowa odpowiedzi.

Latency to opóźnienie między wysłaniem zapytania a reakcją modelu - w praktyce najczęściej mierzy się czas do pierwszego tokenu odpowiedzi. Dla płynnej rozmowy głosowej czy autouzupełniania kodu liczą się ułamki sekundy; przy generowaniu raportu opóźnienie ma mniejsze znaczenie.

Na latency składa się wielkość modelu, obciążenie serwerów, długość promptu i tryb pracy (modele rozumujące „myślą” zauważalnie dłużej). Twórcy aplikacji często żonglują modelami: szybki do natychmiastowych reakcji, mocny do zadań, gdzie użytkownik zaczeka.

Pojęcia powiązane
InferenceStreamingModele rozumujące (reasoning)

← Wszystkie pojęcia w Słowniku AI

// mapa strony
🛒 Sklep Kinetyka Google AI Gemini Pro 170 zł CapCut Pro 460 zł/rok Cursor Pro+ 99 zł/mc Zobacz wszystko →
promptowy w liczbach 0tekstów w archiwum0newsów z ostatnich 7 dni0modeli wideo w obserwatorium0zagadek w grach
× powiększenie