Wiedeński zbiór danych 4G/5G: otwarte pomiary sieci komórkowej dla ML
Naukowcy z Wiednia opublikowali otwarty zbiór danych z pomiarów sieci LTE i 5G zebranych w skali całego miasta. Zbiór łączy obserwacje pasywnych skanerów z logami urządzeń końcowych i zawiera modele zabudowy oraz terenu.

👁 112 przeczytań
Artykuł opisuje zbiór danych o nazwie Vienna 4G/5G Drive-Test Dataset, przygotowany przez zespół siedmiu badaczy: Wilfried Wiedner, Lukas Eller, Mariam Mussbah, Dominik Rössler, Valerian Maresch, Philipp Svoboda i Markus Rupp. Praca ukazała się w marcu 2026 roku, a jej poprawiona wersja pochodzi z września 2026. Została opublikowana w czasopiśmie Scientific Data (wydawnictwo Springer Nature, DOI: 10.1038/s41597-026-08259-z).
Na czym polega problem, który autorzy chcą rozwiązać
Autorzy wskazują, że uczenie maszynowe stosowane do analizy, planowania i optymalizacji sieci komórkowych jest często ograniczone przez brak dużych, kompleksowych zbiorów danych z rzeczywistych środowisk. Właśnie tę lukę ma wypełniać opisywany zbiór.
Co zawiera zbiór danych
Dane zebrano w Wiedniu, w Austrii, obejmując zarówno obszary miejskie, jak i podmiejskie. Zbiór łączy dwa rodzaje pomiarów: obserwacje pasywnych skanerów szerokopasmowych - rejestrujących sieć niejako od strony infrastruktury - oraz aktywne logi urządzeń końcowych (handsetów), które oddają perspektywę użytkownika. Wszystkie pomiary są georeferencjonowane, czyli powiązane z lokalizacją i czasem, co ma zapewniać spójność przy porównywaniu wyników.
Dla reprezentatywnego podzbioru stacji bazowych (BS) zbiór zawiera wnioskowane deskryptory rozmieszczenia: szacowane lokalizacje stacji, azymuty sektorów oraz wysokości anten. Autorzy nie precyzują w abstrakcie, ile dokładnie stacji bazowych objęto tym opisem.
Dodatkowo zbiór zawiera wysokorozdzielcze modele budynków i terenu dla Wiednia. Autorzy wskazują, że umożliwiają one uczenie warunkowane geometrią środowiska oraz kalibrację deterministycznych metod modelowania propagacji radiowej, takich jak ray tracing (śledzenie promieni).
Jak dane są zorganizowane
Zbiór podzielono na cztery komponenty: dane skanera, dane handsetów, szacowane informacje o komórkach oraz model miasta. Do zbioru dołączona jest dokumentacja opisująca dostępne pola danych i sposób łączenia poszczególnych komponentów ze sobą. Artykuł liczy 22 strony, zawiera 13 rysunków i 11 tabel.
Do czego zbiór ma służyć
Autorzy wymieniają kilka zastosowań: reprodukowalne testy porównawcze dla uczenia maszynowego uwzględniającego środowisko, modelowanie propagacji sygnału, analiza zasięgu sieci oraz kalibracja metod ray tracingu. Zbiór jest otwarty - dokument nie precyzuje jednak szczegółów licencji ani miejsca, gdzie dane są dostępne do pobrania (te informacje nie pojawiają się w dostarczonym tekście abstraktu).
Google · Twoje źródłaPromptowy wyżej w Twoim Google - jednym kliknięciemDodaj do preferowanych źródeł →Co z tego wynika
Moim zdaniem wartość tego zbioru jest przede wszystkim praktyczna - brak publicznie dostępnych, dobrze opisanych danych z realnych sieci komórkowych to autentyczny problem w badaniach nad ML dla telekomunikacji, a nie tylko akademicki pretekst. Fakt, że dane pochodzą z jednego miasta i jednej sieci, jest oczywistym ograniczeniem, o którym autorzy wprost nie mówią w abstrakcie - nie wiadomo więc, na ile wyniki modeli trenowanych na tych danych będą się przenosić na inne miasta czy kraje. Dla polskich badaczy i inżynierów telekomunikacji zbiór może być interesującym punktem odniesienia, choć dokument nie mówi nic o tym, czy dane z Wiednia są reprezentatywne dla innych środowisk miejskich w Europie Środkowej.
Źródło: arXiv cs.AI: The Vienna 4G/5G Drive-Test Dataset (dokument z 2026-09-14). To omówienie powstało na podstawie pełnego tekstu dokumentu, nie relacji innych mediów.
Cały tydzień w AI, w jednym mailu
Wybrane premiery, narzędzia i analizy. Raz w tygodniu, prosto do skrzynki.
Zapisz się za darmo →
