Gridfile
Gridfile (ang. = Siatka dyfrakcyjna) jest przynajmniej dwuwymiarową strukturę wskaźnik The wyszukiwanie danych o 2 lub więcej kryteriów znacznie przyspieszone. W przypadku tradycyjnych jednowymiarowych struktur danych (np. Tablicy skrótów ) wyszukiwanie jednego kryterium jest zwykle bardzo łatwe, podczas gdy szukanie drugiego kryterium jest bardzo czasochłonne . Pliki siatki reprezentują specjalny typ mieszania, w którym klasyczna funkcja skrótu jest zastępowana katalogiem siatki.
Ogólne pliki siatki mają wymiar k, co oznacza, że przechowują dane k-wymiarowe z kluczami S1 ... Sk. Pliki siatki są jedną z symetrycznych struktur danych , ponieważ żadna z wartości kluczowych nie jest preferowana, ale wszystkie klucze są zawsze wprowadzane jednakowo.
Na przykład w pliku siatki, podczas wyszukiwania według trzech kryteriów, odpowiedni rekord danych można znaleźć bezpośrednio, jak w trójwymiarowej kostce . Dane zwykle nie są przechowywane w samym pliku siatki (co zajęłoby zbyt dużo miejsca, gdyby sześcian był wypełniony tylko umiarkowanie), a jedynie odniesienie do zasobnika, w którym przechowywane są żądane dane. Wiadro przechowuje kilka rekordów danych, które są obok siebie w pliku siatki .
Tak zwana zasada dostępu do dwóch dysków ma zastosowanie do pliku grid. Oznacza to, że żądany rekord danych jest dostępny po nie więcej niż dwóch żądaniach skierowanych do pamięci dodatkowej . Aby to zapewnić, struktura indeksu i rzeczywiste dane są przechowywane w dwóch oddzielnych strukturach danych. Ponieważ struktura indeksu jest stosunkowo mała w porównaniu z danymi, które mają być adresowane, w idealnym przypadku można je również przechowywać w pamięci głównej.
Do koszyków adresowane są za pomocą tak zwanych skal, które tworzą strukturę indeksu. Dla każdego wymiaru k tworzona jest skala, która sortuje granice segmentów w odpowiednim wymiarze i zawiera indeks dla tego wymiaru. Łącząc wpisy w poszczególnych skalach, można określić odpowiedni segment, który zawiera dane dla poszukiwanych współrzędnych.
Plik siatki jest niewrażliwy na klastry danych, ponieważ reaguje na właściwości treści jako adaptacyjna struktura danych, dzieląc lub poprawiając wymiary (w przypadku przepełnienia zasobnika) i scalając (w przypadku niedomiaru zasobnika).
Zobacz też
Indeks bazy danych , QuadTree , Kd drzewo , drzewo UB , R drzewo , powierzchnia drzewo jako alternatywy
linki internetowe
- Wykład na temat systemów baz danych na Uniwersytecie w Osnabrück , rozdz. 5
- Przegląd plików grid (plik PDF; 350 kB)