dih – Solr.pl

Data Import Handler – import danych z plików Solr XML

Rafał Kuć Ogólna 16 sierpnia 201111 listopada 2020data import handler, dih, solr 0 Comment

Do tej pory, w poprzednich artykułach, przyglądaliśmy się importowi danych z baz SQL. Dziś przyszedł czas na import z plików XML.

Indeksowanie plików doc, pdf itp, czyli integracja Solr z Tika

Marek Rogoziński Solr 4 kwietnia 201111 listopada 2020data import handler, dih 0 Comment

W poprzednim artykule podaliśmy podstawowe informację, jak umożliwić przeszukiwanie zawartości plików binarnych, czyli m.in dokumentów MS Word, PDF czy LibreOffice. Dziś zrobimy to samo, wykorzystując Data Import Handler. Ponieważ parę dni temu pojawiła się nowa wersja serwera SOLR (3.1), poniższe wskazówki bazują na tej wersji. Do prezentacji wykorzystano aplikację „example” – wszystkie poniższe zmiany odnoszą się właśnie do tej aplikacji.

Data Import Handler & XML – zagnieżdzone encje

Marek Rogoziński Solr 7 marca 201111 listopada 2020data import handler, dih, import, solr 0 Comment

Data Import Handler jest bardzo miłym i rozbudowanym narzędziem. Poniżej opis problemu (i rozwiązania) w którym spotkałem się ostatnio.

Data Import Handler – usuwanie danych z indeksu

Marek Rogoziński Solr 3 stycznia 201111 listopada 2020baza danych, data import handler, dih, import, integracja 0 Comment

Usuwanie danych z indeksu przy wykorzystaniu indeksowania przyrostowego w DIH jest na wiki SOLR potraktowane szczątkowo, jako coś, co działa analogicznie do aktualizacji rekordów. Podobnie we wcześniejszym artykule użyłem tego skrótu, tym bardziej, że podany przeze mnie przykład z indeksowaniem zasobów wikipedii nie potrzebował usuwania danych.

Data Import Handler – sharding

Marek Rogoziński Solr 27 grudnia 201011 listopada 2020baza danych, data import handler, dih, integracja 0 Comment

Nasza czytelniczka (pozdrawiamy!) zgłosiła się do nas z problemem dotyczącym współpracy DIH z shardingiem. Wiki projektu SOLR pokazuje moim zdaniem rozwiązanie tej kwestii, ale czyni to trochę na około i przy okazji.

Data Import Handler – import danych z baz SQL (cz. 1)

Marek Rogoziński Solr 11 października 201010 listopada 2020baza danych, data import handler, dih, import 0 Comment

W artykule o sposobach importu danych (http://solr.pl/2010/09/06/solr-importowanie-danych/) wspomniałem o Data Import Handler (DIH). Podstawową zaletą tego sposobu importowania jest brak konieczności tworzenia dodatkowego oprogramowania oraz szybka integracja ze źródłem danych. Ta druga zaleta wymaga jednak wprawy i praktyki. W tym wpisie przedstawię podstawy integracji DIH ze źródłem danych SQL.