Nepomuk

From KDE Wiki Sandbox
Revision as of 12:01, 8 October 2011 by Yurchor (talk | contribs) (Created page with "З іншого боку, засіб індексування файлів Strigi — система для індексування файлів, за допомогою яко...")

Nepomuk

Метою створення цієї сторінки не є розгорнутий опис технології Nepomuk з усіма можливими подробицями. На цій сторінці ви знайдете лише короткий огляд, декілька прикладів та загальний опис призначення технології, а також посилання на пов’язані з нею ресурси у мережі.

Короткий опис

Як ми вже зазначали у глосарії, Nepomuk призначено для класифікування, впорядкування та показу даних. Nepomuk не є якоюсь окремою програмою, але компонентом, яким можуть скористатися розробники програмного забезпечення.

Як спробувати Nepomuk

Nepomuk використано у Dolphin. Щоб познайомитися з можливостями, вам слід увімкнути Nepomuk і Strigi у Системних параметрах -> Додатково -> Стільничний пошук. За допомогою бічної панелі Dolphin ви зможете призначати мітки, оцінки та коментарі. Ці дані буде збережено у Nepomuk та проіндексовано Strigi. Після завершення індексування ви зможете шукати файли за метаданими за допомогою панелі навігації Dolphin. Достатньо ввести "nepomuksearch:/" і ключове слово пошуку.

Функціональні можливості

Nepomuk надає програмам декілька «шарів» функціональних можливостей. Першим і найпростішим з них є визначення міток, оцінок і коментарів файлів вручну, як це можна зробити у Dolphin. Визначені метадані допоможуть вам пришвидшити пошук файлів, але для їх створення потрібні значні зусилля.

Щоб спростити пошук файлів з відповідним текстом, у Nepomuk передбачено іншу функціональну можливість: індексування текстового вмісту файлів. Для цього використано технологію, яка має назву Strigi. У разі її використання знайти файл можна буде на основі декількох слів, які, як ви пам’ятаєте, містяться у ньому, або просто частиною його назви.

Третій шар є дуже складним, саме через нього Nepomuk вважається дослідницьким проектом декількох компаній та університетів Європейської Союзу. Цей шар пов’язано з такими складними поняттями, як «семантична стільниця» та «онтології». Його використання передбачає встановлення контекстів і зв’язків між даними.

Приклади

Давайте спробуємо розібратися з можливостями Nepomuk на двох прикладах.

Зв’язки

Припустімо, ви два тижні тому отримали фотографію, зроблену вашим другом чи подругою. Ви зберегли дані зображення десь на вашому комп’ютері. Як же знайти файл, якщо ви на пам’ятаєте, куди його було збережено?

Nepomuk допоможе вам у пошуку. Ви, звичайно ж, знаєте ім’я того, хто надіслав файл, але комп’ютер про це нічого не знає. Nepomuk допоможе комп’ютерові відновити зв’язок між, скажімо, ім’ям та адресою файла. Достатньо буде вказати ім’я вашого друга чи подруги і у результатах пошуку за метаданими буде показано потрібну вам фотографію!

Іншим потенційним зв’язком є зв’язок між веб-сторінкою, з якої ви скопіювали фрагмент тексту, і документом, куди ви вставили цей текст, або між двома знімками одного автомобіля. Дані про такі зв’язки іноді можна видобути з самих файлів (ви можете проаналізувати фотографії і встановити, що саме на них зображено) або даних програм, за допомогою яких було виконано обробку файлів (див. приклад з зображенням, надісланим електронною поштою). Розробка відповідної частини Nepomuk все ще триває. Потрібна інтеграція до програм, отже повної реалізації доведеться чекати декілька років.

Щоб там ми не говорили, цю частину Nepomuk призначено для інтелектуалізації пошуку. Вона чимось подібна до тої системи, яку Google використовує у власному пошуковому рушії: якщо ви шукаєте назву готелю або міста, рушій покаже над списком результатів пошуку карту google з готелями, які ви шукали! Система навіть може запропонувати точнішу назву, якщо ви припустилися помилки під час введення. Крім того, Google намагається подати найточніші відповідники на початку списку результатів на основі складних обчислень та взаємозв’язків (посилань) між сайтами. Nepomuk зможе подавати подібні кмітливі результати і впорядковувати їх за відповідністю на основі даних про взаємзв’язок.

Контекст

Дані щодо зв’язків не лише допоможуть вам у пошуку файлів, але і зможуть вплинути на роботу програм та показані ними дані. Зауважте, що, таким чином, використання Nepomuk надасть вам більше даних, ніж ви навіть могли припустити! Багато компонентів системи вже реалізовано, але ще не інтегровано з програмами та стільницею.

Наведемо приклад прив’язки стільниці до контексту. Така прив’язка допоможе вам працювати ефективніше.

Припустімо, ви працюєте над якимись нотатками для робочої зустрічі. Дзвонить телефон, хтось просить вас знайти електронну таблицю з цінами на продукцію і створити з неї цінник для покупця. Після декількох подібних прохань, які перериватимуть вашу роботу, на стільниці буде відкрито цілу купу файлів та вікон...

Хотілось би впорядкувати все це кращим чином, чи не так?

Ви можете скористатися 'просторами дій'. Ці простори було введено до Плазми на заміну «стільницям». Простори дій чимось подібні до віртуальних стільниць, але зі зміною наборів програм. Інші віджети, тло стільниці тощо. Починаючи з KDE 4.3, кожну віртуальну стільницю може бути пов’язано з простором дій, отже можлива синхронізація цих двох компонентів середовища.

Оскільки програми і стільниці пов’язано з просторами дій, ви можете створити простір дій для кожного завдань, які вам доводиться регулярно виконувати. Отже, якщо вам часто доводиться працювати з електронною таблицею цін, ви можете створити простір дій для цієї роботи: відкрийте на стільниці віджет перегляду тек (або декілька таких віджетів), додайте віджет калькулятора та віджет стеження за завданнями, щоб стежити за ще не виконаною роботою. Можливо, вам захочеться відкрити віджет електронної пошти зі списком повідомлень, що стосуються електронних таблиць цін!

Якщо хтось надішле запит щодо цін, ви перемкнетеся на відповідний простір дій і відкриєте програму для роботи з електронними таблицями. Програму буде пов’язано з простором дій, отже у ній ви побачите електронні таблиці з останніми даними щодо цін, а не складськими фактурами, над якими ви працюєте у іншому просторі дій! У Kopete буде відкрито вікно балачки з вашим колегою, який володіє інформацією щодо цін, саме відповідний обліковий запис буде пов’язано з цим простором дій.

Коли ви завершите роботу, можна повернутися до іншого простору дій. Всі програми змінять свої параметри відповідно до відкритого простору дій з певною функціональною прив’язкою.

Переваги такої заснованої на просторах дій роботи не обмежуються наведеним вище прикладом. Подібне впорядкування роботи допоможе вам не лише у пошуку файлів та записів контактів, але і у перемиканні між самими завданнями. Мозку людини важко впоратися з виконанням декількох завдань одночасно, — більшості людей потрібно декілька хвилин на адаптацію до нового завдання. Зміна «середовища» значно пришвидшує цей процес, навіть якщо всі зміни обмежуються екраном комп’ютера. Це можна порівняти з покращенням настрою під час пакування речей перед відпусткою!

Звичайно ж, наведені вище приклади здебільшого стосуються людей, які працюють за комп’ютером у офісі або вдома. Комп’ютерним гравцям або звичайним користувачам простори дій не дадуть майже ніяких переваг.

Зауважте, що описаний вище сценарій не відповідає поточній дійсності. Для його реалізації може знадобитися декілька років. Багато з ідей вже реалізовано у KDE, але багато ще чекає на свою реалізацію.

Поширені питання та відповіді на них

Наведені нижче дані взято з допису на форумі KDE. Будь ласка, додавайте ваші пункти до списку, вилучайте застарілі пункти та вносьте зміни, якщо маєте на те бажання!

Питання. Яка відмінність між семантичною стільницею Nepomuk та інструментом індексування файлів Nepomuk (Strigi)?

Відповідь. Семантична стільниця Nepomuk є основою всіх інших модулів інфраструктури Nepomuk. За її допомогою можна впорядковувати, анотувати та створювати зв’язки між даними (не лише назвою файла і його вмістом, але, наприклад, тим, у яких програмах використано певний файл, або мітками цього файла). Програми і робочі простори KDE використовують цю базову інфраструктуру для реалізації своїх можливостей, зокрема додавання міток до повідомлень електронної пошти (KMail) або налаштування просторів дій (Plasma).

З іншого боку, засіб індексування файлів Strigi — система для індексування файлів, за допомогою якої дані додаються до основного сховища даних Nepomuk, зручний спосіб уможливлення використання цих даних у Nepomuk без додавання кожного з файлів вручну. Крім того, після обробки цим засобом програми, зокрема Dolphin, можуть виконувати пошук за вмістом, назвою або іншими метаданими (наприклад мітками), пов’язаними з індексованими файлами. Такий засіб індексування може виконувати обробку не лише текстових файлів, але і файлів PDF, отримуючи доступ до метаданих, що зберігаються у цих файлах (даних щодо автора, публікації тощо). У деяких компонентах KDE передбачено додаткові «аналізатори» для інших типів файлів. Nepomuk може працювати без використання індексатора файлів, який є додатковим (а не обов’язковим) компонентом.

Питання. Як вимкнути семантичну стільницю?

A. Most of the times, the easiest way is to disable file indexing, which is usually, among the Nepomuk components, the heavier in resource usage (although many optimizations have been included in the 4.7 release which reduce resource usage). This is done by unchecking Enable Strigi Desktop File Indexer in the Desktop Search section of System Settings. In case you want to turn off all semantic features, uncheck Enable Nepomuk semantic desktop. Notice that this will turn off search in Dolphin as well.

Notice that with the latter option some programs who use Nepomuk for meta-data will offer reduced functionality: for example KMail will not be able to tag mail, or Plasma activities will not offer additional features such as icons, or program data information.

Питання. Чому я бачу у списку процесів nepomukservicestub навіть після вимикання Nepomuk?

Відповідь. Можливо, причиною є певна вада. Будь ласка, повідомте про неї, надавши повний опис вашої проблеми та кроки з її відтворення.

Питання. Індексування файлів PDF або інших типів не працює.

A. PDF indexing is a known issue and it's being tracked at this bug report. If you have issues with other files, open a bug, preferably adding a sample file that shows the problem.

Питання. Програма nepomukservicestub завершує роботу у аварійному режимі після запуску системи.

A. A large number of fixes for crashes has been fixed for the 4.7.2 release of the KDE Workspaces and Applications. If you encounter more, please file bugs report with detailed instructions on how to reproduce the problem, as sometimes the developers are unable to trigger them in their test setups.

Питання. Процес virtuoso-t споживає 100% процесорного часу.

A. Virtuoso-t is a key component of the Nepomuk infrastructure and in some occasions the commands sent by the other components end up taking too much time (hence showing the effect of 100% CPU). Sebastian Trüg (the lead developer of Nepomuk) has fixed most of these problems in 4.7.1 or newer.

Питання. Іноді Nepomuk споживає занадто багато оперативної пам’яті.

A. Many of these problems have been fixed, in other cases however the developers are unable to reproduce the issues correctly. In this case, providing examples and test cases to bug reports increase the chances to get these bugs fixed.

Питання. Чому Nepomuk повторно індексує файли після запуску системи?

Відповідь. Цю ваду було виправлено у версії 4.7.0. Тепер Nepomuk лише «шукає» зміни без повторного індексування всіх даних.

Питання. Чому Nepomuk під час запуску блокує своїми запитами доступ до диска?

Відповідь. У 4.7 на новіших версіях навантаження на диск було зменшено завдяки реалізації у інструменті індексування файлів механізму гальмування.

Питання. Мою базу даних Nepomuk було пошкоджено. Як спорожнити базу даних?

A. In the extreme case your database is really corrupted and all other attempts have failed, you can delete the $KDEHOME/share/apps/nepomuk directory (where $KDEHOME is usually .kde or .kde4) while Nepomuk is not running. The database will be cleared, but you will also lose existing information such as tags, ratings and comments.

Оприлюднення даних і конфіденційність

І ще одна річ, якої хотілось би торкнутися перед наведенням інших джерел інформації: оприлюднення даних Nepomuk. Іноді буває корисним, якщо ваші мітки, оцінки та коментарі буде надіслано іншим користувачам разом з файлами. Але якщо ви раптом зробили мітку, яка може образити того, кому ви надсилаєте файл (наприклад, мітка «колода у ліжку» для фотографії), ви навряд чи захочете, щоб її було надіслано разом зі знімком того, кому ви надіслали файл...

Звичайно ж, цю проблему було ретельно розглянуто творцями Nepomuk. У поточній версії з міркувань збереження конфіденційності та уникнення зайвих технічних проблем контексти Nepomuk є особистими даними. Таким чином, розробники Nepomuk роблять все можливе для забезпечення конфіденційності ваших даних.

Інші джерела даних:
Вікіпедія — Семантична стільниця 
Вікіпедія — Оболонка NEPOMUK 
Веб-сайт NEPOMUK
Сайт KDE NEPOMUK
Стаття з поясненням можливостей Nepomuk на DOT KDE