Słowosieć

O projekcie

Czym jest Słowosieć?

Słowosieć jest polskim wordnetem – nowoczesnym słownikiem języka polskiego oraz bazą danych opisującą słownictwo na potrzeby automatycznego przetwarzania języka naturalnego (NLP).

Poszczególne znaczenia słów połączone są relacjami opisującymi związki i zależności między nimi. Dzięki gęstej sieci relacji wyrazy mogą „same się definiować", dostarczając zarówno użytkownikom słownika, jak i programom komputerowym bogatych informacji o znaczeniach.

Słowosieć pełni jednocześnie rolę leksykalno-semantycznej bazy danych oraz modelu zasobu pojęciowego języka. Jako publikacja cyfrowa może być stale rozwijana, korygowana i rozszerzana o nowe typy relacji, glosy i anotacje.

Nowoczesny słownik relacyjny

Rozbudowany słownik języka polskiego o strukturze grafu, w którym znaczenia połączone są gęstą siecią relacji.

Dla narzędzi NLP i AI

Opis leksyki jest zaprojektowany z myślą o automatycznym przetwarzaniu języka naturalnego i badaniach nad sztuczną inteligencją.

Nowy standard opisu słownictwa

Model zasobu pojęciowego języka, którego strukturę można ciągle rozwijać i ulepszać.

196 000+

Lematy

rzeczowniki, czasowniki, przymiotniki i przysłówki

297 000+

Znaczenia

powiązane w synsetach i sieci relacji

611 000+

Relacje synsetów

relacje semantyczne między synsetami, w ponad 100 typach

279 000+

Relacje jednostek leksykalnych

relacje między jednostkami leksykalnymi

Dane dla roku 2024. Słowosieć jest obecnie największym wordnetem na świecie, większym nawet niż jej pierwowzór – Princeton WordNet, a także największym słownikiem języka polskiego.

Zobacz szczegółowe statystyki

Dla kogo jest Słowosieć

Trzy główne grupy odbiorców zasobu.

Dla komputerów

Słowosieć może być stosowana w programach wykorzystujących elementy automatycznego przetwarzania języka — od analizy tekstu po systemy dialogowe.

  • Systemy tłumaczeń automatycznych (np. Google Translate)
  • Chatboty i systemy dialogowe
  • Analiza wydźwięku i polaryzacji tekstu
Pobierz dane

Dla każdego

Jako nowoczesny słownik pomaga każdej osobie szukającej porady w dziedzinie słownictwa oraz dla każdego użytkownika języka.

  • Wyszukiwanie synonimów i wyrazów bliskoznacznych
  • Sprawdzanie powiązań między pojęciami
  • Nauka języka polskiego i rozbudowa słownictwa
Przeglądaj słownik

Dla naukowców

Umożliwia prowadzenie badań ilościowych na materiale językowym, analiz wielojęzycznych i eksperymentów z zakresu psycholingwistyki.

  • Badania psycholingwistyczne i diagnostyka afazji
  • Porównawcze analizy wielojęzykowe
  • Badania stylometryczne i ilościowe nad leksyką
Cytowanie i publikacje

Historia i rozwój

Jak Słowosieć stała się kluczowym zasobem w przetwarzaniu języka.
  • Połączona z zasobami światowymi
    Dane Słowosieci są powiązane m.in. z Open Multilingual WordNet i Princeton WordNet.
  • Kluczowy zasób dla NLP
    Wykorzystywana m.in. w systemach tłumaczeń automatycznych, analizie tekstu i badaniach nad sztuczną inteligencją.
  • Infrastruktura i narzędzia
    Rozwijana w ramach CLARIN-PL i powiązana z całą infrastrukturą.

Słowosieć jest kluczowym zasobem w komputerowym przetwarzaniu języka i badaniach nad sztuczną inteligencją. Znajduje zastosowanie m.in. w tłumaczeniach automatycznych (np. Google Translate) oraz w projektach integrujących zasoby wielu języków.

Część danych udostępniana jest za pośrednictwem platformy Open Multilingual WordNet, skupiającej dziesiątki wordnetów dla różnych języków świata, powiązanych poprzez rzutowanie na Princeton WordNet. Dzięki temu Słowosieć staje się ważnym elementem globalnej infrastruktury zasobów językowych.

Polski wordnet budowany jest wspólnym wysiłkiem leksykografów i informatyków z Grupy Technologii Językowych Politechniki Wrocławskiej. Użytkownicy mogą korzystać z Słowosieci poprzez stronę WWW, Wordnet Loom, a także pobierać pliki źródłowe i korzystać z usług sieciowych.

Zastosowania i kierunki rozwoju

  • Prowadzenie dużych badań ilościowych i jakościowych na materiale językowym
  • Generowanie i przekształcanie tekstów
  • Analizy wielojęzyczne i automatyczna analiza tekstów
  • Wsparcie badań psycholingwistycznych i diagnostyki afazji
  • Konstrukcja chatbotów i systemów dialogowych
  • Określanie wydźwięku i polaryzacji tekstu
  • Badania stylometryczne i wspieranie nauczania języków obcych
  • Tłumaczenia automatyczne i programowanie urządzeń

Zespół

Ludzie stojący za Słowosiecią – lingwiści, programiści i konsultanci.

Podczas pracy nad Słowosiecią łączymy perspektywę lingwistyczną z inżynierią oprogramowania. Koordynatorzy i kierownik projektu czuwają nad spójnością naukową i technologiczną zasobu, a także nad jego rozwojem w długim horyzoncie czasowym.

mgr Alicja Derych – koordynatorka

Alicja Derych

mgr Alicja Derych – koordynatorka

dr inż. hab. Maciej Piasecki, prof. PWr – kierownik projektu

Maciej Piasecki

dr inż. hab. Maciej Piasecki, prof. PWr – kierownik projektu

dr Ewa Rudnicka – koordynatorka

Ewa Rudnicka

dr Ewa Rudnicka – koordynatorka

Bartłomiej Alberski
Hubert Jankowski
Paweł Dembowski
Ada Zajączkowska
Adam Sierakowski
Agata Drozd
Agnieszka Dziob-Zadworna
Agnieszka Kołodziej
Aleksander Wiśniowski
Aleksandra Kaczmarczyk
Aleksandra Mielczarek
Aleksandra Pawlikowska
Amelia M. Kiełbawska
Anna Łach
Anna Romańska
Anna Śliwicka
Barbara Nowakowska
Bartłomiej Alberski
Beata Wójtowicz
Błażej Szpakowicz
Dagmara Kałkus
Daria Andrzejewska
Dorota Lewandowska
Edyta Masełko
Edyta Nowakowska
Elżbieta Filipczuk
Emilia Matyka
Ewa Gwiazdecka
Ewa Hartman
Ewa Kaczmarz-Wawryk
Ewelina Woźniak-Wrzesińska
Jadwiga Maksym
Jadwiga Kwiatkowska
Jakub Skurtys-Idczak
Jan A. Wieczorek
Jan Klajn
Joanna Stankiewicz
Joanna Wieczorek
Julia Gryszczuk-Wicijowska
Justyna Markowicz
Justyna Wieczorek
Kacper Paszke
Kamil Kurpiel
Kamil Wabnic
Kamila Rozenek
Kamila Wojda
Karolina Jaworska
Karolina Rosa
Katarzyna Hołojda
Katarzyna Klajn
Katarzyna Kowol
Katarzyna Podlaska
Katarzyna Wodyk
Lilia Nikołajczuk
Łukasz Toruński
Małgorzata Kita
Małgorzata Kościelniak
Małgorzata Ohia-Nowak
Małgorzata Skibińska
Marek Maziarz
Marek Pustowaruk
Maria Głąbska
Maria Rudnicka
Marta Dobrowolska-Pigoń
Marta Micuła
Marta Paszke
Martyna Kaźmierczak
Michał Gajek
Monika Frącz
Natalia Kaśków
Natalia Kościńska
Natalia Podbielska
Natalia Śmiełowska
Oliwer Wicha
Patrycja Krysiak
Patrycja Kurczewska
Paulina Witkowska
Paweł Nowak
Przemysław Smoleń
Tomasz Stępień
Urszula Rezler
Wiktoria Janas
Wojciech Witkowski
Zofia Smuga
Monika Zaśko-Zielińska

Partnerzy i finansowanie

Instytucje wspierające rozwój Słowosieci i wybrane projekty grantowe.
DariahLab

DariahLab

Infrastruktura badawcza dla humanistyki cyfrowej

Politechnika Wrocławska

Politechnika Wrocławska

Jednostka wiodąca, Grupa Technologii Językowych

Uniwersytet Wrocławski

Uniwersytet Wrocławski

Partner akademicki i merytoryczny

Prace nad Słowosiecią realizowane są dzięki grantom Ministerstwa Nauki i Szkolnictwa Wyższego, funduszom unijnym oraz w ramach ogólnoeuropejskiej infrastruktury naukowej CLARIN i polskiego konsorcjum CLARIN‑PL.

W projekcie uczestniczą liczne zespoły badawcze i partnerzy komercyjni. Finansowanie obejmuje zarówno rozwój samego zasobu, jak i budowę narzędzi do analizy tekstu, monitoringu mediów, pracy z big data oraz zastosowań w edukacji.

Wybrane projekty

Przegląd wybranych projektów badawczych i komercyjnych finansujących rozwój Słowosieci.

MNiSW2016-07-01 – 2018-06-30

CLARIN (2): Finansowanie kosztów wkładu krajowego na rzecz udziału we współnym imiędzynarodowym przedsięwzięciu pn: "CLARIN ERIC - European Research Infrastructure

MINISTERSTWO NAUKI I SZKOLNICTWA WYŻSZEGO Piasecki Maciej

5 150 832 zł

Komercyjny2020-01-10 – 2020-04-15

Prowadzenie i rozwój Zintegrowanego Rejestru Kwalifikacji.

INSTYTUT BADAŃ EDUKACYJNYCH Piasecki Maciej

229 675 zł

Komercyjny2019-01-01 – 2020-05-31

System wspomagania optymalizacji treści we własnych kanałach marketingowych marki wraz z narzędziami wykrywania trendów i przewidywania, bazujący na przetwarzaniu tekstu,obrazu,video i danych z mediów

SMARTNET RESEARCH & SOLUTIONS SPÓŁKA Z OGRANICZONĄ ODPOWIEDZIALNOŚCIĄ Piasecki Maciej

379 192 zł

Komercyjny2018-06-01 – 2019-10-31

Opracowanie kompleksowej metody analizy emotywnej i polaryzacji wydzwięku emocjonalnego wypowiedzi tekstowych w jezyku polskim.

W3A.PL SPÓŁKA Z OGRANICZONĄ ODPOWIEDZIALNOŚCIĄ Piasecki Maciej

581 560 zł

MNiSW2018 – 2021

CLARIN-PL (3) – „Polska część infrastruktury naukowej CLARIN ERIC: Wspólne zasoby językowe i infrastruktura technologiczna”, finansowanie kosztów wkładu krajowego wnoszonego na rzeczudziału we wspólnym międzynarodowym przedsięwzięciu pn: CLARIN ERIC – European Research Infrastructure Consortium: Common Language Resources and Technology Infrastructure;

MINISTERSTWO NAUKI I SZKOLNICTWA WYŻSZEGO Piasecki Maciej

8 866 992 zł

Komercyjny2017-10-25 – 2019-06-16

SentiBigData- platforma do monotoringu mediów społecznościowych i Internetu oraz automatycznego raportowania.

SENTIONE SP. Z O.O. Piasecki Maciej

1 474 856 zł

Komercyjny2017 – 2019

SentiCognitiveServices – nowa generacja usług do automatyzacji marketingu i obsługi sieci społecznościowych oparta o metody sztucznej inteligencji

SENTIONE SP. Z O.O. Piasecki Maciej

1 814 073 zł

Komercyjny2017-06-01 – 2018-05-31

Opracowanie metody automatycznej analizy emotywnej i polaryzacji wydźwięku emocjonalnego polskiego tekstu na poziomie leksykalnym w oparciu o dużą leksykalną sieć semantyczną języka polskiego.

W3A.PL SPÓŁKA Z OGRANICZONĄ ODPOWIEDZIALNOŚCIĄ Piasecki Maciej

662 434 zł

Komercyjny2017-01-01 – 2017-12-31

Wykonywanie prac badawczo-rozwojowych na potrzeby współpracy z przemysłem.

Piasecki Maciej

100 000 zł

Komercyjny2016-05-01 – 2017-12-31

Wykonywanie prac badawczo- rozwojowych na potrzeby współpracy z przemysłem.

Piasecki Maciej

100 000 zł

NCN2016-04-01 – 2019-03-31

Ekwiwalencja międzyjęzykowa w leksykalnych bazach danych.

NARODOWE CENTRUM NAUKI Piasecki Maciej

336 388 zł

MNiSW2015-03-01 – 2016-04-30

CLARIN wsparcie: "Opracowanie metodologii prac nad rozwojem infrastruktury technologii językowych CLARIN oraz upowszechnienie..."

MINISTERSTWO NAUKI I SZKOLNICTWA WYŻSZEGO Piasecki Maciej

375 000 zł

Aparaturowy2013-03-01 – 2016-04-30

CLARIN (1): Polska część infrastruktury naukowej CLARIN ERIC: Wspólne zasoby językowe i infrastruktura technologiczna.

MINISTERSTWO NAUKI I SZKOLNICTWA WYŻSZEGO Piasecki Maciej

16 495 280 zł

Komercyjny2014-11-03 – 2017-02-22

Umowa o wykonanie produktu: Narzędzie do proponowania zbioru słów kluczowych

AGORA SPÓŁKA AKCYJNA Piasecki Maciej

70 390 zł

Komercyjny2014-11-03 – 2016-06-30

Umowa o wykonanie produktu: Narzędzie do grupowania dokumentów z serwisów internetowych

Piasecki Maciej

71 548 zł

Komercyjny2014-11-03 – 2017-02-22

Umowa o wykonanie produktu: Rozszerzony mechanizm rzutowania tekstu na rozszerzoną ontologię ogólną

AGORA SPÓŁKA AKCYJNA Piasecki Maciej

109 740 zł

Komercyjny2014-10-06 – 2017-02-22

Umowa o wykonanie produktu: Rozszerzony system do rozpoznawa nia nazw własnych dedykowany do formatu dokumentów i zasobów treściowych Agory

AGORA SPÓŁKA AKCYJNA Piasecki Maciej

310 000 zł

Komercyjny2014-10-06 – 2017-02-22

Rozszerzone narzędzie do automatycznego proponowania tekstowych słów kluczowych

AGORA SPÓŁKA AKCYJNA Piasecki Maciej

129 870 zł

NCBiR2010-08-16 – 2014-07-31

SyNaT - Utworzenie uniwersalnej, otwartej, repozytoryjnej platformy hostingowej i komunikacyjnej dla sieciowych zasobów wiedzy dla nauki, edukacji i otwartego społeczeństwa wiedzy

Piasecki Maciej

2 823 046 zł

NCBiR2009 – 2014

NEKST – "Adaptacyjny system wspomagający rozwiązywanie problemów w oparciu o analizę treści dostępnych źródeł elektronicznych

Piasecki Maciej

4 110 743 zł

MNiSW2009 – 2012

Konstrukcja zasobów leksykalnych przez rozpoznawanie relacji semantycznych na podstawie danych morfosyntaktycznych i semantycznych w korpusach tekstu

MINISTERSTWO NAUKI I SZKOLNICTWA WYŻSZEGO Piasecki Maciej

406 960 zł

europejski FP7-Infrastructures-2007-12008 – 2011

CLARIN – Common Language Resources and Technology Infrastructure

Piasecki Maciej

44 960

MNiSW2005 – 2008

Wielopoziomowe algorytmy rozpoznawania ręcznie pisanych tekstów medycznych

MINISTERSTWO NAUKI I SZKOLNICTWA WYŻSZEGO Sas Jerzy
MNiSW2005 – 2008

Automatyczne metody konstrukcji sieci semantycznej leksemów polskich na potrzeby przetwarzania języka naturalnego

MINISTERSTWO NAUKI I SZKOLNICTWA WYŻSZEGO Piasecki Maciej

366 900 zł

Wyświetlono 24 z 24 projektów

Licencja

Zasady korzystania z Słowosieci i jej danych.

Decyzją władz uczelni Słowosieć jest dostępna bezpłatnie do powszechnego (również komercyjnego) użytku w oparciu o licencję wzorowaną na licencji Princeton WordNet.

plWordNet License

plWordNet® is unencumbered, and may be used in commercial applications in accordance with the following license agreement. An attorney representing the commercial interest should review this plWordNet license with respect to the intended use. plWordNet License

This license is available as the file LICENSE in any downloaded version of plWordNet.

This software and database are being provided to you, the LICENSEE, by Wrocław University of Technology under the following license. By obtaining, using and/or copying this software and database, you agree that you have read, understood, and will comply with these terms and conditions: permission to use, copy, modify, distribute, and public expose this software and database (including data getting) and its documentation for any purpose and without fee or royalty is hereby granted, provided that you agree to comply with the following copyright notice and statements, including the disclaimer, and that the same appear on ALL copies of the software, database and documentation, including modifications which you make for internal use or for wider distribution.

plWordNet 4.2 © 2020 by Wrocław University of Technology. All rights reserved.

THIS SOFTWARE AND DATABASE IS PROVIDED "AS IS" AND WROCŁAW UNIVERSITY OF TECHNOLOGY MAKES NO REPRESENTATIONS OR WARRANTIES, EXPRESS OR IMPLIED. BY WAY OF EXAMPLE, BUT NOT LIMITATION, WROCŁAW UNIVERSITY OF TECHNOLOGY MAKES NO REPRESENTATIONS OR WARRANTIES OF MERCHANT-ABILITY OR MERCHANT-FITNESS FOR ANY PARTICULAR PURPOSE; NOR DOES WROCŁAW UNIVERSITY OF TECHNOLOGY MAKE ANY REPRESENTATIONS OR WARRANTIES THAT THE USE OF THE LICENSED SOFTWARE, DATABASE OR DOCUMENTATION WILL NOT INFRINGE ANY THIRD PARTY PATENTS, COPYRIGHTS, TRADEMARKS OR OTHER RIGHTS.

The name of Wrocław University of Technology may not be used in advertising or publicity pertaining to distribution of the software, the database or both. Title to copyright in this software, database and any associated documentation shall at all times remain with Wrocław University of Technology, and LICENSEE agrees to preserve this copyright

Zacznij korzystać

Gotowy, aby wykorzystać Słowosieć w swoim projekcie?

Dołącz do zespołów badawczych i inżynieryjnych korzystających ze Słowosieci. Przeglądaj zasób, cytuj go w publikacjach albo integruj z własnymi narzędziami NLP.

20+ lat

ciągłego rozwoju

Otwarty

dostęp i licencja

196 000+

lematów w bazie

FENG