Słowosieć

About the project

What is Słowosieć?

Słowosieć is the Polish wordnet — a modern dictionary of the Polish language and a database describing vocabulary for the needs of natural language processing (NLP).

Individual word senses are linked by relations that describe connections and dependencies between them. Thanks to a dense network of relations, words can in a sense “define themselves”, providing rich information about meanings to both dictionary users and computer programs.

Słowosieć serves as both a lexical-semantic database and a model of conceptual resources of language. As a digital publication, it can be continuously developed, corrected, and expanded with new relation types, glosses, and annotations.

Modern network dictionary

An expanded Polish dictionary structured as a network where senses are linked by dense relations.

For NLP and AI tools

A lexical description designed for natural language processing and AI research.

A new standard for vocabulary description

A conceptual resource model whose structure can be continuously developed and refined.

196,000+

Lemmas

nouns, verbs, adjectives, and adverbs

297,000+

Senses

linked in synsets and relation networks

611,000+

Synset relations

semantic relations between synsets, across 100+ relation types

279,000+

Lexical unit relations

relations between lexical units

Data for 2024. Słowosieć is currently the world’s largest wordnet, larger than its predecessor — Princeton WordNet — and the largest dictionary of Polish.

See detailed statistics

Who is Słowosieć for

Three main groups of resource users.

For computers

Słowosieć can be used in programs that rely on automatic language processing — from text analysis to dialogue systems.

  • Machine translation systems (e.g. Google Translate)
  • Chatbots and dialogue systems
  • Sentiment and polarity analysis
Download data

For everyone

As a modern dictionary, it helps anyone seeking guidance in vocabulary and every language user.

  • Searching for synonyms and related words
  • Checking relations between concepts
  • Learning Polish and expanding vocabulary
Explore the dictionary

For researchers

Enables quantitative research on language material, multilingual analyses, and psycholinguistic experiments.

  • Psycholinguistic studies and aphasia diagnostics
  • Comparative multilingual analyses
  • Stylometric and quantitative lexical studies
Citation and publications

History and development

How Słowosieć became a key resource in language technology.
  • Connected with global resources
    Słowosieć data is available via Open Multilingual WordNet and linked to Princeton WordNet.
  • Key NLP resource
    Used in machine translation systems, text analysis, and AI research.
  • Infrastructure and tools
    Developed within CLARIN-PL and connected to the entire infrastructure.

Słowosieć is a key resource in computational language processing and artificial intelligence research. It is used, among others, in machine translation (e.g. Google Translate) and in projects integrating resources across many languages.

Part of the data is shared via the Open Multilingual WordNet platform, which brings together dozens of wordnets for languages around the world, linked by mapping to Princeton WordNet. This makes Słowosieć an important component of the global infrastructure of language resources.

The Polish wordnet is built through the joint effort of lexicographers and computer scientists from the Language Technology Group at Wrocław University of Technology. Users can access Słowosieć via the website and Wordnet Loom, and can also download source files and use web services.

Applications and directions of development

  • Large-scale quantitative research on language data
  • Text generation and transformation
  • Multilingual analysis and automatic text processing
  • Support for psycholinguistic research and aphasia diagnostics
  • Chatbot and dialogue system construction
  • Sentiment and polarity assessment
  • Stylometric research and foreign language learning support
  • Machine translation and device programming

Team

The people behind Słowosieć — linguists, developers, and consultants.

Working on Słowosieć, we combine a linguistic perspective with software engineering. The coordinators and project lead oversee the scientific and technological consistency of the resource, as well as its long-term development.

 Alicja Derych, MA — coordinator

Alicja Derych

Alicja Derych, MA — coordinator

Prof. Maciej Piasecki, PhD — project lead

Maciej Piasecki

Prof. Maciej Piasecki, PhD — project lead

Ewa Rudnicka, PhD — coordinator

Ewa Rudnicka

Ewa Rudnicka, PhD — coordinator

Bartłomiej Alberski
Hubert Jankowski
Paweł Dembowski
Ada Zajączkowska
Adam Sierakowski
Agata Drozd
Agnieszka Dziob-Zadworna
Agnieszka Kołodziej
Aleksander Wiśniowski
Aleksandra Kaczmarczyk
Aleksandra Mielczarek
Aleksandra Pawlikowska
Amelia M. Kiełbawska
Anna Łach
Anna Romańska
Anna Śliwicka
Barbara Nowakowska
Bartłomiej Alberski
Beata Wójtowicz
Błażej Szpakowicz
Dagmara Kałkus
Daria Andrzejewska
Dorota Lewandowska
Edyta Masełko
Edyta Nowakowska
Elżbieta Filipczuk
Emilia Matyka
Ewa Gwiazdecka
Ewa Hartman
Ewa Kaczmarz-Wawryk
Ewelina Woźniak-Wrzesińska
Jadwiga Maksym
Jadwiga Kwiatkowska
Jakub Skurtys-Idczak
Jan A. Wieczorek
Jan Klajn
Joanna Stankiewicz
Joanna Wieczorek
Julia Gryszczuk-Wicijowska
Justyna Markowicz
Justyna Wieczorek
Kacper Paszke
Kamil Kurpiel
Kamil Wabnic
Kamila Rozenek
Kamila Wojda
Karolina Jaworska
Karolina Rosa
Katarzyna Hołojda
Katarzyna Klajn
Katarzyna Kowol
Katarzyna Podlaska
Katarzyna Wodyk
Lilia Nikołajczuk
Łukasz Toruński
Małgorzata Kita
Małgorzata Kościelniak
Małgorzata Ohia-Nowak
Małgorzata Skibińska
Marek Maziarz
Marek Pustowaruk
Maria Głąbska
Maria Rudnicka
Marta Dobrowolska-Pigoń
Marta Micuła
Marta Paszke
Martyna Kaźmierczak
Michał Gajek
Monika Frącz
Natalia Kaśków
Natalia Kościńska
Natalia Podbielska
Natalia Śmiełowska
Oliwer Wicha
Patrycja Krysiak
Patrycja Kurczewska
Paulina Witkowska
Paweł Nowak
Przemysław Smoleń
Tomasz Stępień
Urszula Rezler
Wiktoria Janas
Wojciech Witkowski
Zofia Smuga
Monika Zaśko-Zielińska

Partners and funding

Institutions supporting the development of Słowosieć and selected grant projects.
DariahLab

DariahLab

Research infrastructure for digital humanities

Wrocław University of Science and Technology

Wrocław University of Science and Technology

Lead institution, Language Technology Group

University of Wrocław

University of Wrocław

Academic and substantive partner

Work on Słowosieć is carried out thanks to grants from the Ministry of Science and Higher Education, EU funds, and as part of the pan-European research infrastructure CLARIN and the Polish consortium CLARIN-PL.

Numerous research teams and commercial partners participate in the project. Funding covers both the development of the resource itself and the creation of tools for text analysis, media monitoring, big data work, and educational applications.

Selected projects

An overview of selected research and commercial projects funding the development of Słowosieć.

MNiSW2016-07-01 – 2018-06-30

CLARIN (2): Finansowanie kosztów wkładu krajowego na rzecz udziału we współnym imiędzynarodowym przedsięwzięciu pn: "CLARIN ERIC - European Research Infrastructure

MINISTERSTWO NAUKI I SZKOLNICTWA WYŻSZEGO Piasecki Maciej

5 150 832 zł

Commercial2020-01-10 – 2020-04-15

Prowadzenie i rozwój Zintegrowanego Rejestru Kwalifikacji.

INSTYTUT BADAŃ EDUKACYJNYCH Piasecki Maciej

229 675 zł

Commercial2019-01-01 – 2020-05-31

System wspomagania optymalizacji treści we własnych kanałach marketingowych marki wraz z narzędziami wykrywania trendów i przewidywania, bazujący na przetwarzaniu tekstu,obrazu,video i danych z mediów

SMARTNET RESEARCH & SOLUTIONS SPÓŁKA Z OGRANICZONĄ ODPOWIEDZIALNOŚCIĄ Piasecki Maciej

379 192 zł

Commercial2018-06-01 – 2019-10-31

Opracowanie kompleksowej metody analizy emotywnej i polaryzacji wydzwięku emocjonalnego wypowiedzi tekstowych w jezyku polskim.

W3A.PL SPÓŁKA Z OGRANICZONĄ ODPOWIEDZIALNOŚCIĄ Piasecki Maciej

581 560 zł

MNiSW2018 – 2021

CLARIN-PL (3) – „Polska część infrastruktury naukowej CLARIN ERIC: Wspólne zasoby językowe i infrastruktura technologiczna”, finansowanie kosztów wkładu krajowego wnoszonego na rzeczudziału we wspólnym międzynarodowym przedsięwzięciu pn: CLARIN ERIC – European Research Infrastructure Consortium: Common Language Resources and Technology Infrastructure;

MINISTERSTWO NAUKI I SZKOLNICTWA WYŻSZEGO Piasecki Maciej

8 866 992 zł

Commercial2017-10-25 – 2019-06-16

SentiBigData- platforma do monotoringu mediów społecznościowych i Internetu oraz automatycznego raportowania.

SENTIONE SP. Z O.O. Piasecki Maciej

1 474 856 zł

Commercial2017 – 2019

SentiCognitiveServices – nowa generacja usług do automatyzacji marketingu i obsługi sieci społecznościowych oparta o metody sztucznej inteligencji

SENTIONE SP. Z O.O. Piasecki Maciej

1 814 073 zł

Commercial2017-06-01 – 2018-05-31

Opracowanie metody automatycznej analizy emotywnej i polaryzacji wydźwięku emocjonalnego polskiego tekstu na poziomie leksykalnym w oparciu o dużą leksykalną sieć semantyczną języka polskiego.

W3A.PL SPÓŁKA Z OGRANICZONĄ ODPOWIEDZIALNOŚCIĄ Piasecki Maciej

662 434 zł

Commercial2017-01-01 – 2017-12-31

Wykonywanie prac badawczo-rozwojowych na potrzeby współpracy z przemysłem.

Piasecki Maciej

100 000 zł

Commercial2016-05-01 – 2017-12-31

Wykonywanie prac badawczo- rozwojowych na potrzeby współpracy z przemysłem.

Piasecki Maciej

100 000 zł

NCN2016-04-01 – 2019-03-31

Ekwiwalencja międzyjęzykowa w leksykalnych bazach danych.

NARODOWE CENTRUM NAUKI Piasecki Maciej

336 388 zł

MNiSW2015-03-01 – 2016-04-30

CLARIN wsparcie: "Opracowanie metodologii prac nad rozwojem infrastruktury technologii językowych CLARIN oraz upowszechnienie..."

MINISTERSTWO NAUKI I SZKOLNICTWA WYŻSZEGO Piasecki Maciej

375 000 zł

Equipment2013-03-01 – 2016-04-30

CLARIN (1): Polska część infrastruktury naukowej CLARIN ERIC: Wspólne zasoby językowe i infrastruktura technologiczna.

MINISTERSTWO NAUKI I SZKOLNICTWA WYŻSZEGO Piasecki Maciej

16 495 280 zł

Commercial2014-11-03 – 2017-02-22

Umowa o wykonanie produktu: Narzędzie do proponowania zbioru słów kluczowych

AGORA SPÓŁKA AKCYJNA Piasecki Maciej

70 390 zł

Commercial2014-11-03 – 2016-06-30

Umowa o wykonanie produktu: Narzędzie do grupowania dokumentów z serwisów internetowych

Piasecki Maciej

71 548 zł

Commercial2014-11-03 – 2017-02-22

Umowa o wykonanie produktu: Rozszerzony mechanizm rzutowania tekstu na rozszerzoną ontologię ogólną

AGORA SPÓŁKA AKCYJNA Piasecki Maciej

109 740 zł

Commercial2014-10-06 – 2017-02-22

Umowa o wykonanie produktu: Rozszerzony system do rozpoznawa nia nazw własnych dedykowany do formatu dokumentów i zasobów treściowych Agory

AGORA SPÓŁKA AKCYJNA Piasecki Maciej

310 000 zł

Commercial2014-10-06 – 2017-02-22

Rozszerzone narzędzie do automatycznego proponowania tekstowych słów kluczowych

AGORA SPÓŁKA AKCYJNA Piasecki Maciej

129 870 zł

NCBiR2010-08-16 – 2014-07-31

SyNaT - Utworzenie uniwersalnej, otwartej, repozytoryjnej platformy hostingowej i komunikacyjnej dla sieciowych zasobów wiedzy dla nauki, edukacji i otwartego społeczeństwa wiedzy

Piasecki Maciej

2 823 046 zł

NCBiR2009 – 2014

NEKST – "Adaptacyjny system wspomagający rozwiązywanie problemów w oparciu o analizę treści dostępnych źródeł elektronicznych

Piasecki Maciej

4 110 743 zł

MNiSW2009 – 2012

Konstrukcja zasobów leksykalnych przez rozpoznawanie relacji semantycznych na podstawie danych morfosyntaktycznych i semantycznych w korpusach tekstu

MINISTERSTWO NAUKI I SZKOLNICTWA WYŻSZEGO Piasecki Maciej

406 960 zł

europejski FP7-Infrastructures-2007-12008 – 2011

CLARIN – Common Language Resources and Technology Infrastructure

Piasecki Maciej

44 960

MNiSW2005 – 2008

Wielopoziomowe algorytmy rozpoznawania ręcznie pisanych tekstów medycznych

MINISTERSTWO NAUKI I SZKOLNICTWA WYŻSZEGO Sas Jerzy
MNiSW2005 – 2008

Automatyczne metody konstrukcji sieci semantycznej leksemów polskich na potrzeby przetwarzania języka naturalnego

MINISTERSTWO NAUKI I SZKOLNICTWA WYŻSZEGO Piasecki Maciej

366 900 zł

Showing 24 of 24 projects

License

Rules for using Słowosieć and its data.

By decision of the university authorities, Słowosieć is available free of charge for general use (including commercial use) under a license modeled on the Princeton WordNet license.

plWordNet License

plWordNet® is unencumbered, and may be used in commercial applications in accordance with the following license agreement. An attorney representing the commercial interest should review this plWordNet license with respect to the intended use. plWordNet License

This license is available as the file LICENSE in any downloaded version of plWordNet.

This software and database are being provided to you, the LICENSEE, by Wrocław University of Technology under the following license. By obtaining, using and/or copying this software and database, you agree that you have read, understood, and will comply with these terms and conditions: permission to use, copy, modify, distribute, and public expose this software and database (including data getting) and its documentation for any purpose and without fee or royalty is hereby granted, provided that you agree to comply with the following copyright notice and statements, including the disclaimer, and that the same appear on ALL copies of the software, database and documentation, including modifications which you make for internal use or for wider distribution.

plWordNet 4.2 © 2020 by Wrocław University of Technology. All rights reserved.

THIS SOFTWARE AND DATABASE IS PROVIDED "AS IS" AND WROCŁAW UNIVERSITY OF TECHNOLOGY MAKES NO REPRESENTATIONS OR WARRANTIES, EXPRESS OR IMPLIED. BY WAY OF EXAMPLE, BUT NOT LIMITATION, WROCŁAW UNIVERSITY OF TECHNOLOGY MAKES NO REPRESENTATIONS OR WARRANTIES OF MERCHANT-ABILITY OR MERCHANT-FITNESS FOR ANY PARTICULAR PURPOSE; NOR DOES WROCŁAW UNIVERSITY OF TECHNOLOGY MAKE ANY REPRESENTATIONS OR WARRANTIES THAT THE USE OF THE LICENSED SOFTWARE, DATABASE OR DOCUMENTATION WILL NOT INFRINGE ANY THIRD PARTY PATENTS, COPYRIGHTS, TRADEMARKS OR OTHER RIGHTS.

The name of Wrocław University of Technology may not be used in advertising or publicity pertaining to distribution of the software, the database or both. Title to copyright in this software, database and any associated documentation shall at all times remain with Wrocław University of Technology, and LICENSEE agrees to preserve this copyright

Get started

Ready to use Słowosieć in your project?

Join the research and engineering teams using Słowosieć. Browse the resource, cite it in publications, or integrate it with your own NLP tools.

20+ years

of continuous development

Open

access and license

196,000+

lemmas in the database

FENG