Cristin-resultat-ID: 1925385
Sist endret: 9. februar 2022, 07:37
NVI-rapporteringsår: 2021
Resultat
Vitenskapelig Kapittel/Artikkel/Konferanseartikkel
2021

skweak: Weak Supervision Made Easy for NLP

Bidragsytere:
  • Pierre Lison
  • Jeremy Barnes og
  • Aliaksandr Hubin

Bok

Om resultatet

Vitenskapelig Kapittel/Artikkel/Konferanseartikkel
Publiseringsår: 2021
Sider: 337 - 346
ISBN:
  • 978-1-954085-56-5
Open Access

Klassifisering

Fagfelt (NPI)

Fagfelt: IKT
- Fagområde: Realfag og teknologi

Beskrivelse Beskrivelse

Tittel

skweak: Weak Supervision Made Easy for NLP

Sammendrag

We present skweak, a versatile, Python-based software toolkit enabling NLP developers to apply weak supervision to a wide range of NLP tasks. Weak supervision is an emerging machine learning paradigm based on a simple idea: instead of labelling data points by hand, we use labelling functions derived from domain knowledge to automatically obtain annotations for a given dataset. The resulting labels are then aggregated with a generative model that estimates the accuracy (and possible confusions) of each labelling function. The skweak toolkit makes it easy to implement a large spectrum of labelling functions (such as heuristics, gazetteers, neural models or linguistic constraints) on text data, apply them on a corpus, and aggregate their results in a fully unsupervised fashion. skweak is especially designed to facilitate the use of weak supervision for NLP tasks such as text classification and sequence labelling. We illustrate the use of skweak for NER and sentiment analysis. skweak is released under an open-source license and is available at https://github.com/NorskRegnesentral/skweak

Bidragsytere

Aktiv cristin-person

Pierre Lison

  • Tilknyttet:
    Forfatter
    ved Avdeling for statistisk analyse og maskinlæring for brukermotiverte anvendelser SAMBA ved Norsk Regnesentral

Jeremy Claude Barnes

Bidragsyterens navn vises på dette resultatet som Jeremy Barnes
  • Tilknyttet:
    Forfatter
    ved Forskningsgruppen for språkteknologi ved Universitetet i Oslo

Aliaksandr Hubin

  • Tilknyttet:
    Forfatter
    ved Matematisk institutt ved Universitetet i Oslo
1 - 3 av 3

Resultatet er en del av Resultatet er en del av

1 - 1 av 1