• Open Daily: 10am - 10pm
    Alley-side Pickup: 10am - 7pm

    3038 Hennepin Ave Minneapolis, MN
    612-822-4611

Open Daily: 10am - 10pm | Alley-side Pickup: 10am - 7pm
3038 Hennepin Ave Minneapolis, MN
612-822-4611
Podobieństwo statystyczne i semantyczne między zdaniami w języku angielskim

Podobieństwo statystyczne i semantyczne między zdaniami w języku angielskim

Paperback

General Computers

ISBN10: 6630276027
ISBN13: 9786630276022
Publisher: Wydawnictwo Nasza Wiedza
Published: Aug 7 2026
Pages: 52
Weight: 0.18
Height: 0.12 Width: 6.00 Depth: 9.00
Language: Polish
W niniejszej książce przedstawiono różne algorytmy slużące do obliczania podobieństwa semantycznego między tekstami w języku angielskim. Przeanalizowalem trzy różne algorytmy slużące do obliczania podobieństwa zdań w języku angielskim. Pierwszy algorytm, który zostal dokladnie zbadany w literaturze [Salton i Buckley, 1988; Wu i Salton, 1981], przypisuje slowom w każdym zdaniu wagi na podstawie częstotliwości występowania terminu oraz odwrotnej częstotliwości dokumentu (tf-idf) i nie wykorzystuje żadnych informacji semantycznych. Drugi algorytm wykorzystuje miary odleglości semantycznej między slowami należącymi do tej samej części mowy. Trzeci algorytm lączy wyniki tf-idf z wynikami odleglości semantycznej między slowami. Ocenilem wydajnośc drugiego i trzeciego algorytmu na dwóch zbiorach danych: zbiorze par zdań O'Shea z ocenami podobieństwa dokonanymi przez ludzi [Li i in., Aug, Rubenstein i Goodenough, 1965] oraz zbiorze danych parafraz na poziomie zdań opracowanym przez Microsoft Research [Rus i in., 2012]. W przypadku zbioru danych O'Shea trzeci algorytm dokladniej odzwierciedla ludzkie oceny niż drugi. W przypadku zbioru danych Microsoftu nie odnotowano istotnej różnicy między tymi dwoma algorytmami.

Also in

General Computers