Frasstrukturgrammatik
|
|
- Christian Fransson
- för 8 år sedan
- Visningar:
Transkript
1 729G09 Språkvetenskaplig databehandling (2016) Frasstrukturgrammatik Marco Kuhlmann Institutionen för datavetenskap
2 Korpusdata 1 Folkpensionen folkpension NOUN 2 dobj 2 får få VERB 0 root 3 man man PRON 2 nsubj 4 oberoende oberoende ADJ 7 case 5 av av ADP 4 mwe 6 tidigare tidig ADJ 7 det 7 arbetsinkomst arbetsinkomst NOUN 2 nmod 8.. PUNCT 2 punct
3 Denna föreläsning Generativ grammatik Frasstrukturgrammatik Kontextfri grammatik
4 Generativ grammatik
5 Generativ grammatik Generativ grammatik är en samlad benämning på en speciell typ av grammatiska teorier. Principerna bakom generativ grammatik formulerades först av den amerikanske lingvisten Noam Chomsky (född 1928). Syntactic Structures (1957) Noam Chomsky Generativ grammatik är idag en paradigm inom lingvistiken. Minimalist Program, Lexical Functional Grammar (LFG), Head-Driven Phrase Structure Grammar (HPSG)
6 Vad är ett språk? Ett språk som svenska kan beskrivas på många olika sätt. teckensystem, kommunikationsmedel, socialt normsystem Inom den generativa grammatiken beskriver man språk som en mängd, närmare bestämt som en mängd av satser. min bror köpte cykeln av en gammal vän den gamla damen träffade killen med handväskan En grammatik är en explicit redogörelse för en sådan mängd.
7 En sats en sekvens av ord? antal ord antal permutationer
8 Grammatiska och ogrammatiska satser Bara ett litet fåtal av de möjliga permutationerna är grammatiska. grammatiska satser cykeln köpte min bror av en gammal vän köpte min bror cykeln av en gammal vän ogrammatiska satser *vän gammal en av cykeln köpte bror min *min gammal bror av en cykeln köpte vän
9 Grammatiskt versus faktiskt förekommande Det finns ogrammatiska satser som är fullt begripliga. den stora hus byggt av Kalle Det finns grammatiska satser som är svårbegripliga. osten möglade osten råttan tog möglade osten råttan katten jagade tog möglade osten råttan katten hunden bet jagade tog möglade
10 Om synen på data Generativ grammatik Empiriska data utgörs av satser och talares omdömen om dem. Utvärderingskriterium: Är detta en adekvat beskrivning? En välformad sats är inte alltid ett faktiskt förekommande yttrande. Språkteknologi Empiriska data utgörs av faktiskt förekommande yttranden. Utvärderingskriterium: Hjälper detta i användningen? in vivo-utvärdering, in vitro-utvärdering
11 Hur ska en grammatik se ut? Allmänt sett finns det två olika sätt att ange en mängd: extensionellt (genom uppräkning) {Helsingfors, Köpenhamn, Oslo, Reyjkjavik, Stockholm} intensionellt (genom beskrivning) {x x är huvudstad i ett nordiskt land}
12 Varför en intensionell redogörelse? Varje naturligt språk består av oändligt många satser. osten råttan katten hunden bet jagade tog möglade En grammatik ska även redogöra för satsernas struktur. min bror köpte cykeln av en gammal vän [min bror] [köpte cykeln av en gammal vän] [[min] [bror]] [[köpte] [cykeln] [av en gammal vän]] [[min] [bror]] [[köpte] [cykeln] [av [en gammal vän]]] [[min] [bror]] [[köpte] [cykeln] [av [[en] [gammal] [vän]]]]
13 Adekvathet En grammatik är observationsmässigt adekvat om den genererar alla och endast de grammatiska satserna i det aktuella språket. En grammatik är deskriptivt adekvat om den tilldelar varje grammatisk sats en strukturell beskrivning.
14 Denna föreläsning Generativ grammatik Frasstrukturgrammatik Kontextfri grammatik
15 Frasstrukturgrammatik
16 Fraser Ordgrupper kan ibland fungera som enskilda ord. Statsministern. En stad av samma storlek som Linköping. Elin i Hagen. Hon och var och en av oss. Sådana ordgrupper kallas fraser.
17 Exempel på fraser nominalfraser (NP) hon. Stefan Löfvén. ett sådant klassiskt ställe som Operakällaren. verbfraser (VP) rodnade. bad henne att sätta sig hos honom. levde lyckliga i alla sina dagar. prepositionsfraser (PP) på bordet. bortom all kontroll. med viss självständighet.
18 Frasstrukturgrammatik Fraser kan sättas ihop för att bilda större fraser. generativt perspektiv En komplex fras kan delas upp i mindre fraser. analytiskt perspektiv Detta ger upphov till en hierarkisk struktur som kan beskrivas med hjälp av en frasstrukturgrammatik.
19 Lexikala kategorier A DET N P TV adjektiv determinator (eng. determiner) nomen (eng. noun); substantiv preposition transitivt verb
20 Verbindelning efter transitivitet Intransitiva verb kräver en nominalfras som subjekt. Kalle springer. Båten sjunker. Monotransitiva verb har både subjekt och direkt objekt. Lisa spelar fotboll. Jag sköt en gås. Mormor vek papperssvalor. Bitransitiva verb har subjekt, direkt och indirekt objekt. Vi lånade henne två cd-skivor. Man skänkte staden en staty.
21 Icke-lexikala kategorier AP S NP PP VP adjektivfras (eng. adjective phrase) sats (eng. sentence) nominalfras (eng. noun phrase) prepositionsfras (eng. prepositional phrase) verbfras (eng. verb phrase)
22 Flertydighet I booked a flight from L.A. Denna mening är flertydig. På vilket sätt? Hur yttrar sig flertydigheten med avseende på frasstrukturen?
23 Analys 1: PP modifierar verbets objekt S NP VP Pro Verb NP I booked Det Nom a Nom PP Noun from LA flight
24 Analys 2: PP modifierar verbet S NP VP Pro Verb NP PP I booked Det Nom from LA a Noun flight
25 Kombinatorisk explosion exponentiell kubisk linjär
26 Denna föreläsning Generativ grammatik Frasstrukturgrammatik Kontextfri grammatik
27 Kontextfria grammatik
28 Kontextfri grammatik (CFG) Kontextfri grammatik är en specifik formalism för att beskriva den syntaktiska strukturen hos naturliga språk i termer av hierarkiska fraser. även programspråk En kontextfri grammatik består i huvudsak av ett antal regler som beskriver hur fraser kan delas upp i mindre fraser, ända ner till ordnivån.
29 En kontextfri grammatik Regel S NP VP NP Pronoun NP Proper-Noun NP Det Nominal Nominal Nominal Noun Nominal Noun VP Verb VP Verb NP VP Verb NP PP VP Verb PP PP Preposition NP Exempel I + want a morning flight I Los Angeles a flight morning flight flights do want + a flight leave + Boston + in the morning leaving + on Thursday from + Los Angeles
30 Ingredienser i en kontextfri grammatik N T P S en mängd av frassymboler (eng. nonterminals) en mängd av ord (eng. terminals) en mängd av produktioner eller regler en speciell frassymbol; grammatikens startsymbol
31 Notation för regler vänsterled S NP VP högerled En mening (S) består av en nominalfras (NP) och en verbfras (VP).
32 En kontextfri grammatik Regel S NP VP NP Pronoun NP Proper-Noun NP Det Nominal Nominal Nominal Noun Nominal Noun VP Verb VP Verb NP VP Verb NP PP VP Verb PP PP Preposition NP Exempel I + want a morning flight I Los Angeles a flight morning flight flights do want + a flight leave + Boston + in the morning leaving + on Thursday from + Los Angeles
33 Frasstrukturträd S NP VP Pro Verb NP I prefer Det Nom a Nom Noun Noun flight morning
34 Övning: Generera meningar Lexikala regler DT en IV sover NN hund hunden NN kastrull kastrullen PN Pelle PRO hon PREP på TV kastar Icke-lexikala regler S NP VP NP DT NN NP NN NP PN NP PRO VP IV VP TV NP VP TV NP PP PP PREP NP
35 Begränsningar av kontextfria grammatiker Kontextfria grammatiker kan modellera många intressanta aspekter hos naturliga språk. språklig kreativitet, inbäddade strukturer Men det finns andra aspekter som de inte är så bra på eller inte kan modellera alls. kongruensböjning, korsande dependenser
36 Kongruensböjning På engelska måste ett subjekt ha samma numerus som det verb det är kopplat till. *[A flight] [leave Boston in the morning]. Reglerna från vår exempelgrammatik fångar inte in detta. Man säger att grammatiken övergenererar.
37 Kongruensböjning Ett sätt att lösa problemet är att specialisera reglerna med morfologiska särdrag: Regel S NP[sg] VP[sg] NP[sg] Det[sg] Nom[sg] VP[sg] Verb[sg] PP NP[pl] Det[pl] NP[pl] Exempel this flight + leaves on Monday this + flight leaves + on Monday these + flights Detta gör dock att grammatiken blir väldigt stor.
38 Chomsky-hierarkin rekursivt uppräkningsbara språk kontextkänsliga språk kontextfria språk reguljära språk
39 Denna föreläsning Generativ grammatik Frasstrukturgrammatik Kontextfri grammatik
729G09 Språkvetenskaplig databehandling
729G09 Språkvetenskaplig databehandling Modellering av frasstruktur Lars Ahrenberg 2015-05-04 Plan Formell grammatik språkets oändlighet regler Frasstrukturgrammatik Kontextfri grammatik 2 Generativ grammatik
Föreläsning 5: Modellering av frasstruktur. 729G09 Språkvetenskaplig databehandling Lars Ahrenberg
Föreläsning 5: Modellering av frasstruktur 729G09 Språkvetenskaplig databehandling Lars Ahrenberg 2014-05-05 1 Översikt Introduktion generativ grammatik och annan syntaxforskning Att hitta mönster i satser
Fraser, huvuden och bestämningar
UPPSALA UNIVERSITET Grammatik för språkteknologer Institutionen för lingvistik och filologi Föreläsningsanteckningar Mats Dahllöf November 2015 Fraser, huvuden och bestämningar Översikt i stolpform. Terminologin
Modellering med kontextfri grammatik Kontextfri grammatik - definition En enkel kontextfri grammatik Klasser av formella språk
Modellering med kontextfri grammatik Kontextfri grammatik - definition Kontextfri grammatik (CFG) definition modellering av frasstruktur andra exempel Dependensgrammatik Trädbanker Varianter av kontextfri
Grammatisk teori II Attributvärdesgrammatik
Grammatisk teori II Attributvärdesgrammatik 1. Lexikon and syntaktiska regler Inom lingvistisk teori delas den mentala representationen av språket upp i två centrala komponenter: lexikon och syntaktiska
Grammatik för språkteknologer
Grammatik för språkteknologer Fraser http://stp.lingfil.uu.se/~matsd/uv/uv12/gfs/ Språkteknologiska grammatikkomponenter Tokenisering urskilja graford. Ordklasstaggning och annan taggning tilldela dem
Datorlingvistisk grammatik
Datorlingvistisk grammatik Kontextfri grammatik, m.m. http://stp.lingfil.uu.se/~matsd/uv/uv11/dg/ Mats Dahllöf Institutionen för lingvistik och filologi Februari 2011 Denna serie Formella grammatiker,
Särdrag, lexikon och syntax. Ordklasser. Ordklasskriterier II. Ordklasskriterier. Öppna klasser. Slutna klasser
Särdrag, lexikon och syntax Ordklasser Slutna klasser: prepositioner, konjunktioner, subjunktioner m.fl. (funktionsord) Inga nya ord bildas. Ola Knutsson knutsson@nada.kth.se Öppna klasser: substantiv,
Ordklasser. Särdrag, lexikon och syntax. Ordklasskriterier II. Ordklasskriterier. Öppna klasser. Slutna klasser
Ordklasser Särdrag, lexikon och syntax Ola Knutsson knutsson@nada.kth.se Slutna klasser: prepositioner, konjunktioner, subjunktioner m.fl. (funktionsord) Inga nya ord bildas. Öppna klasser: substantiv,
Lingvistiska grundbegrepp
729G09 Språkvetenskaplig databehandling (2016) Lingvistiska grundbegrepp Marco Kuhlmann Institutionen för datavetenskap Vad är korpuslingvistik? Korpuslingvistik handlar om att undersöka språkvetenskapliga
Innehåll. Syntax. Kan allt delas upp i små delar? Varför är syntax fascinerande? Vad är syntax? Olika språksyn
Syntax Språkteknologi DH2418 Ola Knutsson knutsson@csc.kth.se Innehåll Grundläggande begrepp Två perspektiv på syntax Frasstrukturgrammatiker Olika frastyper och regler för dessa Dependensgrammatik Olika
Lingvistiskt uppmärkt text
729G09 Språkvetenskaplig databehandling (2018) Lingvistiskt uppmärkt text Marco Kuhlmann Institutionen för datavetenskap Korpusdata: Ett konkret exempel 1 Genom genom ADP 2 case 2 skattereformen skattereform
Innehåll. Syntax. Kan allt delas upp i små delar? Varför är syntax fascinerande? Olika språksyn. Vad är syntax?
Syntax Språkteknologi DH2418 Ola Knutsson knutsson@csc.kth.se Grundläggande begrepp Två perspektiv på syntax Frasstrukturgrammatiker Innehåll Olika frastyper och regler för dessa Dependensgrammatik Olika
Konstituenter och frasstruktur. 729G49 16 April
Konstituenter och frasstruktur 729G49 16 April Dagens föreläsning Konstituenter (Fraser och satser) Fraser Frasstrukturer Vad hände? Mannen bet hunden man -> man (rot) + en (suffix) [bestämd betydelse]
TDDD02 Språkteknologi (2016) Syntaktisk analys. Marco Kuhlmann Institutionen för datavetenskap
TDDD02 Språkteknologi (2016) Syntaktisk analys Marco Kuhlmann Institutionen för datavetenskap Syntax pragmatik semantik analys generering syntax morfologi Syntaktisk parsning Syntaktisk parsning är uppgiften
Satser och satsdelar. 1 Satser och satsdelar inledning. 2 Primära satsdelar predikatet. 2.1 Översikt. Grammatik för språkteknologer
UPPSALA UNIVERSITET Grammatik för språkteknologer Institutionen för lingvistik och filologi Föreläsningsanteckningar Mats Dahllöf November 2015 Satser och satsdelar Översikt i stolpform. Terminologin följer
Sidan 1. Repetition: satsledsanalys (delvis från övningsboken) Satser och struktur Föreläsning 8, Lingvistik grundkurs. Vad är objekt och predikativ?
Repetition: satsledsanalys (delvis från övningsboken) Satser och struktur Föreläsning 8, Lingvistik grundkurs Magnus Merkel 2006-02-13 Greta Jansson är 96 år. Han växte upp på landsbygden när man hade
Grammatisk teori III Praktisk analys
Grammatisk teori III Praktisk analys 1. Satser Till skillnad från fraser har satser inga givna strukturella huvuden. Olika teorier gör olika antaganden om vad som utgör satsens huvud. Den lösning som förespråkas
Språkets struktur och funktion, 7,5 hp
Språkets struktur och funktion, 7,5 hp Ellen Breitholtz, ellen@ling.gu.se, Cajsa Ottesjö, cajsao@ling.gu.se ht 2010 Schema, planering Torsdag 4/11: Introduktion, historisk översikt Att läsa: Handout Tisdag
Lingvistik IV Konstituenter och frasstruktur
Lingvistik IV Konstituenter och frasstruktur Dagens föreläsning kommer att ta upp: Konstituenter (Fraser och satser) Fraser Frasstrukturer 1. Konstituenter När vi tittar på hur en mening är uppbyggd kan
Ordklasser. Särdrag, lexikon och syntax. Öppna klasser. Slutna klasser. Vilka ord i lexikon? Vad skall man med en grammatik till?
Ordklasser Särdrag, lexikon och syntax Slutna klasser: prepositioner, konjunktioner, subjunktioner m.fl. (funktionsord) Inga nya ord bildas. Öppna klasser: substantiv, adjektiv, verb, adverb Ständiga nybildningar
Grundläggande syntaktiska funktioner och roller
UPPSALA UNIVERSITET Inst. för lingvistik Niklas Edenmyr Grammatik, 5p. SYNTAKTISKA FUNKTIONER/SATSDELAR Grundläggande syntaktiska funktioner och roller o Exemplen nedan kan få illustrera två grundläggande
Fraser och satsled. Språkets uppbyggnad. Definitioner. Språkets uppbyggnad. De fem frastyperna. Allmänt om fraser
Språkets uppbyggnad Fraser och satsled Språkvetenskaplig databehandling Maria Holmqvist 2011-03-11 Ord som bildar Fraser som bildar Satser som bildar Meningar/yttranden som bildar Texter/dialoger/monologer
FL 6: Definite Clause Grammars (kap. 7)
FL 6: Definite Clause Grammars (kap. 7) Teori Introducerar kontextfria grammatikor och några besläktade begrepp Introducerar definite clause - grammatikor, Prologs sätt att jobba med kontextfria grammatikor
KODNING AV MAXIMALA GRAMMATISKA ENHETER Manual
KODNING AV MAXIMALA GRAMMATISKA ENHETER Manual Jens Allwood Maria Björnberg Alexandra Weilenmann Version 1, januari 1999 1. Principer för kodning av maximala grammatiska enheter När man kodar maximala
Morfologi och syntax. Föreläsning 1 & 2
Morfologi och syntax Föreläsning 1 & 2 Lotta Plejert Kognitionsvetenskapliga programmet, ht2012 november 2012 1 1 Språk som system Olika nivåer Text/diskurs mening sats fras ord morfem fonem text och diskurs
UPPSALA UNIVERSITET Institution för lingvistik och filologi Föreläsningsanteckningar Mats Dahllöf HT 2015 (korrigerad 151126) Depdsgrammatik Dna introduktion till depdsgrammatik försöker följa d standard
Ord, lexem, ordformer (repetition) Ord och morfem (repetition) Fraser/konstituenter (repetition) Grammatisk analys i språkteknologin
Datorlingvistisk grammatik OH-serie 1: introduktion http://stp.lingfil.uu.se/~matsd/uv/uv09/dlg/ LEKTION 1: innehåll Kursformalia Grammatik formell grammatik. Metod och data (lite). Språkteknologisk relevans.
Lingvistiskt uppmärkt text
729G09 Språkvetenskaplig databehandling (2016) Lingvistiskt uppmärkt text Marco Kuhlmann Institutionen för datavetenskap Från form till betydelse pragmatik semantik analys generering syntax morfologi Skolans
Syntaktisk parsning (Jurafsky & Martin kapitel 13)
Syntaktisk parsning (Jurafsky & Martin kapitel 13) Mats Wirén Institutionen för lingvistik Stockholms universitet mats.wiren@ling.su.se DH2418 Språkteknologi DA3010 Språkteknologi för datorlingvister Föreläsning
Inlämningsuppgift: Pronomenidentifierare
1 (7) Inlämningsuppgift: Pronomenidentifierare 2D1418 Språkteknologi landes@bredband.net johnne@kth.se 1 2 (7) 1 Uppgiften... 3 2 Algoritmen i korthet... 3 3 Representation av data... 3 4 Indikatorer...
Syntax Fras, sats, mening
Allmän grammatik 6 Fraser Syntax Fras, sats, mening Lösryckta satsdelar utan kontext; benämns utifrån huvudordet. nominalfras (nomen, dvs. substantiviskt ord + bestämningar) min lilla bortskämda katt,
Tekniker för storskalig parsning: Grundbegrepp
Tekniker för storskalig parsning: Grundbegrepp Joakim Nivre Uppsala Universitet Institutionen för lingvistik och filologi joakim.nivre@lingfil.uu.se Tekniker för storskalig parsning: Grundbegrepp 1(17)
TDDC89 LINGVISTIK måndag 20 oktober 2008
Magnus Merkel Lars Ahrenberg Institutionen för datavetenskap Linköpings universitet RÄTTNINGSMALL TDDC89 LINGVISTIK måndag 20 oktober 2008 Inga hjälpmedel är tillåtna. Maximal poäng är 36. 18 p ger säkert
GÖTEBORGS UNIVERSITET Institutionen för svenska språket. Introduktion till frasstrukturgrammatik
GÖTEBORGS UNIVERSITET Institutionen för svenska språket Introduktion till frasstrukturgrammatik Benjamin Lyngfelt 2004 Innehåll 1. Introduktion 1 1.1. Jämförelse med traditionell satsdelsanalys 2 1.2.
Datum: Date: Provkodr: KTR1 Exam code:
Del 1. Ordklasser (5p) Ange ordklass för de understrukna orden i texten. Då jag föddes i juli 1918 hade mor (1) spanska sjukan, jag var i dåligt skick och (2) nöddöptes på sjukhuset. En dag fick familjen
Yvonne Adesam. Syntaktisk analys. Parsning. Ambiguitet. Utvärdering. References
2014 Outline Min bakgrund Disputerade 2012 Avhandling om att skapa högkvalitativa parallella trädbanker Flerspråkiga parallella trädbanken Smultron Forskare på Språkbanken Historiska resurser (MAÞiR 2014-2016)
Satslära introduktion
Satslära introduktion Dolores Meden Dolores Meden 2010-08-27 1 Skillnaden mellan ordklass och ett ords funktion (syntax): * ett ords tillhörighet i en ordklass är konstant och påverkas inte av användningen
Lite mer psykologi. L2: Automater, Sökstrategier. Top-down. Kimballs sju principer
Lite mer psykologi Perception: yntaktiskt bearbetning: emantisk bearbetning PERON() & LIKE(, y) L2: Automater, ökstrategier Korttidsminnet D4510 Parsningsalgoritmer Höstterminen 200 Långtidsminne Anders
Morfologiska kriterier. Svenska adjektiv har två slags böjningar: kongruensböjning och komparationsböjning.
UPPSALA UNIVERSITET Inst. för lingvistik Niklas Edenmyr Grammatik, 5p. ADJEKTIV Semantiska kriterier. o betecknar egenskaper eller tillstånd hos saker, personer eller företeelser., t.ex. (en) röd näsa,
SYNTAKTISKA FUNKTIONER (forts.) Attribut o Attribut ger ytterligare information om det som nominalfrasen refererar till.
UPPSALA UNIVERSITET Inst. för lingvistik Niklas Edenmyr Grammatik, 5p. SYNTAKTISKA FUNKTIONER (forts.) Attribut o Attribut ger ytterligare information om det som nominalfrasen refererar till. o Ofta fogas
Syntax 1: Fraser och satsled Syntax 2: Satser och meningar
Byggstenar Syntax 1: Fraser och satsled Syntax 2: Satser och meningar Föreläsning 6-7 Bolander kapitel 6 Lingvistik grundkurs Magnus Merkel 15 september & 17 september Sats Satsled Fraser s Ord Morfem
Hemtentamen HT13 Inlämning senast Lärare: Tora Hedin
Hemtentamen HT13 Inlämning senast 131108 Lärare: Tora Hedin Arbetet skall vara skrivet på dator och skickas in i elektronisk form till mig senast torsdagen den 8 november 2013. Dokumentets format ska vara
Semantik VT Introduktion. Dagens föreläsning. Morfem-taxonomi forts. Morfem-taxonomi. Lexikal semantik: studerar ords betydelse
Dagens föreläsning Semantik VT07 Ordbetydelse (Lexikal semantik) Stina Ericsson 1. Introduktion 2. Extensioner 3. Begrepp 4. Extensioner och begrepp - några ytterligare saker Lexikal semantik: studerar
Satsled och satstruktur
Innehåll Satsled och satstruktur Språkvetenskaplig databehandling Maria Holmqvist 2011-03-14 Repetition: Ordklasser och fraser Satsled Satsledsanalys Syntaktiska kategorier vs. Syntaktiska relationer Satser
Språkteknologi. Språkteknologi
Språkteknologi Denna kurs handlar om naturliga språk (svenska, engelska, japanska, arabiska ), och hur vi kan få datorer att utföra användbara och intressanta uppgifter med naturliga språk. Språkteknologi
Syntax S NP VP. AdjP. sleep. ideas. DH2418 Språkteknologi Johan Boye. Syntax
Syntax S NP VP AdjP NP JJ AdjP JJ NP N V sleep AdvP Adv Colorless green ideas furiously DH2418 Språkteknologi Johan Boye Syntax Frågor vi vill besvara: Vilka sekvenser av ord tillhör språket? Vilka relationer
Lingvistik V Satsdelar, huvud- och bisatser
Lingvistik V Satsdelar, huvud- och bisatser 1. Form och funktion I språklig analys gör man en skillnad mellan en konstituents form, dvs hur den är morfologiskt och syntaktiskt uppbyggd, och dess funktion,
Datorlingvistisk grammatik
Datorlingvistisk grammatik Introduktion http://stp.lingfil.uu.se/~matsd/uv/uv11/dg/ Översikt, denna gång (och nästa?) Kursformalia, lärandemål Språkteknologi och grammatik Grunder för grammatisk analys
Tenta i Lingvistik 729G08 ht10 ( )
Tenta i Lingvistik 729G08 ht10 (11-08-25) Skrivningen består av ett antal uppgifter (14) som ska lösas efter bästa förmåga. Uppgifterna bedöms enligt följande skala: 5p = mycket bra svar, 4p = bra svar,
ORDKLASSTAGGNING. Marco Kuhlmann Institutionen för datavetenskap
ORDKLASSTAGGNING Marco Kuhlmann Institutionen för datavetenskap Ordpredicering n-gram-modeller (definition, skattning) den brusiga kanalen: P(R F) = P(F R) P(R) redigeringsavstånd, Levenshtein-avstånd
Tekniker för storskalig parsning
Tekniker för storskalig parsning Grundläggande begrepp och metoder Joakim Nivre Uppsala Universitet Institutionen för lingvistik och filologi joakim.nivre@lingfil.uu.se Tekniker för storskalig parsning
Matematik för språkteknologer
1 / 21 Matematik för språkteknologer 3.3 Kontext-fria grammatiker (CFG) Mats Dahllöf Institutionen för lingvistik och filologi Februari 2014 2 / 21 Dagens saker Kontext-fria grammatiker (CFG). CFG kan
Datorlingvistisk grammatik
Datorlingvistisk grammatik Svenskans satser m.m. http://stp.lingfil.uu.se/~matsd/uv/uv11/dg/ Mats Dahllöf Institutionen för lingvistik och filologi Januari 2011 Satser Satserna utgör den mest mångfacetterade
Byggstenar. Fraser och satsled. Sammanhang. Definitioner
Byggstenar Fraser och satsled Föreläsning 7 Lingvistik grundkurs Magnus Merkel 2006-02-09 Sats Satsled Fraser Ord Morfem Fonem 1 2 Sammanhang Fonem/grafem bildar Morfem som bildar Ord som bildar Fraser
Lingvistik V Satsdelar, huvud- och bisatser. 729G49 23 april
Lingvistik V Satsdelar, huvud- och bisatser 729G49 23 april Form och funktion Primära satsdelar Satser Form och funktion Formklassifikationen berori huvudsakpå konstituenternas interna strukturella egenskaper
Grammatik för språkteknologer
Grammatik för språkteknologer Introduktion http://stp.lingfil.uu.se/~matsd/uv/uv11/gfst/ Mats Dahllöf Institutionen för lingvistik och filologi Oktober 2011 Lärandemål Efter avslutad kurs skall studenten
Datum: Date: Provkodr: KTR1 Exam code:
Del 1. Ordklasser (5p) Ange ordklass för de understrukna orden i texten. (1) Tidigt i gryningen påbörjade han sin (2) förvandling. Han hade (3) noga planerat allting för att (4) ingenting (5) skulle kunna
TDDD02 Språkteknologi för informationssökning (2016) Ordklasstaggning. Marco Kuhlmann Institutionen för datavetenskap
TDDD02 Språkteknologi för informationssökning (2016) Ordklasstaggning Marco Kuhlmann Institutionen för datavetenskap Ordklasstaggning Tagga varje ord i en sekvens av ord (oftast en mening) med dess korrekta
Språkliga strategier för att minnas och lära, till exempel tankekartor och stödord. Mål:
Grammatikprov svenska Nu är det dags att kolla av vad eleverna lärt sig under vårens grammatik arbete. Efter påsklovet tar vi paus från veckans-ord och pluggar grammatik. För att det inte ska bli för mycket
Kompositionell semantik och λ-kalkyl
UPPALA UIVERITET http://stp.ling.uu.se/~matsd/uv/uv05/ads1/ Institutionen för lingvistik och filologi Mats Dahllöf mats.dahllof@lingfil.uu.se Algoritmer för datorlingvistisk semantik I, Föreläsningsanteckningar,
Tentamen 2016-01-13. Marco Kuhlmann
TDDD02 Språkteknologi för informationssökning (2015) Tentamen 2016-01-13 Marco Kuhlmann Denna tentamen består av 10 frågor. Frågorna 8 10 ligger på en högre kunskapsnivå än de övriga och kräver utförliga
Först lite rester...
Först lite rester... Fras Ett ord med dess bestämningar Huvudord bestämning/dependent Ett eller flera ord i frasen fyllnadsled: obligatoriska, frivilliga tilläggsled Frasers kategori? Frasers funktion?
729G09 Språkvetenskaplig databehandling
729G09 Språkvetenskaplig databehandling Föreläsning 2, 729G09, VT15 Reguljära uttryck Lars Ahrenberg 150409 Plan för föreläsningen Användning av reguljära uttryck Formella språk Reguljära språk Reguljära
729G09 Språkvetenskaplig databehandling (2018) Kursintroduktion. Marco Kuhlmann Institutionen för datavetenskap
729G09 Språkvetenskaplig databehandling (2018) Kursintroduktion Marco Kuhlmann Institutionen för datavetenskap Denna föreläsning Kursens innehåll och organisation Korpuslingvistik och språkteknologi Textsegmentering
Datum: Date: Provkodr: KTR1 Exam code:
Del 1. Ordklasser (5p) Ange ordklass för de understrukna orden i texten. Kylan förstärkte alla ljud och lade sig som en osynlig men ogenomtränglig kupa över den (1)domnande staden. Den grep tag i kvällen
Persiska. Albin Finne. Mark Peldius. 2002-10-10 2D1418 Språkteknologi
Persiska Albin Finne 2002-10-10 Sammanfattning Den här uppsatsen beskriver det persiska språket. Språkets historia, morfologi, syntax och ordförråd behandlas. Tonvikten läggs på morfologi och syntax. Avslutningsvis
Ryska pronomen. Pronomen är en sluten ordklass som består av många undergrupper. Pronomina kan fungera självständigt eller förenat
Ryska pronomen Pronomen är en sluten ordklass som består av många undergrupper. Pronomina kan fungera självständigt eller förenat 1 1.Självständiga pronomina Pronomina som kan bilda Nominal Fras (NP) på
Datum: Date: Provkodr: KTR1 Exam code:
Del 1. Ordklasser (5p) Ange ordklass för de understrukna orden i texten. En dag upptäcker min treåriga dotter (1) att det finns kärnor i äpplen. En snabb (2) genomgång av hur och varför visar (3) sig bli
Struktur och funktion i satser en introduktion till satsträd Niklas Edenmyr (Inst. f. lingvistik & filologi)
truktur och funktion i satser en introduktion till satsträd Niklas Edenmyr (Inst. f. lingvistik & filologi) Innehåll 1 Förkortningar och satsträdskonventioner...2 1.1 atser och fraser och andra trädkonstituenter...2
Ordklasser och satsdelar
Ordklasser och satsdelar Vi kommer under de kommande fyra veckorna att arbeta med ordklasser och satsdelar. Under det här arbetsområdet kommer du att få öva på följande förmågor: formulera sig och kommunicera
Grundläggande textanalys. Joakim Nivre
Grundläggande textanalys Joakim Nivre Om kursen Ni har hittills läst Lingvistik Datorteknik Matematik Språkteknologiska tillämpningar Nu ska vi börja med språkteknologi på allvar Hur gör man text hanterbar
Grammatik för språkteknologer
Grammatik för språkteknologer http://stp.lingfil.uu.se/~matsd/uv/uv12/gfs/ är konstruktioner (fraser) som innehåller ett predikat och ett subjekt (Josefssons, s. 151, definition, som är en vanlig definition).
Korpuslingvistik vt 2007
Korpuslingvistik vt 2007 Metoder för annotering II och utvärdering Beata B. Megyesi bea@stp.lingfil.uu.se 1 Annotation: Morfo-syntaktisk analys teckenkodning meningssegmentering tokenisering morfologisk
Kontextfria grammatiker
Kontextfria grammatiker Kontextfria grammatiker 1 Kontextfria grammatiker En kontextfri grammatik består av produktioner (regler) på formen S asb S T T # Vänsterledet består av en icke-terminal (variabel)
Världens språk, 7,5hp vt 2012
Niklas Edenmyr niklas.edenmyr@lingfil.uu.se Världens språk, 7,5hp vt 2012 2. Språkets arkitektur I: Texter, meningar och satser; Huvud- och bisatser; Samordning och underordning; Grammatiska relationer;
Neurolingvistik - Grammatik
Neurolingvistik - Grammatik Innehåll Grammatik-störningar vid afasi: syndrom, agrammatism och paragrammatism Verbets roll Morfologi - forskning och resultat från olika språk 3 teorier om agrammatism -
Grim. Några förslag på hur du kan använda Grim. Version 0.8
Grim Några förslag på hur du kan använda Grim Ingrid Skeppstedt Nationellt centrum för sfi och svenska som andraspråk Lärarhögskolan Stockholm Ola Knutsson IPlab Skolan för datavetenskap och kommunikation,
TDDD02 Språkteknologi för informationssökning (2016) Introduktion. Marco Kuhlmann Institutionen för datavetenskap
TDDD02 Språkteknologi för informationssökning (2016) Introduktion Marco Kuhlmann Institutionen för datavetenskap Vad är språkteknologi? Vad är språkteknologi? Språkteknologi är all teknologi som skapas
Annoteringsvägledning SWE-TIGER
Institutionen för lingvistik Datorlingvistik Stockholms universitet Annoteringsvägledning SWE-TIGER TIGER-annotering av svenska i Annotate Yvonne Samuelsson Version 1.1 (Uppdaterad Juni 2007) Innehåll
Facit för diagnostiska provet i grammatik
Facit för diagnostiska provet i grammatik Textutdrag: De tio vanligaste namnen på honhundar i Sverige är också vanliga kvinnonamn. Mest sällsynt är Bella med 1065 bärare, men åtskilliga av landets 11 954
TDDA94 LINGVISTIK, 3 poäng tisdag 19 december 2000
Lars Ahrenberg, sid 1(5) TENTAMEN TDDA94 LINGVISTIK, 3 poäng tisdag 19 december 2000 Inga hjälpmedel är tillåtna. Maximal poäng är 36. 18 poäng ger säkert godkänt. Del A. Besvara alla frågor i denna del.
*han är nyss bekymrad b)pp kan i motsats till de flesta andra Adj. aldrig ta en gradkvantor (som t.ex. mycket):
OM SVENSKA ADJEKTIV Sven-Göran Malmgren Adjektiviska funktioner i svenskan Nordistica Gothoburgensia 13. Acta Universitatis Gothoburgensis, Göteborg 1990. II + 231 s. ISBN 91-7346-206-3 Syftet med denna
Parsning = analys. Parsningsalgoritmer. Användningsområden. L1: Introduktion
Parsning = analys Maskinell analys av naturligt språks strukturer Uppgiften som en parser löser är 1. Acceptera en sträng som grammatisk, samt oftast 2. Ge en strukturell representation av strängen som
Världens språk, 7,5hp vt 2012
Niklas Edenmyr niklas.edenmyr@lingfil.uu.se Världens språk, 7,5hp vt 2012 4. Lingvistisk typologi I: Ordföljd Ordföljd: Introduktion (I) I typologi har ordföljd och framförallt relationer mellan ordföljden
FTEA12:2 Filosofisk metod. Att värdera argumentation I
FTEA12:2 Filosofisk metod Att värdera argumentation I Dagens upplägg 1. Några generella saker att tänka på vid utvärdering av argument. 2. Grundläggande språkfilosofi. 3. Specifika problem vid utvärdering:
Matematik för språkteknologer (5LN445) Institutionen för lingvistik och filologi VT 2014 Författare: Marco Kuhlmann 2013
UPPSALA UNIVERSITET Matematik för språkteknologer (5LN445) Institutionen för lingvistik och filologi VT 2014 Författare: Marco Kuhlmann 2013 4 Grafer En graf är en struktur av prickar förbundna med streck.
Delkurs grammatik (5 hp, 7,5 hp) - studiehandledning vt 2015
Linköpings universitet Institutionen för kultur och kommunikation Avdelningen för svenska och litteraturvetenskap STUDIEHANDLEDNING 2014-12- 15 714G01 Svenska språket 1, grundkurs 91SV11 Svenska (1-30hp)
Olika typer av satser
UPPSALA UNIVERSITET Grammatik för språkteknologer Institutionen för lingvistik och filologi Föreläsningsanteckningar Mats Dahllöf November 2015 Olika typer av satser Översikt i stolpform. Terminologin
ENGA21: Engelska fortsättningskurs, 30 högskolepoäng Studiebeskrivning
ENGA21: Engelska fortsättningskurs, 30 högskolepoäng Studiebeskrivning Kursen består av följande delkurser vilka beskrivs nedan: Grammatik och översättning, 5 högskolepoäng Skriftlig framställning, 4 högskolepoäng
Partiell parsning Parsning som sökning
Språkteknologi: Parsning Parsning - definition Parsningsbegrepp Chartparsning Motivering Charten Earleys algoritm (top-down chartparsning) Partiell parsning (eng. chunking) med reguljära uttryck / automater
1 Inledning. 1.1 Programförklaring. 1.2 Innehållet. 1.3 Beteckningskonventioner - 1 -
- 1-1 Inledning 1.1 Programförklaring Detta kompendium är utvecklat för en introduktionskurs i datalingvistik som vänder sig till studenter med tidigare kännedom om grundläggande lingvistik och datavetenskap.
FORSKNINGSMETODIK OCH VETENSKAPSTEORI FÖR SPRÅKVETARE: FORMELLA METODER
Mats Dahllöf, Institutionen för lingvistik, Uppsala universitet 2002-02-28 FORSKNINGSMETODIK OCH VETENSKAPSTEORI FÖR SPRÅKVETARE: FORMELLA METODER I. FORMELL METOD att arbeta vetenskapligt med formella
Satsdelar Subjekt, predikat och objekt
Satsdelar Subjekt, predikat och objekt Förkortningar o Predikat = p o Subjekt = s o Direkt objekt /ackusativobjekt = dir.obj / ao. o Indirekt objekt / dativobjekt = indir.obj / do. Vad är en satsdel? Ett
Ordklasstaggning med funktionsordslexikon. Språklig ytanalys med regler. Jabberwocky (Källgren, 1992) Mer Jabberwocky (Lewis Carrol)
Språklig ytanalys med regler Några olika system för: Ordklasstaggning Dependensgrammatik Constraint Grammar presenteras i detalj Ordklasstaggning med funktionsordslexikon Gunnel Källgrens MorP parser Den
Kursbeskrivning med litteraturlista HT-13
Kursbeskrivning med litteraturlista HT-13 Skriftlig språkfärdighet, 7,5 hp Delkurs inom Italienska I, 30 hp. Består av: I. Italiensk grammatik med inlämningsuppgifter, 6 hp, och II. Skriftlig produktion,
ENGA01: Engelska grundkurs, 30 högskolepoäng Studiebeskrivning
ENGA01: Engelska grundkurs, 30 högskolepoäng Studiebeskrivning Kursen består av följande delkurser vilka beskrivs nedan: Litteratur, 6 högskolepoäng Grammatik och översättning, 9 högskolepoäng Skriftlig
2. Utgångspunkter och angreppssätt för automatisk språkgranskning
Översikt och läsanvisning 2. Utgångspunkter och angreppssätt för automatisk språkgranskning Detta kapitel beskriver utgångspunkter och angreppssätt för automatisk språkgranskning för svenska. I kapitlet
ENGA01: Engelska grundkurs, 30 högskolepoäng Studiebeskrivning
ENGA01: Engelska grundkurs, 30 högskolepoäng Studiebeskrivning Kursen består av följande delkurser vilka beskrivs nedan: Litteratur, 6 högskolepoäng Grammatik och översättning, 9 högskolepoäng Skriftlig
Kommentarer till bedömningsmatris för Tala Kurs D
Kommentarer till bedömningsmatris för Tala Kurs D Stockholms universitet Institutionen för språkdidaktik Global bedömning Den globala bedömningen representerar bedömarens första intryck och är en övergripande