<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>zinslengte &#8211; Alex Reuneker</title>
	<atom:link href="https://www.reuneker.nl/tag/zinslengte/feed/" rel="self" type="application/rss+xml" />
	<link>https://www.reuneker.nl</link>
	<description>Alex Reuneker&#039;s Blog</description>
	<lastBuildDate>Thu, 12 Jun 2025 16:22:34 +0000</lastBuildDate>
	<language>nl-NL</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	<generator>https://wordpress.org/?v=7.0.2</generator>
	<item>
		<title>&#167;242. Gemiddelde woord- en zinslengte</title>
		<link>https://www.reuneker.nl/taal/gemiddelde-woord-en-zinslengte/</link>
					<comments>https://www.reuneker.nl/taal/gemiddelde-woord-en-zinslengte/#respond</comments>
		
		<dc:creator><![CDATA[Alex]]></dc:creator>
		<pubDate>Thu, 12 Jun 2025 16:22:34 +0000</pubDate>
				<category><![CDATA[Taal]]></category>
		<category><![CDATA[calculator]]></category>
		<category><![CDATA[letter]]></category>
		<category><![CDATA[Lexicale diversiteit]]></category>
		<category><![CDATA[woorden]]></category>
		<category><![CDATA[woordlengte]]></category>
		<category><![CDATA[zinslengte]]></category>
		<guid isPermaLink="false">https://reuneker.nl/gemiddelde-woord-en-zinslengte/?p=290</guid>

					<description><![CDATA[Nog een kleine toevoeging aan de Lexical Diversity Calculator: je krijgt nu, na het analyseren van je tekst, ook de gemiddelde zinslengte (in]]></description>
										<content:encoded><![CDATA[<p>Nog een kleine toevoeging aan de <a href="https://www.reuneker.nl/ld">Lexical Diversity Calculator</a>: je krijgt nu, na het analyseren van je tekst, ook de gemiddelde zinslengte (in woorden) en de gemiddelde woordlengte (in letters/tekens). (Ook de standaarddeviaties worden daarbij gerapporteerd. Zie overigens <a href="https://academic.oup.com/edited-volume/38609/chapter-abstract/334734241?redirectedFrom=fulltext&amp;login=false" target="_blank" rel="noopener noreferrer">Grzybek, 2014</a> voor een interessant literatuuroverzicht over woordlengte.) Voor sommige onderzoekers is dat nuttig, bijvoorbeeld om te kijken of kinderen steeds langere woorden en zinnen kunnen begrijpen (zie bijvoorbeeld <a href="https://journals.sagepub.com/doi/pdf/10.1177/014272378400501403" target="_blank" rel="noopener noreferrer">George &amp; Tomasello, 1984</a> en, een stuk recenter, <a href="https://pubs.asha.org/doi/abs/10.1044/2022_LSHSS-21-00115" target="_blank" rel="noopener noreferrer">Potratz, Gildersleeve-Neumann &amp; Redford, 2022</a>).</p>
<p>Een simpel voorbeeldje. Zowel de <a href="https://nos.nl/artikel/2570851-glazen-huis-van-3fm-dit-jaar-naar-den-bosch-voor-spieren-voor-spieren" target="_blank" rel="noopener noreferrer">website van de NOS</a> als <a href="https://jeugdjournaal.nl/artikel/2570857-goede-doel-voor-3fm-serious-request-bekendgemaakt" target="_blank" rel="noopener noreferrer">de website van het Jeugdjournaal</a> rapporteert over de bekendmaking van het nieuwe goede doel van <a href="https://www.npo3fm.nl/thema/serious-request" target="_blank" rel="noopener noreferrer">3FM Serious Request</a>.</p>
<p>(Afbeelding verwijderd.)</p>
<p>De gemiddelde zinslengte in het NOS-artikeltje is 15.89 woorden en in het Jeugdjournaal-artikeltje 10.75 woorden. Wat betreft woordlengte is die bij de NOS 5.15 letters, bij het Jeugdjournaal 4.76 letters.</p>
<figure><img decoding="async" src="/wp-content/uploads/imports/20250612163257-Scherm%C2%ADafbeelding%202025-06-12%20om%2016.32.49.jpg" alt="Analyse van Jeugdjournaal-tekstje" /></figure>
<p><em>Analyse van het Jeugdjournaal-tekstje over <a href="https://www.npo3fm.nl/thema/serious-request" target="_blank" rel="noopener noreferrer">3FM Serious Request</a></em></p>
<p>Zinnen en woorden in teksten voor volwassen lijken dus inderdaad langer dan in teksten voor kinderen. De artikeltjes zijn echter veel (en veel!) te kort om echte uitspraken op te kunnen baseren (niet representatief, hoge standaarddeviatie uiteraard), maar dit was dan ook slechts een simpel en klein voorbeeldje.</p>
]]></content:encoded>
					
					<wfw:commentRss>https://www.reuneker.nl/taal/gemiddelde-woord-en-zinslengte/feed/</wfw:commentRss>
			<slash:comments>0</slash:comments>
		
		
			</item>
		<item>
		<title>&#167;216. Zinslengtecalculator</title>
		<link>https://www.reuneker.nl/taal/zinslengtecalculator/</link>
					<comments>https://www.reuneker.nl/taal/zinslengtecalculator/#respond</comments>
		
		<dc:creator><![CDATA[Alex]]></dc:creator>
		<pubDate>Sun, 23 Mar 2025 10:53:17 +0000</pubDate>
				<category><![CDATA[Taal]]></category>
		<category><![CDATA[aantal woorden]]></category>
		<category><![CDATA[calculator]]></category>
		<category><![CDATA[online]]></category>
		<category><![CDATA[tool]]></category>
		<category><![CDATA[zinslengte]]></category>
		<guid isPermaLink="false">https://reuneker.nl/zinslengtecalculator/?p=276</guid>

					<description><![CDATA[Sentence length calculator Laatst wilde ik, voor een voorbeeldje van een toepassing van de t-toets, de lengte van zinnen in twee jeugdromans met]]></description>
										<content:encoded><![CDATA[<p>Laatst wilde ik, voor een <a href="https://www.reuneker.nl/files/blog/2025/03/zinslengte-in-de-brief-voor-de-koning-en-kinderen-van-moeder-aarde">voorbeeldje van een toepassing van de t-toets</a>, de lengte van zinnen in twee jeugdromans met elkaar vergelijken. Je raadt: er moest een scriptje komen om zinnen uit teksten te halen en de woorden erin te tellen. Op een paar interpunctiedingetjes na geen lastig klusje, maar waarom niet ook hiervoor een <em>webscriptje</em> schrijven, zodat ik zoiets de volgende keer zonder enige moeite of ook maar een regel code kan doen? Bovendien kunnen ook anderen er op deze manier gebruik van maken.</p>
<p>Op <a href="https://www.reuneker.nl/senlen">https://www.reuneker.nl/senlen</a> kun je een tekst invoeren en zowel de gemiddelde zinslengte, als een lijst met alle zinnen en hun woordenaantal genereren. Toegegeven, niet iedereen zal hier enthousiast van worden, maar ik heb er best plezier in zoiets te maken en wie weet wanneer en wie het nog eens van pas komt.</p>
<figure><img decoding="async" src="/wp-content/uploads/imports/20250324100747-Scherm%C2%ADafbeelding%202025-03-24%20om%2010.07.29.jpg" alt="enter image description here" /></figure>
<p><em>Zinslengte in &#8216;De Stille Kracht&#8217; van Louis Couperus</em></p>
<p>Mocht je gewoon eens willen kijken hoe e.e.a. werkt, dan kun je gemakkelijk de zinslengtes bekijken in <a href="https://www.gutenberg.org/ebooks/164" target="_blank" rel="noopener noreferrer">Jules Vernes *Twenty Thousand Leagues under the Sea*</a> of <a href="https://gutenberg.org/ebooks/67219" target="_blank" rel="noopener noreferrer">Louis Couperus&#8217;  TOK0 Stille Kracht TOK1 </a>, die je met een klik op de desbetreffende knop op het scherm tovert.</p>
]]></content:encoded>
					
					<wfw:commentRss>https://www.reuneker.nl/taal/zinslengtecalculator/feed/</wfw:commentRss>
			<slash:comments>0</slash:comments>
		
		
			</item>
		<item>
		<title>&#167;214. Woordenschat en zinslengte in &#039;De brief voor de koning&#039; en &#039;Kinderen van moeder aarde&#039;</title>
		<link>https://www.reuneker.nl/taal/zinslengte-in-de-brief-voor-de-koning-en-kinderen-van-moeder-aarde/</link>
					<comments>https://www.reuneker.nl/taal/zinslengte-in-de-brief-voor-de-koning-en-kinderen-van-moeder-aarde/#respond</comments>
		
		<dc:creator><![CDATA[Alex]]></dc:creator>
		<pubDate>Wed, 19 Mar 2025 11:07:21 +0000</pubDate>
				<category><![CDATA[Taal]]></category>
		<category><![CDATA[Lexicale diversiteit]]></category>
		<category><![CDATA[t-toets]]></category>
		<category><![CDATA[thea beckman]]></category>
		<category><![CDATA[tonke dragt]]></category>
		<category><![CDATA[zinslengte]]></category>
		<guid isPermaLink="false">https://reuneker.nl/zinslengte-in-de-brief-voor-de-koning-en-kinderen-van-moeder-aarde/?p=274</guid>

					<description><![CDATA[Bij het eerstejaarsvak [Taal &#38; Media](https://studiegids.universiteitleiden.nl/courses/127692/taal-en-media) van de opleiding [Nederlandse Taal]]></description>
										<content:encoded><![CDATA[<p>Bij het eerstejaarsvak <a href="https://studiegids.universiteitleiden.nl/courses/127692/taal-en-media" target="_blank" rel="noopener noreferrer">Taal &amp; Media</a> van de opleiding <a href="https://studiegids.universiteitleiden.nl/studies/10229/nederlandse-taal-en-cultuur#tab-1" target="_blank" rel="noopener noreferrer">Nederlandse Taal &amp; Cultuur</a> aan de <a href="https://www.universiteitleiden.nl" target="_blank" rel="noopener noreferrer">Universiteit Leiden</a> schrijven studenten een paper over een klein onderzoekje naar een van de besproken onderwerpen. Niet zelden willen ze dan een bepaalde indicatie van tekstniveau vergelijken tussen twee corpora, zoals <a href="https://neerlandistiek.nl/2018/07/als-ik-praat-dan-praat-ik-money/" target="_blank" rel="noopener noreferrer">pop- en rapteksten</a>, <a href="https://neerlandistiek.nl/2024/07/de-woordenschat-van-kinderen-voor-kinderen/" target="_blank" rel="noopener noreferrer">verschillende jaren van Kinderen voor Kinderen</a> of examenteksten. Ze meten dan <a href="https://en.wikipedia.org/wiki/Lexical_diversity" target="_blank" rel="noopener noreferrer">lexicale diversiteit</a> in termen van bijvoorbeeld <a href="https://en.wikipedia.org/wiki/Lexical_diversity" target="_blank" rel="noopener noreferrer">type-token-ratio</a> en/of <a href="https://link.springer.com/article/10.3758/BRM.42.2.381" target="_blank" rel="noopener noreferrer">MTLD</a>.</p>
<p>Om van dergelijke vergelijkingen te kunnen zeggen of verschillen tussen twee corpora significant zijn, kun je de <a href="https://nl.wikipedia.org/wiki/T-toets" target="_blank" rel="noopener noreferrer">t-toets</a> gebruiken. Om studenten in staat te stellen dat te doen zonder uitgebreide statistiek-software te hoeven gebruiken, heb ik een <a href="https://www.reuneker.nl/t">online toegankelijke t-toets-calculator</a> gemaakt. Die waren er natuurlijk al, maar het leek me wel geschikt er een in het Nederlands te maken, die een nette rapportage van de resultaten geeft. Uiteraard moeten studenten in hun paper wel uitleggen hoe die resultaten tot stand zijn gekomen en vooral wat ze betekenen.</p>
<p>Als voorbeeld kijken we naar jeugdliteratuur. Naast lexicale diversiteit wordt ook zinslengte gekoppeld aan tekstniveau; teksten die geschikt zijn voor lagere niveaus zouden minder verschillende woorden bevatten (minder &#8216;lexicaal divers&#8217; zijn) en bovendien kortere zinnen bevatten. Dat staat bijvoorbeeld bij de niveaus op <a href="https://www.lezenvoordelijst.nl/docenten-15-18/leesniveaus/" target="_blank" rel="noopener noreferrer">Lezen voor de lijst</a>, maar ook in <a href="https://tekstblad.nl/nieuws/wat-is-de-ideale-zinslengte" target="_blank" rel="noopener noreferrer">dit stuk in Tekstblad</a>. In dit stukje vergelijken we daarom de lexicale diversiteit en zinslengte in twee klassieke jeugdromans: <a href="https://nl.wikipedia.org/wiki/Tonke_Dragt" target="_blank" rel="noopener noreferrer">Tonke Dragts</a> <a href="https://nl.wikipedia.org/wiki/De_brief_voor_de_koning_%28boek%29" target="_blank" rel="noopener noreferrer">De brief voor de koning</a>, ingeschaald op niveau 1 en <a href="https://nl.wikipedia.org/wiki/Thea_Beckman" target="_blank" rel="noopener noreferrer">Thea Beckmans</a> <a href="https://nl.wikipedia.org/wiki/Kinderen_van_Moeder_Aarde" target="_blank" rel="noopener noreferrer">Kinderen van moeder aarde</a>, ingeschaald op niveau 3. Het eerste boek zou, in principe, minder verschillende woorden en minder lange zinnen moeten bevatten dan het tweede. Dat gaan we toetsten.</p>
<figure><img decoding="async" src="/wp-content/uploads/imports/20250423125805-1742469029744.jpg" alt="enter image description here" /></figure>
<p><em>De brief voor de koning en Kinderen van moeder aarde</em></p>
<p>Om te bepalen in hoeverre boeken op niveaus 1 en 3 verschillen in lexicale diversiteit, nam ik uit beide romans vijftien <em>samples</em> van 500 woorden en ik berekende daar de <em>type-token-ratio&#8217;s</em> (<em>ttr</em>) van. De nulhypothese is dat beide samples niet van elkaar verschillen in <em>type-token-ratio</em>; de alternatieve hypothese is dat beide samples wel van elkaar verschillen in <em>type-token-ratio</em>. Tonke Dragts boek leverde een gemiddelde <em>ttr</em> op van 0.52 (op een schaal van 0-1); voor Thea Beckmans boek was het gemiddelde 0.56.</p>
<figure><img decoding="async" src="/wp-content/uploads/imports/20250320113925-Scherm%C2%ADafbeelding%202025-03-20%20om%2010.58.33.jpg" alt="enter image description here" /></figure>
<p><em>Uitkomsten van de t-toets (type-token-ratio)</em></p>
<p>Er lijkt dus inderdaad een verschil te zijn tussen de twee boeken, maar is het verschil significant? De t-toets-calculator laat zien van wel, getuige de onderstaande rapportage.</p>
<blockquote>
<p>Op de bovenstaande gegevens is een t-toets toegepast (Reuneker, 2025) om te bepalen of gemiddelden van beide dataverzamelingen, gegeven de variantie, significant van elkaar afwijken. Het verschil in type-token-ratio tussen De brief voor de koning (m = 0.52; sd = 0.03) en Kinderen van moeder aarde (m = 0.56; sd = 0.03) is significant (t (28) = 4.13; p &lt; 0.05). Het (negatieve) effect is zeer groot (Cohen&#8217;s d = 1.51; Cohen, 1988).</p>
</blockquote>
<p>De standaarddeviatie is klein en er blijkt een significant verschil te zijn tussen de romans wat betreft lexicale diversiteit. Dat effect is, volgens de effectmaat Cohen&#8217;s <em>d</em>, groot; een Cohen&#8217;s <em>d</em> van -1.51 komt erop neer dat de  type-token-ratio van een gemiddelde zin in <em>De brief voor de koning</em> 1.5 standaarddeviaties lager is dan die van een gemiddelde zin in <em>Kinderen van moeder aarde</em>. Belangrijk daarbij is dus ook wat tussen haakjes staat: het effect is negatief, wat wil zeggen dat het gemiddelde van de eerste steekproef, Tonke Dragts boek, lager is dan dat van de tweede steekproef, Thea Beckmans boek. Dat is uiteraard ook wat we verwachtten.</p>
<p>Nu de zinslengte; het eerste boek bevat 13.352 zinnen en het tweede boek 11.530. Dat is wat veel voor een t-toets (je riskeert dan overmatige invloed van corpusgrootte op significantie). Voor een inzichtelijk voorbeeld nemen we daarom uit beide boeken 100 willekeurig geselecteerde zinnen. De nulhypothese is dat beide samples niet van elkaar verschillen in zinslengte; de alternatieve hypothese is dat beide samples wel van elkaar verschillen in zinslengte &#8212; een zogenaamde <a href="https://thisvsthat.io/directional-hypothesis-vs-nondirectional-hypothesis" target="_blank" rel="noopener noreferrer">non-directionele hypothese</a>, want we spreken geen verwachting uit over de richting van een mogelijk verschil.</p>
<p>In de steekproef uit Tonke Dragts boek is de gemiddelde zinslengte 10.84 woorden, met een standaarddeviatie van 7.52. Dat zegt dat er flink wat variatie in zinslengtes is. In de steekproef uit Thea Beckmans boek is de gemiddelde zinslengte 12.07 woorden, met een standaarddeviatie van 9.06. We zien dus dat de zinnen in het boek op niveau 3 inderdaad gemiddeld langer zijn. Maar is het verschil groot genoeg om daar conclusies aan te verbinden?</p>
<figure><img decoding="async" src="/wp-content/uploads/imports/20250319112040-Scherm%C2%ADafbeelding%202025-03-19%20om%2011.18.38.jpg" alt="enter image description here" /></figure>
<p><em>Uitkomsten van de t-toets (zinslengte)</em></p>
<p>De t-toets geeft een waarde van 1.04 en dat is, gegeven de steekproeven, niet genoeg voor een significant verschil. De onderstaande rapportage, gegenereerd door de calculator, maakt dit duidelijk.</p>
<blockquote>
<p>Op de bovenstaande gegevens is een t-toets toegepast (Reuneker, 2025) om te bepalen of gemiddelden van beide dataverzamelingen, gegeven de variantie, significant van elkaar afwijken. Het verschil in zinslengte tussen De brief voor de koning (m = 10.84; sd = 7.52) en Kinderen van moeder aarde (m = 12.07; sd = 9.06) is niet significant (t (197) = 1.04; p &gt;= 0.05). Het effect is verwaarloosbaar (Cohen&#8217;s d = -0.15; Cohen, 1988).</p>
</blockquote>
<p>Dit resultaat heeft uiteraard met de hoge standaarddeviatie te maken: er is te veel verschil <em>binnen</em> de twee boeken om te kunnen zeggen dat er ook een verschil <em>tussen</em> de boeken is. We concluderen daarom dat we de nulhypothese, namelijk dat er geen verschil is in zinslengte tussen beide boeken, niet kunnen verwerpen.</p>
<p>Samenvattend kunnen we stellen dat <em>De brief voor de koning</em> &#8212; een boek op niveau 1 &#8212; minder lexicaal divers is dan <em>Kinderen van moeder aarde</em> &#8212; een boek op niveau 3, maar dat het niveauverschil zich niet laat zien in zinslengte. Uiteraard is dit maar een voorbeeld met een beperkt corpus, dus verdere conclusies moeten we hier zeker niet aan verbinden, maar als illustratie van zinslengte, lexicale diversiteit en de t-toets volstaat het wel, lijkt me.</p>
<p>Wil je de calculator zelf gebruiken? Ga dan naar <a href="https://www.reuneker.nl/t">https://www.reuneker.nl/t</a>.</p>
]]></content:encoded>
					
					<wfw:commentRss>https://www.reuneker.nl/taal/zinslengte-in-de-brief-voor-de-koning-en-kinderen-van-moeder-aarde/feed/</wfw:commentRss>
			<slash:comments>0</slash:comments>
		
		
			</item>
	</channel>
</rss>
