91
German heatmap based on Wikipedia articles 🇩🇪
(media.kbin.social)
Diese Community wird zum 01.07 auf read-only gestellt. Durch die anhäufenden IT-Probleme und der fehlende Support wechseln wir als Community auf www.feddit.org/c/dach - Ihr seid herzlich eingeladen auch dort weiter zu diskutieren!
Das Sammelbecken auf feddit für alle Deutschsprechenden aus Deutschland, Österreich, Schweiz, Liechtenstein, Luxemburg und die zwei Belgier. Außerdem natürlich alle anderen deutschprechenden Länderteile der Welt.
Für länderspezifische Themen könnt ihr euch in folgenden Communities austauschen:
Eine ausführliche Sidebar findet ihr hier: Infothread: Regeln, Feedback & sonstige Infos
Auch hier gelten die Serverregeln von https://feddit.de !
Banner: SirSamuelVimes
A million words doesn't sound like a lot
To clarify, it is not the total number of words but rather the number of unique words considered. Imho a million of unique words is okay. A bigger concern for me would be that words on Wikipedia can be overly specific.
That million words sounds like a lot.
Have you considered a similarity search approach? They would handle your oddly specific synonym issue
I only have a prespellechecked list of words from here: http://www.aaabbb.de/WordList/WordList_en.php
Oh? Name all of them.
every word in one single picture:
It's incomplete, as you will only finde 95% of words used on ich_iel.
A,
A-a,
Aachen,
...