Rare tekens in een GEDCOM-bestand (é in plaats van é): zo herstelt u ze
· 5 min lezen · The Memory Palace Team
Bekijk uw stamboombestand, zonder account
Gratis hulpmiddel bij deze gids: Controleer je GEDCOM-bestand met de gratis GEDCOM-controle
Uw paleis, ook op uw telefoon.
Staat een naam als René Müller er als René Müller, dan is het GEDCOM-bestand met de verkeerde tekenset gelezen: UTF-8-tekst werd behandeld als Windows-tekst (vaak ANSI genoemd). U herstelt het gratis met onze GEDCOM-controle, die elke verhaspelde regel naast de juiste tekst toont en alleen de regels herstelt die ze exact kan terugrekenen.
Laatst nagekeken: 7 oktober 2026. De controle is van ons; wat ze doet, staat hieronder precies zoals ze werkt.
Zo herkent u het probleem
Verhaspelde tekens volgen een patroon. Een letter met een accent wordt twee tekens, meestal beginnend met à of Â, en aanhalingstekens worden drie tekens die met †beginnen.
| Moet zijn | Staat er als | Moet zijn | Staat er als |
|---|---|---|---|
| é | é | ö | ö |
| è | è | ü | ü |
| ë | ë | ä | ä |
| ç | ç | ß | ß |
| ñ | ñ | ’ | ’ |
Een klein voorbeeld uit een GEDCOM-bestand, voor en na:
Fout:
1 NAME André /Delanoë/
2 PLAC Liège
Hersteld:
1 NAME André /Delanoë/
2 PLAC Liège
Drie verschillende oorzaken
- De verhaspelde tekst staat in het bestand. Een UTF-8-bestand werd als Windows-tekst geopend en opnieuw bewaard. Elk programma toont nu é, want zo staat het in het bestand.
- Het bestand is in orde, maar de kop noemt de verkeerde tekenset. De tekst is UTF-8, maar de kop zegt
1 CHAR ANSELof1 CHAR ANSI. Een programma dat de kop gelooft, toont é; een programma dat naar de bytes kijkt, toont é. - Het omgekeerde: vraagtekens of zwarte ruitjes. Het bestand staat in ANSEL of Windows-tekst en het programma leest het als UTF-8. Dan ziet u René als Ren? of Ren�.
De GEDCOM-norm 5.5.1 noemt vier tekensets voor de kop (ANSEL, UTF-8, UNICODE en ASCII) en noemt ANSEL de voorkeur. Veel Windows-programma's schrijven toch ANSI. GEDCOM 7.0 laat alleen UTF-8 toe. Door die geschiedenis raken bestanden die van programma naar programma gaan zo vaak verhaspeld.
Zo herstelt u het met de gratis controle
- Open de GEDCOM-controle en kies uw .ged-bestand. Het wordt in uw browser gelezen en nooit geüpload.
- Bovenaan ziet u de tekenset: wat de kop zegt en wat de tekst echt is. Verschillen ze, dan meldt de controle dat de kop de verkeerde tekenset noemt (oorzaak 2).
- Onder Verhaspelde tekens ziet u hoeveel regels getroffen zijn en per regel de tekst zoals hij is en zoals hij hersteld zou worden. Bekijk een paar voorbeelden.
- Kloppen ze, vink dan de herstelling van de verhaspelde tekens aan en download het herstelde bestand. De naam eindigt op -repaired.ged.
- Importeer het herstelde bestand in uw stamboomprogramma, of open het in onze GEDCOM-lezer om te zien dat de namen kloppen.
Wat de controle met elke oorzaak doet:
- Oorzaak 1: ze herstelt de verhaspelde stukken, maar alleen als u het vakje aanvinkt en alleen waar het terugrekenen naar bytes geldige UTF-8 oplevert. Al het andere blijft staan: liever een vreemd teken dan een verkeerde letter.
- Oorzaak 2: ze leest de tekst als wat hij echt is, en in het herstelde bestand staat
1 CHAR UTF-8. - Oorzaak 3: ze leest ANSEL en Windows-tekst correct en schrijft het herstelde bestand als UTF-8. Bytes die met geen enkel teken overeenkomen, worden geteld en getoond, maar zijn niet terug te halen.
De herstelling verandert nooit datums, plaatsen, notities of verwijzingen. Ze maakt wel de regeleinden gelijk, haalt lege regels en inspringing weg, en voegt een ontbrekende kop of eindmarkering toe.
Andere manieren om het te herstellen
| Manier | Goed voor | Let op |
|---|---|---|
| Onze gratis GEDCOM-controle | Alle drie de oorzaken; toont elke regel voor er iets verandert; niets te installeren | Verhaspelde tekst die niet exact terug te rekenen is, blijft staan |
| Opnieuw exporteren uit het programma dat het bestand maakte | De beste oplossing als het origineel in dat programma nog juist is; kies UTF-8 als het erom vraagt | Helpt niet als de verhaspelde tekst al in de eigen gegevens van het programma staat |
| Gramps (gratis programma voor de computer) | Zegt de kop ANSEL, dan vraagt Gramps bij het importeren welke tekenset het moet gebruiken (ANSEL, ANSI, ASCII of UTF-8); de GEDCOM-export van Gramps is UTF-8 | Maakt tekst die al verhaspeld in het bestand staat niet ongedaan |
| Een teksteditor met een coderingsinstelling, zoals Notepad++ | Het bestand in een andere codering lezen zonder de bytes te veranderen, of omzetten naar UTF-8 | Het wordt snel erger: een al verhaspeld bestand omzetten verhaspelt het opnieuw; de handleiding noemt ANSEL niet |
Zo voorkomt u het
- Vraagt uw programma bij het exporteren naar een tekenset, kies dan UTF-8.
- Open het bestand na het exporteren één keer in de controle: de kop moet
1 CHAR UTF-8zeggen en de namen onder Kloppen deze namen? moeten juist zijn. - Open en bewaar een GEDCOM-bestand niet in een tekstverwerker of een teksteditor die de codering raadt.
- Stuurt u een bestand naar iemand met een ouder programma? Vraag wat het leest. Oudere programma's verwachten soms ANSEL; lees ook een ANSEL-GEDCOM-bestand omzetten naar UTF-8.
Lees ook: gebroken verwijzingen, dubbele id's en onmogelijke datums, een stamboom exporteren als GEDCOM-bestand en een GEDCOM-bestand openen zonder software.
Bronnen
- The GEDCOM Standard, release 5.5.1 (character sets, line length, cross-reference IDs, dates): gedcom.io/specifications/ged551.pdf
- FamilySearch GEDCOM 7.0 specification (UTF-8 only, no CONC, GEDZIP): gedcom.io/specifications/FamilySearchGEDCOMv7.html
- Gramps source code, GEDCOM import (encoding choice for files marked ANSEL): github.com/gramps-project/gramps/blob/maintenance/gramps60/gramps/plugins/importer/importgedcom.py
- Gramps source code, GEDCOM export (writes GEDCOM 5.5.1 with CHAR UTF-8): github.com/gramps-project/gramps/blob/maintenance/gramps60/gramps/plugins/export/exportgedcom.py
- Notepad++ User Manual, Encoding: npp-user-manual.org/docs/encoding
Vragen die mensen stellen
Waarom toont mijn GEDCOM-bestand é in plaats van é?
De letter é staat in UTF-8 als twee bytes. Een programma dat die bytes als Windows-tekst (ANSI, Windows-1252) leest, toont ze als twee aparte tekens: Ã en ©. Bewaart dat programma het bestand daarna, dan staan de verkeerde tekens in het bestand zelf.
Kan ik rare tekens in een GEDCOM-bestand automatisch herstellen?
Vaak wel. Het patroon is voorspelbaar, dus de oorspronkelijke letter is terug te rekenen. Onze gratis GEDCOM-controle toont elke getroffen regel naast de herstelde versie en verandert alleen de regels waar het terugrekenen exact lukt. U vinkt het vakje zelf aan nadat u de voorbeelden hebt bekeken.
Mijn bestand toont vraagtekens of zwarte ruitjes in plaats van accenten. Is dat hetzelfde?
Nee, het is het omgekeerde. Het bestand staat in een oudere tekenset zoals ANSEL of Windows-tekst, en het programma leest het als UTF-8. De controle leest ANSEL en Windows-tekst correct en het herstelde bestand is UTF-8, dus de letters komen terug. Tekens die in het bestand zelf al door een vraagteken vervangen zijn, zijn niet terug te halen.
Verandert de herstelling mijn namen of datums?
Alleen de verhaspelde tekens, en alleen als u die optie aanvinkt. De rest van de herstelling gaat over de vorm van het bestand: de tekenset, de CHAR-regel in de kop, regeleinden, lege regels en inspringing. Datums, plaatsen en verwijzingen blijven exact zoals ze waren.
Hoe voorkom ik dat het opnieuw gebeurt?
Kies UTF-8 als uw stamboomprogramma bij het exporteren naar een tekenset vraagt, kijk of de kop 1 CHAR UTF-8 zegt, en open en bewaar het bestand niet in een teksteditor. Moet u toch met de hand iets aanpassen, gebruik dan een editor die de codering toont en behoudt.
Een GEDCOM-bestand controleren en herstellen
Vindt een verkeerde tekenset, onleesbare letters, gebroken verwijzingen, dubbele ID's en onmogelijke datums in een GEDCOM-bestand, en biedt een veilig herstelde kopie.
Gratis proberen, zonder accountOf bekijk uw stamboombestand, zonder account
Goedendag. Verder lezen op uw telefoon? Ik houd de deur voor u open.
Liever op uw telefoon? De app is gratis.