Convertir TXT en ASCII
Convertir un fichier texte brut en ASCII 7 bits strict sans confondre les extensions ou ANSI avec un encodage.
Convertir des fichiers TXT en ligne
Nous n’avons pas encore de convertisseur en ligne dédié pour TXT vers ASCII, mais vous pouvez convertir des fichiers TXT en ligne vers ces formats et bien d’autres :
Comment convertir txt en fichier ascii
- Fichiers texte
- Aucune note pour l'instant.
Une application héritée, un périphérique série, une routine d’importation ou une règle de contrôle de version peut rejeter UTF-8 et n’accepter que l’ASCII 7 bits. La conversion modifie l’encodage des caractères et peut nécessiter le remplacement des caractères que l’ASCII ne peut pas représenter.
Contenu des fichiers TXT
TXT est une extension de nom de fichier pour le texte brut, et non un encodage de caractères fixe. Les éditeurs de texte, les exportateurs de journaux, les développeurs et les utilisateurs de logiciels bureautiques créent des fichiers .txt en UTF-8, UTF-16, Windows-1252 et avec d’autres encodages.
Un fichier appelé notes.txt n’est donc pas automatiquement en ASCII. UTF-8 est généralement l’encodage par défaut actuel, car il prend en charge les lettres accentuées, la ponctuation typographique, les écritures non latines et les emoji.
Signification d’ASCII
ASCII est un jeu de caractères sur 7 bits comportant 128 valeurs, représentées par les octets 0x00 à 0x7F. Il prend en charge les lettres anglaises, les chiffres, la ponctuation de base, les tabulations et les caractères de contrôle tels que le retour chariot et le saut de ligne.
L’ASCII ne peut pas représenter des caractères tels que é, —, £, les guillemets courbes, les caractères cyrilliques, les caractères chinois ou les emoji. Ses avantages sont des caractères prévisibles sur un octet et la compatibilité avec les systèmes qui exigent explicitement une entrée sur 7 bits.
L’ASCII est un encodage, et non un format de fichier texte distinct. Un récepteur peut exiger un nom de fichier .asc, .ascii ou .txt, mais la modification de l’extension seule ne change pas les octets du fichier.
Convertir avec une vérification stricte des erreurs
Identifiez autant que possible l’encodage source à partir du programme qui a créé le fichier. Sur macOS ou Linux, file -bi input.txt peut fournir un indice utile, mais son résultat n’est pas définitif.
Sur macOS ou Linux, utilisez iconv pour arrêter la conversion lorsque l’entrée contient un caractère non représentable :
iconv -f UTF-8 -t ASCII input.txt -o output.txt
Remplacez UTF-8 par l’encodage d’entrée réel si nécessaire, par exemple WINDOWS-1252, UTF-16LE ou UTF-16BE. Une commande ayant échoué peut laisser un fichier de sortie partiel ; vérifiez son code de sortie et supprimez la sortie en cas d’échec.
Python fournit la même conversion stricte sous Windows, macOS et Linux :
python -c "from pathlib import Path; s=Path('input.txt').read_bytes().decode('utf-8-sig'); Path('output.txt').write_bytes(s.encode('ascii'))"
Cette commande accepte UTF-8 avec ou sans marque d’ordre des octets UTF-8 et génère une erreur au lieu de modifier silencieusement les caractères non pris en charge. Ne modifiez utf-8-sig qu’après avoir confirmé que la source utilise un autre encodage.
Utilisez Visual Studio Code ou un autre éditeur pour examiner et modifier la source, puis exécutez la conversion localement depuis son terminal intégré. Visual Studio Code peut également utiliser View → Command Palette → Change File Encoding → Save with Encoding et une option ASCII lorsqu’elle est disponible, mais les éditeurs peuvent remplacer les caractères non pris en charge au lieu d’échouer ; utilisez une commande stricte pour les identifiants, les enregistrements et autres données exactes.
Choisir délibérément les substitutions
Si la modification du texte est acceptable, GNU iconv peut tenter une translittération :
iconv -f UTF-8 -t ASCII//TRANSLIT input.txt -o output.txt
La translittération peut convertir é en e et les guillemets typographiques en guillemets droits. Les résultats varient selon le système d’exploitation et la bibliothèque, et les caractères sans substitut pertinent peuvent tout de même être omis ou provoquer une erreur. Pour les données contrôlées, remplacez explicitement les caractères avant la conversion et vérifiez chaque modification.
N’utilisez pas le réglage Save As → ANSI de Windows Notepad comme conversion ASCII. « ANSI » désigne généralement la page de codes Windows active, telle que Windows-1252, qui autorise les octets supérieurs à 0x7F.
Vérifier la compatibilité de la cible
Vérifiez que le système récepteur exige réellement l’ASCII 7 bits, plutôt que Windows-1252, « ANSI » ou une page de codes ASCII étendue non spécifiée. L’ASCII étendu ne constitue pas une norme unique ; un même octet peut représenter des caractères différents selon les pages de codes.
Vérifiez dans la sortie les modifications de ponctuation, les symboles supprimés, les changements de largeur des champs et les fins de ligne requises. Le texte ASCII utilise normalement LF sur les systèmes de type Unix et CRLF dans de nombreux imports destinés à Windows ; la conversion d’encodage ne les modifie pas nécessairement. Une sortie ASCII stricte ne doit pas contenir de marque d’ordre des octets UTF-8.
La plupart des convertisseurs TXT en ligne ne précisent pas clairement leur encodage de sortie ni leur politique de remplacement. Pour les fichiers sensibles ou les imports stricts, utilisez des outils locaux ; utilisez un service en ligne uniquement s’il propose explicitement une sortie US-ASCII, documente le traitement des caractères non pris en charge et si sa politique de confidentialité autorise l’envoi du fichier.