Japonais vertical et mises en page classiques
Le texte vertical est le domaine où les outils de traduction généraux échouent le plus systématiquement. Les caractères défilent de haut en bas et de droite à gauche, et leur lecture avec des hypothèses horizontales produit des phrases dans un ordre incohérent : chaque mot est reconnaissable, mais l'ensemble n'a aucun sens.
Geyi gère spécifiquement les mises en page verticales : la reconnaissance suit l'ordre de lecture vertical, les doubles pages et les pages à plusieurs colonnes sont corrigées automatiquement, et la traduction est restituée en format horizontal.
Mises en page gérées automatiquement
- Japonais et chinois verticaux : reconnus et restitués horizontalement.
- Doubles pages : restaurées avec un ordre de lecture continu sur toute la double page, sans avoir besoin de diviser les pages vous-même.
- Pages à plusieurs colonnes : restaurées colonne par colonne plutôt que balayées horizontalement.
- Légendes et notes marginales : conservées avec la mise en page à laquelle elles appartiennent plutôt que d'être intégrées au corps du texte.
Extraire d'abord, ou traduire directement
Si vous avez besoin d'extraire le texte original d'une œuvre classique pour vos recherches, utilisez l'extraction de document : 4 crédits par page, extraction seule, sortie dans la langue originale au format Word, PDF, TXT ou Markdown.
Si vous avez besoin de lire le contenu, passez directement à la traduction de fichier via le reflow IA, qui reconnaît et traduit en une seule étape. En cas de doute sur la qualité de la reconnaissance, extraire une page en premier est le moyen le plus économique de vérifier.
Obstacles courants avec les documents anciens
La qualité de la reproduction est déterminante : les impressions nettes scannées directement sont les mieux reconnues, tandis que le papier jauni, les bavures d'encre et les scans inclinés rendent le processus plus difficile. Les variantes et les formes de caractères archaïques peuvent être normalisées en formes modernes.
Pour la recherche textuelle, considérez la traduction comme une aide à la lecture et tirez vos conclusions principales de l'original.
Résultats concrets
Quatre pages numérisées de japonais vertical issues de l'édition originale de 1917 de Rashōmon (kanji anciens, kana historiques, furigana) sont converties en chinois simplifié horizontal grâce à la traduction de fichiers avec une grande précision en mode reflow : le sens de lecture de droite à gauche est conservé, les furigana sont exclus du texte, les termes d'époque tels que l'avenue Suzaku, ichime-gasa et momi-eboshi sont préservés, et tout le corps du texte des 4 pages est traduit.
Avant
或日の暮方の事である。一人の下人が、羅生門の下で雨やみを待つてゐた。廣い門の下には、この男の外に誰もゐない。唯、所々丹塗の剝げた、大きな圓柱に、蟋蟀が一匹とまつてゐる。羅生門が、朱雀大路にある以上は、この男の外にも、雨やみをする市女笠や揉烏帽子が、もう二三人はありさうなものである。それが、この男の外には誰もゐない。
Après
这是某日黄昏时分的事情。一个下人正在罗生门下等待雨停。宽阔的门下,除了这个男人以外谁也没有。只有在那几根各处剥落着朱红色油漆的大圆柱上,停着一只蟋蟀。既然罗生门位于朱雀大路上,除了这个男人之外,原本似乎还应有两三个戴着市女笠或揉乌帽子、在此躲雨的人。然而,除了这个男人以外,谁也没有。
Résultat de production réel ; 3 points corrigés manuellement avant affichage · Source : Rashōmon, Ryūnosuke Akutagawa, 1917 (L'auteur, Ryūnosuke Akutagawa, est décédé en 1927, il y a plus de 70 ans ; selon la loi japonaise sur le droit d'auteur, les œuvres des auteurs décédés avant la fin de 1967 étaient protégées pendant 50 ans après leur décès, la protection de ce livre a donc expiré à la fin de 1977. Les collections numériques de la Bibliothèque nationale de la Diète marquent cet élément PDM (Public Domain Mark) et le publient en ligne (DOI 10.11501/1088339).)
Questions fréquentes
Le texte vertical sera-t-il restitué dans le désordre ?
Non. La reconnaissance suit l'ordre de lecture vertical dès le départ, et les doubles pages ainsi que les pages à plusieurs colonnes sont corrigées automatiquement.
La traduction reste-t-elle verticale ?
Non, le résultat est entièrement horizontal, ce qui est plus lisible à l'écran et plus facile à modifier par la suite.
Comment est-ce facturé ?
Les originaux en format vertical sont généralement des scans, ils suivent donc le chemin de reconnaissance utilisé par le reflow IA : 8 crédits par page en haute précision, 4 en standard, avec un minimum de 10 crédits par fichier.
Puis-je obtenir le texte original sans traduction ?
Oui, utilisez l'extraction de document à 4 crédits par page, qui extrait le texte sans le traduire.
Les formes de caractères archaïques sont-elles reconnues ?
La plupart le sont, bien qu'elles puissent être normalisées en formes modernes. Pour la recherche textuelle, travaillez à partir de l'original.
Cela fonctionne-t-il pour les textes chinois classiques ?
Oui. Le chinois vertical suit le même chemin de reconnaissance que le japonais vertical, avec la même correction de l'ordre de lecture.
Contenu associé
- Traduction de documents numérisés
- Extraction de documents
- Traduction de livres entiers
- Traduction de PDF
- Explorez un exemple avant d'utiliser votre propre document
简体中文 · English · Deutsch · Русский · 日本語 · 한국어
Geyi is a proprietary AI document platform owned and operated by Nayuta Technology and Culture Company Limited.