XML-Übersetzer: Übersetzen Sie XML-Dateien unter Beibehaltung von Tags, Attributen und CDATA

Ein XML-Übersetzer übersetzt den menschenlesbaren Text zwischen den Tags und behält dabei das Markup selbst bei – sodass die zurückgegebene Datei wohlgeformtes XML ist, das Ihr System verarbeiten kann, in jeder von über 280 Sprachen.

Sie teilen dem Software Localization Agent von Smartcat mit, welche Elemente und Attribute übersetzbaren Text enthalten – einmalig per XPath –, und alles außerhalb dieser Pfade bleibt unberührt.

Übersetzen Sie jede Datei. In Sekunden.
Bilder, Dokumente, Video, Audio, Kurse — wählen Sie ein Format und ziehen Sie Ihre Datei hierher.
dokumente hier ablegen
oder Dateien auswählen · Unterstützt .docx, .pdf, .pptx, .xlsx und mehr
“

Wir haben schnell erkannt, dass Smartcat genau das bot, was wir brauchten: ein Translation Memory, eine zentrale Drehscheibe für unseren Workflow und kein endloses Hin- und Herschicken von E-Mails oder Jonglieren mit Dateien mehr. Alles – und jeder – arbeitet jetzt an einem Ort zusammen.

”

Shawn Newton

Senior Creative Operations Analyst bei Kids2

Wie übersetzt Smartcat eine XML-Datei?

XML-Übersetzung bedeutet, den Textinhalt einer XML-Datei zu übersetzen, während ihr Markup maschinenlesbar bleibt. Smartcats Software-Lokalisierungs-Agent verwendet einen konfigurierbaren XML-Parser, anstatt Vermutungen anzustellen.

  • Zeigen Sie darauf, was als Text gilt – Sie geben einen XPath zu den segmentbildenden Elementen an, also den Knoten, die im Übersetzungseditor erscheinen sollen, und diese werden zu Ihren übersetzbaren Segmenten.
  • Entscheiden Sie Attribut für Attribut – ein segmentbildender Knoten kann ein Element, das Attribut eines Elements oder Text sein, sodass ein Attribut, das tatsächlich Text enthält (label, title, alt), nur übersetzt wird, weil Sie darauf verwiesen haben, während id und Enum-Werte niemals angetastet werden.
  • Übersetzen und zurückschreiben – jedes Segment wird unter Anwendung Ihres Glossars und Ihres Translation Memorys übersetzt und anschließend wieder in die ursprüngliche Struktur zurückgeschrieben.

Eine strukturelle Anforderung: Die Datei muss sich wiederholende Elemente enthalten, da jede Wiederholung zu einem Ausgangssegment wird.

Regeln einmal festlegen, dann wohlgeformtes XML herunterladen

Laden Sie eine einzelne .xml-Datei oder mehrere auf einmal hoch, einschließlich wiederkehrender Exporte.

  • Legen Sie die Regeln einmalig fest – Zielsprachen, Glossar und die XPaths, die definieren, was übersetzbar, unübersetzbar, eine ID, ein Kommentar oder in der Länge begrenzt ist. Dieselben Regeln gelten für jede zukünftige Datei dieser Form.
  • Im Kontext überprüfen – öffnen Sie den Split-Screen-Editor, wenn ein Prüfer Texte im Kontext sehen soll, und weisen Sie Teammitglieder oder geprüfte Reviewer aus dem Smartcat Marketplace zu.
  • Ganze Projekte mit einem Klick exportieren – wählen Sie sie aus, klicken Sie auf Herunterladen und Sie erhalten alles als eine einzige ZIP-Datei in den Originalformaten zurück, sortiert in Ordner.

Warum geht XML in gewöhnlichen Übersetzungsprogrammen kaputt?

XML transportiert Bedeutungen an Stellen, die ein Allzweck-Übersetzer nicht von Fließtext unterscheiden kann. Vier Dinge zerbrechen:

  • Tags und Attribute werden übersetzt – <button label="Submit"> kommt als <bouton étiquette="Envoyer"> zurück, und Ihr Parser hat noch nie von <bouton> gehört.
  • Entitäten werden "korrigiert" — &amp; wird zu einem einfachen kaufmännischen Und und die Datei lässt sich nicht mehr parsen.
  • Abweichung von Kodierungsdeklarationen – die Deklaration besagt das eine, während der Inhalt etwas anderes besagt, und die Nichtübereinstimmung äußert sich drei Systeme weiter als Mojibake.
  • CDATA wird verstümmelt – ein <![CDATA[ … ]]>-Block, der eingebettetes HTML enthält, ist genau das, was naive Tools zuerst verstümmeln.

Der Fehlermodus ist keine schlechte Übersetzung – es ist eine Datei, die Ihr Import am Veröffentlichungstag um 17:00 Uhr ablehnt.

Was das Entitäten- und Codierungsverhalten angeht, würden wir lieber eine Beispieldatei mit Ihnen testen, als ein bloßes Versprechen abzugeben. Die Parser-Konfiguration übernimmt die beiden konfigurierbaren Optionen – die Übersetzung von Tags und Attributen sowie CDATA.

Regeln, die Sie einmalig festlegen, per XPath

Richten Sie den Parser auf die segmentbildenden Elemente in Ihrer Dateiform aus, zuzüglich separater Pfade für nicht übersetzbare Knoten, String-IDs, Kommentare und Längenbegrenzungen pro Segment.

Konfigurieren Sie Ihren Produkt-Feed, CMS-Dump oder Hilfe-Inhalt-Export einmalig – jede zukünftige Datei dieses Formats folgt denselben Regeln.

Segmente nach ID aktualisieren, ohne Zuweisungen aufzuheben

XML ist eine von nur zwei Formatfamilien – neben PO/Serge –, bei denen eine neuere Version Segmente anhand der ID aktualisieren kann, ohne Aufgabenzuweisungen abzubrechen.

Bei jedem anderen Format werden beim Ersetzen eines Dokuments Übersetzungen aus dem Translation Memory wiederhergestellt, wodurch jedoch die Aufgaben abgebrochen werden, sodass die Linguisten neu zugewiesen werden müssen. Sowohl das Aktualisieren als auch das erneute Hochladen verbrauchen Smartwords für die Neuübersetzung.

103 % Translation-Memory-Treffer über Key-ID

String-IDs werden über ihren eigenen Pfad zugeordnet und für 103% Key-ID-Matching verwendet, während Standard-Dokumentformate bei 102% Kontext-Matching gedeckelt sind.

Kommentare können auf die gleiche Weise zugeordnet und Prüfern als Segmentkontext angezeigt werden.

Über 280 Sprachen, wohlgeformte Ausgabe

Die Struktur wird niemals bearbeitet, daher lässt sich das, was zurückkommt, parsen. Sie wählen die Zielsprachen; das Markup bleibt wie verfasst erhalten.

Was erhalten bleibt, Element für Element

Elementnamen und Attributnamen werden niemals übersetzt. Alles andere ist standardmäßig zustimmungspflichtig:

  • Attributwerte – werden nicht übersetzt, es sei denn, Sie definieren dieses Attribut als segmentbildend, sodass Sie auf label und niemals auf id oder einen Enum-Wert verweisen.

  • Textknoten – werden übersetzt, sofern sie segmentbildend sind, und mit Ihrem Translation Memory und Glossar abgeglichen. Nicht übersetzbare Inline-Knoten können über ihren eigenen Pfad ausgeschlossen werden.

  • CDATA-Abschnitte – konfigurierbar. Wenn HTML-Tags in CDATA-Abschnitten schützen aktiviert ist, wird HTML innerhalb von CDATA durch Smartcat-Tags ersetzt; wenn deaktiviert, werden diese Tags als bearbeitbarer Text angezeigt.

  • String-IDs und Kommentare – jeweils über ihren eigenen Pfad zugeordnet.

  • Längenbegrenzungen – pro Segment einstellbar, wenn ein nachgelagertes Schema ein Feld begrenzt.

Treffen Sie die Entscheidung für das CDATA-Kontrollkästchen wohlüberlegt, denn deaktiviert bedeutet, dass ein Übersetzer Ihr Markup bearbeiten kann.

Die einzige strukturelle Anforderung sind sich wiederholende Elemente: Jede Wiederholung wird zu einem Segment, sodass ein einmaliges Dokument ohne sich wiederholende Struktur für den benutzerdefinierten Parser nicht geeignet ist.

Sehen Sie den für Ihre eigene Datei konfigurierten XML-Parser

Bringen Sie einen Beispielexport zu einem 1:1-Gespräch mit unserem Team mit.

  • XPaths wurden auf Ihrer Dateiform aktiviert.
  • Die Handhabung von CDATA wurde festgelegt.
  • Längenbegrenzungen Ihrem Schema zugeordnet.
  • Entitäts- und Codierungsverhalten anhand Ihrer eigenen Datei getestet, anstatt in einer Tabelle versprochen.

Finden Sie erfahrene Reviewer zur Überarbeitung und zum Trainieren Ihrer KI-Agenten

Der Smartcat Marketplace bringt Sie mit erfahrenen Korrektoren in Ihrer Branche oder Ihrem Zielmarkt zusammen. Nutzen Sie unser KI-gestütztes Matching oder entdecken Sie Profile nach Spezialisierung und Bewertungen.

XML, XLIFF, JSON und YAML im selben Projekt

XLIFF und TMX sind ebenfalls XML, und beide werden unterstützt. XLIFF verfügt über einen eigenen Workflow und eine eigene Seite, den XLIFF-Übersetzungseditor – und beachten Sie, dass Smartcat XLIFF 1.2 und 2.0 importiert, während der Export nur als 1.2 möglich ist.

Lokalisieren Sie auch JSON oder YAML? Dasselbe Projekt, dasselbe Translation Memory – linguistische Ressourcen werden auf Projektebene zugewiesen und gelten für jedes Dokument darin, mit einem beschreibbaren TM pro Sprachpaar.

Wenn Sie dies über die CI ansteuern, erreicht die API dieselben über 50 Formate wie die Plattform:

  • XML, Android XML, RESX, LOCJSON, JSON, TJSON, YML, INC, INX, STRINGS und PROPERTIES darunter.

  • Die Softwarelokalisierungs-API exportiert zusätzlich json, structured-json, yaml, structured-yaml, ios-strings und android-xml.

  • Ausführbare Dateien und Skripte sind aus Sicherheitsgründen blockiert.

PDFDOKXLSXLIFFJSONJPEGMP4und mehr...

Senden Sie den gesamten Export, kein Muster

Es gibt keine Obergrenze für die Anzahl der Dateien in einem Projekt, sodass ein vollständiger Gebietsschema-Export als ein einziger Auftrag hochgeladen wird, der sich ein Glossar und ein Translation Memory teilt.

Beim Aufteilen geht es immer nur um die Geschwindigkeit bei einer sehr großen einzelnen Datei, nie darum, wie viele Dateien Sie senden.

Jeden Sprint neu exportieren, ohne die Arbeit zu verlieren

Wenn Sie bei jedem Release denselben XML-Export ausliefern, ist der entscheidende Unterschied, was beim zweiten Upload passiert.

Übersetzungen werden übernommen und Linguisten bleiben zugewiesen, anstatt für jeden Sprint neu eingeladen zu werden.

Erstellung, Übersetzung, Überprüfung und Bereitstellung bleiben auf einer einzigen Plattform, wobei sich wiederholende Schritte automatisiert werden und Smartwords nur für erneute Übersetzungen verbraucht werden.

Beweis, dass Smartcat die Formatierung beibehält und die Bereitstellung beschleunigt

Senden Sie wohlgeformtes XML an jeden Markt

Text übersetzt, Markup unberührt, Ihre eigenen Regeln darüber, was als Text zählt – in über 280 Sprachen, wobei KI-Agenten die Arbeit auf Parsing-Ebene erledigen.

Kostenlos für 15 Tage mit 15.000 Smartwords und vollem Zugriff auf alle Übersetzungsfunktionen, keine Kreditkarte erforderlich.

Häufig gestellte Fragen

Was ist Smartcat?

Smartcat ist eine KI-gestützte globale Content-Plattform, die für Unternehmen entwickelt wurde, die mehrsprachige Inhalte über Märkte hinweg skalieren müssen.

Es vereint KI-Agenten, Translation Memories und menschliche Zusammenarbeit in einem einzigen System und hilft Teams dabei, XML-Dateien und andere Inhalte schneller und präziser zu übersetzen.

Was ist eine XML-Datei?

Eine XML-Datei (Extensible Markup Language) ist ein flexibles, textbasiertes Format, das Daten mithilfe von benutzerdefinierten Tags organisiert und speichert.

Es ist so konzipiert, dass es sowohl von Menschen als auch von Maschinen gelesen werden kann, was es nützlich macht, um von App-Einstellungen bis hin zu Schulungsmaterialien alles zu strukturieren.

Wo werden XML-Dateien üblicherweise verwendet?

XML-Dateien sind allgegenwärtig – von der App-Entwicklung und Website-Lokalisierung bis hin zu Content-Management-Systemen (CMS) und E-Learning-Plattformen.

Sie sind das Arbeitstier für die Strukturierung von Inhalten und den Datenaustausch über Software, Plattformen und Systeme hinweg.

Warum sind XML-Dateien wichtig und wer verwendet sie?

XML hält komplexe Daten organisiert und portabel, weshalb es in App-Konfigurationen, CMS-Exporten, Produkt-Feeds, E-Learning-Paketen und SCORM-Inhalten vorkommt.

Die Teams, die es übersetzen, sind in der Regel Entwicklungs-, Produktinhalts- und Lokalisierungsteams, die mit einer Datei arbeiten, die von einem anderen System nach einem Zeitplan generiert wird.

Was sind KI-Agenten und wie unterstützen sie die XML-Übersetzung?

KI-Agenten sind aufgabenspezifische, workflow-orientierte Automatisierungswerkzeuge.

Die Agenten von Smartcat, wie der Software Localization Agent, sind darauf ausgelegt, strukturierte Formate wie XML zu verarbeiten – wobei die Tag-Integrität gewahrt bleibt und Ihre Glossare angewendet werden, sodass die Lokalisierung ohne Entwicklerunterstützung skaliert werden kann.

Sie lernen auch aus menschlichem Feedback, was Produktivitäts- und Qualitätsverbesserungen selbst in komplexen Unternehmensabläufen vorantreibt.[1]

Kann ich steuern, welche Attribute übersetzt werden?

Ja, und Kontrolle ist eher der Mechanismus als eine nachträglich aufgesetzte Einstellung. In der XML-Parsing-Konfiguration geben Sie einen XPath für die segmentbildenden Elemente an, und ein segmentbildender Knoten kann ein Element, ein Attribut oder Text sein.

Ein Attribut wird nur dann übersetzt, wenn Sie darauf zeigen – label wird also zu einem Segment, während id und Enum-Werte niemals in den Editor gelangen. Sie können auch separate Pfade für nicht übersetzbare Knoten, Zeichenfolgen-IDs, Kommentare und Längenbegrenzungen angeben.

Wie übersetze ich XML-Dateien unter Beibehaltung der Tags?

Laden Sie die Datei hoch und definieren Sie dann, was als Text gilt.

Die Struktur wird vom Parse-Modell niemals bearbeitet: Element- und Attributnamen bleiben unberührt, und nur die Knoten, auf die Ihr XPath verweist, werden zu bearbeitbaren Segmenten.

Der übersetzte Text wird wieder in die ursprüngliche Struktur eingefügt, sodass der Download wohlgeformtes XML mit derselben Struktur wie die von Ihnen gesendete Datei ist.

Kann Smartcat Android-strings.xml-Dateien übersetzen?

Ja. Android XML ist ein unterstütztes Format, und in einem Software-Lokalisierungsprojekt können Sie Strings mit ihren Schlüssel-IDs importieren und exportieren – genau wie bei JSON, YAML und iOS .strings –, sodass <string name="checkout_cta"> seinen name behält und R.string.checkout_cta in jedem Gebietsschema aufgelöst wird.

Plural-Schlüssel werden auf Projektebene unterstützt: Ein Schlüssel kann mit all seinen Pluralformen erstellt werden, und Plurale werden als mit dem ICU MessageFormat kompatible Zeichenketten exportiert.

Welche XML-Formate unterstützt Smartcat?

Standard-XML, Android-XML, XLIFF und TMX sowie benutzerdefinierte Schemata über die XML-Parsing-Konfiguration.

Der XLIFF-Import akzeptiert 1.2 und 2.0, während der Export nur 1.2 unterstützt, und XLIFF verfügt über einen eigenen Workflow auf der Seite XLIFF-Übersetzungseditor.

Für ein benutzerdefiniertes Schema wird der Parser einmal pro Dateiform konfiguriert, anstatt bloß zu raten – und er benötigt sich wiederholende Elemente, anhand derer er segmentieren kann.

Was passiert mit CDATA-Abschnitten, die HTML enthalten?

Sie entscheiden über ein Kontrollkästchen: HTML-Tags in CDATA-Abschnitten schützen. Geprüft: Die HTML-Tags innerhalb des CDATA-Blocks werden durch Smartcat-Tags ersetzt, sodass Übersetzer sie verschieben, aber nicht beschädigen können. Wenn sie nicht markiert sind, erscheinen diese Tags als bearbeitbarer Text. Lassen Sie es für alles, was maschinell verarbeitet wird, angehakt.

Kann Smartcat JSON in XML konvertieren?

Nein – es ist ein Übersetzer, kein Formatkonverter. Es übersetzt JSON und XML jeweils in ihrem eigenen Format; siehe den JSON-Übersetzer für Locale-Dateien.

Kann ich wiederkehrende XML-Übersetzungen automatisieren?

Ja – siehe „Segmente nach ID aktualisieren, ohne Zuweisungen zu stornieren“ oben, um zu erfahren, was beim zweiten Hochladen geschieht.

Für Pipelines lädt die Smartcat-API Dateien hoch und ruft Übersetzungen ab, arbeitet asynchron mit Benachrichtigungs-Callbacks, sodass ein Build-Schritt nicht untätig abfragt, und verfügt über eine CLI für CI/CD. Drei Bedingungen vorab:

  • Der API-Zugriff ist nur in den Tarifen Anticipate und Autonomous enthalten.
  • Es erfordert ein Unternehmenskonto anstelle eines Freiberufler-Kontos.
  • Es ist während des kostenlosen Testzeitraums nicht verfügbar.

Jede Methode teilt sich ein Limit von 4 Anfragen pro Sekunde, und die Dokumentation ist öffentlich unter developers.smartcat.com einsehbar.

Bietet Smartcat eine Versionskontrolle für XML-Übersetzungen an?

Ja – jede Bearbeitung und Revision wird im Smartcat Editor nachverfolgt. Sie können zu früheren Versionen zurückkehren oder Aktualisierungen über verschiedene Sprachsets hinweg vergleichen, wodurch die Lokalisierung über alle Releases hinweg konsistent bleibt.

Sind meine XML-Inhalte auf Smartcat sicher?

Smartcat ist SOC 2 Typ II-konform. Dateien werden sowohl bei der Übertragung als auch im Ruhezustand verschlüsselt, Arbeitsbereiche sind pro Konto isoliert und der Zugriff erfolgt rollenbasiert. Details finden Sie auf der Sicherheitsseite.

Wird die Ausgabe anhand meiner DTD oder XSD validiert?

Wohlgeformtheit stammt aus dem Parse-Modell – Struktur wird niemals bearbeitet.

Die Schema-Validität ist teilweise eine Eigenschaft des Inhalts, und Übersetzung verändert den Inhalt: Ein Feld, das Ihre XSD auf 40 Zeichen begrenzt, kann überlaufen, da das Deutsche gewöhnlich länger ist als das Englische.

Genau dafür gibt es eine echte Kontrollfunktion – die Parser-Konfiguration ermöglicht es Ihnen, Längenbegrenzungen für Segmente festzulegen, sodass Übersetzer die Obergrenze bereits während der Arbeit sehen und nicht erst, nachdem der Import fehlgeschlagen ist. Führen Sie für die ersten Dateien pro Sprachpaar Ihre eigene Schemavalidierung durch.

Wie viel kostet die Übersetzung von XML-Ressourcendateien?

Die Übersetzung wird in Smartwords gemessen, wobei Wiederholungen rabattiert werden, und die Preisgestaltung richtet sich nach dem Volumen statt nach dem Dateiformat.

Jeder Plan beginnt 15 Tage lang kostenlos mit 15.000 Smartwords und vollem Zugriff auf die Übersetzungsfunktionen, keine Kreditkarte erforderlich.

Hier nicht aufgeführt? Demo buchen – ein 1:1-Gespräch mit einem Lokalisierungsingenieur, ganz unverbindlich.

Kann ich Smartcat online als XML-Übersetzer verwenden?

Ja. Laden und übersetzen Sie XML-Dateien direkt über Ihren Browser mit Smartcats Software Localization Agent – ganz ohne Downloads oder manuelle Einrichtung.

Wie viele Sprachen unterstützt Smartcat für XML-Inhalte?

Über 280 Sprachen, einschließlich Dialekten und von rechts nach links geschriebenen Schriften.

Wie groß darf eine XML-Datei sein, und wie viele kann ich senden?

Die veröffentlichte Obergrenze gilt global und nicht XML-spezifisch:

  • 6 GB pro Dokument- oder Projektdatei.
  • Die Empfehlung lautet, alles über 1 GB in kleinere Teile aufzuteilen, damit es schneller verarbeitet wird.
  • Keine Begrenzung der Segmentanzahl ist dokumentiert, und es gibt überhaupt keine Obergrenze für die Dateianzahl – Batch-Uploads von Hunderten von Dateien in ein Projekt werden unterstützt, und dies variiert nicht je nach Tarif.

Die Einschränkung betrifft die Größe pro Datei, nicht wie viele Dateien Sie senden.

Quellen

  1. MIT News. (2024). MIT-Forscher entwickeln Effizienztraining für zuverlässigere KI-Agenten. news.mit.edu