Ein XML-Übersetzer übersetzt den menschenlesbaren Text zwischen den Tags und behält dabei das Markup selbst bei – sodass die zurückgegebene Datei wohlgeformtes XML ist, das Ihr System verarbeiten kann, in jeder von über 280 Sprachen.
Sie teilen dem Software Localization Agent von Smartcat mit, welche Elemente und Attribute übersetzbaren Text enthalten – einmalig per XPath –, und alles außerhalb dieser Pfade bleibt unberührt.
Wir haben schnell erkannt, dass Smartcat genau das bot, was wir brauchten: ein Translation Memory, eine zentrale Drehscheibe für unseren Workflow und kein endloses Hin- und Herschicken von E-Mails oder Jonglieren mit Dateien mehr. Alles – und jeder – arbeitet jetzt an einem Ort zusammen.
”Fallstudie ansehen →
XML-Übersetzung bedeutet, den Textinhalt einer XML-Datei zu übersetzen, während ihr Markup maschinenlesbar bleibt. Smartcats Software-Lokalisierungs-Agent verwendet einen konfigurierbaren XML-Parser, anstatt Vermutungen anzustellen.
Eine strukturelle Anforderung: Die Datei muss sich wiederholende Elemente enthalten, da jede Wiederholung zu einem Ausgangssegment wird.
Laden Sie eine einzelne .xml-Datei oder mehrere auf einmal hoch, einschließlich wiederkehrender Exporte.
XML transportiert Bedeutungen an Stellen, die ein Allzweck-Übersetzer nicht von Fließtext unterscheiden kann. Vier Dinge zerbrechen:
Der Fehlermodus ist keine schlechte Übersetzung – es ist eine Datei, die Ihr Import am Veröffentlichungstag um 17:00 Uhr ablehnt.
Was das Entitäten- und Codierungsverhalten angeht, würden wir lieber eine Beispieldatei mit Ihnen testen, als ein bloßes Versprechen abzugeben. Die Parser-Konfiguration übernimmt die beiden konfigurierbaren Optionen – die Übersetzung von Tags und Attributen sowie CDATA.
Regeln, die Sie einmalig festlegen, per XPath
Richten Sie den Parser auf die segmentbildenden Elemente in Ihrer Dateiform aus, zuzüglich separater Pfade für nicht übersetzbare Knoten, String-IDs, Kommentare und Längenbegrenzungen pro Segment.
Konfigurieren Sie Ihren Produkt-Feed, CMS-Dump oder Hilfe-Inhalt-Export einmalig – jede zukünftige Datei dieses Formats folgt denselben Regeln.
Segmente nach ID aktualisieren, ohne Zuweisungen aufzuheben
XML ist eine von nur zwei Formatfamilien – neben PO/Serge –, bei denen eine neuere Version Segmente anhand der ID aktualisieren kann, ohne Aufgabenzuweisungen abzubrechen.
Bei jedem anderen Format werden beim Ersetzen eines Dokuments Übersetzungen aus dem Translation Memory wiederhergestellt, wodurch jedoch die Aufgaben abgebrochen werden, sodass die Linguisten neu zugewiesen werden müssen. Sowohl das Aktualisieren als auch das erneute Hochladen verbrauchen Smartwords für die Neuübersetzung.
103 % Translation-Memory-Treffer über Key-ID
String-IDs werden über ihren eigenen Pfad zugeordnet und für 103% Key-ID-Matching verwendet, während Standard-Dokumentformate bei 102% Kontext-Matching gedeckelt sind.
Kommentare können auf die gleiche Weise zugeordnet und Prüfern als Segmentkontext angezeigt werden.
Über 280 Sprachen, wohlgeformte Ausgabe
Die Struktur wird niemals bearbeitet, daher lässt sich das, was zurückkommt, parsen. Sie wählen die Zielsprachen; das Markup bleibt wie verfasst erhalten.
Elementnamen und Attributnamen werden niemals übersetzt. Alles andere ist standardmäßig zustimmungspflichtig:
Attributwerte – werden nicht übersetzt, es sei denn, Sie definieren dieses Attribut als segmentbildend, sodass Sie auf label und niemals auf id oder einen Enum-Wert verweisen.
Textknoten – werden übersetzt, sofern sie segmentbildend sind, und mit Ihrem Translation Memory und Glossar abgeglichen. Nicht übersetzbare Inline-Knoten können über ihren eigenen Pfad ausgeschlossen werden.
CDATA-Abschnitte – konfigurierbar. Wenn HTML-Tags in CDATA-Abschnitten schützen aktiviert ist, wird HTML innerhalb von CDATA durch Smartcat-Tags ersetzt; wenn deaktiviert, werden diese Tags als bearbeitbarer Text angezeigt.
String-IDs und Kommentare – jeweils über ihren eigenen Pfad zugeordnet.
Längenbegrenzungen – pro Segment einstellbar, wenn ein nachgelagertes Schema ein Feld begrenzt.
Treffen Sie die Entscheidung für das CDATA-Kontrollkästchen wohlüberlegt, denn deaktiviert bedeutet, dass ein Übersetzer Ihr Markup bearbeiten kann.
Die einzige strukturelle Anforderung sind sich wiederholende Elemente: Jede Wiederholung wird zu einem Segment, sodass ein einmaliges Dokument ohne sich wiederholende Struktur für den benutzerdefinierten Parser nicht geeignet ist.
Bringen Sie einen Beispielexport zu einem 1:1-Gespräch mit unserem Team mit.
Der Smartcat Marketplace bringt Sie mit erfahrenen Korrektoren in Ihrer Branche oder Ihrem Zielmarkt zusammen. Nutzen Sie unser KI-gestütztes Matching oder entdecken Sie Profile nach Spezialisierung und Bewertungen.
XLIFF und TMX sind ebenfalls XML, und beide werden unterstützt. XLIFF verfügt über einen eigenen Workflow und eine eigene Seite, den XLIFF-Übersetzungseditor – und beachten Sie, dass Smartcat XLIFF 1.2 und 2.0 importiert, während der Export nur als 1.2 möglich ist.
Lokalisieren Sie auch JSON oder YAML? Dasselbe Projekt, dasselbe Translation Memory – linguistische Ressourcen werden auf Projektebene zugewiesen und gelten für jedes Dokument darin, mit einem beschreibbaren TM pro Sprachpaar.
Wenn Sie dies über die CI ansteuern, erreicht die API dieselben über 50 Formate wie die Plattform:
XML, Android XML, RESX, LOCJSON, JSON, TJSON, YML, INC, INX, STRINGS und PROPERTIES darunter.
Die Softwarelokalisierungs-API exportiert zusätzlich json, structured-json, yaml, structured-yaml, ios-strings und android-xml.
Ausführbare Dateien und Skripte sind aus Sicherheitsgründen blockiert.
Es gibt keine Obergrenze für die Anzahl der Dateien in einem Projekt, sodass ein vollständiger Gebietsschema-Export als ein einziger Auftrag hochgeladen wird, der sich ein Glossar und ein Translation Memory teilt.
Beim Aufteilen geht es immer nur um die Geschwindigkeit bei einer sehr großen einzelnen Datei, nie darum, wie viele Dateien Sie senden.
Wenn Sie bei jedem Release denselben XML-Export ausliefern, ist der entscheidende Unterschied, was beim zweiten Upload passiert.
Übersetzungen werden übernommen und Linguisten bleiben zugewiesen, anstatt für jeden Sprint neu eingeladen zu werden.
Erstellung, Übersetzung, Überprüfung und Bereitstellung bleiben auf einer einzigen Plattform, wobei sich wiederholende Schritte automatisiert werden und Smartwords nur für erneute Übersetzungen verbraucht werden.
Text übersetzt, Markup unberührt, Ihre eigenen Regeln darüber, was als Text zählt – in über 280 Sprachen, wobei KI-Agenten die Arbeit auf Parsing-Ebene erledigen.
Kostenlos für 15 Tage mit 15.000 Smartwords und vollem Zugriff auf alle Übersetzungsfunktionen, keine Kreditkarte erforderlich.
Smartcat ist eine KI-gestützte globale Content-Plattform, die für Unternehmen entwickelt wurde, die mehrsprachige Inhalte über Märkte hinweg skalieren müssen.
Es vereint KI-Agenten, Translation Memories und menschliche Zusammenarbeit in einem einzigen System und hilft Teams dabei, XML-Dateien und andere Inhalte schneller und präziser zu übersetzen.
Eine XML-Datei (Extensible Markup Language) ist ein flexibles, textbasiertes Format, das Daten mithilfe von benutzerdefinierten Tags organisiert und speichert.
Es ist so konzipiert, dass es sowohl von Menschen als auch von Maschinen gelesen werden kann, was es nützlich macht, um von App-Einstellungen bis hin zu Schulungsmaterialien alles zu strukturieren.
XML-Dateien sind allgegenwärtig – von der App-Entwicklung und Website-Lokalisierung bis hin zu Content-Management-Systemen (CMS) und E-Learning-Plattformen.
Sie sind das Arbeitstier für die Strukturierung von Inhalten und den Datenaustausch über Software, Plattformen und Systeme hinweg.
XML hält komplexe Daten organisiert und portabel, weshalb es in App-Konfigurationen, CMS-Exporten, Produkt-Feeds, E-Learning-Paketen und SCORM-Inhalten vorkommt.
Die Teams, die es übersetzen, sind in der Regel Entwicklungs-, Produktinhalts- und Lokalisierungsteams, die mit einer Datei arbeiten, die von einem anderen System nach einem Zeitplan generiert wird.
KI-Agenten sind aufgabenspezifische, workflow-orientierte Automatisierungswerkzeuge.
Die Agenten von Smartcat, wie der Software Localization Agent, sind darauf ausgelegt, strukturierte Formate wie XML zu verarbeiten – wobei die Tag-Integrität gewahrt bleibt und Ihre Glossare angewendet werden, sodass die Lokalisierung ohne Entwicklerunterstützung skaliert werden kann.
Sie lernen auch aus menschlichem Feedback, was Produktivitäts- und Qualitätsverbesserungen selbst in komplexen Unternehmensabläufen vorantreibt.[1]
Ja, und Kontrolle ist eher der Mechanismus als eine nachträglich aufgesetzte Einstellung. In der XML-Parsing-Konfiguration geben Sie einen XPath für die segmentbildenden Elemente an, und ein segmentbildender Knoten kann ein Element, ein Attribut oder Text sein.
Ein Attribut wird nur dann übersetzt, wenn Sie darauf zeigen – label wird also zu einem Segment, während id und Enum-Werte niemals in den Editor gelangen. Sie können auch separate Pfade für nicht übersetzbare Knoten, Zeichenfolgen-IDs, Kommentare und Längenbegrenzungen angeben.
Laden Sie die Datei hoch und definieren Sie dann, was als Text gilt.
Die Struktur wird vom Parse-Modell niemals bearbeitet: Element- und Attributnamen bleiben unberührt, und nur die Knoten, auf die Ihr XPath verweist, werden zu bearbeitbaren Segmenten.
Der übersetzte Text wird wieder in die ursprüngliche Struktur eingefügt, sodass der Download wohlgeformtes XML mit derselben Struktur wie die von Ihnen gesendete Datei ist.
Ja. Android XML ist ein unterstütztes Format, und in einem Software-Lokalisierungsprojekt können Sie Strings mit ihren Schlüssel-IDs importieren und exportieren – genau wie bei JSON, YAML und iOS .strings –, sodass <string name="checkout_cta"> seinen name behält und R.string.checkout_cta in jedem Gebietsschema aufgelöst wird.
Plural-Schlüssel werden auf Projektebene unterstützt: Ein Schlüssel kann mit all seinen Pluralformen erstellt werden, und Plurale werden als mit dem ICU MessageFormat kompatible Zeichenketten exportiert.
Standard-XML, Android-XML, XLIFF und TMX sowie benutzerdefinierte Schemata über die XML-Parsing-Konfiguration.
Der XLIFF-Import akzeptiert 1.2 und 2.0, während der Export nur 1.2 unterstützt, und XLIFF verfügt über einen eigenen Workflow auf der Seite XLIFF-Übersetzungseditor.
Für ein benutzerdefiniertes Schema wird der Parser einmal pro Dateiform konfiguriert, anstatt bloß zu raten – und er benötigt sich wiederholende Elemente, anhand derer er segmentieren kann.
Sie entscheiden über ein Kontrollkästchen: HTML-Tags in CDATA-Abschnitten schützen. Geprüft: Die HTML-Tags innerhalb des CDATA-Blocks werden durch Smartcat-Tags ersetzt, sodass Übersetzer sie verschieben, aber nicht beschädigen können. Wenn sie nicht markiert sind, erscheinen diese Tags als bearbeitbarer Text. Lassen Sie es für alles, was maschinell verarbeitet wird, angehakt.
Nein – es ist ein Übersetzer, kein Formatkonverter. Es übersetzt JSON und XML jeweils in ihrem eigenen Format; siehe den JSON-Übersetzer für Locale-Dateien.
Ja – siehe „Segmente nach ID aktualisieren, ohne Zuweisungen zu stornieren“ oben, um zu erfahren, was beim zweiten Hochladen geschieht.
Für Pipelines lädt die Smartcat-API Dateien hoch und ruft Übersetzungen ab, arbeitet asynchron mit Benachrichtigungs-Callbacks, sodass ein Build-Schritt nicht untätig abfragt, und verfügt über eine CLI für CI/CD. Drei Bedingungen vorab:
Jede Methode teilt sich ein Limit von 4 Anfragen pro Sekunde, und die Dokumentation ist öffentlich unter developers.smartcat.com einsehbar.
Ja – jede Bearbeitung und Revision wird im Smartcat Editor nachverfolgt. Sie können zu früheren Versionen zurückkehren oder Aktualisierungen über verschiedene Sprachsets hinweg vergleichen, wodurch die Lokalisierung über alle Releases hinweg konsistent bleibt.
Smartcat ist SOC 2 Typ II-konform. Dateien werden sowohl bei der Übertragung als auch im Ruhezustand verschlüsselt, Arbeitsbereiche sind pro Konto isoliert und der Zugriff erfolgt rollenbasiert. Details finden Sie auf der Sicherheitsseite.
Wohlgeformtheit stammt aus dem Parse-Modell – Struktur wird niemals bearbeitet.
Die Schema-Validität ist teilweise eine Eigenschaft des Inhalts, und Übersetzung verändert den Inhalt: Ein Feld, das Ihre XSD auf 40 Zeichen begrenzt, kann überlaufen, da das Deutsche gewöhnlich länger ist als das Englische.
Genau dafür gibt es eine echte Kontrollfunktion – die Parser-Konfiguration ermöglicht es Ihnen, Längenbegrenzungen für Segmente festzulegen, sodass Übersetzer die Obergrenze bereits während der Arbeit sehen und nicht erst, nachdem der Import fehlgeschlagen ist. Führen Sie für die ersten Dateien pro Sprachpaar Ihre eigene Schemavalidierung durch.
Die Übersetzung wird in Smartwords gemessen, wobei Wiederholungen rabattiert werden, und die Preisgestaltung richtet sich nach dem Volumen statt nach dem Dateiformat.
Jeder Plan beginnt 15 Tage lang kostenlos mit 15.000 Smartwords und vollem Zugriff auf die Übersetzungsfunktionen, keine Kreditkarte erforderlich.
Hier nicht aufgeführt? Demo buchen – ein 1:1-Gespräch mit einem Lokalisierungsingenieur, ganz unverbindlich.
Ja. Laden und übersetzen Sie XML-Dateien direkt über Ihren Browser mit Smartcats Software Localization Agent – ganz ohne Downloads oder manuelle Einrichtung.
Über 280 Sprachen, einschließlich Dialekten und von rechts nach links geschriebenen Schriften.
Die veröffentlichte Obergrenze gilt global und nicht XML-spezifisch:
Die Einschränkung betrifft die Größe pro Datei, nicht wie viele Dateien Sie senden.
MIT News. (2024). MIT-Forscher entwickeln Effizienztraining für zuverlässigere KI-Agenten. news.mit.edu