XML翻訳ツールは、マークアップ自体を保持しながらタグの間にある人間が読めるテキストを翻訳します。そのため、戻ってくるファイルはシステムが取り込み可能な整形式XMLであり、280以上の言語に対応しています。
Smartcatのソフトウェアローカリゼーションエージェントに、翻訳可能なテキストを含む要素や属性をXPathで一度指定するだけで、それらのパス以外のすべての部分はそのまま保持されます。
Smartcatは、翻訳メモリ、ワークフローの一元的なハブ、そして果てしないメールのやり取りやファイルのやりくりからの解放という、私たちが求めていたまさにそのものを提供してくれることがすぐに分かりました。あらゆるもの、そしてあらゆる人が、今やひとつの場所で連携して機能しています。
”導入事例を見る →
XMLの翻訳とは、マークアップを機械可読な状態に保ちながら、XMLファイルのテキストコンテンツを翻訳することを意味します。Smartcatのソフトウェアローカリゼーションエージェントは、推測するのではなく、設定可能なXMLパーサーを使用します。
構造上の要件の1つとして、各繰り返しがソースセグメントになるため、ファイルには繰り返される要素が含まれている必要があります。
1つの.xmlファイルをアップロードするか、定期的なエクスポートを含めて複数を一度にアップロードします。
XMLは、汎用翻訳機では散文と区別できないような箇所にも意味を持たせています。4つのものが壊れる:
失敗のパターンは誤訳ではなく、リリースの日の午後5時にインポートで弾かれるファイルなのです。
エンティティおよびエンコーディングの動作に関しては、口約束を並べるよりも、お客様と一緒にサンプルファイルをテストしたいと考えております。パーサー設定は、設定可能な2つ(タグおよび属性の翻訳と、CDATA)を処理します。
XPathで一度だけ設定するルール
パーサーがファイル形状内のセグメント形成要素を指すように指定し、さらに翻訳対象外のノード、文字列ID、コメント、セグメントごとの長さ制限のための個別のパスも指定します。
製品フィード、CMSダンプ、またはヘルプコンテンツのエクスポートを一度設定すれば、今後その形式を持つすべてのファイルに同じルールが適用されます。
割り当てをキャンセルせずにIDでセグメントを更新する
XMLは、PO/Sergeと並び、新しいバージョンでタスクの割り当てをキャンセルすることなくIDによってセグメントを更新できる、わずか2つのフォーマットファミリーのうちの1つです。
それ以外のすべての形式では、ドキュメントを置換すると翻訳メモリから翻訳が復元されますが、タスクがキャンセルされるため、言語担当者を再割り当てする必要があります。更新と再アップロードのいずれにおいても、再翻訳のためにSmartwordsが消費されます。
103% キーID翻訳メモリ一致
文字列IDは独自のパスによってマッピングされ、103%のキーID一致に使用されます。これに対し、標準的なドキュメント形式では102%のコンテキスト一致が上限となります。
コメントも同様にマッピングでき、レビュー担当者向けにセグメントのコンテキストとして表示することができます。
280以上の言語、整形式の出力
構造が編集されることは決してないため、返されるものは正常に解析できます。翻訳先言語はご自身で選択していただけます。マークアップは作成された状態のまま維持されます。
要素名および属性名は決して翻訳されません。その他はすべて、意図的にオプトイン方式になっています。
属性値 — その属性をセグメント生成属性として指定しない限り翻訳されません。したがって、label を指定し、id や列挙値を指定することはありません。
テキストノード — セグメントを形成する箇所が翻訳され、翻訳メモリおよび用語集と照合されます。翻訳不可能なインラインノードは、自身のパスによって除外できます。
CDATAセクション — 設定可能。CDATAセクション内のHTMLタグを保護をオンにすると、CDATA内のHTMLはSmartcatのタグに置き換えられます。オフにすると、それらのタグは編集可能なテキストとして表示されます。
文字列IDとコメント — それぞれ独自のパスによってマッピングされます。
長さの制限 — 下流のスキーマによってフィールドの上限が設定されている場合、セグメントごとに設定可能。
オフにすると翻訳者がマークアップを編集できるようになるため、CDATAのチェックボックスは慎重に決定してください。
唯一の構造的要件は要素の繰り返しです。各繰り返しが1つのセグメントになるため、繰り返しの構造がない単発のドキュメントはカスタムパーサーには適していません。
弊社のチームとの個別面談(1:1)にエクスポートのサンプルをご持参ください。
Smartcatマーケットプレイスは、お客様の業界やターゲット市場における経験豊富なレビュー担当者とおつなぎします。当社のAIマッチングを利用するか、専門分野や評価からプロフィールを探すことができます。
XLIFFとTMXもXMLであり、両方ともサポートされています。XLIFFには独自のワークフローと専用ページであるXLIFF翻訳エディターがあります。なお、SmartcatではXLIFF 1.2および2.0のインポートに対応していますが、エクスポートは1.2のみである点にご注意ください。
JSONまたはYAMLもローカライズしますか?同一プロジェクト、同一の翻訳メモリ — 言語資産はプロジェクトレベルで紐付けられ、プロジェクト内のすべてのドキュメントに適用されます。書き込み可能なTMは言語ペアごとに1つです。
これをCIから実行する場合、APIはプラットフォームと同様に50以上のフォーマットに対応します。
XML、Android XML、RESX、LOCJSON、JSON、TJSON、YML、INC、INX、STRINGS、そしてPROPERTIESなどが含まれます。
ソフトウェアローカリゼーションAPIは、さらにjson、structured-json、yaml、structured-yaml、ios-strings、およびandroid-xmlもエクスポートします。
実行可能ファイルおよびスクリプトは、セキュリティのためにブロックされています。
1つのプロジェクトに含めるファイル数に上限はありません。そのため、完全なロケールエクスポートは、1つの用語集と1つの翻訳メモリを共有する単一のジョブとしてアップロードされます。
分割とは、単に非常に大きな単一ファイルにおける処理速度のためだけに行われるものであり、送信するファイルの数とは一切関係ありません。
リリースごとに同じXMLエクスポートを出荷する場合、重要となる違いは2回目のアップロード時に何が起こるかです。
翻訳は引き継がれ、スプリントごとに再招待される代わりに言語担当者が割り当てられたままになります。
作成、翻訳、レビュー、納品が1つのプラットフォーム上で完結し、反復的なステップは自動化され、Smartwordsは再翻訳時にのみ消費されます。
テキストは翻訳され、マークアップはそのまま、何がテキストであるかという独自のルールも適用可能 — 280以上の言語に対応し、AIエージェントが構文解析レベルの作業を実行します。
15日間無料、15,000Smartwordsおよび翻訳機能へのフルアクセス付き、クレジットカード不要。
Smartcatは、複数の市場にわたって多言語コンテンツを拡大する必要がある企業向けに構築された、AI搭載のグローバルコンテンツプラットフォームです。
AIエージェント、翻訳メモリ、そして人間のコラボレーションを単一のシステムに統合し、チームがXMLファイルやその他のコンテンツをより迅速かつ正確に翻訳できるように支援します。
XML(Extensible Markup Language)ファイルは、カスタムタグを使用してデータを整理・保存する、柔軟なテキストベースの形式です。
人間と機械の双方が読めるように設計されているため、アプリの設定からトレーニング教材に至るまで、あらゆるものの構造化に役立ちます。
XMLファイルは、アプリ開発やウェブサイトのローカライゼーションから、コンテンツ管理システム(CMS)やeラーニングプラットフォームに至るまで、あらゆる場所で使用されています。
それらは、ソフトウェア、プラットフォーム、システム間におけるコンテンツの構造化やデータ交換の主力となるものです。
XMLは複雑なデータを整理されたポータブルな状態に保つため、アプリの設定、CMSのエクスポート、製品フィード、eラーニングパッケージ、SCORMコンテンツなどで広く利用されています。
それを翻訳するチームは通常、エンジニアリング、プロダクトコンテンツ、ローカリゼーションの各チームであり、他のシステムがスケジュールに基づいて生成するファイルをもとに作業を行います。
AIエージェントは、タスク固有かつワークフローを意識した自動化ツールです。
ソフトウェアローカリゼーションエージェントをはじめとするSmartcatのエージェントは、XMLなどの構造化フォーマットを処理できるように構築されており、タグの整合性を維持しながらお客様の用語集を適用するため、開発者のサポートなしでローカリゼーションを拡張できます。
それらは人間のフィードバックからも学習し、これにより複雑なエンタープライズワークフローにおいても生産性と品質の向上が促進されます。[1]
はい、そして制御とは後から付け足された設定ではなく、メカニズムそのものなのです。XML解析構成では、セグメントを形成する要素のXPathを指定します。セグメントを形成するノードには、要素、属性、またはテキストを指定できます。
属性は指定した場合にのみ翻訳されるため、labelはセグメントになりますが、idや列挙値がエディタに入ることは決してありません。翻訳不可ノード、文字列ID、コメント、および文字数制限に対して個別のパスを指定することも可能です。
ファイルをアップロードしてから、何がテキストとみなされるかを定義します。
構文解析モデルによって構造が編集されることは決してありません。要素名や属性名はそのまま維持され、お使いのXPathが指しているノードのみが編集可能なセグメントになります。
翻訳されたテキストは元の構造に書き戻されるため、ダウンロードされるファイルは送信されたファイルと同じ形状の整形式XMLになります。
はい。Android XMLはサポートされているフォーマットであり、ソフトウェアローカリゼーションプロジェクトでは、JSON、YAML、iOSの.stringsと同様に、文字列をキーIDとともにインポートおよびエクスポートできます。そのため、<string name="checkout_cta">はそのnameを保持し、すべてのロケールでR.string.checkout_ctaが解決されます。
複数形キーはプロジェクトレベルでサポートされています。キーはすべての複数形を含めて作成でき、複数形はICU MessageFormat互換の文字列としてエクスポートされます。
標準XML、Android XML、XLIFF、TMXに加え、XML解析設定によるカスタムスキーマ。
XLIFFのインポートは1.2および2.0に対応していますが、エクスポートは1.2のみであり、XLIFFにはXLIFF翻訳エディターページに独自のワークフローがあります。
カスタムスキーマの場合、パーサーは推測されるのではなく、ファイルの形状ごとに一度設定されます。そして、セグメント化の基準となる反復要素が必要です。
チェックボックスで選択します: CDATA セクション内の HTML タグを保護する。確認しました。CDATAブロック内のHTMLタグはSmartcatタグに置き換えられているため、翻訳者はそれらを移動することはできますが、破損させることはできません。チェックを外すと、それらのタグは編集可能なテキストとして表示されます。機械によって処理されるものについては、チェックを入れたままにしてください。
いいえ、それは翻訳者であり、フォーマット変換ツールではありません。JSONとXMLをそれぞれ独自の形式で翻訳します。ロケールファイルについては、JSONトランスレーターを参照してください。
はい — 2回目のアップロード時に何が起こるかについては、上記の「Update Segments by ID Without Cancelling Assignments」(割り当てをキャンセルせずにIDでセグメントを更新)を参照してください。
パイプライン向けとして、Smartcat APIはファイルのアップロードや翻訳の取得を行い、ビルドステップが待機してポーリングを行わずに済むよう通知コールバックを伴う非同期処理を行い、さらにCI/CD用のCLIを備えています。前もって提示する3つの条件:
すべてのメソッドは1秒あたり4リクエストの制限を共有しており、ドキュメントは developers.smartcat.com で公開されています。
はい — Smartcatエディターでは、すべての編集と修正が記録されます。以前のバージョンに戻したり、言語セット間で更新内容を比較したりできるため、リリース全体でローカリゼーションの一貫性を維持できます。
SmartcatはSOC 2 Type IIに準拠しています。ファイルは転送中および保存時に暗号化され、ワークスペースはアカウントごとに隔離されており、アクセスはロールベースで管理されています。詳細はセキュリティページに記載されています。
整形式は構文解析モデルに由来し、構造が編集されることは決してありません。
スキーマの妥当性はコンテンツの特性でもあるため、翻訳によってコンテンツが変化します。ドイツ語は通常英語よりも長くなるため、XSDで40文字に制限されているフィールドはオーバーフローする可能性があります。
まさにそのための実際の制御機能があります。パーサー設定によりセグメントに長さの制限を設定できるため、翻訳者はインポートが失敗した後ではなく、作業中に制限を確認することができます。言語ペアごとの最初のファイルに対して、独自のスキーマ検証を実行してください。
はい。Smartcatのソフトウェアローカリゼーションエージェントを使用すれば、ダウンロードや手動での設定を行うことなく、ブラウザから直接XMLファイルをアップロードして翻訳できます。
方言や右から左に書く文字を含む、280以上の言語。
公開されている上限は、XML固有のものではなくグローバルなものです。
制限されているのは送信するファイル数ではなく、ファイルごとのサイズです。
MITニュース。(2024年)。MITの研究者、より信頼性の高いAIエージェントに向けた効率性トレーニングを開発。news.mit.edu