このプロジェクトについて

BabelDOCは、元のレイアウト、書式、構造を維持したままPDFファイルを翻訳するために設計されたオープンソースのドキュメント翻訳ツールです。プラグインベースのシステムとして構築されており、他のプログラムに埋め込むか、コマンドラインインターフェース(CLI)を通じて直接使用することができます。 ## 主な機能 - **レイアウトの保持**: テキストブロック、数式、表、読み順を含む元の文書構造を維持したままPDFを翻訳します。 - **バイリンガル出力**: 原文と訳文が並列または交互に表示されるバイリンガルPDFと、単一言語の翻訳済みPDFの両方を生成できます。 - **複数の翻訳バックエンド**: Ollamaなどのローカルモデルを含む、OpenAI互換APIエンドポイントをすべてサポートします。ベースURL、APIキー、モデル選択は設定可能です。 - **用語集サポート**: 一貫した用語翻訳のためのCSVベースの用語集をサポートし、エントリごとにターゲット言語を指定することも可能です。 - **オフラインアセット管理**: エアギャップ環境向けのオフラインアセットパッケージの生成と復元をサポートし、SHA3-256ハッシュ検証を行います。 - **高度なPDF処理**: スキャン文書のOCR、自動レイアウト検出、数式認識、透かしや装飾線などの複雑な要素の処理に対応しています。 - **プラグインアーキテクチャ**: カスタムモデル、OCRエンジン、レンダラーをサポートする拡張可能なパイプラインを提供します。 ## インストールと使用方法 BabelDOCは`uv`を使用してソースからインストールし、CLI経由で使用できます。基本的な使用例: ```bash babeldoc --openai --openai-model "gpt-4o-mini" --openai-base-url "https://api.openai.com/v1" --openai-api-key "your-api-key-here" --files example.pdf ``` 設定はコマンドラインオプションまたはTOML形式の設定ファイルで提供できます。このツールは、翻訳品質、出力形式、ページ選択、透かし処理などを制御するためのさまざまなオプションをサポートしています。 ## Python API BabelDOCはプログラムmaticな使用のためにPython APIを提供していますが、すべてのAPIは内部用であり、直接の使用は公式にはサポートされていません。このAPIはpdf2zh_nextと互換性があり、既存のワークフローとの統合を可能にします。 ## ユースケース - 学術論文、研究資料、技術マニュアルの翻訳 - 言語学習用の文書のバイリンガル版作成 - 一貫した用語を使用したPDFファイルの一括翻訳 - ドキュメント管理システムや翻訳ワークフローへの統合 ## 関連プロジェクト BabelDOCは、レイアウトリーダー、OCRシステム、翻訳サービスなどを含む広範なドキュメント処理ツールのエコシステムの一部分です。自己デプロイメントシナリオではPDFMathTranslateなどのツールと連携し、Zoteroプラグインとは研究ワークフローの自動化のために統合されています。