arXiv reaDer
GlyphControl: ビジュアル テキスト生成のためのグリフ条件付きコントロール
GlyphControl: Glyph Conditional Control for Visual Text Generation
最近、一貫性のある整形式のビジュアル テキストを生成できる、拡散ベースのテキストから画像への生成モデルの開発に対する関心が高まっています。この論文では、このタスクに対処するために、GlyphControl と呼ばれる新しく効率的なアプローチを提案します。 ByT5 のような文字認識テキスト エンコーダに依存し、テキストから画像へのモデルの再トレーニングが必要な既存の方法とは異なり、私たちのアプローチは追加のグリフ条件情報を利用して、正確なビジュアルを生成する際の既製の安定拡散モデルのパフォーマンスを強化します。文章。グリフ命令を組み込むことで、ユーザーは特定の要件に応じて、生成されるテキストの内容、位置、サイズをカスタマイズできます。ビジュアル テキスト生成のさらなる研究を促進するために、LAION-Glyph と呼ばれるトレーニング ベンチマーク データセットを構築します。生成されたビジュアル テキストの OCR ベースのメトリクスと CLIP スコアを測定することで、アプローチの有効性を評価します。私たちの経験的評価は、GlyphControl が OCR 精度と CLIP スコアの点で最近の DeepFloyd IF アプローチよりも優れていることを実証し、私たちの方法の有効性を強調しています。
Recently, there has been a growing interest in developing diffusion-based text-to-image generative models capable of generating coherent and well-formed visual text. In this paper, we propose a novel and efficient approach called GlyphControl to address this task. Unlike existing methods that rely on character-aware text encoders like ByT5 and require retraining of text-to-image models, our approach leverages additional glyph conditional information to enhance the performance of the off-the-shelf Stable-Diffusion model in generating accurate visual text. By incorporating glyph instructions, users can customize the content, location, and size of the generated text according to their specific requirements. To facilitate further research in visual text generation, we construct a training benchmark dataset called LAION-Glyph. We evaluate the effectiveness of our approach by measuring OCR-based metrics and CLIP scores of the generated visual text. Our empirical evaluations demonstrate that GlyphControl outperforms the recent DeepFloyd IF approach in terms of OCR accuracy and CLIP scores, highlighting the efficacy of our method.
updated: Mon May 29 2023 17:27:59 GMT+0000 (UTC)
published: Mon May 29 2023 17:27:59 GMT+0000 (UTC)
参考文献 (このサイトで利用可能なもの) / References (only if available on this site)
被参照文献 (このサイトで利用可能なものを新しい順に) / Citations (only if available on this site, in order of most recent)
Amazon.co.jpアソシエイト